
1. 长会话跑到一半被压缩为什么关键信息还在如果你用 Claude Code 跑过跨小时的重构任务大概率见过这个场景对话突然提示上下文超限然后它像没事人一样继续改代码甚至还记得你半小时前纠正过的函数签名。这背后不是魔法是 Claude Code 在压缩时做了两套并行的信息保留机制。我最近把src/services/compact/和src/services/SessionMemory/这两个目录翻了一遍发现它的设计比想象中细一条路径让模型生成 9 部分结构化摘要另一条路径在后台持续把 10 部分记录写进memory.md压缩后再按 50K 预算把最近文件、已调用技能、Plan、CLAUDE.md、MCP 指令重新注入同时保留 10K–40K 的最近消息窗口。问题也随之而来这些摘要调用、后台 Session Memory 更新、工具调用每一步都在烧 Token。你想照着源码把长会话实际跑通就得先解决模型通道的问题——让 compact 摘要、Session Memory 提取、tool_use/tool_result 都走同一个入口。这篇就按「Agent / Harness 视角」把这条链路拆开先讲清楚两条保留路径在干什么再把 Claude Code 的模型通道切到 TaoToken最后验证一次 compact 之后摘要是否仍引用最近对话原文、memory.md是否继续更新、工具对是否完整。适合谁看正在用 Claude Code 做长任务编排、想读懂压缩源码、或者被「压缩后任务跑偏」折磨过的开发者。前置要求只有一条你得先把模型通道配通否则源码读得再透也跑不起来。2. 先把模型通道落到 TaoTokenClaude Code 默认走 Anthropic 官方通道但长会话里压缩相关的调用密度很高统一入口对排查和成本观察都更友好。TaoToken 在这里的角色很单纯提供 Key 和 Base URL让 compact 摘要、Session Memory 提取、工具调用都从同一个地址出去。它不替代编辑器也不接管你的代码逻辑只负责把请求转发到模型。第一步打开官网创建 Keyhttps://taotoken.net/?utm_sourcetaotoken_aicg_blog_endutm_mediumcsdnutm_campaignrewriteutm_content登录后在控制台里生成 API Key建议单独建一个给 Claude Code 用方便后面按调用来源区分。Key 生成入口https://taotoken.net/console/api-keys第二步记住 Base URL 的写法这是最容易踩坑的地方https://taotoken.net/api注意两点不要加/v1也不要填带 UTM 参数的官网地址。Claude Code 的模型通道配置里Base URL 就填上面这一行多一个字符都可能让请求打到错误路径。如果你用的是环境变量方式可以这样设export ANTHROPIC_BASE_URLhttps://taotoken.net/api export ANTHROPIC_API_KEYsk-你的TaoToken密钥设完之后可以用env | grep ANTHROPIC确认一下避免 shell 里残留旧值。这一步做完compact 摘要和 Session Memory 的后台 agent 才会走同一个入口。3. 两条保留路径的源码拆解与可复制配置3.1 路径一compact/prompt.ts 的 9 部分结构化摘要传统压缩路径会向模型发一个精心设计的 Prompt要求生成 9 个特定部分的摘要不是自由发挥。Prompt 里要求模型先用analysis标签梳理思路再输出summary而formatCompactSummary()最终只保留summary内容analysis草稿被丢弃。9 部分模板大致是Primary Request and Intent、Key Technical Concepts、Files and Code Sections、Errors and fixes、Problem Solving、All user messages、Pending Tasks、Current Work、Optional Next Step。其中第 6 和第 9 部分最关键——第 6 部分要求列出所有非工具结果的用户消息第 9 部分要求引用最近对话的原文防止任务理解偏移。你可以通过/compact附带自定义指令让摘要聚焦特定信息/compact 聚焦在对 auth 模块的修改记住我改过的每一个函数签名这条指令会被注入摘要 Prompt 的 Additional Instructions 段。摘要生成后作为用户消息发送时还会附上完整 transcript 的路径模型需要细节时可以用 Read 工具回溯。3.2 路径二SessionMemory/prompts.ts 的 10 部分记录Session Memory 是独立于压缩的后台系统持续把信息写进~/.claude/session-memory/memory.md。它的 10 部分模板包括 Session Title、Current State、Task specification、Files and Functions、Workflow、Errors Corrections、Codebase and System Documentation、Learnings、Key results、Worklog。后台更新机制是这样的上下文达到 10K tokens 时后台 agent 首次提取之后每增长 5K tokens 或累积 3 次工具调用再触发一次每次用 Edit 工具增量修改memory.md。更新 Prompt 里有几条硬约束绝不修改 section header、优先写具体文件路径和函数名、不重复 CLAUDE.md 已有信息、每节上限约 2000 tokens、优先保留 Current State 和 Errors Corrections。SM 压缩路径的巧妙之处在于它不需要调用 AI 生成摘要直接把memory.md内容当摘要用。传统路径是「消息 → 调 AI → 生成摘要 → 替换消息」SM 路径是「消息 → 读 memory.md → 直接当摘要 → 替换消息」后台 agent 已经提前提取好了。3.3 压缩后重新注入的 50K 预算压缩生成摘要后系统会从摘要之外主动恢复关键上下文总预算 50,000 tokens。清单包括最近读取的文件最多 5 个每个 ≤ 5K、已调用技能每个 ≤ 5K总预算 25K、Plan 文件、CLAUDE.md、MCP 指令、Agent 列表、异步 Agent 状态、Deferred Tools。文件恢复的逻辑在createPostCompactFileAttachments()里先排除不应恢复的路径和保留消息中已读的文件再按时间戳降序取最新 5 个每个截断到 5K累计不超过 50K。技能恢复则按invokedAt降序排预算紧张时丢弃较早的。3.4 保留窗口与工具对完整性压缩不是全量总结最近消息窗口会被完整保留。calculateMessagesToKeepIndex()有三重约束下限 minTokens 10,000、下限 minTextBlockMessages 5 条、上限 maxTokens 40,000必须同时满足两个下限或命中上限才停止扩展。更关键的是adjustIndexToPreserveAPIInvariants()Anthropic API 要求每个tool_result都有对应的tool_use。如果压缩恰好切在tool_result处API 会报错。修复分两步——向前扫描保留消息里的tool_result找到它引用的tool_use如果tool_use在被删消息里就把 startIndex 前移再扫描 assistant 消息里共享message.id的 thinking/tool_use 块同样前移保留。流式传输会把一个 assistant 消息拆成多条记录所以这两步是保证压缩后不报格式错的核心。4. 验证请求compact 后摘要、memory.md、工具对是否正常配好通道后跑一次真实的长会话验证。建议用一个中等规模的重构任务让对话自然触发压缩。验证分三个观察点。第一看 compact 后的摘要是否仍引用最近对话原文。触发压缩后检查摘要消息里 Optional Next Step 部分有没有带引号的原文片段。如果只有概括没有引用说明摘要 Prompt 没走通或者模型通道返回异常。第二看memory.md是否继续更新。压缩前后分别查看文件时间戳和内容ls -la ~/.claude/session-memory/memory.md tail -50 ~/.claude/session-memory/memory.md正常情况下压缩后 Current State 和 Worklog 两节应该有新内容且 section header 没被改动。第三确认 tool_use/tool_result 配对完整。压缩后继续让 Claude Code 调用一次工具如果 API 没报tool_result without tool_use之类的错误说明adjustIndexToPreserveAPIInvariants()生效了。你也可以在请求日志里确认入口地址# 确认请求确实打到 TaoToken curl -s https://taotoken.net/api/v1/models \ -H Authorization: Bearer $ANTHROPIC_API_KEY | head -20注意这里 curl 验证时路径带/v1是 API 规范但 Claude Code 的 Base URL 配置里不要带。两者不冲突一个是客户端配置一个是标准 API 路径。5. 本篇常见错排查报错一Base URL 填成带 UTM 的官网地址。症状是请求 404 或返回 HTML 而不是 JSON。修复Base URL 只填https://taotoken.net/apiUTM 参数只用于官网跳转不用于 API 配置。报错二Base URL 多加了/v1。症状是请求路径变成/api/v1/v1/messages。修复Claude Code 配置里去掉/v1让它自己拼接。报错三压缩后 API 报 tool_result 配对错误。这通常不是通道问题而是压缩边界切在了工具对中间。检查是不是用了非标准消息格式或者手动改过 transcript。正常走adjustIndexToPreserveAPIInvariants()不会出现。报错四memory.md 不更新。先确认后台 agent 有没有触发——上下文要过 10K tokens 或累积 3 次工具调用。再看~/.claude/session-memory/目录权限以及模型通道是否返回了有效响应。如果 compact 摘要正常但 memory.md 不动多半是 Session Memory 的后台调用被通道配置影响了。报错五压缩后任务跑偏。检查摘要里第 9 部分有没有引用原文。如果没有可能是/compact自定义指令没生效或者 PreCompact Hook 配置有问题。可以在 CLAUDE.md 里加一段 Compact Instructions 引导摘要重点。6. 把长会话链路固定下来读源码的价值在于知道每一步在干什么配通道的价值在于让这些步骤真的跑起来。我的做法是把 Claude Code 的模型通道固定到 TaoToken然后按「compact 摘要 → memory.md 更新 → 工具对校验」三个点做回归。每次改完压缩相关配置就跑一次长会话看摘要有没有引用原文、memory.md有没有增量、工具调用有没有报配对错。如果你要长期跑编码任务或 Agent 编排可以看下 Coding Plan 的额度方案把压缩调用和日常调用分开观察https://taotoken.net/coding-plan?utm_sourcetaotoken_aicg_blog_endutm_campaignrewrite接入文档在这里里面有 Base URL 和 Key 的完整说明https://taotoken.net/doc?utm_sourcetaotoken_aicg_blog_endutm_campaignrewrite想先验证模型通道是否通可以直接在模型对话里发一条测试消息https://taotoken.net/?utm_sourcetaotoken_aicg_blog_endutm_campaignrewrite最后留一个我踩过的坑压缩后如果发现技能附件没恢复先看invokedSkills状态有没有跨压缩保留。这个状态是按 agent 隔离保存的压缩后重新注入但sentSkillNames是刻意不重置的避免重复注入约 4K 的 skill_listing。如果你手动清过状态这两者的行为会不一致排查时优先看src/bootstrap/state.ts里的markPostCompaction()和consumePostCompaction()标记。