
前两月写得最多、也最适合加码的题型是「理解 X」与 Agent 基础窗口、token、工具、裁剪、评测。各篇分开读够用工程上它们是同一条链。本文当加强版详解把分散概念收成上下文工程最小闭环。无真实后台数据时选题依据是计划内高频主线而非伪造点击率。一、一句话定义上下文工程在有限窗口里为模型选对、放对、管好材料并用评测证明这样做是否真的更好。它不只是「把提示写长」。二、窗口与 token容量合同上下文窗口是一次请求可见材料的上限token 是尺子。工程含义1系统提示、工具说明、历史、检索、工具结果、输出预算抢同一块容量2标称 128K ≠ 你有 128K 业务正文3先看 usage再凭感觉细节见早期「理解上下文窗口」此处只取合同视角。三、材料分层什么配长期驻留建议四层1宪法层安全与硬约束短而稳2任务层目标、范围、验收每任务更新3事实层已确认摘要可替换流水历史4证据层当前相关代码/日志切片用完可丢错位的典型把证据层全历史永久塞进宪法层。四、裁剪算法可执行当接近预算或信噪比变差A删重复日志留末次 结论B将旧轮次折叠进「已确认」摘要C大文件改为检索命中片段D保证验收条件永不被裁掉E新子任务可新开线程携带摘要砍的是轨迹不是目标。五、工具结果第三种上下文污染源工具一多失败栈与巨型 stdout 会占满窗。治理1返回结构化错误码见工具失败三层2截断 stdout保留尾部 N 行3禁止把整库 dump 进对话4写操作结果用「变更摘要」代替全 diff 常驻六、与结构化输出、MCP 的接口1要程序接龙用 schema不要散文假装 JSON2MCP / 插件扩权后工具说明本身也占窗——控制工具数量3约束 验收写进任务层减少乱调用七、用评测集关闭虚荣指标没有评测裁剪策略只是审美。最小闭环1固定 20 道丑题含长上下文与工具失败2改裁剪策略后重跑3看通过率、费用、越权率4演示成功的题收进集合上下文工程的 KPI 是评测不是「窗开到最大」。八、一张实践检查单[ ] 宪法层 N token且本周无脏内容混入 [ ] 每任务有范围与验收 [ ] 有摘要槽旧历史可折叠 [ ] 工具输出有截断与错误码 [ ] 接近预算有自动/半自动裁剪 [ ] 裁剪策略变更必跑评测子集九、常见误区1只扩窗2摘要空洞3工具全开4无评测凭感觉5把检索当装饰仍全量粘贴十、小结加强版不讲新神话只把窗口、裁剪、工具结果与评测接成闭环。上下文工程做得好模型像更聪明其实是材料终于配得上那个模型。完