大纲:shen-ru-li-jie-ai-agent(2026-08-27,批量模式,不停笔)
原书 12 个内容单元(引言 + 10 章 + 后记,约 43.5 万字符)。切 13 章: 第 2 章是全书最重的一章(约 13.5 万字节,上下文/缓存/提示/Skills/状态栏/压缩六件事), 按新词密度拆成三份;第 3 章用户记忆与知识库检索各是一条独立推理链,拆成两份; 后记(两朵乌云、飞轮)并进多 Agent 一章收尾。其余与原书 1:1。
自查:逐行核过「出去时知道」,无两节重复;每章主走查用书内真实数字/走查对象。
| # | 文件 | 拆什么原文章 | 进来时以为 → 出去时知道(每行一节,这里列章级) | 主走查 |
|---|---|---|---|---|
| 01 | 01-agent-formula | 引言+第1章 | 以为 Agent 是产品品类 → 知道 Agent = LLM+上下文+工具(策略/观察/动作),工作流到自主是一道光谱,Harness 五功能与五波演进,以及为什么「只改外壳就能 52.8%→66.5%」 | 多币种汇总的 ReAct 循环:3 次迭代 4 次工具调用,每步上下文怎么长 |
| 02 | 02-context-foundation | 第2章前半 | 以为模型记得对话 → 知道每次调用无状态、messages 列表就是 Agent 的全部记忆、静态前缀+轨迹、20 行循环与轮数上限 | 「问温哥华时间再问天气」两轮:messages 数组逐轮怎么长 |
| 03 | 03-context-cache | 第2章中部 | 以为慢和贵是模型的事 → 知道 KV Cache 是什么、前缀缓存为什么便宜 90%、一行时间戳如何让月账单翻倍,以及三条缓存铁律与 Claude Code 的架构约束 | 时间戳事故:10 万次对话/天,逐层算 0.5s→3-5s 与账单翻倍的账 |
| 04 | 04-context-design | 第2章中部偏后 | 以为提示词是文笔问题 → 知道上下文是检索引擎的一半、Skills 渐进式披露、状态栏让 2B 模型追平前沿、工具定义按需披露,以及消融实验的证据(组织打乱→-30%) | 打电话计数:数不清第几次→状态栏显式「第 4 次呼叫」→错误率大降 |
| 05 | 05-context-compression | 第2章末+注入节 | 以为窗口大了就不用管 → 知道上下文腐化(装得下找不到)、六策略压缩(367K→40K)、生产五层、隔离优于压缩、提示注入三类攻防 | 实验2-9:10 次搜索 367K 字符,逐策略算压缩率与迭代数 |
| 06 | 06-user-memory | 第3章前半 | 以为记忆=存聊天记录 → 知道记忆是关于用户的预测模型、四种存储格式的张力、User as Code/Engram 谱系、Mem0 提取-决策管线、冲突与压缩 | 订机票对话:提取四条记忆→选格式→「张医生」消歧怎么存 |
| 07 | 07-knowledge-retrieval | 第3章后半 | 以为 RAG=接个向量库 → 知道分块/稠密/稀疏/混合检索各自的失败模式、BM25 能手算、结构化索引(RAPTOR/GraphRAG)何时才需要、上下文感知检索失败率降 49% | BM25 手算:N=10 语料,「蒸馏」IDF=1.22,doc_1 总分 3.67(书内数) |
| 08 | 08-tools | 第4章 | 以为工具就是个函数 → 知道五类工具、描述的核心是「什么时候用」、静默输入转换反模式、MCP 的上下文开销、执行安全多层(提议者-审核者/Sidecar/沙盒/幂等)、训练同步部署异步的根本矛盾 | shell_exec("rm -rf /tmp/data"):多层安全逐层怎么拦 |
| 09 | 09-coding-agent | 第5章 | 以为 Coding Agent 是写代码工具 → 知道代码是元能力(运行时造新工具)、文件系统是中枢、致命三要素+持久记忆、故障四层与恢复分级、τ-bench 三重保障、模型与脚手架此消彼长 | cancel_reservation 三重保障:参数 checklist/服务端真值/提示词逐层防伪造 |
| 10 | 10-evaluation | 第6章 | 以为评估=跑个分 → 知道评的是模型+Harness 组合体、数据集泄漏防法、Pass@k 与 Pass^k 的 99% vs 7.8%、LLM 裁判的位置偏差与古德哈特、成本复利与统计显著性(±9pp) | 三轮退款成本表:2500/3200/3800 输入 token,缓存命中 $0.022 vs 无缓存 $0.036 |
| 11 | 11-post-training | 第7章 | 以为后训练=再喂点数据 → 知道 SFT 记忆 RL 泛化、先形后神、GRPO 组内比较、RLVP 用组内方差统一解释、 数据与环境比算法重要、OPD 稠密信号 | 24 点 OOD 对照:RL +3.5% vs SFT −8.1%;全对/全败组方差为零的零梯度死局 |
| 12 | 12-multimodal | 第9章 | 以为语音=ASR+LLM+TTS → 知道三代范式沿着「摆脱 VAD」一条轴、思考架构三方案、文本代理思考、Computer Use 定位三路线与分辨率匹配、机器人动作分块拿反应性换平滑性 | 延迟瀑布:VAD 500-800ms+ASR+LLM+TTS=0.9-2s,流式化压到 600-800ms,VAD 压不掉 |
| 13 | 13-multi-agent | 第10章+后记 | 以为多 Agent=多开几个 → 知道两个正交维度、新信息判据(辩论无效/执行反馈翻倍)、OS 对应表(轨迹=内存/LLM=CPU)、三拓扑与移交包、拜占庭故障与错误级联放大,以及后记两朵乌云与飞轮 | 10 个学院网站找「张伟」:级联终止+竞态条件逐消息走查 |
兑现预登记(写 index 时逐行核)
- 01 「三个不会过时的问题」→ index §2 主线 + 13 后记回收
- 03 「缓存三条铁律」→ 03 §缓存铁律;05 「压缩与缓存互补」→ 05
- 04 「时间感后训练留到第七章」→ 11(时间感 OPD +23~47pp)
- 08 「Skills 与 MCP 分工」→ 08 §MCP;07 「分块切断上下文联系」伏笔 → 07 §上下文感知检索
- 12 「Computer Use 实时性未解决」→ 12 §实时性;13 「A2A 与 MCP 分工」→ 13 §A2A
追记(2026-08-27 复查整改)
- review-01 指出原书第 8 章未覆盖:已补
12-continuous-evolution.md(三层验证器/ 四种更新载体/双循环/安全边界,主走查=实验 8-1 客服轨迹验证器);原 12/13 两章 顺延为 13/14。index chapters、地图、兑现表已同步;章号口径统一:中文数字 「第 N 章」=原书章号一律改写,拆解章一律「第 NN 章」。