跳到主要内容

01-outline — learning-langchain 章节切分

切分依据:按新词密度与完整推理链切;原书 9 个正文章(preface + ch1–11,其中 spine 的 fm-prerequisites 实为原书 Chapter 9「Deployment」)+ 关于作者页全部覆盖; praise/copyright/index/colophon 为导航章跳过。

大纲(12 章,一节一行 = 一章的行)

01 01-prompt-composition.md 提示词的组合学

  • 进来时以为:会用 ChatGPT 就等于会给模型下指令 → 出去时知道:单个提示技术(zero-shot/CoT/RAG/工具调用/few-shot)各自都有失手方式,LangChain 的立身之本是「这些技术组合起来才可靠」,这个判断从全书的第一个实验就成立。
  • 覆盖:pre 全章(LLM 分类、token、贯穿五技术的 Coolidge 实验、LangChain 动机案例)。

02 02-uniform-components-lcel.md 所有积木共用一个接口

  • 进来时以为:调不同厂商的 API 各学各的 SDK → 出去时知道:OpenAI 和 Anthropic 的消息格式微妙不兼容才是常态;LangChain 用统一 Runnable 接口(invoke/batch/stream)消掉这类差异,LCEL 写法免费拿到并行/流式/异步。
  • 覆盖:ch1(Why LangChain、两种接口、四种消息、模板、结构化输出、output parser、命令式 vs 声明式)。

03 03-embeddings-and-indexing.md 把意思变成距离,把文档变成数

  • 进来时以为:搜索就是关键词匹配 → 出去时知道:词袋只认字面不认意思(sunny day≠bright skies);稠密嵌入把语义变成空间里的距离(余弦相似度),再经加载→切块→嵌入→入库四步,Tesla 年报才能被一句自然语言问到;改文档不是重建库,RecordManager 增量同步。
  • 覆盖:ch2 全部(bag-of-words→dense、cosine、四类工具、indexing API、MultiVector/RAPTOR/ColBERT)。

04 04-retrieval-generation-rag.md 从一个问题到一个答案

  • 进来时以为:RAG 就是「检索一下贴给模型」 → 出去时知道:检索/生成两阶段都有讲究——k 取小不为省内存,是为防无关上下文诱发幻觉;复制粘贴能答对的题(FIFA 例),规模化后靠查询改写、路由、查询构造三组策略续命。
  • 覆盖:ch3 全部(RAG 三阶段、retriever/k、rewrite/multi-query/RAG-Fusion/HyDE、逻辑与语义路由、SelfQuery/text-to-SQL 及其安全红线)。

05 05-langgraph-state-memory.md 无状态的模型,有状态的对话

  • 进来时以为:聊天机器人天生记得上文 → 出去时知道:模型每次都对上文零记忆,「记得」是把历史重发一遍;LangGraph 用中央状态+checkpointer+thread 把这件事做成框架能力,历史太长还要 trim/filter/merge 三招修剪。
  • 覆盖:ch4 全部(stateless、StateGraph/reducer/node/edge、MemorySaver/thread/Jack 走查、trim_messages 参数群、filter/merge)。

06 06-cognitive-architecture-ladder.md 自主的价码:架构四级阶梯

  • 进来时以为:好应用的标志是全自动 → 出去时知道:多让模型决定一件事,可靠性就掉一级;代码→单次调用→链→路由器的阶梯就是按「模型说了算的范围」排的,email 助手的两条约束说明这个价码必须先谈。
  • 覆盖:ch5 全部(agency vs reliability、三级自主光谱、0 Code/#1 call/#2 Chain 双温度设计/#3 Router 条件边与流式走查)。

07 07-agent-loop-react.md 让模型自己决定何时停

  • 进来时以为:agent 是个玄乎的新物种 → 出去时知道:它就是「人写的循环换成模型控制停止条件」;CSV 手工版三轮走查把 ReAct 拆到每一轮喂了什么、吐了什么;两个扩展(强制首工具、RAG 选工具)都是拿灵活性换可控性的交易。
  • 覆盖:ch6 全部(act 三层含义、Plan-Do 循环三轮手工走查、ToolNode/tools_condition、stream 走查、first_model、select_tools)。

08 08-reflection-and-multi-agent.md 自省与分工

  • 进来时以为:更强的 agent = 更长的 prompt → 出去时知道:两条结构路子——反思回路(靠反转消息角色骗过对话模型)和多 agent(supervisor 星型拓扑最稳);两者都不该是第一选择,直白循环够用就别升级。
  • 覆盖:ch7 全部(reflection 图、角色反转技巧、subgraph 两种接法、Network/Supervisor/Hierarchical/Custom 四拓扑、supervisor 结构化输出)。

09 09-taming-agency-patterns.md 在自主与可靠之间架桥

  • 进来时以为:自主和可靠只能二选一 → 出去时知道:前沿曲线可以整体外推——结构化输出降方差、中间输出治等待焦虑、HITL 五种模态(interrupt/authorize/resume/restart/edit/fork)换回监督、并发输入五种策略各有适用面。
  • 覆盖:ch8 全部(frontier、三目标互斥、三种结构化策略、stream_mode 三档、HITL 全模态、double texting 五策略与 CRDT)。

10 10-deployment-production.md 从笔记本到生产

  • 进来时以为:部署就是把脚本挂到服务器上 → 出去时知道:生产级 LLM 应用 = 向量库(Supabase/pgvector)+ 托管运行时(LangGraph Platform 的 Assistant/Thread/Run/Cron 四模型)+ 可视化调试(Studio)+ 最小权限三原则;安全边界在「假设凭据会被用满」。
  • 覆盖:ch9 全部(env 配置、match_documents SQL、Platform 数据模型、五流式模式、部署流程、Studio、安全三条原则三场景、滥用防护)。

11 11-testing-evaluation-monitoring.md 非确定性系统的测试学

  • 进来时以为:测试该像传统软件一样追求 100% 通过 → 出去时知道:模型漂移让满分变成错误目标,该追的是「不劣于基线」;设计期自纠错(Self-corrective RAG)、预生产数据集+三类评估器、生产期 tracing 与在线反馈构成闭环;agent 要按终答/单步/轨迹三层分别测。
  • 覆盖:ch10 全部(三阶段循环、self-corrective RAG、数据集三型三来源、评估器三类与 few-shot 自改进、pairwise、回归对比、SQL agent 三层评测、tracing/在线评估/分类打标/灰度放量)。

12 12-llm-native-software.md 软件的下一张脸

  • 进来时以为:往现有应用里塞个聊天框就算 AI 化 → 出去时知道:工具面板+画布这套旧 UI 公理(功能事先已知)在 LLM 应用上失效;侧聊、协作者、环境计算三种形态各自需要的状态共享/任务管理/长期记忆,指向的是软件本身的换代。
  • 覆盖:ch11 全部(Figma/Word 对照、chatbot/collaborative editing/ambient computing 三模式及所需构件)、关于作者页(利益相关交代)。

自查(任意两行「出去时知道」不得同义)

  • 02 vs 01:01 只讲提示词怎么组合;02 讲框架为什么存在(接口统一)。不同层。
  • 03 vs 04:03 是入库前(把文字变数并存好);04 是查询时(把问题变查询并生成答案)。方向相反,机制不同。
  • 05 vs 06:05 讲状态如何保存(memorize);06 讲决策权如何在人与模型之间分配(decide)。不同轴。
  • 06 vs 07:06 给梯子和权衡定价;07 是梯子最高一级的具体构造。递进非重复。
  • 07 vs 08:07 单循环;08 循环之外的结构扩展(自省/团队)。不重叠。
  • 08 vs 09:08 的多 agent 分工在「谁来做」;09 的模式在「做的时候人怎么介入」。补充关系,HITL 内容只在 09。
  • 10 vs 11:10 管「跑起来」(部署平面);11 管「跑得对」(质量闭环)。
  • 12 与前面各章:12 收束为 UI/产品形态判断,不含任何前面机制的复述。
  • 主线检查:01 组合律 → 02 统一接口 → 03–04 让模型接触你的数据 → 05 让对话延续 → 06 权衡定价 → 07 最高自主形态 → 08 结构增强 → 09 对冲手段 → 10–11 上生产的两张门票 → 12 形态展望。每一步被上一步逼出,无双头蛇。

结论

自查通过,不停笔,直接按此连续写作。