跳到主要内容

审查 da-yu-yan-mo-xing-cong-li-lun-dao-shi-jian — 2026-08-28

结论: ISSUES(16 条——出处与结构全部属实,但有一批编辑残留和两处章名标错,需一轮清理)

门禁实跑:

book-verify: 1 本有拆解、共 806 处出处、0 处对不上
book-jargon: 1 本,共 0 处专业词没解释就用了
生面孔配额:段级超额 0 处(上限 1)、节级超额 0 处(上限 5)
book-dodged: 1 本,共 0 个词被躲开(阈值:原书出现 ≥15 次)

先说过的项(复核通过)

  • 完整性:原书 12 章全覆盖——ch1→01、ch2→02+03、ch3→04、ch4→05、ch5→06、ch6→07+08、ch7→09、ch8→10、ch9→11、ch10→12、ch11→13、ch12→14;各章 sourceChapterschapters.json 章名逐字一致。
  • 出处抽查 6 条全部属实(含 2 条邻章尾巴):01-ch01.txt:282(3640 PFLOPS)、04-ch04.txt:512/516(16Φ 字节/120GB)、05-ch05.txt:854(350GB→35MB)、06-ch06.txt:950(R1-Zero 15.6%)、08-ch08.txt:89(MiniGPT-4「10 小时」——确系第 7 章正文落在 08 文件头)、12-ch12.txt:121(LLMEval-3「刷榜」——确系第 11 章正文落在 12 文件头)。两条邻章引用落点与短语都对,没有误引邻章内容;错的是「原书章」标签(见问题 4、5)。
  • 复旦校区例两章互核:01 引 01-ch01.txt:296「新江湾校区」、06 引 05-ch05.txt:38「江湾校区」——原书两处本来就是两个变体,各自忠实,不是笔误。
  • 主走查抽 3 章核落位:05(§2 张量并行按列切,真算矩阵+标明演示值;ZeRO、BLOOM 另起两处,未超限)、07(§5 GRPO 组比较,演示分标明)、12(§5 推测解码整回合,演示值标明)。承重机制在各章走查上的占位都指得出来。
  • 判断块:全书 5 处(02、06、index×3),全部带「如果错,会错在」。TODO(没懂) 零命中。
  • 总纲:六节齐全、顺序对;第 2 节(主线)只读它可复述全书;兑现表 24 行抽查 10 行(§2⑥→12、02 判断块→06/12、03→06 位置插值、04→13 污染、07→08、10→11、14→12 等)全部兑现,含一条诚实标注「这次改的」。
  • 身份考据:书卡 provenance 把 lifecycle.md「疑似同族」疑问的落定过程写清了(533 页/12 章五部分/「截至 2025 年 2 月」含 DeepSeek-R1、vLLM V1),并写明库内未收第 1 版;aiRef/sources/ 全库仅此一条登记,无重复收录。
  • 红线一:抽查引文均为短句钉用法;代码块里的书例(复旦校区、a dog is in the garden)是书中教学例,量小且必要。未见整段搬运。
  • 干净:14 个拆解章正文无格式/许可/清洗台账混入(仅 index 页脚一句,见问题 16)。

问题清单

甲类:编辑残留与数字错误(必修,半小时内能清完)

  1. [04 §1 工序一] 「常用困惑度…来算——越像人话越不惊讶(第 13 章会正式讲它),越像人话越不惊讶——」同一短语连排两次 — 编辑残留 — 删一处,保留带「(第 13 章会正式讲它)」的那处。
  2. [04 §2 工序四] 「一种以字节(8 位的最小存储单位)为单位的编码——的词表是这样练出来的:字节(8 位的最小存储单位)是这里的切分原料」同一括号解释同句两现 — 编辑残留 — 删后一处。
  3. [04 frontmatter essence + §2 主走查落点] 存活率口径写错:essence 说「只有约一成九能活到」(「一成九」读作 19%,实际 11.67%≈一成二);正文说「这九分之二的淘汰」(存活≈九分之一,淘汰应是九分之八) — 违反「留下的每个数字都要有参照物/正确」 — 改为「约一成多能活到」「这九分之八的淘汰」。
  4. [09 原文地图末两行 + 脚注[^9][^10]] MiniGPT-4 的 logo 问答与两阶段训练数字是第 7 章正文(因转码滞后落在 08-ch08.txt 头部),「原书章」却写「8 大模型智能体」 — 出处章名标错(文件/行号/短语本身都对) — 改回「7 多模态大语言模型」,并照 13 [^20] 的样子补一句「此节正文在 08-ch08.txt 文件头部(章界溢出)」。
  5. [13 原文地图 5 行 + 脚注[^17][^18][^19]] Chatbot Arena/胜率矩阵/LLMEVAL 五种评法/Elo 与积分制/LLMEVAL-3 防刷榜是第 11 章正文(落在 12-ch12.txt 头部),章名写成「12 大语言模型应用开发」;同文件的 [^20] 和 LLMEVAL-Medicine 行却标对了——前后不一致 — 出处章名标错 — 统一改「11 大语言模型评估」。(对照:12 章的 KIVI/Orca/vLLM 引 11-ch11.txt 头部、章名标「10 效率优化」,是对的——照它改。)
  6. [11 §3 检索前] 「把自然语言转成 SQL…直接查表格和知识图谱,直接查表格和知识图谱。」— 编辑残留 — 删一处。
  7. [14 §4 第一层] 「模型要转成它的 GGUF 格式(HuggingFace 上有在线转换工具)[^10]。」整句连排两次(脚注标记也重复)— 编辑残留 — 删一处。
  8. [14 §3] 「合成(人工造出来而非真实采集的)」一段三现 — 力气撒平/编辑残留 — 首现给括号,后两处直接写「合成数据」。
  9. [02 §7 边界与局限] 第 1 条与第 3 条是同一件事(注意力平方复杂度、原书后置小节点破、改进在第 03 章),仅措辞不同 — 重复条目 — 合并,保留带「2.3.2 节」坐标的那条。
  10. [13 §3 主走查] 计算中间留有自问残句「候选覆盖了其中 1 个:(in the)?不对——候选是…」,且六个标准词对只核了四个、未说明跳过 there-is/is-a — 走查呈现混乱(结果 3/6 本身正确)— 删残句,六个词对一次列全再打勾。

乙类:定位账(必修,影响读者/agent 路由)

  1. [index §5 判断三 + 书卡 soWhat] 「与库内已有书的关系」只对照了 hands-on 与 nndl,完全没提 llm-and-agent(邱锡鹏《大模型与智能体》,18 章拆解)——那才是题材最近的邻书。差异化本身立得住(抽 2 章对比:两书的注意力章都用「那只猫没过马路」,但 llm-and-agent 03 走「信号衰减/不可并行→柔性查字典」的动机综合路线、另立「注意力≠理解」边界;本书 02 走 QKV 三步的机制拆解、逐段背书原书,还带 √d/多头/掩码等工程细节;llm-and-agent 06 把 RLHF/DPO/GRPO 讲成「同一笔账的三种记法」,本书 07/08 沿原书策略梯度→PPO→GRPO 演化线推公式、落到 R1 案例)——但总纲不说,读者无从分流 — 违反「覆盖什么/不覆盖什么」的分流职责 — 判断三补一行与 llm-and-agent 的分工(如:llm-and-agent 重主线重判断、含 DPO 与具身/治理;本书重机制重数字、公式与实验账最全)。
  2. [index §5 判断三 + 书卡 soWhat] 引用的书 id「hands-on-llm」不存在,实际目录是 hands-on-large-language-models(书名《动手学大语言模型》本身没错)— agent 按 id 跳转会落空 — 改成实际目录 id。

丙类:建议修(不拦收)

  1. [09 §5 训练杠杆] 「三个杠杆:」下第二条丢了列表标记和加粗标签,以「先说语义关联:」起头(「先说」与它排第二矛盾)— 列表结构破损 — 补成「- 语义关联:…」。
  2. [04 §2 工序二] 「用 GPT-2 做束搜索(b=32)」——「束搜索」是行话,(b=32) 没有解释它 — 红线三(门禁词表没覆盖到,属漏网)— 补半句:每次保留打分最高的 b 条候选句的解码法。
  3. [index §2 ⑥] 连续 8 个单句段、每句挂一个(12),把每段首句抄成一列读像清单不像推理链;另外「词元」在 index 首现(§2⑤「翻译成…一串词元」)未给半句解释(jargon 门禁是启发式,此处漏报)— 总纲海拔/红线三 — ⑥ 合并成 2–3 个带因果的段落;⑤ 的「词元」补「(模型吃的最小字块)」一类的半句。
  4. [index 页脚] 「原始书籍文件不入库」是台账句(不影响读者怎么读),样板书页脚无此句 — 「页面上不放台账」(轻)— 删半句,保留「本组文档是我们自己的重写…可回核」。

一句话总结

底子是好的:12 章全覆盖、806 条出处抽查全属实、走查与判断块都到位、身份考据清楚、与最近邻教材的讲法差异真实存在;但交稿前缺最后一轮清稿——8 处编辑残留/重复、2 处数字口径、2 处邻章章名标签、1 个坏书 id,外加总纲漏了与 llm-and-agent 的分流对照。以上修完即可交主人验收。