跳到主要内容

审查 cong-ling-gou-jian-da-mo-xing — 2026-08-27

结论: PASS(0 条阻断问题,3 条备忘级观察)

审者独立重跑全部门禁,并按 REVIEWER-BRIEF 逐项抽查;所有数字均为本人实跑/亲核,未采信写手自报值。

门禁实跑(四条命令末行原样)

book-jargon: ✓ cong-ling-gou-jian-da-mo-xing —— 147 个专业词首次出现处都有解释
book-jargon --quota: ■ cong-ling-gou-jian-da-mo-xing —— 段级超额 0 处、节级超额 0 处
book-dodged: ✓ cong-ling-gou-jian-da-mo-xing —— 0 个词被躲开(阈值:原书出现 ≥15 次)
book-verify: cong-ling-gou-jian-da-mo-xing: 444 处出处 + 5 处书架锚,0 处对不上

docs-lint(只报不拦):30 处命中,全部落在标准明文豁免的类别上(脚注地址密集导致的「段落墙/反引号」、并列枚举的「顿号串」),无需整改。

逐项核过(收尾自检表)

  1. 完整性 ✓ — 对照 library/cong-ling-gou-jian-da-mo-xing/chapters.json:原书 12 个正文章全部有对应拆解章(sourceChapters 一致);引言并入 01;9.2 与 7.3 重复合并进 07 且在 07 §1/§5、09 §5 双向声明;4.5 电子版缺失在 04 §5 与书卡 readChapters 如实注明;小结/思考题按教学装置处理并在总纲 §1 交代口径。
  2. 红线一(不搬原文) ✓ — 抽 9 处脚注回核原文(超出要求的 5 条),全部属实且引用均为短句:
    • 01 [^13] GPT-4「1750亿参数」= 03-fm.txt:91 原文逐字;
    • 03 [^6] -100 标签 = 19-ch03-01-3-1.txt:236 逐字;
    • 07 [^11] 「模拟64的批量大小」= 57-ch09-02-9-2.txt:48 逐字;
    • 09 [^9] 0.0045 = 58-ch09-03-9-3.txt:36;10 [^5]/[^12] 110.00M 与 89.21% = 64-fm.txt:232/:169;
    • 01 [^2] 分词嵌入定义 = 06-ch01-02-1-2.txt:24;04 [^3] patch_size 讲解段 = 25-ch04-01-4-1.txt:48(散文);12 [^10] quantize_dynamic = 80-fm.txt:51(散文)。
  3. 红线二(主走查) ✓ — 抽 3 章核落位:01 §3.2(「猫 追 它」四步注意力,演示数当场标「编的」)、07 §3.3(16→64 攒批,loss/4 与清零两个坑都在)、12 §3.2(解冻参数名原书打印 + 三轮损失)。走查全部在正文、与顶层全景同输入、书内数与自编数分得很清;未上走查的机制(多头、残差/归一化、位置编码)按「力气分配」裁决两三行带过并引书内实验,未另起第三处。
  4. 红线三(生词/配额) ✓ — 机检双零;抽读 02 §3.1-3.2、06 §3.3、10 §3.1 的段落首句链,不跳级;空转词三类 grep 零命中,TODO(没懂) 零命中。
  5. 总纲 ✓ — 导读 + 六节齐;§2 主线能独立成篇(八站流水线,每步「上一步逼出什么」清楚,术语就地括号解释,机制细节留在章节层);兑现表 19 行,抽 3 行核实:03 §4「AdamW 放 09 章」→ 09 §3.1 ✓;09 §5「12.3 补实战配比」→ 12 §3.3(2e-5+0.01)✓;02 §5「11 章碰真实模型」→ 11 §3.2/§3.5 ✓。
  6. 判断块 ✓ — 全书 4 处(index×3、01、06 各 1)均带「如果错,会错在」。
  7. 书卡 ✓ — readState/readChapters/claims/notCovered/summary/soWhat 全填,与拆解实际覆盖一致(notCovered 与总纲 §4.4/4.5 逐条对得上;readChapters 主动记了「4.5 缺失」「9.2 与 7.3 重复」)。
  8. 台账泄漏 ✓ — 正文无格式/清洗统计;index.md:193 提「84 号文件只是字体许可声明」属「影响读者怎么用出处」的必要背景(已核实 84-fm.txt 确为 SIL OFL 字体许可全文),判为合规。
  9. 诚实(三个声音) ✓ — 4 处硬伤 + 4 处结构问题逐项核了点破方式,全部是「照录 + 注明」,没有替原书改(详见下节)。

硬伤点破专项(抽 2 处细核 + 2 处带看)

  • GPT-4 参数实为 GPT-3(01 §5 + index 判断②):正文先照录「原书引言有一处硬伤:『GPT-4 通过 1750 亿参数』」,脚注 [^13] 逐字引原文并注明「1750 亿是 GPT-3(2020)的公开数字」、修正来源标「补充:不在书里,来自通用知识」;index 判断块还给了可证伪条件(若系排版之误则评价宽容、修正清单不变)。三个声音分得干净。✓
  • 「线性衰减=等比」(09 §4):正文照录原书原话「以一种线性方式(即等比下降)」,再用书里自己的数字(0.1→0.01、每轮约减 0.0045 = 等差)自证,收在「读的时候按等差理解」——注明而非改写。✓
  • 带看两处同风格:ViT「编解码器」(04 §4,照录 26-ch04-02-4-2.txt:122 原句 + 指出原版只有编码器半边)、「Casual Tokenizer」(01 §3.1 判断块,因无从核实而以判断块+可证伪条件处理,分寸正确)。4.5 缺失、7.3/9.2 重复、10.2 数字打架(89.21% vs 0.8735,已亲核两处原文行)均在对应章节点破且未擅改。✓

代码清单为图片的体例限制专项

  • 抽查引用落点:绝大多数出处指向「代码解析」讲解散文段(如 25-ch04-01:48、80-fm:51 均为散文);少数几条指向书里留在文本层的演示输出/短代码行(11 [^14]→73-fm.txt:103 def resume_training、12 [^4]/[^5]→78-fm.txt:42/60/81、07 [^2] 路径→69-fm.txt:54 set(cleaned_data))——这些行确实存在于文本层、可回核,不属「引到图片里的内容」,且 11 §4 已主动声明「部分代码块以图片呈现,正文只保留关键函数文本」。
  • 边界声明齐:总纲 §1 要留意的①与 §4.5、书卡 notCovered、01 §4 体例说明、02 §3.2「对应文本内容原书以图片呈现,没进文本」共五处声明,口径一致。✓

书架锚专项(抽 3 处,实核 4 处,全部与 ../ai-frontier-reference/ 吻合)

「事实=」核对
peft#01-lora-math.mdΔW=B·A、h=Wx+(α/r)·BAx、B 零初始化 —— 源文档第 8/38/44 行逐字吻合 ✓
pytorch#05-distributed-ddp.md「跨卡求平均」(21 行)、「梯度桶+autograd 钩子」(28 行)吻合 ✓
accelerate#04-mixed-precision-and-accumulation.md「fp16 没走 scaler(梯度可能下溢)、loss 没除累积步数(梯度偏大 N 倍)」—— 162 行逐字吻合 ✓
minbpe#02-regex-split.md(顺带)「合并只能在同一个选区内发生」—— 33 行逐字吻合 ✓

问题清单(无阻断项,以下为备忘)

  1. [11-training-in-practice.md:脚注14、12-finetune-in-practice.md:脚注4/5] 少数出处指向文本层残留的代码/输出行而非讲解散文段 — 不违反标准(地址可达、行句极短、且 11 §4 已声明体例),但与「出处多引自代码解析散文」的自我口径略有出入 — 无需修改;若后续原书重转码导致这些行漂移,依赖 --fix 按短语回位即可。
  2. [index.md §4.5] 「84 号文件只是字体许可声明」一句带出台账味信息 — 判据上属「影响读者怎么用出处」的背景,判为可留;若求极简可并入「书末无文献表」一笔带过 — 可选。
  3. [收尾自检表·最后一行] 「主人认可」(book-verdict 读过-认可)不在审者权限内,目前未见记录 — 门禁全绿不替代主人验收,请按流程走 book-verdict