跳到主要内容

审查 fine-tuning-with-python-train-align — 2026-08-27

结论: PASS(3 条非阻塞问题,见末尾)

门禁实跑(末行原样):

node scripts/book-jargon.mjs fine-tuning-with-python-train-align
→ book-jargon: 1 本,共 0 处专业词没解释就用了(111 个首次出现处都有解释)
node scripts/book-jargon.mjs fine-tuning-with-python-train-align --quota
→ 生面孔配额:段级超额 0 处(上限 1)、节级超额 0 处(上限 5)
node scripts/book-dodged.mjs fine-tuning-with-python-train-align
→ book-dodged: 1 本,共 0 个词被躲开(阈值:原书出现 ≥15 次)
node scripts/book-verify.mjs fine-tuning-with-python-train-align
→ book-verify: 1 本有拆解、共 401 处出处、0 处对不上(另 6 处书架锚全过)

逐项核查(按任务书重点)

1. 原书缺漏声明的核查 — 属实,且各处一致。

  • 医疗/金融两节:grep 07-ch04 全文,医疗/金融仅出现在引子(段 7、9)、正文零星带过 (段 99、113、121、123、129)与章总结(段 137,且总结只提医疗不提金融), 无任何独立小节正文。拆解 07 §1/§5/fn2、总纲 §1/§4/§5.1、书卡 notCovered 五处声明口径一致,均声明「不虚构」;07 章实际内容(法律/代码/低资源语言) 逐条有原文出处,没有一处编造医疗/金融内容。10 章的医疗案例出自原书第 7 章 (段 53–79 全部存在),来源正当。
  • 第 6 章承自姊妹书:原文实证充分——段 17「we built in Chapter 5」(本书第 5 章是评测章)、 段 213「financial document analysis model from Chapter 4」、段 1117「This final chapter bridged…RAG and fine-tuning systems」,乃至实操代码类名就叫 RAGRequest/handle_rag_request。 拆解 09 §1/fn3、§5 与总纲 §5.1 均如实点破「机制可用、行文坐标别信」,处理得当。

2. 与 post-training 拆解的交叉引用 — 吻合。 06 章 fn 中 shelf=ai-book-reference/post-training-ai-practical-guide-to#04-preference-learning.md 的「事实=」(把「人挑的偏好信号如何变成训练目标」当主线)与该文件 essence/正文 (「SFT 教格式,偏好学习教质量」)一致;总纲 §6 判断一「Post-Training AI 讲训练信号的 原理与选择」与 04 章内容相符,互补定位成立。

3. ② 类锚对源码逐字核(6 处全核,超出抽 2 的要求)— 全部属实。

  • peft@src:src/peft/tuners/lora/layer.py:338:注释原句「initialize A the same way as the default for nn.Linear and B to zero」,默认 kaiming_uniform_,gaussian 是 elif 选项, nn.init.zeros_(self.lora_B…) 在场——与拆解「事实=」逐字吻合。
  • trl@src:trl/trainer/dpo_trainer.py:1465:per_sequence_loss = -F.logsigmoid(self.beta * delta_score),delta_score = chosen_scores - rejected_scores(1460 行)——逐字吻合。
  • 文档锚 trl#02-sft.md(掩码折进 labels -100)与 peft#01-lora-math.md(LoRA 数学三行、 B 置零)亦核对无误。

4. LoRA 初始化点破方式 — 正确的「照录+注明」。 03 §3.3 先原样照录书里的说法 (「按秩的平方根缩放的高斯随机数」),再注明 PEFT 默认是 kaiming、高斯是可选项, 并指出「B 置零、起点等于原模型」这一承重性质两边一致、不受影响——没有替书改口, 也没有让读者带着错误认知离开。总纲 §5.3 用同一点破面向读者,口径一致。

5. 消费级硬件视角 — 立住了。 抽查 07 领域章:内容全是领域特有(条款边界语义分块、 shall/indemnification 术语分量、辖区切窄、代码执行式验证、私有框架、XLM-R 迁移、 回译/过采样、自建基准三件套、检索嵌入也要领域微调),没有复述通用微调常识。 硬件账的独有价值由 03(56GB 一步步算)、04(8–12GB 兑现)、09(微秒切换、10–20 适配器) 承住,数字全部可回核原书。

6. 完整性 — 原书 7 章全覆盖。 chapters.json 7 个正文章 → 01/02←Ch1、03/04←Ch2、 05/06←Ch3、07←Ch4、08←Ch5、09←Ch6、10←Ch7;前言/作者简介由总纲脚注 1–3 覆盖。 各章 frontmatter sourceChapters 与 chapters.json 章名一致。

7. 脚注抽 5 条回核原文 — 5/5 属实。

  • 01 fn5:段 299–363 逐条数,"billing") 恰 8 条(第 9 个 billing 是 LABEL_NAMES 行), 「30 条工单、8 条 billing、2e-5、4 遍」全与原文配置一致;
  • 05 fn12:段 81 原文「GPT-3.5 to generate 52,000 … from 175 seed examples」,300 倍说法成立, 脚注还如实注明原文表述是 GPT-3.5;
  • 08 fn23:段 111 原文「0.5 or more on a 5-point scale → 50 to 100 examples」逐字符合;
  • 09 fn11:段 73–81「a dozen task-specific fine-tunes」(12 的出处)、microseconds、 ten to twenty、80GB 全在场,主走查「数字全部来自书里」的标注成立;
  • 10 fn16:段 129「276,000 … reduced this to 92,000 … covering high-resource languages fully」 逐字符合。

8. 主走查抽 3 章 — 合格。 01(§1 立靶 + §4 全参/冻结主干两版对照,有 8 条 billing、 2e-5、1e-3 等实数)、03(§3.1 四件套账 14+14+28=56,有 A100/24GB 对照,并当场点破 第 1 章 40GB 粗账漏了梯度)、08(§3.6 五步管线,15 条真值、0.60/1.00、三道闸阈值, 并照录书里「simulated」的声明)。走查全部落在正文,承重机制各占一步。

9. 总纲第 3 节(§2 全书一条主线)— 独立成篇。 十步因果链,机制细节已退回章节, 术语全部就地一句带过(Libra:LoRA「只训两小块新增的小数表」等),数字只留了 56GB→8–12GB 一处冲击性参照。许诺兑现表 27 行,抽核 3 行(02 §3.3+04 §3.4 的 「只训小块步子要大」、01 §408 §3.2 的 F1 展开、07 主走查10 §3.3 的 23%→74%) 全部兑现。

10. 其余自检项。 台阶:抽 03 §3.1、06 §3.2–3.5、07 §3.2,段首句连读不跳。 判断块:总纲 3 条均带「如果错,会错在」;各章 §4 均按「书里当证据/立场/坦白没给」三分。 TODO(没懂) 零命中。红线一:全文最长引文均为单句级(工单原文、注入句、模板行)。 docs-lint 48 处(段落墙 31)为宽松期只报不拦,其中脚注反引号按标准属误报豁免。

问题清单(均非阻塞)

  1. [10 §3.4 / 04 §3.6] 书内自相矛盾未像 40GB/56GB 那样点破 — 违反「诚实」项的处理先例一致性: (a) 适配器体积原书第 2 章说「a few megabytes」(text/05…:139)、第 6 章说「a few hundred megabytes」(text/09…:77),拆解统一用「几 MB」(取第 2 章口径,也与实情相符)但未注明第 6 章 的另一说法;(b) 多语言案例「高资源语言足额 1000/类」与 92,000 条算术对不上 (17×12,000+6×2,400=218,400),拆解照录书内两个数未点破。建议:两处各加一句 「书内两处口径不一/数字对不上,以 X 为准」的点破,与 03 章处理 40GB 的方式对齐。
  2. [07 §1/fn2、index §4] 「只有引子与章总结提及」措辞偏窄 — 诚实声明的精度问题: 实际正文还有零星带过(段 99、113、121、123、129),且章总结只提医疗未提金融。 材料事实(两节无正文、不虚构)完全成立,但审计者按字面去核会发现更多「提及」。 建议改为「无独立小节正文,仅引子、总结与零星段落提及」。
  3. [04 §6 第 7 条] 自标「我们的补充判断」却无可证伪条件 — 违反判断块格式 (§5 边界里注明了「本章可带走第 7 条是我们的补充判断」,但可带走第 7 条 「要切换留适配器、要性能就 merge」没有「如果错,会错在」一行)。 建议补一行可证伪条件,或降格为书内两个选项的中性复述。