跳到主要内容

审查 shen-du-xue-xi-gao-shou-bi-ji — 2026-08-27

结论: ISSUES(6 条,全部为编辑级/标注级,不伤「读完不必看原书」判据;修完即可 PASS)

门禁实跑(2026-08-27,审者本人所跑,末行原样):

book-verify: 1 本有拆解、共 948 处出处、0 处对不上
book-jargon: 1 本,共 0 处专业词没解释就用了
生面孔配额:段级超额 0 处(上限 1)、节级超额 0 处(上限 5)
book-dodged: 1 本,共 1 个词被躲开(阈值:原书出现 ≥15 次)

附注:book-validate(全库)报的 1 个 ERROR 是别的书的生成物漂移(da-yu-yan 等 5 个文件), 与本书无关;它引用的「段级 32 处/节级 4 处」配额警告经 --all 逐本核对,全部属于 shen-du-xue-xi-quan-shu,本书为 0。

两个专项裁断

1. 篇幅:数字口径有误,但判据成立

先纠正一个数字:「0.75×」是单位错配算出来的。 实测(Python len,同单位比较):

拆解(13 章 + index.md)原书(text/ 14 桶)
字符140 134346 974
字节260 991617 172

「原书 347k、拆解 261k」= 拿拆解的字节对原书的字符;同口径真实比例是 0.40×(字符)或 0.42×(字节),不是 0.75×。汇报与任何后续引用都应改用 0.40×。

但按判据(「读完不必看原书」)独立抽查 3 章后,篇幅本身可接受。 抽的是原书代码/公式 最密的三段,逐一与原文比对:

  • 第 03 章 ↔ 原书 1.4:原书该节含 2 个 Keras 代码清单(res_block_v1/resnet_v1)与 式 1.10~1.20 全部公式图。拆解把承重机制全部讲完:退化定义与过拟合之分、VGG-100 思想实验、 残差之名的统计学来历、两假设正反向论证、λ 反证、表 1.1 七变体、表 1.2 五种激活位置、 集成视角。机制零缺失。
  • 第 05 章 ↔ 原书 1.9.1:原书该节是全书代码最密处(to_qkv/einsum/CyclicShift/两个 掩码生成清单、式 1.46~1.49)。拆解保留全部机制:块合并对比池化、(hw)²→M²hw 复杂度 (原文 1.47 逐字核过)、循环移位与 −inf 掩码、权值共享批评、Swin-T 超参数(hidden_dim=96、 layers=(2,2,6,2)、heads=(3,6,12,24) 与源码清单一致)。缺的只是逐行源码走读——读者不需要。
  • 第 13 章 ↔ 原书 6.2/6.3:原书含 Keras LN 清单与式 6.30~6.35。拆解覆盖共适应、 等价正则推导、三技巧、蒙特卡洛 Dropout、ICS 官方理由与 MIT 反驳、利普希茨平滑、 批次 128/8 对照(原文核过:「BN 反而会减慢收敛速度」「BN 无法运行」)、LN/IN/GN/WN/SN。

裁断:认可篇幅(去代码/公式后讲解完整,无「该讲未讲」的承重机制),但 0.75× 的说法 本身必须作废,如实口径为 0.40×。 另发现一处小节级遗漏:原书 3.7.5「Lite R-ASPP」 (约 1 页,MobileNet v3 的分割头)未覆盖——不伤主线,建议在第 08 章 §5 边界补一句。

2. 「异步」豁免:成立,维持豁免

核实:grep -o 全书 18 次「异步」全部位于 text/01-p1-20.txt:130–166,即 「关于异步社区和异步图书」出版社页面;逐条看全部是品牌名「异步社区/异步图书」。 全书检索「异步训练/异步更新/异步SGD/异步梯度/异步并」零命中——确无技术义。 且 BOOK-TEARDOWN 明文规定版权页类导航章「不要读、不要引」,拆解跳过它正是守规矩。 书卡 notCovered 已如实记录。豁免通过。

问题清单

  1. [07-nas-rl.md:16-18] 章首「这一章讲三件事」引语有复制粘贴残留:同一句「靠『行动→奖励』 的反馈自己调整策略的方法,3.2 节展开——搜网络的 NAS 怎么转起来」出现两遍半,且第二遍 带不配对的右括号「展开)」— 违反行文质量(非门禁项,但读者第一屏即见)— 删残句, 重写为一句。
  2. [05-transformer-into-vision.md:78-79] 「任务配比上,自回归训练优于 BERT 式训练,两者 集成最优[^duibi]。」连续出现两遍 — 编辑残留 — 删一处(脚注保留一处即可)。
  3. [04-senet-densenet-dpn.md:119-121] 同一句内 RNN 的括号解释出现两遍:「——RNN(循环神经 网络:……第 09 章的主角)的高阶版本——作为公共语言——RNN,循环神经网络:……第 09 章 的主角——」— 编辑残留 — 删第二处 gloss,保留第一处。
  4. [02-inception.md:59] 「它没白死:」」「多套权重……」冒号后有多余的「」引号残片 — 标点 错误 — 删多余符号。
  5. [08-constrained-nas.md 全章] 13 章中唯一没有显式「主走查」标记的一章(其余 12 章均有 声明句)— 红线二加强要求「每一章必须有一条主走查,指不出来就是不合格」;§3.1 的 113ms/183ms 实测账与 §3.5 的 100/1000 采样对照事实上承担了走查职能,但章内无一句指认 — 在 §2 末尾补一行主走查声明(如「主走查:§3.1 那笔 113ms 对 183ms 的账,看奖励函数 换尺子前后各算出什么」)。
  6. [03-resnet.md §3.3 变体表] 「排他门 | 最好 9.81%,多数失败」与原书表 1.1 不符:排他门 最好成绩是 8.79(初始化 bg=−6),9.81 是 bg=−7;脚注 [^biao11] 里两个数都对, 主表与自己的脚注不一致 — 出处准确性 — 主表改为「最好 8.79%,多数失败」。

常规项核查(逐项过收尾自检表)

  • 完整性:原书 6 章 ↔ 拆解 13 章逐节对照目录,全部覆盖;frontmatter sourceChapters 与原书节名一致。唯一小节级遗漏 Lite R-ASPP(见上)。
  • 红线一(不搬原文):抽查引文均为加引号短句(「移步其他基础类图书」「赤裸裸的炫富」 「复杂度是 M²hw」等),无整段搬运。
  • 红线二(主走查):12/13 章在正文有显式主走查且带具体数(LeNet 逐层参数表、SE 块 56×56×256、Swin 224→8×8 窗、base2 采样、80/10/10、Dropout 正则账、注意力六步取整 得分);演示数均当场标注「为演示编的」。第 08 章缺标记(问题 5)。
  • 红线三/配额:门禁全绿(见上)。
  • 台阶:抽第 06 章 §3.2 段首句成列(手术动机→损耗证据→手术一→手术二→收尾),不跳。
  • 出处抽查(5 条,亲自开原文核):①02:87 15.3% ✓;②06:150 耗时仅占 50% 左右 ✓; ③09:520 「10x0 + 5x1 + 10x1」点乘 ✓;④11:528 赤裸裸的炫富 ✓;⑤11:628 80%/10%/10% 掩码 ✓。另核走查数字:LeNet 4 704/156/1 516/48 120 ✓、Dropout 0.982 6→0.984 1 ✓、表 1.1/1.2 全部数字 ✓、批次 8 BN 减速 ✓、MNIST 改造 239 936→29 184 ✓、Swin M²hw ✓。1 处不符见问题 6。
  • 总纲:六节齐全(另有 §5 时效修正、§7 兑现表,属加分);§2 主线十一步独立成篇, 每个术语就地一句解释,机制细节留在章节层;兑现表 19 行,抽 4 行(01→13 BN、02→07 β=0.3、03→04 显存墙、05→10 XL)全部真兑现且兑现的是许诺的那件事。
  • 判断块:全书 15 处「判断(我们的)」与 15 处「如果错」一一对应,无一缺席。
  • 三个声音:各章 §4「作者的判断与证据」把实验证据/转述/署名推测分开;「我相信作者 一定探索过」「这令我非常困惑」等均标明是书作者口吻。
  • 补充来源:仅 index §5 三处「补充(不在书里)」(RoPE/InstructGPT/Chinchilla), 均带 arXiv 号与「查阅于 2026-08-27」。
  • 书卡:readState=read、readChapters、6 条 claims、notCovered、summary、soWhat 齐全,与拆解实际覆盖一致(含「异步」豁免记录)。
  • 台账泄漏:正文 grep 许可/清洗/转码/字符/篇幅比 零命中。
  • 篇幅:见专项 1,认可但须改口径。

修复建议汇总

问题 1–4 为删改残句(半小时内);问题 5 补一行声明;问题 6 改一个数。均为局部小修, 不动结构,修完无需全量重审,复核 6 处即可。