跳到主要内容

审查 handbook-of-deep-learning-models — 2026-08-27

结论: ISSUES(7 条) — 主体合格:两个特殊裁断均立住、质量地图逐条属实、四门禁全绿、 10 处出处抽查全对;但全书锚点数字有一处连环算错(问题 1),覆盖映射缺 5 节(问题 2), 第 11 章缺判断块(问题 3),两章主走查不达标(问题 5、6)。修完可转 PASS。

门禁实跑(末行原样):

book-verify: 1 本有拆解、共 611 处出处、0 处对不上
book-jargon: 1 本,共 0 处专业词没解释就用了
生面孔配额:段级超额 0 处(上限 1)、节级超额 0 处(上限 5)
book-dodged: 1 本,共 0 个词被躲开(阈值:原书出现 ≥15 次)

特殊裁断一:「架构=先验」主线立得住

抽 CNN(06/07)、RNN(08)、GAN(09)三章核:

  • 06(CNN)是真承重:整章就是两条假设(平移不变+局部性)推出卷积的推导, 参数量链 10¹²→4×10⁶→4Δ² 是章节骨架本身,不是贴在章首的标签。已对原文 text/41:349/360/430/447 与 d2l 原章逐数核对,链路忠实。
  • 08(RNN)是中度承重:先验框架出现在章首(「第二条架构先验」)与收束判断块 (与 CNN 构成镜像对),且落在机制上——「同一组权重用在每个时间步」正是先验的结构化身。 但「假设省参数/省数据」的定量兑现只有 CNN 一家,时间/博弈/距离三族都只有定性说法。
  • 09(GAN)不是贴标签,是诚实划界:判断块明说博弈先验与另两条不同类 (「不假设数据长什么样,假设可区分性本身可优化」),并交代了这一设计的脆弱面 ——这比硬套框架可信。10/11 的「原型」线(监督/无监督两副面孔)+11 §7 收束表闭环完整。

裁断:立住。 唯一保留意见:主线句的后半截「假设越贴合→参数与数据越省」只在 CNN 上兑现过, 其余家族无定量账——不算违规(index §2.2 只把这笔账挂在 CNN 名下),但读者可能高估它的普适度。

特殊裁断二:「草率已标」属实,拆解没有把原书错误当事实转述

抽 4 处回核原文 + d2l 交叉佐证:

  1. ch2 Lasso 代码贴错:属实。 text/12:235 起散文明说「construct a Lasso regression model using the 'Lasso' class」,而其下代码 import 的是 LinearRegression、数据与 2.6.1 完全相同, 再下一段散文还在讲 X_train/y_train/lasso_model.coef_——三处对不上,拆解 [^9]/[^10] 描述准确。
  2. 3.4-3.5 造假输出:属实。 text/30:157「total available labor is 100 hours」对 :203 「Project B: 4,950.0 hours」;:240「sum(x) <= 1」对 :264「Optimal value: 5.9999…, solution [≈0, 3.0]」(该约束下真最优是 0)。拆解判「输出一律不可引」,处理正确。
  3. ch6 聊天腔与引用错位:属实。 text/43:954「beyond the scope of a single response」、 :1436「not provided in the code snippet you shared」逐字在;文献表 Goodfellow 2014 条目 确为《On distinguishability criteria…》短文、Lee et al. 2009 确为卷积 DBN 论文,三处错位全实。
  4. ch4 = d2l 改编未署名:属实。 text/41:630 第一行 from d2l import torch as d2l; 章末文献(2048 段起)无 d2l 条目;参数链推导与本库 dive-into-deep-learning/text/40-from-fully-connected-layers-to-convolutions.txt 逐节同构 (10¹²→4×10⁶→4Δ²、「another four orders of magnitude」、inductive bias 段)。 拆解 [^14] 的「逐节同构」说法经交叉核对成立。
  5. 未发现把原书错误写成事实的段落:每处硬伤都点名并给出可靠替代(公式丢了平方号以代码为准、 遗忘门首句笔误以公式为准、sigmoid 转码丢分子以代码为准)。书卡「不收也说得通」段 (与 d2l 大面积同源、质量更低、可被替代)与库规诚实口径相符,d2l 同源这点经上面第 4 条证实。

裁断:质量地图成立。 但拆解自己的锚点数字有一处连环错,见问题 1。

问题清单

  1. [index §2.2/§3/§6 兑现表;01 §6;06 标题/§1/§7;11 §7] 锚点数字连环算错。 10¹² 被注成「一百万亿」——错,10¹²=一万亿,一百万亿=10¹⁴;并由这个错 gloss 算出 「十一个数量级」——也错,10¹²→4×10⁶→几百(约 4×10²)合计约 9–10 个数量级, d2l 原文自己只说第二步「another four orders of magnitude」。共 7 处「十一个数量级」 (含 06 章标题与 index 章节地图行)、5 处「一百万亿」。违反:第 13 条补款(数字要可核对)、 诚实条款。修:统一改「一万亿」与「约十个数量级」;index:122「十一层数量级」是同一处的漏字,一并改。

  2. [02/03/05 frontmatter] 原书 5 节不在任何 sourceChapters 里。 2.1、2.2 已被 01/02/03 的脚注实际引用,3.14 被 05 脚注引用两处,但都没声明; 2.3(ML 流程)、2.5(监督算法总览)全书零引用。违反:收尾自检「完整性——原书每一章都被覆盖了吗」

    • sourceChapters 字段规则;notes/01-outline.md 原把 2.1-2.10 划给 02,成稿悄悄缩水且交稿未说明。 修:2.1/2.2 记入 02(或 01)、3.14 记入 05 的 sourceChapters;2.3/2.5 要么并进 02/03 并声明,要么如实写进书卡 notCovered。
  3. [11-self-organizing-maps.md] 全章没有判断块。 §6 末条「书里没点破的一层关系(我们点破)」 与 §7 收束表(四种先验、地图复用法)是实质的我们自己的判断,却无 「判断(我们的)…如果错,会错在」格式。违反:「区分谁在说话」+判断块规则 (其余 10 章各 1 块,唯独 11 为 0)。修:把 §6 末条与 §7 的复用主张收进一个判断块并补可证伪条件。

  4. [02-classic-line-models.md:118] 正文字符串损坏:「三条不相!?同的路线」。修:改「不相同」。

  5. [03-trees-and-ensembles.md] 主走查覆盖不足。 本章承重机制的一半(集成、验收)不在 「门诊分流树」主走查上:bagging/boosting 只有步骤描述与零星数字(1000 条、99% 陷阱), 也未按规则声明「另起走查处」(一章最多两处)。违反:红线二加强(每个承重机制在主走查上占一步; 落不到的才另起且要记账)。修:给集成一节补一个小走查(如门诊数据自助抽样三次、看三棵树投票), 或明示两处「另起走查」的记账。

  6. [10-rbf-networks.md §2] 主走查没有数字流过。 三步训练全程只有符号公式 (k-means 步骤、σ=d/√(2M)、W=(GᵀG)⁻¹GᵀT),具体数字全在 §3 用例(K=8、33%、88%)。 违反:红线二口径 3(只描述步骤不算数)+「每一步旁边有具体的数」。修:拿 3-5 个二维演示点 把三步算到底(数字标注「为演示编的」),或把 §3 用例的实配数字提进主走查。

  7. [04 §7、06 §6、07 §6、08 §6、09 §7 等] 边界小节里的书外说法未标「补充(不在书里)」。 GELU 变体、序列主流已是 Transformer、带 stride 卷积替代池化、语音/翻译曾是 LSTM 天下、 扩散接过生成王座与 GAN 黄金期 2014-2021——均为④类通用知识,正文无标记。 违反:来源四类标法。这些都在「边界与局限(书没讲)」小节,误读风险低,故列轻罪。 修:各补一行「补充(不在书里,来自通用知识)」或脚注。

小疵(不计入通过线,顺手修):01 §4 时间线表 1958 排在 1956 前;04 §5 层形态表 「详在第 04-05 章」自指本章,建议改「本 04 章与 05 章」。

抽查记录(出处与数字)

  • 5 条随机脚注全部属实:01 [^1] (六作者,04-fm-biography:3/36)、02 [^4] ([12. 14. 16.],text/12:74/98)、 03 [^2] (就诊阈值 4 / 2 天,text/17:28/31)、09 [^7] (Mode Collapse,text/43:245)、 11 [^4] (SOM 走查 0.4 / 0.545 / 0.51 / 0.675,text/45:218/304/414-435,逐数与原文一致)。
  • 两个主走查数字核对:06 互相关 19(0×0+1×1+3×2+4×3)算术正确、输出尺寸 (3−2+1)=2 正确、 边缘行 [0,1,0,0,0,−1,0] 与 text/41:927 张量输出逐字一致;05 主走查 [0.02922543 3.06187484 1.94812191] / [−0.05168228 3.11146125 1.94541002] 与 text/31:242/359 一致,表格舍入正确。04 softmax 演示数(e^5=148.4 等)自验无误且已标「演示」。
  • 其余顺带核实:Lasso 贴错、3.5 两条造假输出、ch6 聊天腔、d2l import、参数链五处——全部属实。
  • 台账:正文无格式/许可/清洗统计;index 尾注与样板书 what-is-chatgpt-doing 同款,不算泄漏。
  • 生词:门禁全绿之外人工抽读 01/05/08/09/11,双样本检验、拓扑保持、cell state、dropout、 早停等首现处均有就地解释,未发现机器查不出的漏网。

判为合格的项

完整性主链(不看原书可复述)✓;红线一(无整段搬原文,引文皆短句)✓;红线三与配额 ✓; 台阶与首句链(抽 01 §2、06 §1-3、09 §2-3)✓;总纲六节齐全、§3 可独立成篇、机制细节未上提 ✓; 许诺兑现表 16 行抽核(SOM 走查、批归一化→09 §5、多输出通道→07 §3 等)均兑现 ✓; 书卡 readState/claims/notCovered 与拆解实际一致 ✓;frontmatter 齐备 ✓。