跳到主要内容

审查 python-shen-du-xue-xi-pytorch — 2026-08-28

结论: ISSUES(10 条,其中主要 3 条)

门禁实跑(末行输出原样):

  • node scripts/book-jargon.mjs python-shen-du-xue-xi-pytorchbook-jargon: 1 本,共 0 处专业词没解释就用了
  • node scripts/book-jargon.mjs python-shen-du-xue-xi-pytorch --quota生面孔配额:段级超额 0 处(上限 1)、节级超额 0 处(上限 5)
  • node scripts/book-dodged.mjs python-shen-du-xue-xi-pytorchbook-dodged: 1 本,共 0 个词被躲开(阈值:原书出现 ≥15 次)
  • node scripts/book-verify.mjs python-shen-du-xue-xi-pytorchbook-verify: 1 本有拆解、共 883 处出处、0 处对不上(含 3 处书架锚)

抽查出处 5/5 属实:

  1. 01 [^12] → text/02-ch01-1-numpy.txt:738-742:循环 798.34ms vs 向量 1.885ms、「大约是向量运算的400倍」,与拆解「798ms/1.9ms/约 400 倍」一致;
  2. 06 [^2] → text/07-ch06.txt:145:原文「1×1+1×0+1×1+0×0+1×1+1×0+0×1+0×0+1×1=4」,主走查九连乘逐项一致;
  3. 09 [^22] → text/10-ch09.txt:502:原文输出「准确率: 100%,阀值: 0.11820279」(原书「阀值」为原文用字,拆解照录),一致;
  4. 10 [^5] → text/11-ch10.txt:222:「Valid Acc: 0.748905, Time 00:03:22」,与拆解「75%、每轮约 3 分 22 秒」一致;
  5. 13 [^21] → text/06-ch05.txt:74:原文「AlphaGo Zero…完全摒弃了人类知识,碾压了早期版本的AlphaGo」,与拆解表述一致。

已过的检查(不再列入问题):完整性——16 个正文章 sourceChapters 并集全覆盖,前言入总纲脚注 [^1]-[^4],附录 A 在总纲 §1 与 01 §9 有处置落点;判断块 11/11 均带「如果错,会错在」;主走查抽 3 章(01 §5 广播逐格、03 §2 MNIST 循环逐行、06 §2 九连乘=4)全部落位且带真实数字,承重机制均在走查上有步;总纲「全书一条主线」一节独立成篇、无机制细节倾倒;台阶抽 3 节(03 §5、05 §4、13 §2)首句连读不跳;无 TODO、无三类空转词;引文均为短句,红线一未见违反;「量化」两处(01 §6 批量(成批处理)、11 §7 量化(用具体数字横比))均已就地括号解释,非数值压缩义,处理口径正确;与 TensorFlow 系已拆书 shen-du-xue-xi-quan-shu 不同源——CNN 章主走查(本书 5×5×3×3 九连乘=4 + 68→95% 阶梯 vs 彼书 3×3 滤波器演示 + Keras 逐层参数清点 320/18496)、RNN 章主走查(本书两步前向 0.537/1.561 + 词性标注全错→全对 vs 彼书航空营收五配置 RMSE 表 + 股价「镜头拉远」拆穿)各自取自原书,侧重分别为「参数账/谱系/形状契约」与「特征工程/配置实验/BERT 线」,互补定位成立;书卡 readState/readChapters/claims/notCovered/summary/soWhat 均填,且与拆解实际覆盖一致。

问题清单

  1. [03 §7 → 04 §5,及总纲兑现表] BN 模式切换的许诺未兑现。 03 边界节写明「训练/测试两种模式下的行为差别(用批统计还是全局统计)…机制留到第 04 章补」,总纲兑现表记「03 §2 | BN 模式切换的机制「第 04 章补」 | 04 §5 | ✓」。但 04 §5 只讲了 BN 的前向机制(按小批算均值方差、γβ 拉开、作用在激活前),通篇没有「训练用批统计、测试换全局统计」这一模式差异(全文搜「全局统计/批统计」零命中)。读者带着 03 留下的问题到 04 找不到答案 — 违反「许诺要兑现」(正是「讲的是同名的另一件事」)。建议:在 04 §5 补一小段讲清两种模式(可作 ④ 类补充标注),或删去 03 的许诺与兑现表对应行。
  2. [05 §8] 台账泄漏进正文。 「书中动量/NAG/…的伪代码是图片,清洗后的文本只剩描述」——「清洗后的文本」是我们转码流水线的内部状态,原书读者手里的书是有图的;这违反「页面上不放台账(格式/许可/清洗统计)」。建议改成以读者为对象的表述,如「书里这组伪代码以截图形式给出,不便转录成公式,要看公式需另查原文或原论文」。
  3. [11 §3] 主走查数字内部不一致,未标注系原书笔误。 主走查先给分布「(Tom, 0.3)(Chase, 0.2)(Jerry, 0.5)」,紧接着公式写「C杰瑞 = 0.3·h(Tom) + 0.1·h(Chase) + 0.5·h(Jerry)」。回核原文:分布值见 text/12-ch11.txt:97,式 11-13 作 0.1 见 :129——原书两处本就不一致,拆解照录属实但原样并排后读者会以为拆解算错。按「书里错了照实写」的口径,应当场加注一句「原书分布写 0.2、式 11-13 写 0.1,两处不一致,以分布为准」。建议补上此注。
  4. [01 frontmatter] title 混入英文残词且与 H1 不一致。 第 3 行 title: 从 NumPy 到 Tensor — 深度学习的数 underneath,正文 H1 为「深度学习的数据容器」。「underneath」显然是残留笔误,且两处标题分裂会影响侧边栏/索引展示。建议 title 与 H1 统一。
  5. [index 兑现表] 两处节号错位(内容对、坐标错)。01 §5 末|批处理四步」实际许诺在 01 §6 末(§5 是广播主走查);「12 §4|修复模糊→08 §6(VAE 模糊)」实际内容在 08 §5 的对照表(§6 是 CGAN)。兑现表是给 agent 的跳转表,节号错即地址错。建议改为 01 §6 末、08 §5。
  6. [index §2⑦、07 §3] 两个承重词首现无解释且不在 jargon 词表(机检盲区)。 总纲主线 ⑦「潜在空间」只有「分布」被解释,空间本身未解释(08 章才出现「压成一个低维向量 z」的间接说明);07 §3「特征值分解」直接引用未解释。按守则「词表里没有但读者不懂的词,加进词表,别绕过检查」。建议:就地各补半句,并把「潜在空间」「特征值」补入 scripts/book-jargon.mjs 词表。
  7. [07 §7] 「与本书拆解过的语义变距离思想同源」归属不通。 本书是被拆解对象,没有「拆解过」任何东西;若指本库其他拆解(如 what-is-chatgpt-doing 的「意思变成距离」),应点名并给书架锚;否则删。建议核实出处后改写或删除。
  8. [12 §7 与总纲 §1] 附录 B 处置声明自相矛盾。 总纲声明「附录 B…只用来给写作年代定位,不进拆解正文」,而 12 §7 写「与附录 B 的行业乐观叙事形成有趣的对照」——这是对附录 B 内容的正文引用,且无脚注。建议:删去该对照句,或修正处置声明并补出处(text/19-apx-b-b-ai.txt)。
  9. [06 §3] 同一句重复两次。 「谱系不是年代陈列,是问题清单的交接」在谱系表前(引言)与表后各出现一次,表后那次还带着与引言重叠的 LeNet/AlexNet 复述。建议删表后一段,保留一处。
  10. [frontmatter] area 字段全书不统一。 12 个文件 area: ai-foundations,11llm13rl;姊妹书 shen-du-xue-xi-quan-shu 全书 15 个文件统一 ai-foundations。area 是侧边栏分组键,一本书拆进三个分组会让「按书浏览」断裂;字段语义是「书的领域」而非「章的领域」。建议统一为 ai-foundations

观察(不计入问题)

  • 篇幅:05(7908 字符)、11(7874 字符)略低于「9k–11k」参考线;两章七段结构齐全、主走查带真数字、对应原书章的内容无缺失(原书这两章大篇幅是代码清单),故仅记录不建议强行加长。
  • 09 §4 判断块内「检索(按相似度查找)」同段重复解释两次,下次顺手删其一即可。