大规模语言模型:从理论到实践 — 书籍拆解
读到哪:未读。
readState不是 read/partial 的书不能当锚。
| 项 | |
|---|---|
| 作者 | 待填 |
| 版次 | 2023 版 |
| 格式 | pdf | 文本源 pdftotext -layout |
| 许可 | 自购/个人收藏 |
| 来源 | 主人个人藏书,2026-08 放入收件箱 |
| 清洗 | 删页眉页脚 274 行、页码 50 行、断词接回 14 处 |
我们重写的拆解(0 章)
(还没写。拆解是这本书对我们的真正产出——底下的元数据只是索引。)
为什么收它
要解释「模型是怎么训出来的」时的中文出处。
合法性
自购/个人收藏。来源:主人个人藏书,2026-08 放入收件箱。原始文件不入库,转码文本入库(私有库)。
出版方怎么说
(起草参考,不是我们的判断。真正的「覆盖什么/不覆盖什么」写进 frontmatter 的 claims / notCovered)
它覆盖什么、不覆盖什么
(还没读到能下判断的程度。claims / notCovered 空着就是空着,不猜。)
怎么引用它
(依据: book=da-gui-mo-yu-yan-mo-xing §3 语言模型训练数据)
章节名对不上会被 lab:validate 拦下;页码锚(§p.123)同样可用。
结构(16 段,共 1300k 字符)
| 段 | 章节 | 页 | 规模 |
|---|---|---|---|
| 01 | 前沿 | p.3–12 | 26.6k |
| 02 | 1 绪论 | p.13–24 | 17.5k |
| 03 | 2 大语言模型基础 | p.25–56 | 195.5k |
| 04 | 3 语言模型训练数据 | p.57–85 | 41.1k |
| 05 | 4 分布式训练 | p.86–129 | 686.3k |
| 06 | 5 有监督微调 | p.130–156 | 85.3k |
| 07 | 6 强化学习 | p.157–188 | 78.9k |
| 08 | 7.1 推理规划 | p.189–192 | 4.1k |
| 09 | 7.2 综合应用框架 | p.193–211 | 30.5k |
| 10 | 7.3 智能代理 | p.212–219 | 12.9k |
| 11 | 7.4 多模态大模型 | p.220–228 | 11.4k |
| 12 | 7.5 大语言模型推理优化 | p.229–235 | 9.2k |
| 13 | 8.1 模型评估概述 | p.236–237 | 1.7k |
| 14 | 8.2 大语言模型评估体系 | p.238–249 | 15.2k |
| 15 | 8.3 大语言模型评估方法 | p.250–263 | 22.3k |
| 16 | 8.4 大语言模型评估实践 | p.264–298 | 61.2k |
我们自己的读书笔记(0 篇)
(还没有。读完某章后写进 docs/da-gui-mo-yu-yan-mo-xing/notes/,那才是这本书对我们的产出。)
本页由 node scripts/book-build.mjs 生成:表格来自转码结果,散文来自书卡正文。不要手改本页。