大模型基础 — 书籍拆解
读到哪:未读。
readState不是 read/partial 的书不能当锚。
| 项 | |
|---|---|
| 作者 | 待填 |
| 版次 | 2024 版 |
| 格式 | pdf | 文本源 pdftotext -layout |
| 许可 | 自购/个人收藏 |
| 来源 | 主人个人藏书,2026-08 放入收件箱 |
| 清洗 | 删页眉页脚 280 行、页码 351 行、断词接回 0 处 |
我们重写的拆解(0 章)
(还没写。拆解是这本书对我们的真正产出——底下的元数据只是索引。)
为什么收它
中文系统教材,和 Happy-LLM 互为对照。
合法性
自购/个人收藏。来源:主人个人藏书,2026-08 放入收件箱。原始文件不入库,转码文本入库(私有库)。
出版方怎么说
(起草参考,不是我们的判断。真正的「覆盖什么/不覆盖什么」写进 frontmatter 的 claims / notCovered)
它覆盖什么、不覆盖什么
(还没读到能下判断的程度。claims / notCovered 空着就是空着,不猜。)
怎么引用它
(依据: book=da-mo-xing-ji-chu §2.3 基于Encoder-only架构的大语言模型)
章节名对不上会被 lab:validate 拦下;页码锚(§p.123)同样可用。
结构(23 段,共 328k 字符)
| 段 | 章节 | 页 | 规模 |
|---|---|---|---|
| 01 | 1 语言模型基础 | p.8–40 | 45.3k |
| 02 | 2.1 大数据+大模型→新智能 | p.41–46 | 7.5k |
| 03 | 2.2 大语言模型架构概览 | p.47–55 | 9.7k |
| 04 | 2.3 基于Encoder-only架构的大语言模型 | p.56–65 | 10.7k |
| 05 | 2.4 基于Encoder-Decoder架构的大语言模型 | p.66–72 | 9.0k |
| 06 | 2.5 基于Decoder-only架构的大语言模型 | p.73–88 | 21.2k |
| 07 | 2.6 非Transformer架构 | p.89–104 | 17.9k |
| 08 | 3.1 Prompt工程简介 | p.105–113 | 9.5k |
| 09 | 3.2 上下文学习 | p.114–121 | 8.1k |
| 10 | 3.3 思维链 | p.122–127 | 8.4k |
| 11 | 3.4 Prompt技巧 | p.128–144 | 16.1k |
| 12 | 3.5 相关应用 | p.145–157 | 20.5k |
| 13 | 4 参数高效微调 | p.158–192 | 38.6k |
| 14 | 5.1 模型编辑简介 | p.193–200 | 7.7k |
| 15 | 5.2 模型编辑经典方法 | p.201–211 | 13.2k |
| 16 | 5.3 附加参数法:T-Patcher | p.212–216 | 4.8k |
| 17 | 5.4 定位编辑法:ROME | p.217–226 | 12.2k |
| 18 | 5.5 模型编辑应用 | p.227–235 | 8.9k |
| 19 | 6.1 检索增强生成简介 | p.236–242 | 6.2k |
| 20 | 6.2 检索增强生成架构 | p.243–250 | 8.6k |
| 21 | 6.3 知识检索 | p.251–262 | 10.5k |
| 22 | 6.4 生成增强 | p.263–277 | 15.6k |
| 23 | 6.5 实践与应用 | p.278–291 | 17.9k |
我们自己的读书笔记(0 篇)
(还没有。读完某章后写进 docs/da-mo-xing-ji-chu/notes/,那才是这本书对我们的产出。)
本页由 node scripts/book-build.mjs 生成:表格来自转码结果,散文来自书卡正文。不要手改本页。