一次只添加一个词 — 生成到底是怎么发生的
这一章讲三件事: 你看到字一个个冒出来时,它在重复什么动作; 那些「可能性」是从哪儿来的;以及为什么这件事只能靠「算」,不能靠「查」。 读完你会拿到全书的第一条推理链——这条链后面六章都在往下接。 不需要任何基础,遇到的生词都在当场解释。
1. 先看现象:字是一个一个蹦出来的
你用它的时候,回答不是「唰」地整段出现,而是一个字一个字往外冒。
那不是动画效果,那就是它真实的工作节奏。
它在反复回答同一个问题:
「照目前这段文字,下一个词该是什么?」 问一次,写一个词,把加长后的文字再喂回去,重新问一遍。
没有「先构思、再打草稿、最后润色」这样的阶段。每一步它都现算一张清单: 哪些词可能接在后面,各自的可能性有多大。然后挑一个接上去,再算下一张1。
你输入:「今天天气」
│
├─ 算一张清单 → 很好 40% / 不错 25% / 怎么样 15% / 预报 5% / …
│ 挑中「很好」,接上去
▼
现在是:「今天天气很好」
│
├─ 再算一张清单 →(从头再来一遍)
▼
……一直到它算出「该停了」为止
图说:每一步都是独立的一次计算,前一步的清单算完就丢掉了。
**这四个百分比是为演示编的,不是真实数值。**
这张清单是本章的主走查。 下面每一节都会回到它: 第 2 节看它上面那些「词」到底是什么单位,第 3 节看怎么从它里面挑, 第 5 节看它是从哪儿来的。
一句要记住的话:它追求的是「像」,不是「对」
书里对「该接什么」给的定义,值得原样记住:看过海量人类写的文字之后, 人们大概率会接着这么写2