跳到主要内容

感知机 — 第一台「自己学会认东西」的机器

这一章讲三件事: 1958 年那台机器到底做了什么、它「学习」的动作具体是哪一步; 为什么它的发明者反而成了最早给这项技术泼冷水的人; 以及反对者明斯基是谁——他的反对将在第二章直接决定这门技术此后十几年的命运。 这一章是整本书的起点:后面所有人物(辛顿、杨立昆、萨特斯基弗)追的东西,都是这台机器的直系后代。

1. 顶层全景:先看它做了什么

1958 年 7 月 7 日,华盛顿特区,美国国家气象局的一台大计算机旁。这台平时算天气预报的机器 价值 200 万美元,被租给了海军和一位 29 岁的康奈尔大学教授弗兰克·罗森布拉特1

演示很简单:喂给它两张卡片,一张的方块画在左边,一张画在右边。起初它分不出; 再看 50 张新卡片之后,它几乎每张都能答对——方块在左还是在右2

没有人告诉它「左边」长什么样。它是从对错反馈里自己调出来的。 罗森布拉特给这套东西起名感知机——最早的「神经网络」之一, 也就是 54 年后辛顿以 4,400 万美元卖掉的那项技术的直系祖先3

第二天的《纽约时报》把调门拉到了天上:海军展示了一台电子计算机原型, 预期未来它可以「走、说、看、写、自我复制,并意识到自身的存在」4

记住这个句式。技术在起点,标题在终点——这个落差会在 1969 年反噬这门技术, 在 2012 年成全它,在 2016 年再度掀翻整个行业。原书讲的就是这部循环史。

2. 核心机制:它「学习」的那一步到底是什么

解决什么问题: 让机器认出一个图案(比如「字母 A」),传统做法是工程师写死规则—— 「左上有一撇、中间有一横就是 A」。但手写体千变万化,规则永远写不全。 罗森布拉特的办法是:不写规则,让机器自己把规则试出来

怎么做: 以 1960 年建成的实体机器马克一号为例5。它的「眼睛」是一台照相机, 里面 400 个能感光的点,每个点对着纸板画面的一小块区域:

纸板:A ┌─┐ 照相机 400 个感光点,一个点管一小块
└─┘ │

每个点带一个「权重」= 这个点说的话算几分
例(编的数):左下角点 权重 8,右上角点 权重 1


判断 = 把「发黑的点」的权重全加起来,过线就算 A

这里的权重是第一个承重词:它是「一个输入说了算几分」的数。 同一个字母 A,不同写法发黑的位置不同;权重就是机器记录「哪些位置更像是 A 的特征(认出 A 要靠的那些记号)」的方式6

学习 = 调权重。 一次识别之后,由旁边的技术员告诉它对还是错; 错了,就把相关点的权重挪一挪,下次让对的那批点「说话更有分量」7。 罗森布拉特有个证明这是学出来的狠招:当众拔掉机柜里几根电线,把人造神经元之间的连接断开, 机器立刻变笨;再喂一批卡片重新学习,它又恢复了水准8

为什么有效: 因为它把「认 A」从「背答案」换成了「调判据」。答案有无穷多种写法, 而判据只是一组可以一点点小调的数——改判据的成本低到可以重复几万次,这就是「学习」在这台机器里的全部含义。 今天的大模型动辄几千亿个权重,动作和 1958 年是同一个:看错题、挪数字。

边界在哪: 罗森布拉特自己当场承认:这套东西「缺乏深度感知和判断力的完善」, 离实际应用还很远9。马克一号只能认印刷体大写字母,手写体就不行10。 更根本的天花板在结构上——它只有一层权重,这一层能凑出的判据有限。 这个天花板由谁来捅破、什么时候捅破,是第 02、03 章的主线。

3. 一个反讽:最早泼冷水的正是发明人本人

原书在这里埋了全书第一个重要判断:这项技术的第一次形象危机,不是对手造成的,是媒体造成的。

  • 俄克拉何马州一篇报道的标题叫「海军设计的会思考的科学怪物」,罗森布拉特对此越来越反感11;
  • 四年后他在专著里正式改口:这个项目「主要关注的不是发明『人工智能』设备, 而是研究『自然智能』背后的物理结构」——他要的是用机器理解大脑,不是造一个新大脑12;
  • 被问到感知机有什么做不到时,他举着双手说:「爱,希望,绝望。简言之,就是人性。」13

这个改口非常重要,但要读准: 他说的是「我的研究目的不是 AI」, 不是「这技术没用」。原书特别指出,把夸张预期按在感知机头上的, 是那批「像一群快乐的猎犬」的记者14。从此这门技术背上了原罪: 每次它还没兑现,公众就已被许诺过了。 两次「AI 寒冬」的燃料都是这个落差(第 02、03 章)。

4. 对手登场:明斯基与「另一条路」

明斯基是谁: 与罗森布拉特同一年从布朗克斯科学高中毕业15, 哈佛读书期间用 3,000 多根真空管搭过一台可能是史上第一个神经网络的机器 SNARC16—— 他本来就出身这门技术,后来却转向了别的路。1956 年夏天, 他和麦卡锡、西蒙、纽厄尔等人在达特茅斯组织会议,给这个领域起了名字:「人工智能」17。 这批人的纲领后来被称为符号人工智能:不模仿大脑,由工程师一条一条写下规则, 穷举机器可能遇到的所有情况18。其登峰造极之作是 80 年代的 Cyc 项目—— 一个小组在得克萨斯每天记录「你不能同时出现在两个地方」这类常识,打算记上几十年19

两条路线的分野,一句话说清:

感知机这一派(后来的连接主义)符号人工智能这一派
知识从哪来从数据里自己调权重工程师手工写规则
强项图案、感知这类「说得清却写不成规则」的事推理(从规则一步步推出结论)、逻辑这类「规则明确」的事
弱点当时只能干很简单的事规则永远写不完

原书点明:明斯基后来反对神经网络,掺杂着经费竞争的现实理由—— 麻省理工学院和斯坦福研究所、康奈尔航空实验室抢的是同一批政府经费20

5. 作者的判断与证据

书里给了证据的:

  • 感知机确实从错误中改进:50 张卡片的演示、拔电线再学、邮政与空军的合同意向,都是当时记录在案的事实21;
  • 罗森布拉特确实主动降调:他的专著原文和 1962 年的表态被原书直接引用22;
  • 明斯基的攻击确实有公开展示现场:1966 年圣胡安会议上他站起来问发言的年轻科学家 「像你这样聪明的年轻人,怎么能把时间浪费在这种事情上呢?」,并断言「这是一个没有未来的想法」23

作者(或当事人)的推测,要分开:

  • 「很多人认为《感知机》一本书关闭了这个想法 15 年」——原书用的是「很多人认为」, 这是圈子里的归因,不是可以严格证明的因果24;
  • 明斯基的真实立场可能没那么绝:辛顿评价他是「失落的神经网络追随者」—— 幻想破灭但并未死心(这个判断在第 02 章还有一次呼应)25

6. 边界与局限

  • 本章(和原书这一章)没有讲清「调权重」的数学。 为什么「把权重挪一挪」一定能挪向更对? 这个问题要等第 02 章的反向传播才有答案;1958 年的感知机用的调法只对单层结构成立;
  • 1969 年那个「证明」证明的是什么,本章只开个头。 原书把它放在明斯基与佩珀特的 《感知机》一书里,它精确打击的只是「单层网络」,而罗森布拉特本人研究过多层方案—— 这段公案的对错细节,第 02 章展开;
  • 原书是记者写的历史,不是技术评估。 感知机的能力边界(比如它到底能不能学会 「左侧 vs 右侧」以外的任务)在原书里只有轶事证据,没有系统数据。

7. 可带走的

  1. 「学习」= 从错误反馈里调整内部数值(权重),不是背答案。 这是 1958 年就定下的动作,今天没变;
  2. 感知机是「给输入打分量、按分量总和做判断」:每个感光点有一个权重,发黑就计入;
  3. 「拔掉电线重新学会」是学习最硬的现场证明——能力在被破坏后靠数据重建;
  4. 这门技术的第一次寒冬,燃料是媒体预期与现实能力的落差,点火的是同行反对;
  5. 罗森布拉特本人最早降调:他的目标是理解大脑,不是宣称造出 AI——引用这本书时别把记者的标题当成科学家的主张;
  6. 符号人工智能与连接主义的分野:写规则 vs 调权重;这个分野决定了此后 60 年每一轮路线之争;
  7. 明斯基的反对从一开始就不纯是学术的——经费在同一口锅里。

8. 原文地图

主题原书章原文位置
1958 演示、200 万美元机器、50 张卡片01 感知机text/02-p21-40.txt:317(搜「价值 200 万美元」) · text/02-p21-40.txt:325(搜「50 张卡片」)
《纽约时报》标题01 感知机text/02-p21-40.txt:339(搜「自我复制」)
「会思考的科学怪物」与罗森布拉特反感01 感知机text/02-p21-40.txt:308(搜「会思考的科学怪物」)
感知机=直系祖先01 感知机text/02-p21-40.txt:349(搜「早期化身」)
马克一号:6 机柜、400 光电管、技术员报对错01 感知机text/02-p21-40.txt:430(搜「马克一号」) · text/02-p21-40.txt:441(搜「告诉机器它是对的还是错的」)
权重机制(黑点多→高权重→判为 A)01 感知机text/03-p41-60.txt:15(搜「高的权重」)
拔电线再学01 感知机text/02-p21-40.txt:444(搜「拉出几根」) · text/03-p41-60.txt:2(搜「重新学习了同样的技能」)
「爱,希望,绝望」;「缺乏深度感知」01 感知机text/02-p21-40.txt:415(搜「爱,希望,绝望」) · text/02-p21-40.txt:411(搜「判断力的完善」)
四年后改口、骂记者像猎犬01 感知机text/03-p41-60.txt:76(搜「快乐的猎犬」) · text/03-p41-60.txt:84(搜「自然智能」)
手写体不行、邮政空军合同01 感知机text/03-p41-60.txt:19(搜「不规则的手写字母」) · text/03-p41-60.txt:8(搜「邮政部门」)
明斯基:SNARC、达特茅斯起名01 感知机text/03-p41-60.txt:42(搜「SNARC」) · text/03-p41-60.txt:37(搜「人工智能」)
圣胡安会议攻击、经费竞争01 感知机text/03-p41-60.txt:122(搜「怎么能把时间浪费在这」) · text/03-p41-60.txt:140(搜「政府研究经费」)
符号 AI、Cyc、记常识01 感知机text/03-p41-60.txt:175(搜「符号人工智能」) · text/03-p41-60.txt:184(搜「两个地方」)
罗森布拉特之死01 感知机text/03-p41-60.txt:201(搜「帆船事故」)

Footnotes

  1. 出处:「01 感知机:最早的神经网络之一」第 317 段(text/02-p21-40.txt:317,搜「价值 200 万美元」)。机器平时承担气象局的计算工作,演示日租给海军;罗森布拉特时年 29 岁。

  2. 出处:同章(text/02-p21-40.txt:323,搜「左边标记了一个小方」与 text/02-p21-40.txt:325,搜「50 张卡片」)。演示是两张卡片区分左右,50 张学习后「几乎每一次」正确。

  3. 出处:同章(text/02-p21-40.txt:349,搜「早期化身」)。原书原话:感知机是辛顿 50 多年后拍卖给最高报价者的技术的早期化身。

  4. 出处:同章(text/02-p21-40.txt:339,搜「自我复制」)。《纽约时报》1958-07-08 报道。

  5. 出处:同章(text/02-p21-40.txt:430,搜「马克一号」)。1960 年完成,占 6 个冰箱大小的电气设备架,「照相机」上覆盖 400 个光电管。

  6. 出处:同章(text/03-p41-60.txt:15,搜「高的权重」)。原文:某点发黑多于发白,就分给高权重,它在计算中发挥更重要作用;多数高权重点发黑即判为 A。本节「权重 8/权重 1」为演示编的数。

  7. 出处:同章(text/02-p21-40.txt:441,搜「告诉机器它是对的还是错的」)。技术员告知对错,机器据此继续学习。

  8. 出处:同章(text/02-p21-40.txt:444,搜「拉出几根」)与(text/03-p41-60.txt:2,搜「重新学习了同样的技能」)。断线后识别费力,重学后恢复。

  9. 出处:同章(text/02-p21-40.txt:411,搜「判断力的完善」)。罗森布拉特承认技术离实际应用还有很长的路。

  10. 出处:同章(text/03-p41-60.txt:19,搜「不规则的手写字母」)。「仅此而已」——不够灵活,认不了手写。

  11. 出处:同章(text/02-p21-40.txt:308,搜「会思考的科学怪物」)。

  12. 出处:同章(text/03-p41-60.txt:84,搜「自然智能」)。专著《神经动力学原理》(1962)里的原话。

  13. 出处:同章(text/02-p21-40.txt:415,搜「爱,希望,绝望」)。

  14. 出处:同章(text/03-p41-60.txt:76,搜「快乐的猎犬」)。

  15. 出处:同章(text/03-p41-60.txt:28,搜「布朗克斯科学高中」)。两人是同期校友。

  16. 出处:同章(text/03-p41-60.txt:42,搜「SNARC」)。哈佛本科时用 3,000 多根真空管加 B-52 轰炸机零件所造。

  17. 出处:同章(text/03-p41-60.txt:46,搜「达特茅斯」)。麦卡锡把「自动机研究」改名为人工智能并组织 1956 年夏会议;与会者还有西蒙、纽厄尔。

  18. 出处:同章(text/03-p41-60.txt:175,搜「符号人工智能」)。按人类工程师制定的离散规则运行,规则穷举每种情况。

  19. 出处:同章(text/03-p41-60.txt:184,搜「两个地方」)。Cyc 项目,奥斯汀,记录「你不能同时出现在两个地方」「喝咖啡时杯口朝上」等常识,预计需要几十年甚至几个世纪。

  20. 出处:同章(text/03-p41-60.txt:140,搜「政府研究经费」)。杜达的判断:明斯基攻击的机构与麻省理工竞争同样经费。

  21. 出处:同章(text/03-p41-60.txt:8,搜「邮政部门」)。SRI 跟进,邮政要读信封地址、空军要识别航拍目标,但都「还很遥远」。

  22. 出处:同章(text/03-p41-60.txt:80,搜「收回了自己早期的说法」)与(text/03-p41-60.txt:76,搜「快乐的猎犬」)。

  23. 出处:同章(text/03-p41-60.txt:122,搜「怎么能把时间浪费在这」)与(text/03-p41-60.txt:130,搜「没有未来的想法」)。

  24. 出处:同章(text/03-p41-60.txt:149,搜「关闭了罗森布拉特的想法之门」)。原文措辞「很多人认为」。

  25. 出处:「02 辛顿与人工智能的第一次寒冬」(text/03-p41-60.txt:252,搜「失落的神经网络追」)。辛顿对明斯基的定性,详见第 02 章拆解。