IT 论文精读 · PAPER 35
Vannevar Bush · The Atlantic Monthly · 1945
你现在点一下网页上的蓝字就跳到相关内容,随手把一串有用的资料收藏成一个夹子——这套「点一下就跳到相关的东西」的想法,早在 1945 年就被一个美国科学家 Vannevar Bush 想清楚了,写在一篇叫《As We May Think》(诚如所思)的文章里。那时既没有个人电脑,也没有互联网。他设想了一台叫 Memex 的桌子,一台「记忆的延伸机」。
二战刚打完,人类的知识正以吓人的速度膨胀——书越出越多、论文越堆越高。可 Bush 注意到一件憋屈的事:东西越多,你要找的那一条反而越难找到。更糟的是,很多重要发现明明已经发表了,却很快被埋进书海、再没人翻得到。问题不是我们产得太少,而是存进去容易、找出来难、把相关的连起来更难——找信息的办法,还跟几百年前一个样。
Bush 说,先把「装得下」解决掉:靠当时最先进的微缩胶片(把书页拍成极小的照片),他预言整套大英百科全书能缩到一个火柴盒大小。于是 Memex 这张桌子,理论上能装下你一辈子读的所有书和记的所有笔记,随手一调就投到桌面的屏幕上。但这还不是真正的新想法——真正的新想法是怎么把它们连起来。
Bush 盯着图书馆的归档方式发现了毛病:书都是按字母、按分类号一层层往下摆的(先大类、再小类、再小小类),找一本书得像爬树一样从上往下找,而且一本书只能待在一个格子里。可他说,人脑根本不这么想事——人脑靠「联想」:想到一件事,脑子啪地就蹦到相关的另一件事上。
那机器为什么不能也这样?于是 Memex 的灵魂机制来了:让你随时把任意两条资料「拴」在一起——看着 A 资料,按个钮,机器立刻把当初拴在一起的 B 资料调出来。你把一串相关的东西一条条拴接下去,就织成了一条「小径」(trail):它可以起个名字、存下来,日后整条重走一遍,甚至整条复制给朋友。这,就是今天超链接、收藏夹、乃至知识图谱的老祖宗。
后来发明鼠标、做出第一批超文本系统的那批人(Douglas Engelbart、Ted Nelson)都公开说:是读了这篇文章受的启发。这条「点一下跳到相关内容」的血脉,一路长大,最后就变成了我们天天在用的万维网。一篇没有一个公式、连一台机器都没造出来的文章,却画出了半个世纪后整个信息世界的样子。
1945 年 Bush 就想到:与其像图书馆那样把知识按分类死摆、一条只能归一处,不如让人像大脑联想那样,把相关资料随手两两「拴」起来、串成能命名能分享的「小径」——这就是超链接和万维网的思想源头。(不过 Memex 是胶片机械的、从没真造出来,那些「小径」还得你自己一条条手动拴;后来真正让海量信息可找的,是自动搜索引擎,不是手工小径。)
想看 Memex 桌子的结构图、联想小径怎么运作、以及它到底预言中了什么? → 切到精读版
1945 年,Vannevar Bush 在《大西洋月刊》发表《As We May Think》,面对二战后爆炸式增长的科学文献,提出用一台叫 Memex 的个人设备把海量记录压缩存下,并靠联想式索引(associative indexing)把资料两两相连、串成可命名、可保存、可分享的「小径(trail)」——用机器模仿人脑的联想方式来组织和检索知识。它没有一行数学、也从没造出任何机器,却预言了超文本、超链接与个人计算,是信息科学与万维网公认的思想源头。
作者 Vannevar Bush 是 MIT 教授、工程师,早年造过模拟计算机「微分分析仪(differential analyzer)」;二战期间任 OSRD 主任,统筹约六千名科学家的军事科研(曼哈顿计划亦在其协调之下)。这篇文章 1945 年 7 月刊于《大西洋月刊》(同年 9 月《Life》杂志配插图重刊,流传更广)。它上承 Bush 对「信息过载」的长年忧虑,下启 Douglas Engelbart(增强人类智力、鼠标、超文本系统)、Ted Nelson(造出 hypertext 一词、Xanadu 计划),乃至 Tim Berners-Lee 的万维网。这不是一篇实验论文,而是一篇奠基性的构想(vision)。
二战即将结束,Bush 抛出一个问题:动员起来打赢战争的这批科学家,和平时期该把力气转向哪里?他的答案是——让不断膨胀的人类知识重新变得「可用」。他写道,人类经验的总和正以惊人速度扩张,可我们穿过由此形成的迷宫、去够到那一条当下要紧资料的手段,还「跟帆船时代用的一样」。
他点出两层病。表层是量的爆炸与专业化:文献多到任何一个研究者都被成千上万同行的成果压垮,重要结论常常一发表就被埋没、再难被后人找到——不是没产出,而是产出够不着。而更深的病根,在归档方式本身:我们把资料按字母、按数字层层分类存放,找的时候得从大类往小类一级级追下去。Bush 认为这套人为的层级体系与人脑的运作方式南辕北辙,检索之难,一半是它造成的。真正的瓶颈,从来不是「存不存得下」,而是「找不找得到、连不连得起」。
Bush 先押注摄影 / 微缩技术会带来惊人的压缩——他预言「整套大英百科全书可缩到火柴盒大小,一座百万卷的图书馆能塞进书桌的一角」。有了密度,才谈得上把一个人一生要读的东西都随身带着。
Memex(这名字是他「随手取的」,后世常读作 memory + index,即「记忆的延伸」)就是这样一台设备:外形是一张书桌,桌面斜置几块半透明屏幕把内容投出来阅读,配一个键盘、几排按钮和拉杆;桌子内部是微缩胶片库。绝大部分内容以现成胶片买来插入,用户也能用一种「干版摄影」把自己的手写笔记、照片直接拍进胶片里。Bush 把它定义为「一个人记忆的放大与私密补充」——不是公共图书馆,而是属于你个人的、你亲手长年经营的知识库。这正是后来「个人计算机」概念的雏形。
Memex 的灵魂不是「存得多」,而是连接的方式。Bush 尖锐地批评一切按字母 / 数字的层级归档「人为造作」:找一条资料得从大类往小类一层层追,更要命的是,一条资料同一时刻只能归进一个格子——可现实里一份材料往往牵连好几个主题。他给出那句被反复引用的判断:「人脑不是这样工作的,它靠联想运转」——抓住一条,就顺着脑中某张错综的联想之网,瞬间蹦到下一条。
于是 Memex 的核心特性是 associative indexing(联想式索引):让用户把任意两条资料「拴」在一起,此后看其中一条时,按一个钮就自动带出另一条。把一串相关资料一条接一条地拴下去,就织成一条 trail(小径)——它可命名、可保存,日后能像走一条自己修的路一样整条重走,还能整条复制、分享给别人的 Memex。Bush 举的例子是:为弄清「为何十字军东征中土耳其弓占优」,他把力学原理、材料弹性、历史记载等资料一条条拴成一条小径,随时可回看、可续接。
因为检索的真正难点,不在「存不存得下」,而在「资料该按什么关系连起来」。层级归档强迫每条资料只归一处,还要求你预先知道它被分在哪一类才找得到;联想小径反过来,让资料按「你实际怎么用它、它和什么有关」自由互连,并把这份「连接的智力劳动」固化下来、重复使用、传给他人——想过一次的思路不必重想。由此 Bush 顺势预言了两件事:会出现「天生就织满联想小径」的新型百科全书;还会出现一种新职业——trailblazer(拓径者),专门在浩瀚的公共记录里开辟出有用的小径供人取用。
必须诚实:这不是一篇有实验、有数据、有基线对照的论文——它是一篇构想,没有一台机器被造出、没有一个指标被测量。它的「结果」只能用预言的命中率来衡量:微缩压缩存储、语音转文字(他描绘过一台「听人说话就打字」的机器)、可穿戴的「独眼相机」、能处理符号逻辑的计算机器,以及最要紧的——联想链接与个人知识库。这些设想在此后半个世纪里逐一被不同技术兑现。评判它是否成功,靠的不是它测出了什么,而是后来者是否沿着它指的方向走出了真东西。
它是信息科学(information science)的奠基文本之一,其影响是通过一串关键人物「接力」实现的。Douglas Engelbart 在战后读到重刊的它,深受触动,据此开创「增强人类智力(augmenting human intellect)」研究,做出鼠标、屏幕编辑与超文本系统 NLS,1968 年那场「所有演示之母(Mother of All Demos)」几乎就是 Memex 的活体演示。Ted Nelson 于 1960 年代造出 hypertext(超文本) 一词、发起 Xanadu 计划,公开尊 Bush 为思想源头。这条「点一下就跳到相关内容」的血脉,最终在 Tim Berners-Lee 的万维网里落地为超链接。今天你每点一次链接、每存一个收藏夹、每看一张知识图谱,都是 Memex「小径」的回声。
① 一句话:1945 年 Bush 提出用个人设备 Memex 把海量记录压缩存下,靠「联想式索引」把资料串成可命名可分享的「小径」——超文本与万维网的思想源头。
② 痛点:二战后知识爆炸,存进去容易、找出来难、连起来更难;层级归档「一条资料只归一处、要逐层追」,与人脑的联想方式南辕北辙。
③ 核心机制:让用户把任意两条资料「拴」在一起,看其一按钮自动带出另一条;一串拴接成 trail(小径),可命名、可保存、可整条重走与分享。
④ 为什么这样设计:检索的难点是「按什么关系连」,不是「存不存得下」;小径把「连接的智力劳动」固化下来重复使用、传给他人。
⑤ 配套设想:微缩压缩(大英百科缩到火柴盒)、Memex 桌(屏幕+键盘+胶片库+干版摄影台)、语音转文字、可穿戴相机、拓径者职业。
⑥ 结果的性质:无实验无数据,是一篇构想;靠「预言命中率」评判,多数设想此后逐一被兑现。
⑦ 影响:经 Engelbart(鼠标、NLS、1968 演示)、Ted Nelson(造出 hypertext 一词、Xanadu)接力,最终在 Berners-Lee 的万维网落地为超链接。
⑧ 局限:押错媒介(胶片模拟而非数字)、小径全手工无自动搜索、无网络概念、Web 未兑现其双向链接、终究是构想而非工程。