1918年的夏天,奥地利的炮兵军官路德维希·维特根斯坦在意大利战线的炮火间隙中,写下了一本不足三万字的哲学作品。这个手稿伴随他在战场上不断移动;同年11月,他在南蒂罗尔被意大利军队俘获,送入卡西诺战俘营。在著名经济学家约翰·梅纳德的调解下,维特根斯坦得以在营中与外界通信,将手稿寄给了他的导师罗素,同时留下了这样一句话:这些问题在本质上已得到解决。这本书便是《逻辑哲学论》。罗素在战前就称赞维特根斯坦是“完美的天才典范”,而维特根斯坦在序言中的自信表达,读起来依然引人注目:我相信自己已经在本质上解决了所有这些问题。如果我没搞错,这本书的第二个价值在于,指出在这些问题得到解决后,我们所取得的成就却是多么微不足道。——维也纳,1918年。 维特根斯坦果然言出必行,完成这部著作后,他放弃了当时欧洲最大的私人遗产之一,前往奥地利乡村当小学教师,接着当了修道院的园丁,并为姐姐设计了一座被誉为现代主义经典的建筑。他认为哲学已经结束,理应去从事别的事情。 十年后,维特根斯坦改变了主意。1929年1月,他重返剑桥。当日,搭乘同一列火车的凯恩斯给妻子莉迪娅写道:上帝来了,我在5点15分的火车上遇见了他。他打算长时间住在剑桥。虽然这让我感到疲惫可能会是毁灭性的,但我无法让他每天和我多说话超过两三个小时。剑桥时刻意识到这是何等人物。凯恩斯不愿轻率地用“天才”一词,他直截了当地说:上帝来了。本文的标题正是源自这条信息,因为一百年后,另一群人正把这句玩笑当真。然而这一次,“上帝”不再乘坐5点15分的火车,而是在计算系统中自我进化。 经历了一百多年的时间,自《逻辑哲学论》问世以来,位于旧金山的两家实验室每隔几个月便推出新的旗舰模型,传达着同一信念:通用智能是一个可以解决的工程问题。其中一家将其最终目标明确地写在每一份宣传材料中,而另一家则将“人类”(anthropos)一词融入了它的名字。本文核心思想是:Anthropic与OpenAI这两家公司的秘辛,早已在1921年出版的那本哲学小书中预示。 这并非毫无根据,把《逻辑哲学论》的七组命题逐一剖析后,你会发现它提供了一份大模型的全面技术规格说明,涵盖了世界观、学习原理、生成机制、架构定义、失败模式(幻觉)、安全机制(对齐),甚至终极警告,样样俱全。1918年那位炮兵军官所绘制的蓝图,如今在2020年代被这两家组织默默地执行着。 首先,给出对照表的框架,本文将按照大模型的技术栈,从底层向上推进——包含语料、嵌入、生成、预测、架构、规模和对齐七个关键词逐一解构;当我们走到第七部分时,前六部分将汇聚成一个概念:智能涌现。 通过《逻辑哲学论》与大语言模型的对应图表,我们看到1921年的哲学与当今技术之间存在共通之处。七级阶梯上,命题1到6逐级攀升,而命题7则在无言中涌现。看完这份表,你将意识到一件更为令人不安的事情:这本书不仅揭示了大模型为何能成功的原因,还预示了其潜在的问题。因为其作者维特根斯坦,正是首个“运行”起这套系统的人,并最终遭其反噬。 在数据(Data)方面,维特根斯坦指出,世界是事实的集合。“数据是新石油”的说法在过去十年中流传开来,但很少有人探讨:为什么文本能催生智能?为什么将人类所写的内容输入到机器中,其结果并不是数据库,而是近乎理解的输出?答案的基石便奠基于1918年。他在书中第一组命题中写道:1 世界是一切发生的事情。1.1 世界是事实的总和,而不是事物的总和。这一表述在当时标志着哲学史上的重大变革。此前两千年,西方哲学关注的是“事物是什么”:实体、本质、共相,但维特根斯坦纠正了这一方向。他认为世界的基本单位并非物体,而是事实——不是“苹果”,而是“苹果在桌上”。 一个多世纪后,这一转变在技术现实中得到了验证。大模型的训练过程正是学习事实,而非单纯的名词本质,它学习的是词与词在真实语言环境中的组合、共现和相互排斥,语言学家称之为分布式语义:一个词的意义由其所在的全部句子决定。为了更加明确,《逻辑哲学论》中提到:2.011 物能够成为事态的构成部分,这是物的本质所在。2.012 在逻辑中没有偶然的事物:如果物能出现在事态中,那么这种可能性必定隐含于物自身之中。 换句话说,孤立的意义并不存在,只有在关系中才能找到意义。这也解释了为何模型可以在完全不接触实物的情况下,仅通过文本就学会“理解”世界,因为文本不是物体的简单列表,而是对事实的全面记录。维特根斯坦在4.26中将这一观点推向极致:4.26 给出所有真实的基本命题,就得到了世界的完整描述。请再读一遍这句话。“所有真命题的完整陈述,就是对世界的完整描述。”——这正是对预训练理论的明确定义。大模型公司的训练流程,本质上就是一个将人类记录的事实尽可能地呈现给机器的过程。