AI 日报hiw3c.com

Nature:AI重生到1900,这一世抢先爱因斯坦提出光量子

量子位 www.qbitai.com 网页快照

Nature:AI重生到1900,这一世抢先爱因斯坦提出光量子

文婷 发自 凹非寺 量子位 | 公众号QbitAI

如果把AI送回1911年,只让它掌握爱因斯坦所能了解的知识,AI能否在4年后的1915提出相对论?

这个听起来有些离谱的测验,来自诺奖得主、Google DeepMind联合创始人 哈萨比斯 。

哈萨比斯真正想考的,是AI能不能仅以1911年的知识水平,直面当时的知识和物理难题,自己提出一套新的解释框架,并完成一套超出训练材料的推理,而不是只会照着答案复读。

而这个设想最巧妙的地方就在于,科学史已经告诉我们发生了什么,只要我们能把知识节点控制好,就有机会对照着历史,观察模型有没有获得超越训练数据的推理能力。

今年3月,独立研究者Michael Hla把知识截止时间进一步提前到1900年,并从零训练了一个历史语言模型 GPT-1900 ,试图让它重新发现光量子、狭义相对论和广义相对论。

实验中,GPT-1900竟然吐出了一段跟爱因斯坦1905年论文 高度相似 的论述:

因为GPT-1900在大多数物理任务上都失败了,其亮眼回答也高度依赖人类整理好的问题和提示,就连那个号称封闭在1900年的知识世界,也没有完全挡住现代AI的影响。

Nature在最新研究中梳理了这些尝试,并指向了一个比“AI有没有答对”更难的问题:

Michael Hla将自己的项目命名为 Machina Mirabilis 。

1905年,26岁的爱因斯坦接连发表4篇改变物理学的论文,涉及光量子、布朗运动、狭义相对论和质能关系。

这个爆发式产出的一年,后来被称为“Annus Mirabilis”,即“奇迹年”。

Hla想知道:如果一个AI拥有爱因斯坦当时能够接触到的知识,它能不能也迎来自己的“奇迹时刻”?

为此,他借助Andrej Karpathy的nanochat训练框架,从零训练了一个 33亿参数 的Transformer语言模型,并将其称为 GPT-1900 。

模型的主要预训练材料来自1900年以前的书籍和报纸, 总计约220亿token 。

为了增强它的研究能力,Hla又收集了2600多部历史物理书籍、期刊和科学著作,包括牛顿的《光学》、麦克斯韦和法拉第的相关著作,形成了约 2.9亿token 的历史物理语料。

如果一份文献中出现“爱因斯坦”“量子力学”“相对论”等现代概念,整份文献都会被删除。现代人添加的前言、脚注,以及明显不属于1900年前的词汇,同样需要被过滤。

这确实挺神似爱因斯坦“能量一份份传递”的解释,Hla也把它形容为 “直觉的闪现” 。

它在大多数物理任务上都翻车了,而那些看似突破的回答,可能只是模型在拼接合理的词句,谈不上形成了真正可靠的物理理解。

更何况,在整个测试里,Hla已经替它筛好了现象、理好了矛盾,模型要做的,只是找出哪项假设可能出错,并给出解释。

Hla虽给这个“1900年的大脑”做了数据清洗,实验过程中却仍借助了现代AI Claude 的帮助——用Claude Sonnet 4、Claude 3 Haiku等模型生成指令问答,强化学习也靠现代模型评分。

这意味着,Hla虽然过滤了其中涉及现代知识的内容,但这座“1900年的房间”也没有完全隔绝现代知识。

实验者自己也在日志中承认: 现代模型的介入,让这场实验的“零污染”人设有点立不住了…

Google DeepMind研究员Tom Zahavy在一篇题为《LLM无法跳跃》的立场论文中,把科学推理分成了三个层次。

Zahavy认为,当前的大模型已经非常擅长归纳,也在迅速提高演绎能力,但仍缺少爱因斯坦式的“溯因飞跃”。

无独有偶,Sendhil Mullainathan研究一个学习行星轨道的基础模型时,也撞见了同样的现象:

在设定好的行星轨道任务里,模型预测得头头是道;一换新场景,就没法举一反三地运用牛顿力学了。

它更像是给每套数据临时拼出一套规则,还分不清哪些理论真正正确、值得检验,哪些只是碰巧符合眼前的数据。

这就好比一个学生背下了所有历年真题的答案,但却始终没有学会题目背后的底层原理,于是,老师稍微改个数字,他就不会做了。

MIT计算机科学家Jacob Andreas 则一针见血地指出,AI产生一套相对论式表述本身可能并不是最困难的部分,真正困难的是 它能不能判断哪些理论是正确的,或者至少值得被实验检验?

毕竟会生成理论只是第一步,知道哪个理论值得赌上时间、经费和职业生涯,才可能让AI成为一名真正的科学家。

怎么判断一个想法值不值得深挖、又如何评估它的重要性;这才是AI与人类专家最大的分水岭。

或许未来有一天,随着科技的发展,AI真的能通过“爱因斯坦测试”,推导出相对论级别的成果;

在没人替它划重点时,它照样能自己找到那个值得追问的问题、判断问题的价值并主动验证和修正。

参考链接: [1] https://www.nature.com/articles/d41586-026-02804-x?utm_source=x&utm_medium=social&utm_campaign=nature&linkId=63673104 [2] https://michaelhla.com/blog/machina-mirabilis.html [3] https://github.com/michaelhla/gpt1900/blob/master/PROJECT_LOG.md#4-instruction-data-generation [4] https://www.tomzahavy.com/files/llms-cant-jump.pdf [5] https://arxiv.org/abs/2507.06952 [6] https://x.com/Nature/status/2099077628900565498

马斯克批量收购破产公司ing…世界首富脑子是不一样 2026-09-19

27B模型分分钟交付网页,Qwen 3.8还是太能了 2026-09-19

刚刚,能预测多智能体交互的世界模型来了 2026-09-09

相关阅读

论文像素级抄袭、网课骗钱,AI网红老师Siraj遭行业大牛抵制,Jeff Dean:已取关

从辅助驾驶到无人驾驶出租车,Mobileye展现技术与商业化双重实力

腾讯WorkBuddy联名硬件来了!首批100多家伙伴入场

鹅厂机器狗花式穿越10m梅花桩:前空翻、单桩跳、起身作揖...全程不打一个趔趄

你天天刷的小红书,正在长出一个GitHub

1000个Agent圈地模拟人类社会,北大校友创业AI版「我的世界」

热门文章

首届蚂蚁灵波具身大模型挑战赛正式启动

AI开始改进“改进自己的方法”,RSI进入平方时代丨MetaRSI

端侧AI从「能跑」到「会进化」,元空智能跑进惠普预装

中国物理AI大突破:PhysBrain 1.5登顶全球开源榜一,空间智能与GPT-6 Astra并驾齐驱

智谱提前剧透下一代GLM:完全自训练方法公开了

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1