AI 日报hiw3c.com

OpenAI一夜甩出722篇数学论文!黎曼霍奇BSD全上阵,数学家:读不过来

量子位 www.qbitai.com 网页快照

OpenAI一夜甩出722篇数学论文!黎曼霍奇BSD全上阵,数学家:读不过来

听雨 发自 凹非寺 量子位 | 公众号 QbitAI

这些手稿归成372组结果。据OpenAI介绍,模型此前一共尝试了约4000个研究问题,平均每项结果消耗的算力,约相当于ChatGPT Pro思考3小时。

翻开目录, 准黎曼猜想、霍奇猜想、BSD猜想、π的无理性指数 ……一个比一个名头大。

再往下翻,还有自旋玻璃、量子磁性、自由群因子、相对论性弗拉索夫—麦克斯韦方程……数论、代数几何、理论计算机、统计力学,17个方向铺得满满当当。

722篇手稿里,究竟写了什么?

有的组只有一篇主论文,有的还附了另一种证明、相关推论。除了论文PDF和源码,仓库里还有10份模型推理摘要。

OpenAI给出的结论是: ζ函数和所有狄利克雷L函数,在实部大于7/8的区域都没有零点 。

此前,数学家连「实部大于0.99的一整条竖带里没有零点」都证不出来,已知的无零点区域,只是贴着实部=1的边缘越收越窄。

也就是说,它声称一口气把零点可能出现的范围往中间推了一大截。当然,离黎曼猜想要求的那条1/2直线,还有距离。

而且同组里还不止一份证明。另一份独立证明给出的是实部大于11/12的版本,范围稍窄,但多带了一个结论:一致排除「西格尔零点」。

西格尔零点,指的是某些L函数可能藏在实数1附近的“捣乱零点”。它们是否存在,困扰了数论学家近百年,许多关于素数分布的结果,都得绕开它们写。

这道题的整数版本,1970年就由苏联数学家马季亚谢维奇最终解决;有理数版本却悬了半个多世纪。

OpenAI声称,针对满足Selmer余秩为0或1等条件的椭圆曲线,得到了完整公式;再结合仓库里的另一组结果,按密度统计,可覆盖每条有理数域上椭圆曲线的绝大多数二次扭曲。

这道题关心的是,一类复杂几何空间里看得见的「形状信息」,能否由代数方程定义出的几何对象来解释。

OpenAI这组手稿处理的是两类对象:具有特殊复乘结构的阿贝尔簇,以及K3曲面的乘积。

其中关于复乘阿贝尔簇的论文,声称覆盖了这一类对象的所有维度和余维。不过霍奇猜想涉及的几何空间要广得多,这批论文目前只覆盖上述范围。

另一篇声称证明, 卡塔兰常数是无理数 。π是无理数早有定论;卡塔兰常数究竟是不是无理数,此前一直没有公认的证明。

这个猜想2002年由Khot提出,2018年数学家证明了它的一个弱化版本,完整版一直没拿下。

OpenAI在目录中声称证明了这一猜想,还给出了最大割、顶点覆盖等问题的近似难度结论。

稀疏自旋玻璃的梅扎尔—帕里西公式、量子海森堡铁磁体的自发磁化、自由群因子同构,以及三维单种粒子相对论性弗拉索夫—麦克斯韦方程的整体光滑解,都出现在结果目录里。

值得注意的是,OpenAI表示,平均每项结果消耗的算力约相当于ChatGPT Pro思考3小时。

仓库也交代了:绝大多数结果,都是同一个未发布的内部模型按同一套固定流程跑出来的。

但有两项是例外—— **黎曼ζ函数的无零点区域 ,以及 复乘阿贝尔簇上的霍奇猜想** ,没有完全走这套固定流程。

其中,黎曼ζ函数实部大于11/12的那篇证明,文稿还经过了人工编辑,以便读者阅读。

数学家:No No No!几百篇手稿谁来读啊…

Timothy Gowers 、 Martin Hairer ,以及理论物理学家 Edward Witten 。

他们承认,这是数学界的一件大事。但他们同时表示:顾问组此前给OpenAI提过建议, 不代表他们已经认可这些结果,也不代表他们认可OpenAI产出成果的过程 。

手稿发布前,得克萨斯大学奥斯汀分校数学家 Francesco Maggi 就在社媒上发问:

Maggi的态度很有代表性。他并不反对用AI做数学,但他担心的是,结果产出的速度已经远远超过了人类能理解的速度,数学家只能在后面追着AI跑。

西北大学数学家Bryna Kra等人希望看到写得清楚、能让同行阅读和引用的论文。

部分与会者称,他们当时以为OpenAI不会一次放出所有成果;OpenAI发言人则表示,公司不清楚有过这样的承诺。

当时,NYU数学家Tristan Buckmaster与Anthropic研究员Levent Alpöge公开了三篇流体方程爆破证明,同样配有Lean形式化。

Buckmaster表示,原本想再花时间把证明写得好读一些,最终因外部压力提前发布。

随后,Buckmaster一方与OpenAI围绕研究进度和成果归属起了争执,双方拿出了相近/相同的结果,而OpenAI否认Buckmaster此前使用Codex时的提示词影响了自己的模型。

菲尔兹奖得主 Cédric Villani ,在看到OpenAI拿下千禧难题之一的纳维–斯托克斯方程后,也直接瘫软了。。。

我大受震撼…… 简直跟世界末日一样,这是数学界有史以来从未见过的浩劫。

到了这次发布,OpenAI把论文、部分Lean证明和推理摘要统统放进了仓库,还表示会出资办研讨会,帮助数学界研究这些成果。

顾问组的回应则是:材料公开了,接下来该由数学家检查、讲解,再决定哪些结果真正能进入数学研究。

One More Thing

接下来28天,每天都要给Codex或Work用户带来一项明显改进;哪天没交出来,就重置用户的使用额度。

其中最容易感受到的是 Auto-review :Codex执行长任务时,可以让另一个AI代理检查它准备采取的操作,替用户拦下高风险动作。

参考链接: [1] https://openai.com/index/sharing-ai-progress-in-mathematics/ [2] https://github.com/openai/math [3] https://agmai.org/ [4] https://x.com/thsottiaux/status/2107575657014468879

GPT-6要“吃掉”3D公司?这家公司不到2年ARR翻百倍,破1亿美元 2026-10-04

AI用了一堆、钱没赚到?阿里瓴羊放话:AI员工得直接扛KPI 2026-09-26

GPT-6 Astra搓3D刷屏后,3D生成的竞争规则变了 2026-09-23

在云栖大会,我终于看懂了米哈游千亿AI野心 2026-09-26

相关阅读

ChatGPT修bug横扫全场,准确率达78%!网友:程序员要开心了

OpenAI夺金IOI,但输给3位中国高中生

GPT现状终于有人讲清楚了!OpenAI大牛最新演讲爆火,还得是马斯克钦点的天才

OpenAI收购“我的世界开源版”,GPT-5要在虚拟世界中进化了?

谁是余家辉?“年薪1亿美元”AI研究员,吴永辉的嫡系弟子

谷歌AI获IMO“唯一金牌”,硅谷夹道祝贺,奥特曼丢人又丢人

热门文章

OpenAI推理之父最新访谈!数学只是多智能体时代的开胃菜

Manus 2.0回来了!给AI配手机号和钱包,还能拉群干活

DeepSeek知乎独家发文,首次公开V4.1 Agent训练“大本营”DSec

Anthropic,你是来给智谱打广告的吧!

直播回顾:工业AI的下一个机会在哪?

量子位 QbitAI 版权所有©北京极客伙伴科技有限公司 京ICP备17005886号-1