首页 > 资讯 > OpenAI公开722篇数学手稿意味什么

OpenAI公开722篇数学手稿意味什么

头条热榜 2026-10-09 19:55 6 阅读 查看原文

► 文 观察者网心智观察所


OpenAI公开722篇数学手稿意味什么


2026年10月初,没有预先向学术界打招呼,没有经过同行评审期刊漫长的审稿流程,OpenAI直接将722篇由未公开前沿大模型撰写的纯数学研究手稿公之于众。这批手稿被归拢为372个成果族,内容涵盖数论、代数几何、理论计算机科学、流体力学与统计物理等17个前沿领域,甚至直接触碰了3道享誉世界的千禧年数学难题。此前,纯数学向来被视为人类智力皇冠上最坚固的堡垒,需要顶尖学者穷经皓首,才有灵光一闪。然而,AI以极快的运算节奏,一口气将堆积如山的严密证明推到人类学者眼前,在当代科学界引发了一场剧烈的海啸。


沉睡了160多年的数学明珠与那些未解之谜

在纯数学的宏伟大厦里,数论就像基石,而素数的分布规律又是基石中的核心。素数也就是那些只能被1和自身整除的整数,比如2、3、5、7、11等。它们如同数字世界的原子,构成了所有整数,但它们出现的位置看上去却杂乱无章。

1859年,德国数学家黎曼发表了一篇仅8页纸的论文。他定义了一个特殊的复变函数,即著名的黎曼zeta函数,并提出了一个惊人的猜想。黎曼指出,这个函数所有神秘的非平凡零点,其坐标实部的值都精确地落在1条竖直线上,这条线就是实部等于1/2的黄金分割线。如果这个猜想成立,素数在数轴上的分布规律就拥有了极其严密的精确刻画。160多年来,黎曼猜想成为了现代数学王冠上最璀璨的明珠,现代解析数论中有上千条定理都是在假定该猜想成立的前提下建立起来的。

证明极其艰难。一个半世纪以来,全世界最聪明的头脑也没能征服它,数学家至退而求其次去寻找准黎曼猜想,也就是试图证明在实部远离1/2的某个区域里,绝对没有零点存在。此前学界最好的进展,也仅仅是证明了在贴近实部等于1的极狭窄边缘没有零点,而且随着高度上升,这个无零点区域还在不断变窄,数学家甚至无法排除在实部大于0.99的竖直带状区域内存在反常零点的可能。不仅如此,数论领域还游荡着一个被称作西格尔零点的幽灵,某些特殊函数可能在非常靠近1的实数轴上藏有捣乱的零点,这让许多关于素数的经典推导始终悬在半空。

除了黎曼猜想,数学界在2000年由克雷数学研究所评选出了7道千禧年大奖难题,每一道都悬赏100万美元,其中就包括研究复杂几何形状与代数方程关联的霍奇猜想、探索椭圆曲线有理点深层规律的伯奇和斯温纳顿-戴尔猜想,以及描述流体运动本质规律的纳维-斯托克斯方程。这些难题犹如冰川绝壁阻挡了数代先驱的步伐,人类甚至做好了再花几个世纪慢慢攻克它们的准备。


从准黎曼猜想推移到常数破解的数字突围

这次公开的722篇手稿中,最为引人注目的当属编号为第003组的成果,它直接将矛头对准了困扰学界百年的准黎曼猜想。手稿中给出的证明显示,黎曼zeta函数以及所有更广泛的狄利克雷L函数,在实部大于7/8的整个半平面区域内,绝对不存在任何非平凡零点。另一份同组的独立手稿则给出了实部大于11/12的界限证明,并且以非常完备的逻辑彻底排除了一致西格尔零点的存在。

这意味着AI将此前牢牢卡死人类的安全边界向中心硬生生推进了一大步。虽然这距离最终的1/2线仍有一段距离,但在解析数论学者眼中,把无零点区域推进到一个固定的常数边界,并彻底驱逐潜伏在1附近的特殊反常零点,已经是该领域半个世纪以来最具颠覆性的跨越。

惊喜与震动并没有在数论领域止步。编号为第004组的手稿把目标锁定了有理数域上的希尔伯特第10问题。早在1900年,数学大师希尔伯特就提出了一个宏伟设想:能否找到一套通用的机械计算流程,只要输入任意一个多元整数系数多项式方程,就能自动判断它是否存在整数解。1970年,学者们已经证明了整数范围内的通用算法根本不存在。可是,一旦把寻找解的范围放宽到由两个整数相除构成的有理数范围,这个问题就悬置了50多年。这次的论文手稿宣告,在有理数范围内,判断方程解是否存在的通用算法同样在逻辑上绝无可能。

令人拍案叫绝的还有两个看起来极为基础、却让无数大师折戟的数学常数难题。其中一篇手稿证明,圆周率π的无理性指数恰好等于2。用通俗的话来讲,无理性指数衡量的是用普通分数去逼近一个无理数的精准极限。以往人类经过漫长复杂的分析,只能把这个指数压缩到7.1左右,而这次,AI一举将它推到了理论极限的数字2。另一篇论文则完成了对卡塔兰常数无理性的证明,这个从19世纪就被深入探讨的特殊数值,此前从未在严谨意义上被证实到底是不是无理数。

这批手稿涉及的领域纵深极为广阔。从理论计算机科学中关于优化难题极限的唯一游戏猜想,到描述超导与自旋玻璃的统计力学公式,再到描述带电粒子束运动的相对论性弗拉索夫-麦克斯韦方程整体平滑解,算法将触角同时伸向了17个分支,展现出令人难以置信的知识跨度。


仅需3小时思考的硅基风暴是如何刮起来的

面对铺天盖地的数学定理,普通大众最关心的问题无疑是:计算机究竟掌握了怎样的神通,能够在短短时间内写出数百篇连顶级学者都需要研读数月的硬核论文。

根据研发团队披露的技术细节,这批庞大手稿全部出自一个尚未向公众开放的内部前沿大模型。在此之前,研发人员为模型设定了大约4000个高难度的前沿纯数学研究命题进行测验。惊人的是,在最终成功产出成果的手稿中,平均每一项突破所耗费的计算资源,仅仅相当于其旗舰产品专业版思考模型全速运转3小时的计算量。3小时的硅基运算,便跨越了人类顶级学者数年甚至数十年的推演跋涉。

过去的人工智能处理文字,本质上依赖于概率分布的联想,这种模式在严苛的数学证明中极易产生似是而非的幻觉。只要某一步推导出现哪怕一丁点逻辑漏洞,整个宏伟的证明大厦就会瞬间崩塌。为了打破这一瓶颈,研发人员结合了前沿的逻辑推理链条与一种被称为Lean的计算机形式化验证语言。

Lean形式化语言就像一个毫无感情、冷酷无情的严苛法官。在它的世界里,数学概念被拆解为一行行严谨的代码,公理、定义与每一步推演都必须通过底层逻辑内核的严格检验。如果某一处逻辑跳跃无法成立,系统就会直接报错拒绝通过。在本次公开的数学成果中,模型不仅用人类自然语言写成了包含引理、命题和推论的学术论文,还为其中大量的核心结果附带了可以直接跑在计算机上的Lean代码。

这意味着什么呢。一位独立学者下载了准黎曼猜想相关的代码与校验配置文件,在自己的计算机终端上运行了Lean系统的内核检测。验证软件最终输出了校验通过的绿灯信号。这意味着模型给出的逻辑推导,在形式化系统底层经受住了考验,完全排除了传统大模型胡言乱语的幻觉缺陷。

研发团队坦言,绝大多数论文都是模型依照一套固定的自动化流水线自主生成的。只有在黎曼zeta函数无零点区域以及复乘阿贝尔簇上的霍奇猜想等极少数超重量级成果上,研究人员才参与了格式调整,对论文的语句排版进行了人工编辑,以确保人类数学家在阅读时不至于被过于冰冷的机械推导结构所困扰。此外,为了辅助这种高密度的逻辑作业,系统还引入了长任务自动审查机制,由专门的辅助智能体实时监控推导过程,在发生逻辑偏差前及时纠错,极大地提升了深度思考的准确度。


手稿堆成大山之后的学术震荡与恐慌

这722篇论文如同核弹雨般倾泻而下,全球数学的感受并不是单纯的狂喜,其中夹杂着无力、戒备与深重焦虑的复杂震荡。传统学术界有一套沿袭了数百年的运作节奏:学者提出构想、撰写手稿、提交同行评议、在研讨会上反复辩论,最终由学术共同体在数年时间里逐步消化吸收并建立信任。

然而,一家商业科技巨头越过了期刊出版商,越过了学术评审流程,在一天之内将数百篇高度抽象的研究成果砸向学术圈。面对几千页密密麻麻的符号推演,得克萨斯大学奥斯汀分校的几何分析学者弗朗切斯科·马吉在社交平台上发出了充满无奈的感叹。他提到,此前研究人员发布的纳维-斯托克斯方程证明,全球专家至今还在埋头钻研它的运作机理;现在突然又涌出来几百篇,全世界的数学家就算不吃不喝,又哪来那么多精力去逐字逐句研读。更为关键的是,即便读完了,人类学者究竟能从中提炼出富有启发的数学思想,还是只能跟在AI的身后疲于奔命。

早在手稿发布的两个月前,即2026年8月,OpenAI研发团队曾经在私下里邀请了大约40位全球顶级数学家举行闭门交流会,试图探讨如何平稳地公布这些成果。西北大学知名学者布琳娜·克拉回忆,当时的会议现场弥漫着一种极度亢奋与极度不安交织的怪异气氛。数学家们当时恳切地呼吁,希望企业遵守学术伦理与发表规范,以清晰、易读且符合学术传统的方式逐步公开成果,留给人类学者充分的验证与理解窗口。许多与会学者原以为对方会分批次、细水长流地推出成果,却没想到最终迎接他们的是一场铺天盖地的代码库突袭。

在手稿上线后不久,由9位国际知名学者组成的数学与人工智能独立顾问组迅速发表了一份措辞严谨的声明。这个顾问组极具分量,成员中包括了菲尔兹奖得主蒂莫西·高尔斯、马丁·海尔以及当代物理学巨擘爱德华·威滕。顾问组在声明中开门见山地指出,这无疑是数学发展史上的一件大事,但顾问组此前向该机构提供交流建议,绝不代表学术界已经背书并认可了这批手稿中的所有结论,更不代表认同这种简单粗暴的成果产出与倾倒方式。这些手稿究竟在逻辑上是否完全站得住脚,对未来的科学探索能产生多大价值,必须交由各个细分领域的人类学者耗费漫长时间去独立研判。

曾经对人工智能辅助研究抱有极大热情的菲尔兹奖得主陶哲轩,在近期的一场学术演讲中也罕见地表达了谨慎态度,坦言技术的演进节奏实在是太疯狂了,其推进速度甚至超越了必要的理性界限。另一位菲尔兹奖得主塞德里克·维拉尼在看到AI攻入千禧年难题的核心地带后,更是直言感受到了前所未有的心理冲击,甚至将其形容为数学界从未直面过的剧烈震荡。

不少学者产生恐慌的原因,还在于这批代表人类抽象思维极境的智力成果,正在被极少数拥有海量算力与工程壁垒的技术寡头所主导。当数学定理的发现过程从人类智者的沉思,演变为数据中心内部数万枚高性能计算芯片数小时内的暴力搜寻,科研范式正在经历一场哥白尼式的变轨。


来源|心智观察所


OpenAI公开722篇数学手稿意味什么