南风窗 6小时前
AI大战数学家:可以回去刷盘子了
index_new5.html
../../../zaker_core/zaker_tpl_static/wap/tpl_keji1.html

 

作者 | 荣智慧

编辑 | 向现

两家顶级 AI 大模型的数学 " 军备竞赛 ",已经如火如荼地展开。

9 月 4 日,OpenAI 的 GPT-6 Astra,攻克了 5 道埃尔德什(Erd ő s)数学难题。9 月 5 日,Anthropic 的 Claude 将 " 费马大定理 " 转化为机器形式化(代码)证明。

数学界的超级震荡,一个接着一个,有研究者公开承认 " 要震蒙了 "。

今年 5 月,困扰数学家 80 年的 " 平面单位距离问题 " 被 AI 推翻。7 月,有 87 年历史的 " 雅可比猜想 " 被 AI 找到反例。8 月," 六维球面复结构 " 悬案告破;" 黎曼猜想 " 相关零点下界得以推进。

人类智力金字塔尖的 " 数学殿堂 ",短短几个月里被 AI 接连暴力破门。

菲尔兹奖得主陶哲轩在社交媒体发布了令人深思的 " 思想实验 ":假如 AI 早来 20 年,张益唐还在餐馆刷盘子。

陶哲轩设计的思想实验,在试验的世界中,2013 年张益唐无法竞争过 AI,还在餐厅打工

可以说,AI 达成的一连串爆炸性 " 史诗级突破 ",迫使顶尖数学家不得不面对数学的终极问题:数学研究将向何处去?人类数学家的价值在哪?

当新的定理、答案如流水线产品一般被源源不断地 " 生产 " 出来,数学存在的意义是什么?

乱拳打死老师傅

"ChatGPT 时刻 " 已经过去了三年多,在 2026 年,AI 模型想要搞 " 大新闻 ",必须拿出点看家本领了。

数学是最好的 " 试金石 "。一旦 AI 解决了未解的数学难题,就意味着它具备了长链条的、严密的、可以自我纠错的逻辑推理能力。

攻克数学这座 " 圣殿 ",成了各家 AI" 自我证明 " 和 " 无限进化 " 的唯一途径。

5 月,OpenAI 打响了 "AI 解题第一枪 ",成功构造并证伪了保罗 · 埃尔德什于 1946 年提出的 " 平面单位距离 " 问题。埃尔德什人称 " 猜想狂魔 ",他提出,把 n 个一模一样的小圆点平铺,任意两个圆点之间的距离等于 1 厘米,它们之间就可以连线,那么,怎么摆放这些圆点,才能连上最多数量的线?

这道题本来是点阵连线的 " 几何摆放题 ",但 OpenAI 的模型在代数数论里 " 借 " 了几件工具,用代数方法得出了与埃尔德什不同的答案。埃尔德什当年断言,连线数量接近 n 的一次方,而模型的结果为 n 的 1.014 次方。

虽然指数只增加了 0.014,但只要点数的规模扩大,最后的结果将比人类算出的结果多出几倍或几十倍。1998 年菲尔兹奖得主蒂莫西 · 高尔斯评价," 如果这是人类算出来的结果,我会毫不犹豫地推荐发表在数学顶级学术期刊上。"

7 月,Anthropic 的 Claude Fable 5" 轰 " 掉了有 87 年历史的 " 雅可比猜想 "。1939 年,德国数学家奥特 - 海因里希 · 凯勒提出猜测,如果一种多项式算法,在任何一个局部的微小变动中,都不会发生数据模糊或信息重叠,那么,这种算法整体上一定是绝对安全、绝对唯一的。也就是说,世界上绝对没有两个不同的起始坐标,经过其方程计算,得到完全相同的终点坐标。

数学家张益唐在普渡大学读博期间,研究的课题就是 " 雅可比猜想 ",经评审团审议该核心成果错误,只能勉强毕业,离开学术界,在赛百味当了多年收银员。直到 2013 年转攻解析数论,发表了推动 " 孪生素数猜想 " 研究的论文,才重新回到学界。

张益唐当年论证的是二维情形下的猜想,而 Claude Fable 5 证伪的是三维及以上的情况不成立——其编写了 3 个三变量的方程式,局部变化率不变,当把 3 个不同的初始点坐标代入方程,终点坐标完全相同,证明了 " 雅可比猜想 " 的错误。

其实,由于二维没有高维度的折叠空间可利用,证明起来比三维及以上要困难很多。张益唐要论证的情况,至今依然没有攻破。

8 月,Claude 的实验版本刷新了 " 黎曼猜想 " 的数据,将黎曼函数在临界线上的已知零点比例下界从 41.6% 提升到了 67.2%。" 黎曼猜想 " 认为,所有的 " 零点 "(让函数值等于 0 的点)都无一例外地躺在 " 临界线 " 上。

而直接证明所有的 " 零点 " 都在这条线上太难了,证明零点在这条线上的百分比还相对好算一点。1989 年,数学家布莱恩 · 康瑞得出了 41.6%。Claude 花了一天半,得出了 67.2%。

9 月 5 日,官方团队宣布,Claude 在 11 天内自主将 350 多年历史的 " 费马大定理 " 翻译并编译成计算机可校验的形式化代码证明。这一成果的意义是,大模型写出了数学史上最长的、100% 通过机器核验的无错证明。

英国帝国理工学院从 2023 年启动由数学家凯文 · 巴扎德领衔的 " 费马大定理形式化 " 项目,原计划拟用 5 年甚至更长时间冲刺完成,结果被 AI 用 11 天 " 截胡 " 并 " 超车 "。巴扎德可不是普通数学家——拿过 1987 年国际数学奥林匹克满分金牌,导师理查德 · 泰勒曾协助安德鲁 · 怀尔斯证明 " 费马大定理 ",也是形式化数学(Lean 语言)的 " 教父 "。

随着 AI 掏出一系列咄咄逼人的 " 战书 ",数学家几无还手之力。毕竟,动辄上千万行的证明,人类连看懂都费劲,只能交给计算机自动化测试。换句话说,AI 解出的数学难题,人类评价 " 对不对 " 的资格都没了。

也难怪今年的菲尔兹奖得主雅各布 · 齐默曼得奖当天宣布加入 OpenAI。颁奖三天前,他的学生刚利用 Claude Fable 5 推翻 " 雅可比猜想 "。据不完全统计,仅 2026 年前 8 个月,有至少 22 位来自斯坦福、伯克利、哈佛、麻省理工的顶级数学、理论物理学教授加入 AI 公司。

历史进程之突变,正如巴扎德 " 令人愕然 " 的亲身经历——最大力拥抱计算机的先驱,最先被 AI" 乱拳打死 "。

数学是检验真理的唯一标准?

OpenAI 与 Anthropic,你追我赶地解决数学难题,不仅仅是想用 " 技术能力 " 证明自己,也受到了不少外部因素的左右。

今年 5 月,Anthropic 在 H 轮融资中狂揽 650 亿美元,估值升至 9650 亿美元。6 月提交上市申请,预计 10 月中旬挂牌,冲刺 2 万亿美元的开盘市值。

Anthropic 估值演变

这也是 OpenAI 赶紧在 5 月打响 "AI 解题第一枪 " 的原因。3 月底,其估值停留在 8520 亿美元。同样是 10 月上市,它仅能冲击 1 万至 1.6 万亿美元的开盘市值。虽然 8 月 ARR(年度经常性收入)为 400 亿美元,但 2026 年预计亏损 140 亿美元。面对亏损和 Anthropic 在财务指标上的压制,OpenAI 必须靠模型的能力突破,向资本市场证明自己 " 货真价实 "。

而且,看技术路线,两家公司完全不同,数学成了检验真理的唯一标准。

OpenAI 崇尚大平台、大生态和大规模扩张,Anthropic 高举 AI 安全、可控部署、人机对齐的大旗。过去,安全和严谨往往意味着牺牲模型的性能,但模型解出数学难题,反向证明 " 重视 AI 安全 " 的模型的能力绝不比 " 放任自流 " 的模型差。

重要的是,硅谷正身处于生存危机之中,高质量人类语料告竭。2026 年初,几大巨头已经把互联网上的高质量文本、代码数据吃干抹净,如果继续用低质量数据训练,短则三代、长则九代,模型就会发生不可逆的 " 智力退化 "。

数学具备人类语言不具备的特征,不需要依赖人类的现成语料,有客观的验证机制。AI 生成一行证明,机器编译器可以随之核验是否正确,只要正确就可以继续往下写。AI 学了数学,可以通过强化学习(RL),自己给自己出题,自己和自己下棋,自己推演公式,自己纠错,不会出现幻觉,也不会引发智力退化。

同时,华尔街的耐心正逐渐耗尽。

高盛报告称,2026 年全球 AI 投资总额超 1 万亿美元,其中美国占一半以上,而收入与资本支出的转化比率仅为 4%。普华永道报告称,全球 56% 的 CEO 明确表示,其公司在过去 12 个月部署 AI 后没能带来任何收入增加、成本削减。德勤数据指出,全球 1326 位一线财务领袖投票,其麾下可量化出清晰投资回报率的部门,占比不足四分之一。

2013-2025 年全球企业 AI 投资总额

7 月 23 日,各家科技巨头在第二季度财报披露了庞大的 AI 资本开支方案,纳斯达克指数暴跌超 2%,特斯拉、Alphabet 等均遭受重创。受下行影响,7 月底,华尔街明星 AI 对冲基金、由 OpenAI 前员工阿申布伦纳创办的 " 态势感知 " 基金爆雷清盘。

AI 对零容错的数学的精通,可以缓解华尔街的焦虑。数学是自然科学的 " 元语言 ",一个精通数学的大模型,必然也精通理化生——从半导体与芯片设计、金融风控到生物医药,AI 可以靠几百万倍于人类实验室的速度,完成具体工作。有了应用场景,赚钱便不成问题。

此外,作为 "AI 军备竞赛 " 的最大推手,英伟达功不可没。

因为算数学题特别烧输出词元,大模型要进行超大规模并行计算。比如 Claude 算 " 费马大定理 ",11 天烧掉 60 万亿输出词元,堪称 AI 解题之 " 大力出奇迹 " 的典型。照这种烧法,算力基础设施远远没有饱和,数据中心还得建,GPU 还得买,英伟达全球第一的万亿商业帝国才能继续运转。

数学的 " 百年新危机 "

数学家与 AI" 血刃相见 ",早已不是新闻。

2006 年菲尔兹奖得主陶哲轩,是推动数学界向 " 代码证明 "(Lean 形式化)转变的核心旗手,去年便已深度介入 OpenAI、微软研究院以及各种前沿 AI 项目的顾问工作。今年以来 OpenAI 攻克的数学难题,陶哲轩都充当了 " 首席裁判 " 和 " 评议人 " 的角色。

陶哲轩直言,数学已经迎来 " 百年新危机 ",专业数学家如今最紧迫的任务是 " 跟上 AI 的脚步 "。

为 AI" 布道 " 的同时,陶哲轩也泼了一些冷水。今年 8 月,他在国际数学家大会上发表了《AI 时代的数学》演讲,提出 " 可能有必要禁止自动求解器介入某些类别的数学问题,以保护这些问题对数学生态系统的广泛价值,包括培养下一代数学家 "。

陶哲轩《AI 时代的数学》演讲

今年 6 月,由国际数学家联盟背书的《莱顿宣言》发布,警告 AI 解题正在威胁数学研究的准确性、可靠性和独立可验证性,科技公司的参与可能将研究重点扭曲到那些适合 AI 解题的问题上,而非真正有深层意义的问题上。

如今,数学界形成了两种交织的声音,一方希望数学家拥抱 AI 这一有力工具,不断攻克数学高峰;一方期待人类数学家夺取失地,用审美而不是暴力计算来维护数学的 " 意义 "。

其实,要解决这些看似矛盾的意见,解决数学的 " 百年新危机 ",必须要厘清数学家和 AI 的思维范式的区别。

AI 用的是 " 初等数学 "(形式化的、可计算的)的范式来肢解数学难题,这倒不是贬低它,而是它通过把符号和逻辑拆成了可供计算机穷举、逻辑树搜索的规则,拼命计算。假如某条路走不通,编译器报错,它就立刻选择另一条路穷举,把 " 大力出奇迹 " 发挥到极致。

FrontierMath 4 级测试不同 ai 在解决难题时具备的高级数学推理能力

人类数学家靠的是直觉和类比。数学家理解高等数学,类似于 " 自由的艺术 ",像著名数学家庞加莱、克莱因等人,往往是在洗澡、散步或者做梦时,突然觉得两个不相干的领域似乎有一种隐秘的相关,从而创造出新的几何空间或代数工具。

在 " 经典 " 的高等数学领域,数学家扮演的是 " 立法者 ",不仅可以自己发明规则,比如高斯、罗巴切夫斯基、黎曼否定了平行公理,非欧几何诞生,一个全新的数学世界和物理世界(爱因斯坦在此基础上算出了引力是时空的弯曲)得以展开;还可以追寻 " 规则本身是否合理 "。

集合论的开山鼻祖康托尔有句名言:" 数学的本质在于它的自由。"AI 并不 " 自由 ",它的成功在于 " 吞下 " 了巨量的数学论文和著作,并拥有比人类快几万倍的计算速度,因此可以用某种超越人类视角的概率网络发现难题中的隐秘相似性和拼接可能。

在思维范式的意义上,AI 还是在给定的围墙里做计算,因此还是大体遵循了 " 初等数学 " 的玩法。而 " 自由 " 的数学家可以破墙,可以 " 立法 ",可以自己创造一个新世界,这是 " 高等数学 " 的 " 特权 "。

然而," 数学的百年新危机 " 并不能说解决了,而是变得更为复杂。

在今天,想进行数学研究,得到一个以前算不出的结果,比以前容易多了。但是,想得到简约、优美、统一的数学趣味,得到 " 结果 " 之外的东西,则是难上加难。

数学的殿堂,门槛被 AI 锯平了,而穹顶也被抬到了一般数学家难以企及的高度。这一趋势,很快会蔓延至其他学科。

宙世代

宙世代

ZAKER旗下Web3.0元宇宙平台

一起剪

一起剪

ZAKER旗下免费视频剪辑工具

相关标签

ai 数学 菲尔 陶哲轩 保罗
相关文章
评论
没有更多评论了
取消

登录后才可以发布评论哦

打开小程序可以发布评论哦

12 我来说两句…
打开 ZAKER 参与讨论