OpenAI被曝正用霍奇猜想刷AI数学能力,千禧年难题成新Benchmark

5 阅读

OpenAI的“刷题”节奏快得让数学家害怕

《纽约时报》最近补了一篇深度报道,把OpenAI和数学家Tristan Buckmaster之间的那场冲突细节又挖深了一层。最引人注意的,不是已经吵翻天的数据归属问题,而是OpenAI顺带透露的一句话:

文章配图

在纳维-斯托克斯之外,我们已在另一道千禧年大奖难题上取得实质性进展,结果即将公布。

文章配图

这句话像一颗石子扔进池塘,涟漪迅速扩散。圈内人几乎立刻把矛头指向了霍奇猜想——那个连接拓扑学与代数几何的抽象堡垒。更让人不安的是,OpenAI似乎不是在做一次性的探索,而是在用这些世纪难题当测试集,系统性地验证自家AI的极限。

文章配图

这已经不是“辅助研究”,更像是“接管研究”。

文章配图

Buckmaster为何拒绝那笔“交易”

事情回到8月。当时Buckmaster和合作者Levent Alpöge刚用Anthropic的Claude模型推进到欧拉方程的证明边缘。他们没料到,OpenAI内部其实已经用自研系统跑通了更难的纳维-斯托克斯方程。

OpenAI研究负责人Sébastien Bubeck随后联系Buckmaster,提出几种合作方案:

  • 让Buckmaster先发欧拉方程成果,OpenAI隔天再公布纳维-斯托克斯;
  • 由Buckmaster挂名主作者,整理AI生成的论文;
  • 提供大量算力支持他继续独立研究;
  • 公开建议千禧年大奖应归Buckmaster团队。

听起来很慷慨?但Buckmaster嗅到了不对劲的味道。关键卡在Alpöge身上——这位合作者虽在Anthropic任职,但研究纯属个人行为。可Bubeck明确表示:“我们不希望一名Anthropic员工出现在OpenAI内部项目的论文里。”

对Buckmaster来说,这等于要求他抛弃搭档。他反问:既然两人都用了Claude和Codex,为什么不能两家公司共同署名?OpenAI显然无法接受这种“跨阵营”合作。

更让他心寒的是后续通话中那句:“你为什么要毁掉自己的职业生涯?”尽管Bubeck事后解释这是“糟糕的措辞”,并称自己当场道歉,但Buckmaster感受到的只有威胁。周日夜里,他在纽约大学办公室召集同事,黑板上画满时间线,连夜决定公开所有材料。

被忽略的人类铺路者

这场争执最刺痛数学界的,其实是另一个事实:纳维-斯托克斯的突破并非凭空而来。

几年前,西班牙数学家Diego Córdoba和Luis Martínez-Zoroa提出了一套新策略:通过精确设计的外力“踢击”,把流体一步步推向极端状态,最终逼出速度无限大的奇点。这套思路成了后续所有工作的基础。

Buckmaster负责把问题形式化,Alpöge则把问题喂给Claude。两人反复根据模型输出调整方向,才逐步逼近欧拉方程的解。按传统节奏,这条路可能还要走十年才能抵达纳维-斯托克斯。

但OpenAI直接调用上万个Agent,在88小时内暴力跑出了答案。GPT-6 Astra再花17小时完成Lean形式化验证。人类几年的积累,被压缩成几天的算力消耗。

Buckmaster坚持认为:“主要的智力功劳应该归于Luis和Diego。”可当OpenAI宣布成果时,这些铺路人几乎没被提及。AI成了唯一的主角。

霍奇猜想:下一道被“刷”的题?

现在焦点转向了霍奇猜想。这个由英国数学家William Hodge在20世纪提出的命题,试图在两个数学世界间搭桥:

  • 拓扑学关心高维空间里有多少个“洞”;
  • 代数几何研究由多项式方程定义的形状。

霍奇猜想断言:在一类特定的复杂空间中,那些拓扑发现的“洞”,背后必然存在由代数方程构成的几何结构。换句话说,看不见的拓扑特征,应该有看得见的“骨架”支撑。

它之所以难,是因为需要同时驾驭复几何、代数几何和拓扑学三套语言。过去几十年,只有零星进展。

有趣的是,在OpenAI正式公布纳维-斯托克斯前,就有数学教授从“可信渠道”听说被攻克的是霍奇猜想。当时这被视为误传。如今OpenAI确认第二道题已有实质进展,这条旧线索又被翻了出来。

Aeon模型:边训练边刷题的“解题机器”

据OpenAI透露,负责这些突破的内部模型从8月28日才开始训练,数学能力已显著超过GPT-6 Astra——而后者甚至还没结束纳维-斯托克斯项目。

外界传言这个新模型代号叫Aeon,但OpenAI未证实。真正惊人的是它的运作方式:模型被接入一个由上万个Agent组成的系统,同时对多道千禧年难题发起冲击。

整轮测试产生了490万条Agent消息和约3000亿个输出Token。仅纳维-斯托克斯一题就动用约1万个并行Agent,产出270万条消息,消耗1300亿Token。从启动到找到解法只用了88小时。

这已经不是传统意义的“研究”,而是一场大规模暴力搜索。AI不再等待人类提出猜想,而是直接尝试证明所有开放问题。

数学家的恐惧:与万亿美元公司对抗

Buckmaster在采访中说了一句很重的话:“与一家万亿美元公司对抗,非常可怕。我们都害怕OpenAI。”

他的恐惧很具体:数学家习惯把未发表的草稿、半成品思路输入AI工具寻求灵感。但这些输入可能被用于训练,最终变成公司的“内部成果”。更糟的是,当人类还在打磨证明时,AI公司已经用算力碾压式地跑完了全程。

他并不在乎那100万美元奖金,只希望成为历史的一部分。结果他确实进了历史,却是以“被AI抢跑的研究者”身份。

普林斯顿高等研究院的Peter Sarnak听完OpenAI开出的条件后直言:“这种讨价还价,我从来没有听说过。”在他看来,Buckmaster坚持学术共同体的原则,恰恰是“按照数学家的方式行事”。

千禧年难题正在变成AI的Benchmark

目前七大千禧年难题中,仅庞加莱猜想被佩雷尔曼解决。如果OpenAI的纳维-斯托克斯证明通过审查,就还剩五道。而现在,OpenAI和Anthropic似乎正把它们当成AI能力的试金石。

这场竞赛的规则很残酷:谁先跑通证明,谁就掌握话语权。人类积累的策略、直觉、协作网络,在算力洪流面前显得脆弱。

Buckmaster的遭遇提醒我们:当AI开始“刷”世纪难题时,最大的挑战或许不是技术,而是如何重新定义“发现”与“创造”的归属。毕竟,数学不仅是答案,更是通往答案的旅程。而这段旅程,正在被压缩成几行日志和一堆Token。