AI突破黎曼猜想纪录:Claude将零点比例下界提升至67.2%

7 阅读

引言

2026年8月,一则消息震惊数学界与AI界:Anthropic宣布其未公开的Claude研究模型在黎曼猜想上取得重大进展,将满足猜想的ζ函数零点比例下界从41.6%提升至67.2%。这一突破不仅刷新了人类数学家历经数十年才缓慢推进的纪录,更展示了AI在开放数学问题上的惊人潜力。

黎曼猜想:数学皇冠上的明珠

黎曼猜想由德国数学家波恩哈德·黎曼于1859年提出,至今已困扰人类167年。它研究的是素数分布的内在规律。素数(如2、3、5、7)是只能被1和自身整除的整数,看似随机分布,实则隐藏着深刻规律。黎曼引入ζ函数,其非平凡零点的分布与素数紧密相关。猜想断言:所有非平凡零点的实部均为1/2,即位于复平面的临界线上。

若猜想成立,将为数论、密码学等领域提供坚实基石。然而,尽管计算机已验证了海量零点,但无限多个零点无法逐一验证,完整证明仍遥不可及。

从41.6%到67.2%:下界的突破

由于完整证明困难,数学家转而研究“至少有多少比例的零点在临界线上”。经过几代人的努力,这一比例的下界被逐步提升至41.6%。Claude的突破在于将下界大幅提升至67.2%,意味着它证明了至少67.2%的非平凡零点位于临界线上。

需明确,这并非证明黎曼猜想,而是对零点比例下界的显著改进。尽管如此,从41.6%到67.2%的跨越,相当于将人类数十年的进展一举超越,意义重大。

Claude的研究方法:智能体协作与自主探索

Anthropic员工Jarred最初将整个猜想证明任务交给Claude,Claude首轮尝试了650个思路,全部失败。但Jarred并未放弃,而是简单指令“再试一次”。第二轮,Claude在Claude Code中启动了约60个子智能体,运行一天半,执行2400条Shell命令,编写数百个Python脚本,并对已知零点进行数千次数值检验。

这些智能体分工明确:有的提出新思路,有的深入推导,有的寻找反例,有的担任审稿人。最终,2个智能体提出了关键数学思路,13个提供辅助想法,30个探索其他方向,13个验证论证,2个整理成果。人类Jarred的主要工作竟是不断发送鼓励信息,如“继续Claude,相信你自己”。

验证与审稿:AI的自我纠错

Claude并未急于宣布成果,而是进行了严格的自我验证。它拉来不同子智能体交叉审稿、寻找反例,并从arXiv下载54篇论文检查重复性。随后,它从头独立证明了一遍,确认无误后主动提出写成论文并寻求人类专家审阅。

Anthropic内部数学家Levent Alpöge和Ralph Furman检查了结果,Claude还与员工Eric Easley合作将证明转化为Lean形式化验证版本,并通过Comparator测试。此外,解析数论专家Brian Conrey和Dan Goldston也审阅了论文。这一流程几乎覆盖了科研的全过程,从思路生成到交叉验证、查重、复现、写作和形式化验证。

意义与局限:AI在数学研究中的角色

此次突破展示了AI在开放数学问题上的能力:它不仅能解决有标准答案的题目,还能自主探索未知方向、阅读文献、试错、发现漏洞,甚至产出新结果。然而,Anthropic明确表示,该方法大概率无法直接通向完整证明,黎曼猜想仍未解决。

这一成果也引发思考:AI是否将成为数学家的得力助手?或许未来,人类与AI协作将成为常态,人类提供直觉与方向,AI负责大规模计算与推理。但AI的“黑箱”特性也带来挑战,如何确保其推理的可靠性仍需进一步研究。

未来展望:AI与数学的融合

此次突破可能只是开始。随着AI模型能力的提升,其在数学、物理等基础科学领域的应用将更加广泛。或许不久的将来,AI能协助解决更多长期未解难题,甚至独立提出新猜想。但我们也需谨慎,AI的推理可能存在偏见或错误,需要人类专家的严格把关。

结语

Claude在黎曼猜想上的突破,不仅是AI能力的展示,更是人机协作的典范。它提醒我们,AI并非替代人类,而是拓展人类认知边界的工具。未来,数学研究或许将迎来人机共生的新时代。