
黎曼猜想的167年历史,在2026年8月被一个尚未公开发布的研究版Claude撕开了一道口子。
它没有证明黎曼猜想——那个克雷数学研究所悬赏100万美元、困扰人类数学界167年的终极难题。但在尝试解题的过程中,Claude完成了一件让数学家为之震撼的事情:它将黎曼ζ函数临界线上零点比例的下界,从人类数学家耗时数十年推到的41.6%,一举提升到了67.2%。
过去37年,人类在这个数字上只往前推进了0.8%。Claude一次跳跃,提升了25.6%。这不是马拉松的最后冲刺,这是有人在中途直接换了一辆车。
黎曼猜想研究的是黎曼ζ函数非平凡零点的位置。这个猜想认为,所有非平凡零点都位于复平面上实部等于1/2的同一条临界线上。它之所以重要,是因为这些零点与素数分布紧密相关——它们就像数字世界底层代码的索引表。
但167年来,没人能证明所有零点都在那条线上,也没人能找到一个反例。于是数学家换了一种思路:既然证明不了100%,那就先证明至少有多大比例的零点在临界线上。
这个比例的下界,就是数学家们一代代往上推的数字。到Claude介入之前,这个数字是41.6%。
Claude给出的新证明是:至少67.2%的非平凡零点位于临界线上。这不是黎曼猜想完成了67.2%,不等于剩下的32.8%不满足猜想——数学不是进度条,从67.2%到100%之间的跨度,可能比从0到67.2%还要大。但对于一个被人类磨了几十年的纪录来说,从41.6%直接跳到67.2%,已经足够扎眼。
这个故事最离谱的部分在于它怎么发生的。
启动这项研究的人叫Jarred Sumner,Anthropic员工,Bun的缔造者,16岁从高中辍学,几何课只上了半年。他在一次晨跑中随口给Claude下了一个任务:认真尝试攻克黎曼猜想。
Claude第一次尝试,生成并测试了650个思路,全部失败。Sumner没有提供数学指导——他本人也不是数学家。他做的最多的事是反复输入两句话:继续,以及相信你自己。
Claude第二次尝试,自己拉起约60个子智能体,在Claude Code里跑了一天半。这些子Agent总计执行了约2400条Shell命令,写了数百个Python脚本,对已知的ζ函数零点进行了数千次数值检查,还从arXiv下载了54篇论文相互审查。
60个子Agent中,真正贡献核心数学想法的只有两个。13个负责给它们喂想法当外援;30个试了但什么也没试出来;13个当验证员专门挑推导的错;最后2个负责把论文初稿写出来。整个过程中,有一半的Agent白干。
两期测试累计消耗3100万输出Token。这个量级放在数学家个人身上,相当于连续不断地写上好几个月。
Claude的突破建立在过去几十年多位数学家的研究基础之上。它结合了Baluyot、Goldston、Suriajaya、Turnage-Butterbaugh等数学家近期的工作,以及Bombieri在2000年的相关观察。
Claude构建了一个由Weil二次型诱导的合适函数空间,把原本的解析数论问题表示成了一个Hermitian矩阵问题。临界线上的零点贡献正方向,临界线外的零点对称出现。它提出了一个秩—迹不等式,同时处理两类贡献,再利用已经能够从素数一侧计算的一阶矩和二阶矩,估计临界线上零点的数量。
最终的公式可以直接写成:H(λ)=2-1/λ-λ/3。取λ=1,得到H(1)=2/3。继续使用Montgomery-Taylor最优窗函数,结果提高到0.67250。
Anthropic内部数学家验证了Claude的论文,并在Lean定理证明器中完成了该证明的形式化。两位外部数论专家Brian Conrey和Dan Goldston也审阅了论文。Anthropic已将论文、过程日志和Lean验证证明全部公开。
2024年,AI在国际数学奥林匹克竞赛中拿到金牌。那时人们还在用能解高中奥数题衡量AI的智力。
到了2026年,事情变得不一样了。
4月,GPT-5.4 Pro给出关键证明,解决了Erdős在1966年提出的第1196号问题。5月,OpenAI内部模型推翻了延续近80年的平面单位距离猜想,菲尔兹奖得主Timothy Gowers评价这是AI自主产生的最具趣味性的数学成果。7月,Claude Fable找到三维反例,推翻了提出87年的Jacobian猜想。8月,OpenAI一口气公布10项数学和理论计算机科学进展。同月,Claude把黎曼猜想的零点比例下界从41.6%推到了67.2%。
2026年,几乎每个月都有一个数学猜想被AI改写。
更说明问题的是人才的流向。7月,新晋菲尔兹奖得主、数论学家Jacob Tsimerman在领奖当天宣布加入OpenAI。AlphaFold核心人物、诺奖得主John Jumper离开Google DeepMind,加入Anthropic。AI公司从抢AI工程师,变成了抢菲尔兹奖得主、诺奖得主、理论物理学家。
黎曼猜想仍然没有被证明。但这已经不是故事最重要的部分。当AI开始自己组织60个Agent协同工作数十小时,发现问题、验证结论、写出论文,还建议人类专家复核时,AI与科学的关系已经跨过了从工具到同事的那条线。
正如Anthropic CEO Dario Amodei所说:不要只把AI看作分析数据的工具,要把它看作能端到端完成科学家工作的智能体。