一句「试试黎曼猜想」,Claude把46年的数学进展一个下午推完了

一句「试试黎曼猜想」,Claude把46年的数学进展一个下午推完了

Anthropic的一个工程师随口让Claude试试黎曼猜想,结果Claude一个下午把零点比例从41.6%推到67.2%,超过人类46年的进展总和。

发布于 2026/08/11
更新于 2026/08/16
9 分钟阅读
3 次阅读

昨天看到这条消息的时候,我整个人是懵的。

事情是这样的。8月10号,Anthropic发了一篇研究报告。他们内部一个叫Jarred Sumner的普通工程师,给了一个还没发布的Claude研究版本一句话,「Take a real stab at the Riemann hypothesis」。大白话就是,认真试试黎曼猜想。

然后Claude就真的去试了。

它没能证明黎曼猜想,毕竟这是1859年提出的数学界终极Boss之一,悬赏一百万美金,167年了全人类最聪明的脑袋加一块都没搞定。但它在尝试过程中,「顺手」把一个相关问题往前推了一大步。

简单说,数学家们一直在证明「至少有多大比例的ζ函数零点确实在临界线上」。过去46年,人类把这个比例从33.6%推到了41.6%。

46年,8个百分点。而Claude一次性推到了67.2%,提高了25.6个百分点,用时一个下午。

说真的,我看到这个数字的时候,第一反应不是兴奋,是一种不真实感。就好像你一直在看一部AI科幻电影,然后突然意识到你看的不是电影,是新闻。

这种级别的问题,正常的预期是几代数学家前赴后继,每人往前挪一小步。不是一个非数学家对着电脑说了句「试试看」,然后电脑就真的搞出了突破性进展。

但偏偏就发生了。

我觉得最让人震撼的甚至不是那个数字本身,而是它发生的方式。你想想看,Claude做这个的时候发生了什么。Claude启动了大约60个子代理同时从不同方向探索,执行了2400个shell命令,写了几百个Python脚本验证想法,中间经历了650次失败的尝试。

一个数学家可能花一辈子盯着一个问题,大部分时间都在走死胡同。这个过程,Claude用一天半走完了。不是因为它比人类聪明,是因为它可以同时在650个方向上撞墙,撞完立刻换方向,没有情绪负担,不需要睡觉,不需要怀疑人生。

它把数学研究从「一个天才的灵感」变成了「大规模并行试错」。

但最让我着迷的,是它实际做了什么。它的核心贡献不是发明新的数学工具,而是发现了一种把已有结果组合起来的新方式。它把几位数学家关于零点间距的工作,跟Bombieri在2000年写的一篇关于Weil二次型的论文连接了起来。这两块东西之前没有人想过可以这么连

以前的数学家处理Weil二次型时,习惯性地把正定和负定部分拆开分别处理。Claude没这么做,它把整个二次型当作一个整体来看,包括那些交叉项,发现这样能得到更好的结果。

你品品这件事。它看到了碎片之间一条谁都没走过的连接路径。 它不是发明家,它是连接者。

坦率的讲,人类数学已经积累了海量的论文、定理、引理,堆积如山。我们从来不缺拼图块,缺的是找到正确组合方式的能力。 而这恰恰是AI最擅长的事

我自己的感受是,以前我们总在等天才,现在可以让机器去碰运气了。这感觉有点像,你一直以为围棋靠直觉和美感来下,然后AlphaGo告诉你靠穷举加评估函数也能下出人类理解不了的妙手。数学研究可能也在经历类似的范式转移。

而且67.2%还有一层含义。这是人类历史上第一次证明大多数零点都在临界线上。以前最好的41.6%都不到一半,现在突破了50%的门槛,数学意义上的分量比单纯看百分比要重得多。

当然了,有几件事得说清楚。第一,Anthropic自己明确表示这个方法不会导向证明黎曼猜想本身,从67.2%到100%可能有完全不同性质的困难。第二,结果目前由内部数学家审核确认并有Lean形式化验证,但还没经过传统同行评审。第三,距离「所有零点都在」还很远。这些都要诚实地说。

但即使考虑了所有限定条件,有一些东西在根本性地改变。

你注意到整件事里最魔幻的细节了吗?就是那个开头。一个不是数学家的人,对着AI说了句「认真试试黎曼猜想」。没有精心设计的prompt,没有几百页背景输入。就一句,试试看。

从「让AI做研究」到「AI真的做出了研究成果」,中间只隔了一个下午。

怎么说呢,这件事触及了一个很多人心里想但不敢说出口的问题,AI到底能不能做真正的科学发现?之前的答案一直模糊。现在这个共识出现了裂缝,裂得还挺大。

你回头看科学史,绝大多数突破都不是无中生有。DNA双螺旋靠的是把X射线晶体学数据和化学键理论组合起来,青霉素是因为弗莱明注意到了别人看见但没当回事的霉菌现象。创新也许从来都不是无中生有,它是在已有事物之间建立新的连接。 Claude做的事情,跟这个模式几乎完全一致。

我不是说AI可以取代数学家了。它的成果归根到底建立在人类几十年积累的基础上。它站在巨人的肩膀上,然后在巨人们彼此看不到的缝隙里找到了一条通道。

但这件事打开了一扇门。我跟你说,打开了就关不上了。如果一天半能把46年才推进8个百分点的问题往前推25.6个百分点,那未来当模型更强、知识库更大、子代理从60个变成6000个呢?

数学研究的时间尺度,可能正在被压缩。

如果这种「大规模并行试错」范式被验证有效,那不只是数学,物理学、生物学、材料科学,任何需要在巨大可能性空间里寻找有效组合的领域都可能被加速。这一次是纯数学,人类智力皇冠上最抽象的那颗宝石。如果连这块都能被AI推动,真的很难想象还有什么领域是安全的。

最后说一个可能有点感性的东西。黎曼猜想从1859年被提出,167年了。无数数学天才为它倾注毕生心血,有人一辈子就研究这一个问题,有人临终前还在纸上写公式。这个猜想背后承载的,不仅是数学真理,还有人类对未知近乎执念的好奇心。

现在,一个AI加入了这场167年的接力。它没有跑到终点,但确实往前迈了一步,而且这一步比过去46年人类走的总和还大。

AI不再只是工具。它是同行者。

在人类认知边界的最前沿,在那些最难最深最让人绝望的问题面前,它站在我们旁边了。它用自己的方式在思考,在尝试,在失败,在那些失败的废墟里找到了一条我们没看到的路。

这条路通向哪里,我们还不知道。

但它已经在走了。

以上,既然看到这里了,如果觉得不错可以给我个星标⭐~

谢谢你看我的文章,我们,下次再见。


评论区

欢迎留下你的看法,支持匿名评论。

你的评论会公开展示,建议填写便于交流的昵称,并尽量提供有信息量的反馈。