众力资讯网

一个写 JavaScript 工具的工程师,8 月 10 日跑步时随口跟 Cla

一个写 JavaScript 工具的工程师,8 月 10 日跑步时随口跟 Claude 说了一句试试黎曼猜想,1.5 天后 AI 把这道困扰数学界 37 年的题往前推了一大步——零点落在临界线上的比例,从此前的 41.6% 直接跳到 67.2%。过去几十年人类数学家在这道题上能稳定证明的上限,被一台语言模型在不到两天内刷新了。

过程像科幻。Claude 自己试了 650 个错误方向、开了 60 个子代理、跑了大约 2400 次命令行命令,最后还自己把论文写完了。它没从已有论文里拼答案,而是自己撞墙、自己绕路、自己换路子,直到跑出一条新路径。

真正关键的一跃还是落在人身上。Anthropic 内部数学家 Levent Alpöge 本科在哈佛读数学和物理、博士师从菲尔兹奖得主 Manjul Bhargava、Erdős 数只有 2,他用一种新方法把两篇相隔 20 年的数学论文合并起来,才把 41.6% 顶到 67.2%。AI 负责大面积试错,人负责最后一锤定音。

最值得记住的不是那个百分比,而是研究方式本身变了:以前顶尖数学家关起门想几年甚至几十年,现在一个工程师跑着步说一句,AI 自己折腾、自己写论文,专家把关。过去那种 AI 做数学只会拼接资料的印象,这次被直接打脸。

不过也有冷静的声音。评论区已经有人提醒,这篇 AI 写的论文数学界还没逐行验完,67.2% 是否被解析数论主流正式承认,还得再等。AI 把门踹开了,门后面的东西还是得靠人搬。

你愿意让 AI 自己试错几百个方向,然后把成稿的论文交给你审吗?