Anthropic 员工 Jarred Sumner(一个非数学专业出身的普通人)突发奇想,给 Claude 下了一道近乎刁难的指令:去真刀真枪地尝试一下数学界最著名的世纪难题——黎曼猜想。这个悬赏百万美元的问题,人类顶级数学家攻了一百多年仍未攻克,Claude 果然也没能证明它。
但奇迹发生在失败之后。Claude 在 "Claude Code" 环境中开了两个工作会话,输出 3100 万 token,调度约 60 个分身子智能体协同作战:有人构思核心思路、有人贡献灵感、有人负责验证逻辑。它先疯狂尝试了 650 个数学想法,全军覆没;在人类一句句"继续!别停!"的鼓励下,它坚持爆肝一天半,跑了 2400 次命令行、写了几百个脚本、下载 54 篇前沿论文交叉比对,最终取得了出人意料的突破——把黎曼 zeta 函数零点满足猜想的下界,从人类此前保持的 41.6% 一举提升到 67.2%。
技术上看,Claude 巧妙结合了近年几位数学家"不依赖黎曼猜想"的新技术与 Bombieri 2000 年的经典论文,并展现出人类数学家罕见的"勇气":不回避庞大复杂的数学结构,把正定与负定部分放在一起全局处理,最终得出了惊人结论。它甚至主动把成果写成学术论文,又生成了一份可机器校验的 Lean 形式化验证代码,通过了严格逻辑检验。
这件事最震撼之处在于:连 Claude 自己都一度怀疑这个结果——它"知道"黎曼猜想有多难,也"知道"AI 的局限,但在几句简单的人类鼓励下,它打破了思想钢印。或许我们所有人,都严重低估了 AI 进化的速度。
原文链接:www.anthropic.com
