holy shit,人类数学家花了 37 年,把这个数从 40% 推到 41.6%,Claude 用了 1.5 天,就推到了 67.2%,这是黎曼假设关键部分结果的历史最大单步跃升。
@AnthropicAI 的未发布研究版 Claude,60 个 subagent,3100 万 token,2400 条 shell 命令,650 个失败想法之后,找到了一条人类数学家 40 年没找到的路。
不是那种数值计算,是严格证明,Lean 形式化验证,Conrey 本人 -- 就是那个 1989 年创下 40% 纪录的人审阅通过。
指挥这次突破的人不是数学家,他叫@arredSumner ,Anthropic 员工,给了 Claude 一句开放指令:认真试试黎曼假设。然后 Claude 自己开了 60 个 agent,跑了一天半,写了几百个脚本,试了 650 个想法全失败,第 651 个把一个停滞 40 年的数学纪录从 41.6% 砸到了
这是 AI 第一次在纯数学最硬核的开放问题上,做出了专家级的原创贡献,
很多年后我们回头看,这可能是 AI 开始做原创科学发现 的第一个明确里程碑,不是解题,也不是辅助计算,是真的往前推了一步。