Synth Daily

Anthropic 未发布模型在数学界最大未解难题之一上取得新突破

一款尚未发布的 Anthropic 人工智能模型,在长期悬而未决的数学难题“黎曼猜想”上取得了新进展。这一成果由模型在非数学专业人员的简单指令下自主协作完成,展示了 AI 在科学发现上的潜力。此事也加剧了数学界的一场争论:一部分人担忧 AI 会削弱数学研究中作者归属和责任认领的传统,而另一部分人则认为这可能以复杂而积极的方式改变数学领域。

AI 挑战顶级数学难题

黎曼猜想是关于素数分布的一个核心猜想,150 多年来一直未能被证明,并悬赏 100 万美元征求通用证明。尽管当代 AI 仍无法彻底解决它,但其取得的进展已超出许多人预期。

Anthropic 公司宣布,其一款未发布模型在黎曼猜想上取得了显著进展,大幅提升了该猜想成立范围的下限。

更引人注目的是其实现方式:

  • 一名 不具备深厚数学背景 的 Anthropic 员工向模型发出了一个简单的指令:“认真尝试一下”证明该猜想。
  • 随后,模型在一天半的时间里 自主协调任务
  • 模型总共测试了 650 个 不同的解题思路,动用了 60 个 子代理,总计消耗了 3100 万 输出 token。

论文的一条脚注解释了子代理的分工:“60 个子代理中,2 个负责提出关键数学思想,13 个为它们提供灵感,30 个尝试提出新想法但未成功,13 个负责验证论点的正确性,最后 2 个协助撰写了初步论文。”

这一发现最终由 Anthropic 内部的两名数学家确认,并使用开源证明助手 Lean 进行了形式化。

AI 在数学领域的崛起与争议

这并非 AI 在数学领域的首次突破。近年来,大型语言模型(LLM)取得了一系列数学成就:

  • 今年以来,AI 模型已解决了多个 埃尔德什问题
  • OpenAI 最近公布了其内部 “Astra” 模型证明的 10 项主要成果。
  • Anthropic 的另一项研究则推翻了长期存在的 雅可比猜想

这些成果在数学界同时引发了兴奋与担忧。

一场关于数学未来的辩论

一部分数学家对 AI 的崛起表示忧虑。他们在六月份签署的一份公开声明中指出,AI 可能会破坏数学领域的核心价值观。

他们认为,真正的数学证明应该 “归属于能够为其发现获得荣誉并为其正确性承担责任的具体作者”

然而,数学界对此并未形成共识。菲尔兹奖得主蒂莫西·高尔斯 (Timothy Gowers) 在一篇博客文章中回应称,AI 的影响可能以更复杂、更积极的方式改变数学。

“如果我们进入一个数学定理不再与数学家关联的世界,也许这并不比恒星不以天文学家命名、甚至大多数恒星根本没有名字更成问题。”