Anthropic 宣布 Claude 完成费马大定理首次计算机验证
Anthropic 宣布,其 AI 模型 Claude 在 11 天内自主完成了费马大定理的首次完整计算机验证,生成了 1300 万行 Lean 代码,并证明了 29500 个中间定理。该成果已获数学家 Kevin Buzzard 认可,标志着 AI 在数学形式化验证领域迈出重要一步。
核心事实
据 Anthropic 官方博客,其 AI 模型 Claude 在 11 天内自主完成了费马大定理(FLT)的首次完整计算机验证。Claude 使用 Lean 编程语言编写了 1300 万行代码,证明了 29500 个中间定理,最终通过了 Lean 证明助手的自动检查。该成果已分享给伦敦帝国理工学院的 Kevin Buzzard 教授,他评价称这是“非凡的自动形式化成就”。
背景与影响
费马大定理由皮埃尔·德·费马于 1637 年提出,直到 1995 年才由安德鲁·怀尔斯给出首个完整证明,长达 129 页。此后,形式化该证明一直是数学界的长期目标。Anthropic 表示,Claude 的成果基于怀尔斯证明的简化版本,并使用了其研究者 Tianyi Peng 设计的 Prove2Me 平台。该平台通过维护定理依赖图、分离定理陈述与证明文件等方式,帮助多个 AI 代理并行协作。Anthropic 称,这一成果表明 AI 能够形式化大量数学内容,可能有助于发现现有数学证明中的错误,并减轻人工审稿负担。他们还提到,未来可能将形式化证明作为数学论文的常规组成部分。
限制与来源
该成果尚未经过独立验证,Anthropic 也未提供完整证明的公开访问方式。文中提到的“6 billion output tokens”和“Claude Fable 5.1”等细节均来自 Anthropic 自身描述,未获第三方确认。此外,Claude 的证明依赖 Lean 的三个标准公理,但未说明其与怀尔斯原始证明的完整对应关系。更多信息请参阅 Anthropic 官方博客原文。