正式证明费马大定理——Anthropic
1 天前 1 阅读来源:anthropic.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
数学界迎来里程碑:AI 首次独立完成费马大定理的计算机验证
9月4日,Anthropic 公司宣布,其 AI 模型 Claude 在几乎完全自主的情况下,耗时11天,用 Lean 编程语言写出了费马大定理(Fermat's Last Theorem)的首个端到端计算机验证证明。这不仅是数学史上的一项壮举,更标志着 AI 在严谨逻辑推理和复杂数学形式化领域迈出了实质性一步。对于依赖算法和数据处理的中国跨境电商及AI从业者而言,这一事件预示着未来技术验证和复杂系统构建的方式可能发生根本性变革。
这项工作的起点源于一个长达数百年的谜题。1637年,数学家皮埃尔·德·费马在书页空白处写下猜想:当整数 n > 2 时,方程 aⁿ + bⁿ = cⁿ 不存在正整数解。这个看似简单的陈述,却让后世数学家困扰了超过350年。直到1995年,安德鲁·怀尔斯爵士才给出了长达129页的首次完整证明,该证明又经过数月艰苦的人工核查才被确认无误。此后,将此类复杂证明“形式化”——即转化为计算机可自动检查的代码——成为数学界的一个长期目标。2024年,伦敦帝国理工学院的凯文·巴扎德教授发起了使用 Lean 证明助手进行形式化的多年社区协作项目。而此次,Anthropic 研究员田一鹏(Tianyi Peng)决定测试 Claude 在此任务上的能力,结果远超预期:Claude 不仅写出了1300万行 Lean 代码,还证明了29500个中间定理,最终产出了完整且经过机器验证的证明。
核心变化:从“人工验证”到“AI 自动验证”的范式转移
此次突破的核心意义在于“验证”本身。与近期 AI 在黎曼猜想上生成全新数学成果不同,Claude 的工作聚焦于对已有证明的严格机器核查。在数学研究中,理解一个新结果并确信其正确性,往往需要数月甚至数年时间,因为逻辑链条中任何一环的断裂都可能导致整个结论崩塌。费马大定理的历史就是明证:1908年,德国曾悬赏10万金马克(相当于今天的100-200万美元)征求证明,仅第一年就收到621份错误尝试;1993年怀尔斯宣布证明后,也在两个月后被发现存在关键漏洞,又花了一年时间才修复。而现在,Claude 能够在11天内完成这一过程,且其产出“除了数学公理外无任何假设”,这大大降低了验证复杂数学成果的时间成本。正如巴扎德教授所言,这一成就展示了 AI 自动形式化产物已足够稳健,可以被进一步构建和发展。
对跨境电商及 AI 从业者的启示:信任与效率的重新定义
对于中国出海卖家和 AI 工具用户来说,这一事件虽然发生在纯数学领域,但其影响却可能外溢至商业和技术实践。一方面,它展示了 AI 在长链条、高精度任务中的可靠性。在跨境电商的供应链管理、多语言合规审查或广告投放算法优化中,如果 AI 能像验证数学定理一样,对复杂业务逻辑进行“无死角”的自动核查,将极大降低因人为疏忽导致的运营风险。另一方面,这也意味着 AI 工具的能力边界正在从“内容生成”向“逻辑证明”延伸。未来,卖家或许能借助类似技术,自动验证合同条款的严谨性、税务计算的无误性,甚至对选品数据模型进行数学层面的完备性检验。当然,目前该技术仍处于早期,其计算资源消耗巨大,距离商业应用尚有距离。但不可否认,当 AI 能够自主完成如此高难度的智力劳动时,我们对其处理复杂商业问题的信任度与使用方式,都需要被重新审视。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
