AI智能体11天证明费马大定理
12 小时前 1 阅读来源:newscientist.com
AI 中文改写
原文为英文,由 AI 改写为中文报道,内容完整。如需参考原文请点击下方链接
人工智能公司Anthropic近日宣布,其AI智能体集群仅用11天便完成了费马大定理的形式化证明,验证了上世纪90年代数学家安德鲁·怀尔斯提出的经典证明的正确性。这一成果意味着,困扰数学界三个半世纪的难题,如今已被机器以计算机可验证的方式彻底锁定。
费马大定理由17世纪法国数学家皮埃尔·德·费马提出,内容看似简单:当整数n大于2时,方程aⁿ + bⁿ = cⁿ不存在正整数解。费马在书页边角写下这一猜想,并声称自己已找到证明方法,但“空白处太小写不下”。此后数百年间,无数数学家尝试破解均告失败,直到1995年,安德鲁·怀尔斯在秘密工作七年后才给出完整证明。然而,怀尔斯的证明长达100多页,逻辑链条极其复杂,任何一步出错都可能导致全盘崩塌——事实上,他最初的证明确实被发现存在漏洞,后与同事理查德·泰勒合作花了一年时间才修复。
形式化证明正是为了解决这一痛点而生。它将数学证明从纸笔转化为计算机代码,让机器可以逐步推演逻辑、暴露任何隐藏的错误。目前,全球已有约200万行形式化数学代码存储在名为Mathlib的中央库中。今年早些时候,伦敦帝国理工学院的数学家凯文·巴扎德还启动了一个为期五年的项目,计划用Lean编程语言将怀尔斯和泰勒的证明形式化。但Anthropic的AI系统显然跑得更快——其生成的证明代码长达1300万行Lean代码,涵盖约29500个中间定理,规模是怀尔斯原始证明的五倍以上。
Anthropic在博客中透露,其Claude模型连续自主工作了11天,多个AI智能体分工协作,各自负责定理的局部证明。人类专家偶尔会发出“高层指令”引导方向,但过程中智能体多次“迷失项目状态、停止有效协作”。有趣的是,最终突破发生在引入一款名为Prove2Me的工具之后——这款工具原本是为人类数学协作设计的,帮助不同智能体追踪进度并决定下一步任务。巴扎德在Anthropic发布的声明中表示,这份形式化证明“除了数学公理外没有任何假设”,并指出AI自动形式化的能力已达到可被信赖并作为研究基础的程度。
对中国跨境电商卖家和AI从业者而言,这一事件释放的信号值得关注:AI不再只是处理文本或图像的助手,它已能参与高度抽象的数学推理,并在复杂任务中保持长时间自主协作。这意味着,未来AI在供应链优化、定价策略、多语言客服等需要多步骤逻辑推理的场景中,其能力边界将被大幅拓宽。同时,Anthropic在协作工具上的经验也提示我们,AI智能体的效率不仅取决于模型本身,还依赖于任务分解和协作机制的精心设计——这或许是比“更强大的模型”更值得投入的方向。
这篇文章对你有帮助吗?
觉得有用?分享给更多人
留言 · 0 条
暂无留言,来说两句吧
