人工智能领域再次迎来突破性进展——Anthropic公司宣布,其研发的Claude模型成功完成了费马大定理的形式化证明。这项耗时仅11天的工程,将人类数学家三百余年的智慧结晶转化为计算机可验证的1300万行Lean代码,规模达到Lean核心数学库Mathlib的五倍以上。
费马大定理作为数学史上最著名的猜想之一,其内容看似简单:当整数n大于2时,不存在正整数a、b、c使得aⁿ+bⁿ=cⁿ成立。这个命题自17世纪提出以来,吸引了欧拉、高斯等数学巨匠的持续研究,直到1994年才由安德鲁·怀尔斯完成最终证明。然而,如何让计算机完全理解并验证这个证明过程,成为数学界面临的新挑战。
形式化验证要求将数学证明转化为计算机能够逐行检查的严格逻辑链条。传统数学证明中常见的"显然成立"步骤,在Lean等证明助手系统中必须展开为完整的逻辑推导。帝国理工学院Kevin Buzzard教授领导的团队原计划用数年时间完成这项工作,其项目蓝图就达86页之巨。Claude的介入彻底改变了这一进程——通过多智能体协作系统,不同模块分别处理定义补充、引理证明、定理整合等任务,最终构建出包含3万余个中间定理的完整证明体系。
项目推进过程中并非一帆风顺。初期多智能体系统因任务分配混乱导致效率低下,早期尝试生成的代码仅占最终成果的7%。转折点出现在团队引入"Prove2Me"协作平台后,该系统将证明过程分解为有向无环图结构,使智能体能够清晰判断各定理的证明状态和依赖关系。配合加速编译和自然语言描述保留功能,不同智能体得以高效协同,最终完成这项被评价为"非凡"的自动化形式化工程。
这项成就的意义远超出数学证明本身。传统数学文献形式化工作高度依赖人工,导致进展缓慢。Claude展示的自动化能力表明,现代复杂数学理论可以系统化地转化为计算机可验证的形式,这为数学研究的严谨性验证和知识传承开辟了新路径。值得注意的是,整个证明过程仅依赖Lean的三个标准公理,且最终定理陈述与Mathlib库中的版本完全一致,确保了验证的权威性。
在人工智能竞赛日益激烈的背景下,OpenAI同期宣布向付费用户逐步开放GPT-6 Astra模型。这款新模型重点强化了长链路任务处理、软件工程和科学计算能力,与Claude在数学形式化领域的突破形成技术呼应。两大AI实验室的最新进展,预示着人工智能在专业领域的应用正进入全新阶段。










