ITBear旗下自媒体矩阵:

姚班才子领衔,Claude 11天完成费马大定理形式化证明壮举

   时间:2026-09-05 14:04:32 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

人工智能领域迎来重大突破——Anthropic公司宣布,其研发的Claude模型成功完成费马大定理的形式化验证工作。这项耗时仅11天的工程,将人类数学家350余年的智慧结晶转化为计算机可严格验证的1300万行Lean代码,规模达到Lean核心数学库Mathlib的五倍以上。

费马大定理作为数学史上最著名的未解之谜之一,其内容看似简单:当整数n大于2时,不存在正整数a、b、c满足aⁿ+bⁿ=cⁿ。这个由17世纪数学家费马提出的命题,直到1994年才被安德鲁·怀尔斯完全证明。然而数学界并未止步于此,如何让计算机完全理解并验证这个证明,成为新的挑战。

形式化验证过程需要消除所有"显然成立"的推理步骤,将每个数学推导都转化为计算机可检查的严格逻辑。帝国理工学院Kevin Buzzard教授领导的团队原计划用数年时间完成这项工作,其技术蓝图就达86页之巨。Claude的出现彻底改变了这个进程,它通过多智能体协作系统,将整个证明拆解为超过3万个中间定理,最终构建出完整的验证体系。

项目负责人田义鹏博士透露,初期尝试遭遇了智能体协作困境。随着工程规模扩大,不同智能体逐渐失去对项目全局的把握,导致7%的代码成为无效尝试。转机出现在引入"Prove2Me"协作平台后,这个专门为数学形式化设计的系统,通过有向无环图(DAG)管理定理节点,使智能体能够清晰判断证明进度和优先级。

整个验证过程消耗约60亿个输出Token,依赖的智能体能力相当于Claude Fable 5.1水平。值得关注的是,人类专家的干预非常有限,仅提供高层战略指导,如确定研究方向或定理优先级。具体到定义撰写、中间证明、任务拆分等细节工作,均由智能体自主完成。

这项成果的价值远超出单个定理的验证。数学文献的形式化进程长期受制于人工操作的速度和准确性,Claude展示的自动化能力为这个领域带来变革可能。当现代数学的复杂成果能够被系统转化为计算机可验证的形式,数学研究的可靠性和传播效率都将获得质的提升。

在人工智能竞赛的另一条赛道上,OpenAI同步推进着大模型的实际应用。其最新发布的GPT-6 Astra模型正逐步向ChatGPT付费用户开放,Pro版本用户可在对话、工作场景和代码生成等多个模块中使用。该模型重点强化的能力包括长链路智能体任务、软件工程、计算机操作等实用领域,显示出与Claude截然不同的应用导向。

两大科技公司的不同路径,折射出人工智能发展的双重维度:一边是追求基础科学验证的严谨性,另一边则侧重实际应用的广泛性。随着Claude在数学形式化领域取得突破,以及GPT-6 Astra进入商业应用阶段,人工智能正在不同维度上重塑人类的知识边界和工作方式。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version