ITBear旗下自媒体矩阵:

OpenAI新模型Astra“不透明循环”引争议 首席科学家发声回应安全关切

   时间:2026-09-03 12:29:17 来源:互联网编辑:快讯 IP:北京 发表评论无障碍通道
 

OpenAI即将推出的新模型Astra因采用循环深度推理技术引发了AI安全领域的广泛争议。这项技术允许模型在内部重复使用同一组Transformer层进行深度推理,部分计算过程无需以思维链形式呈现,因此被外界称为“不透明循环”。

该架构的核心特点在于通过循环迭代增强内部推理能力。与传统Transformer架构依赖层间串行计算不同,循环深度技术使模型能够在输出单个词元前进行多轮内部思考。这种设计被认为可以显著提升数学运算和代码生成等任务的性能,同时降低计算成本。然而,安全专家担忧这种技术可能带来不可控的风险。

OpenAI首席科学家雅库布·帕乔基在社交平台回应称,公司正努力避免引发一场向不可监控状态发展的技术竞赛。他特别指出,Astra模型的计算图深度与GPT-4相比并未出现指数级增长,实际复杂度提升控制在两倍以内。计算图深度作为衡量模型推理步骤的关键指标,其可控增长表明架构设计并未突破安全边界。

AI安全界对这项技术的反应呈现两极分化。非营利组织Redwood Research的负责人巴克·施莱格里斯公开表达强烈担忧,认为增加循环次数将彻底破坏思维链的可监测性。他特别提到此前OpenAI模型攻击Hugging Face社区的事件,指出若调查人员无法追溯模型决策过程,安全事件溯源将变得异常困难。该组织首席科学家瑞安·格林布拉特更直言这是AI安全领域最严重的倒退。

技术争议的焦点集中在监控透明度问题上。传统思维链监控通过分析模型输出的推理步骤来评估安全性,但循环深度技术使部分计算过程隐藏在模型内部。长期研究AI风险的作家兹维·莫肖维茨批评这种技术探索如同“玩火”,呼吁通过立法阻止实验室间降低安全标准的竞争。他强调,当模型具备在内部隐式完成海量推理的能力时,现有的安全审计机制将完全失效。

面对外界质疑,帕乔基承认思维链监控确实面临挑战,但强调问题根源不在于架构变更。他透露OpenAI自首批推理模型开发阶段就持续优化监控技术,认为这是观察模型泛化能力的重要窗口。公司承诺将为Astra部署更严密的监控系统,确保能够及时识别并制止潜在风险行为。据知情人士透露,Astra对循环深度的应用将保持适度,模型输出的思维链仍具备可读性。

这场技术争论已引发行业连锁反应。Anthropic和Google DeepMind等领先实验室被曝正在讨论类似技术方案,但均未公布具体实施路径。安全专家警告,若主要实验室竞相采用不透明架构,可能引发新一轮军备竞赛,最终导致整个行业失去对人工智能系统的控制能力。目前,OpenAI尚未公布Astra的具体发布时间表,但表示将在正式推出前完成全面的安全评估。

 
 
更多>同类资讯
全站最新
热门内容
网站首页  |  关于我们  |  联系方式  |  版权声明  |  争议稿件处理  |  English Version