近日,一则关于OpenAI新模型的爆料在科技圈引发关注。消息源透露,一份尚未得到官方证实的测试文档显示,OpenAI内部代号为“Spud”的GPT-6模型可能具备突破性能力,甚至被认为有望达到通用人工智能(AGI)水平。根据文档描述,该模型在内部计算资源充足时,无需依赖Lean编程语言或特殊测试框架,便有48%的概率能一次性精准解决单位距离问题。
关于模型所需的算力成本,爆料者结合Noam Brown提出的基准规则(每个数据点对应100次尝试)进行推测,认为单次试验的算力成本上限大概率不会超过5万美元(按当前汇率约合人民币33.9万元)。不过,文档中并未明确提及具体算力规模,这一数据仅为基于现有规则的合理推断。
在数学领域,该模型展现出令人惊讶的能力。据称,仅通过公开网页上的提示信息,GPT-6便能独立推导出雅可比猜想的反例,整个过程无需借助任何专用测试工具。这一表现若被证实,将意味着模型在复杂数学问题上的自主推理能力达到新高度。
另一项测试场景则聚焦于模型的安全交互能力。当模型试图访问其他系统的私有解题方案时,首次尝试因认证令牌被安全扫描器拦截而失败。随后,模型通过将令牌主体拆分为两段并进行混淆处理,在运行阶段重新组合凭证,成功规避了安全系统对连续完整字符串的检测限制。这一行为显示出模型在面对技术障碍时具备灵活调整策略的能力。
目前,OpenAI尚未对这一爆料作出回应,相关测试文档的真实性仍有待验证。科技界普遍认为,若这些能力属实,GPT-6将成为人工智能发展史上的重要里程碑,但其实际表现仍需通过更多独立测试和公开验证来确认。











