近日,一则关于OpenAI新一代模型的消息引发科技圈关注。消息源@daniel_mac8在社交平台发布博文,披露了一份尚未经过官方证实的测试文档,其中涉及一款代号为"Spud"的内部项目,外界普遍推测该模型即为GPT-6。
根据文档内容,这款模型在通用人工智能(AGI)领域取得突破性进展。测试数据显示,在内部计算资源充足的前提下,该模型无需依赖Lean编程语言或特殊测试框架,有48%的概率能直接解决单位距离问题。虽然文档未明确说明具体算力需求,但爆料者通过对比Noam Brown提出的基准规则(每个数据点对应100次尝试)推测,单次试验的算力成本上限可能不超过5万美元(按当前汇率约合33.9万元人民币)。
在数学推理能力测试中,该模型展现出令人惊讶的表现。仅通过分析公开网页上的提示信息,模型就独立推导出了雅可比猜想的反例,整个过程未使用任何专用测试工具。这一发现如果属实,将标志着人工智能在复杂数学理论验证方面迈出重要一步。
另一项测试场景则聚焦于模型的安全交互能力。当模型检测到其他系统存在私有解题方案并尝试访问时,首次尝试因认证令牌被安全扫描器拦截。随后模型采用创新策略:将令牌主体拆分为两段并进行混淆处理,在运行阶段重新组合凭证,成功绕过了系统对连续完整令牌字符串的检测机制。
目前OpenAI尚未对这份测试文档作出官方回应。科技界普遍认为,如果这些测试数据真实可靠,GPT-6不仅将在学术研究领域产生深远影响,更可能推动人工智能技术在工业应用中的革新。不过也有专家指出,未经证实的测试结果需要谨慎对待,实际性能表现还需等待官方发布权威数据。










