OpenAI公司近日宣布,针对其顶尖AI模型GPT-5.6 Sol推出了一项名为Ultrafast的超高速模式,目前以预览形式向特定用户开放。这一模式将模型的处理速度提升至标准水平的14倍,最高可实现每秒750个词元的输出效率,旨在满足对实时性要求极高的业务场景需求。
据OpenAI介绍,Ultrafast模式由Cerebras提供技术支持,其核心目标是通过优化响应速度,帮助用户在工作流中更高效地完成复杂任务。传统AI模型在速度与能力之间往往存在权衡——若追求更快的输出,通常需要牺牲模型性能,转而使用更小或更专用的替代方案。而Ultrafast模式则突破了这一限制,首次实现了“速度与能力兼得”的技术突破。
OpenAI列举了多个早期应用场景,包括事故响应与可靠性分析、金融研究与安全分析、客服与语音交互、电商场景中的商品问答与库存查询,以及实时研究和实验等。这些领域对模型响应速度的要求极高,例如在金融交易中,毫秒级的延迟可能直接影响决策结果;在客服场景中,快速响应能显著提升用户体验。
目前,Ultrafast模式仍处于有限预览阶段,仅向一小批客户开放。OpenAI表示,早期测试将帮助团队评估速度提升在不同环节的实际价值,并观察模型能否与用户操作节奏保持同步。例如,在实时研究场景中,模型需要快速处理动态数据并生成分析结果;在电商库存查询中,系统需即时响应商品状态变化。这些测试将为后续优化提供关键数据支持。
OpenAI强调,Ultrafast模式的推出标志着AI应用方向的重要转变——从单纯追求模型能力,转向“每秒完成更多有价值工作”的效率提升。这一模式尤其适用于需要高频交互或实时决策的场景,未来可能进一步扩展至医疗诊断、自动驾驶等对延迟敏感的领域。











