一场由AI生成的“GPT-6发布会”图片在网络引发热议,主持人竟是虚拟角色“赛博义父Tibo”。这场看似真实的发布会场景,实则出自尚未正式发布的新版生图模型GPT Image 2.5之手。据测试者透露,该模型已能通过ChatGPT弹窗提示向部分用户开放内测,其生成效果足以以假乱真。
与外界此前猜测的GPT Image 2.1不同,新版本直接跳至2.5,暗示升级幅度超出预期。在LMArena竞技场的匿名测试中,代号“luna-lisa-alpha”的模型被证实为GPT Image 2.5。测试结果显示,其生成速度较前代提升显著,照片真实度达到新高度,尤其在人脸一致性、文字嵌入效果和噪点控制方面表现突出。例如,生成的多张同一角色图像中,面部特征始终保持稳定,文字内容即使经过复杂排版也极少变形。
该模型的文本理解能力同样令人惊叹。当用户要求生成“爱因斯坦笔迹的世界货币历史手稿”时,模型不仅精准模仿了爱因斯坦独特的倾斜字体和连笔风格,还自动添加了符合真实场景的咖啡渍污迹。对比真实爱因斯坦手稿照片,两者在笔触力度、字母形态等细节上高度相似,甚至能清晰还原纸张横格线的纹理。
在功能性测试中,GPT Image 2.5展现了强大的场景还原能力。生成的乡村风景照中,树木枝叶的层次感、房屋砖石的纹理、羊群毛发的质感均达到照片级水准,背景虚化效果自然过渡,完全摆脱了前代模型常见的塑料感。与GPT Image 2的对比测试更直观显示,新版本在光影处理、细节丰富度和整体协调性上均有质的飞跃。
ChatGPT网页版对生图功能的重视也印证了其战略地位。该功能曾被短暂提升至主目录第二位,仅次于“新聊天”入口,虽然后续被隐藏,但这一调整被解读为为GPT-6时代铺路。测试者通过社交平台分享的案例显示,模型已能生成包含复杂元素的社交媒体截图,从头像比例到文字排版均无破绽,甚至能模拟不同设备的拍摄质感。
技术社区对GPT Image 2.5的讨论持续升温。有开发者指出,该模型在多模态理解上的突破,可能为AI生成内容带来新的评估标准。目前,部分测试案例已通过特定链接公开,包括发布会场景、历史手稿和风景照片等,供公众验证模型的真实能力。











