在AI生图领域,GPT-Image-2长期占据主导地位,其生成的复杂信息图和满足日常PS需求的图像随处可见。然而,近期一款名为Imagine Image 2.0的新模型凭借独特功能引发关注,甚至被马斯克在社交平台X上大力推广。
Imagine Image 2.0在大模型竞技场的文本转图像生成和图像编辑两个类别中均排名世界第二。与传统生图模型不同,它重点支持可交互的精准编辑。用户上传图片后,系统会自动分层,例如将维基百科表情包中的地球碎片、举地球的人物(包括仅人脸和手势动作两个图层)精准分离。点击图层右侧下载按钮,可导出任意主体为透明背景;魔棒工具则能处理自动分层无法覆盖的区域。该模型的多参考编辑功能支持一次处理最多5张输入图像,实现自动拼接。
实际操作中,Imagine Image 2.0的分层编辑能力展现出显著优势。以经典“分心男友”表情包为例,用户可直接编辑不同选区,替换或增加内容;会议室白板图的气泡框会被自动识别为选区,用户只需填入文字即可生成纵向漫画Meme图。这种交互方式与GPT-Image-2依赖提示词生成或点选评论的模式形成鲜明对比,被认为更加友好。
然而,Imagine Image 2.0的审核机制也引发争议。部分用户反映,上传蜘蛛侠照片会被提示“无法生成可能包含受版权保护的内容”,涉及擦边内容的创作也受到严格限制。这种“过度防护”导致部分用户认为其可用性下降。
与此同时,OpenAI被曝正在测试GPT-Image-2的后续版本。网友发现,一款代号为“mona-lisa-1”的模型在大模型竞技场中悄然出现。随机测试显示,新版本在真实感和噪声控制方面略有改进,部分用户认为其减少了AI生成的“塑料感”,照片更接近手机拍摄效果。例如,在生成当代纽约街景时,新模型在广告牌、店面等细节上更贴近真实场景,而旧版的中度思考模式则明显带有AI痕迹。
更有用户通过特殊提示词探索GPT-Image-2的新玩法。例如,要求生成“用iPhone随手自拍、构图混乱、光线不均”的照片,模型竟能模拟出运动模糊、曝光过度等真实拍摄缺陷。这种“反精致化”的创作方式,为AI生图开辟了新方向。
关于“mona-lisa-1”的身份,网友通过OpenAI验证工具发现其生成图片包含SynthID水印,确认与OpenAI相关。但该模型的知识库仅更新至2025年5月22日,在绘制Anthropic发布记录时,Opus 4之后的模型时间线出现错乱。因此,有猜测认为这可能是GPT-Image-2.0 Mini或开源版本,而非正式升级。
当前,AI生图领域的竞争已从单纯的质量比拼转向功能创新。从一致性保持、密集文字处理到精准编辑和美学品质,用户对模型的要求日益多元化。Imagine Image 2.0的交互式编辑与GPT-Image系列的真实感优化,分别代表了不同技术路线,而OpenAI新模型的神秘亮相,则为这场竞争增添了更多悬念。










