阿里巴巴旗下千问AI平台近日迎来重大更新,其自主研发的图像生成模型Qwen-Image-3.0正式向全球用户开放使用。该模型同步推出旗舰版Qwen-Image-3.0-Pro与标准版Qwen-Image-3.0-Standard,API接口已全面上线,单张文生图价格低至0.18元起。海外用户可通过Qwen Cloud服务直接调用,国内用户则可在千问AI平台及阿里云百炼平台体验。
技术突破方面,Qwen-Image-3.0实现三大核心升级。在输入处理能力上,模型支持最长4.5k token的文本输入,较前代提升4.5倍。用户可像撰写设计需求文档般详细描述画面元素,包括结构布局、文字内容、视觉风格及排版细节,模型能精准生成报纸版面、影视分镜、数学试卷等复杂场景图像。实测显示,在文字对齐、微观细节还原、多图叙事连贯性等维度均有显著提升。
多语言与字体支持成为另一亮点。模型原生兼容12国语言及20余种字体渲染,即使提示词包含中英韩等多语种混合内容,也能确保文字完整输出,避免缺字、乱码或变形问题。在知识图解生成场景中,模型可同时处理公式符号、几何图形、逻辑推导步骤等多元要素,轻松生成包含精确文字、图表及漫画人物的知识卡片。
细节表现力方面,模型突破性实现10像素小字精准渲染,毛孔、发丝等微观质感还原度大幅提升。在人像摄影、古碑拓片等场景中,模型展现出强大的细节还原能力,文字清晰度、画面层次感及复杂构图渲染效果均达到行业领先水平。国际评测平台Arena.ai最新榜单显示,该模型在中文文生图领域位居国内首位。
应用场景覆盖影视制作、内容创作及商业设计三大领域。在影视分镜生成中,模型可一次性输出20个竖版短篇条漫分镜,剧情衔接自然,对话气泡文字清晰可读。内容创作者能通过单次生成获得涵盖9个不同领域的九宫格知识图解,满足多样化创作需求。商业设计领域则支持多语言产品海报、网页原型及游戏界面仿真生成,大幅提升设计效率。
据悉,Qwen-Image-3.0系列模型已全面接入千问AI平台生态。除现有API调用服务外,Qwen Studio专业工具及千问移动端应用即将上线免费体验版本。阿里云百炼平台同步开放模型部署服务,为企业用户提供定制化解决方案,推动AI图像生成技术从"视觉美观"向"功能实用"的深度转型。







