据悉,阿里发布了最新图像生成基础模型Qwen-Image-3.0。该模型支持最大4.5k token的超长输入,可一次性生成融合公式、几何图形、逻辑推导步骤等元素的知识图解或复杂UI界面。它同时支持12国语言和20多款字体的原生渲染,能有效降低多语言产品海报、影视漫画分镜等商业素材的生产成本。
Qwen-Image-3.0是千问图像生成和编辑模型系列的第三代产品,其能力覆盖人像摄影、数学试卷、古碑拓片乃至直播间页面等多种场景,生成图片细节丰富。相较于前代,新模型的文本输入长度提升了4.5倍,显著增强了复杂信息的承载能力。
在需要超长提示词的场景中,用户现在可以像撰写需求文档一样详细描述画面结构、文字内容、视觉风格和排版细节,从而让模型更精准地生成图文,减少反复调试。新模型还能一次性生成涵盖多个领域的9宫格知识图解。
此外,Qwen-Image-3.0能够理解复杂指令与画面的逻辑嵌套关系,可根据单条指令在同一幅图中组合生成网页、软件界面、海报等多类视觉内容,并保持各层界面结构和细节的准确性,即使微小文字也清晰可辨。








