登录

阿里千问发布Qwen-Image-3.0:超长指令让复杂图文一键生成


2026年07月21日 15:36

快科技7月21日消息, 今日,阿里发布最新图像生成基础模型Qwen-Image-3.0。

新模型支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂UI界面。

同时,该模型还支持12国语言和20多款字体原生渲染,字字清晰,大幅降低多语言产品海报、影视/漫画分镜等“可读可用”商业素材的生产成本。

据悉,Qwen-Image-3.0是千问图像生成和编辑模型系列的第三代基础模型,核心能力全面升级。

GPT-Image-2擅长的直播间页面,Qwen-Image-3.0也能轻松生成,从人像摄影,到数学试卷、古碑拓片,千问生成的图片细节满满,栩栩如生。

此次Qwen-Image-3.0重点提升了模型对于复杂信息的承载能力,较前代在文本输入长度上实现了4.5倍的跃升。

这意味着,在影视短剧分镜、复杂信息图、产品说明页等需要超长提示词输入的场景中,用户不再需要将需求压缩成一句话。

而是可以像给设计师撰写需求文档一样,完整描述画面结构、文字内容、视觉风格和排版细节,从而让模型更精准地生成图文内容,减少反复生成和人工调试成本。

凭借Qwen-Image-3.0对于语义并置和空间控制能力的极致把握,新模型可一次性生成涵盖9种不同领域的9宫格知识图解,字字清晰,幅幅准确。

主题:Qwen-Image-3.0|新模型