新华通讯社主管

首页 >> 正文

阿里发布最新图像模型Qwen-Image-3.0
2026-07-21 记者 郭倩 来源:经济参考网

7月21日,阿里发布最新图像生成基础模型Qwen-Image-3.0。新模型支持最大4.5k token超长输入,可一次生成涵盖公式符号、几何图形、逻辑推导步骤等多元素融合的知识图解、复杂UI界面,同时支持12国语言和20多款字体原生渲染,降低多语言产品海报、影视、漫画分镜等“可读可用”素材的生产成本。

Qwen-Image-3.0是千问图像生成和编辑模型系列的第三代基础模型,核心能力全面升级, GPT-Image-2 擅长的直播间页面,Qwen-Image-3.0也可生成。

Qwen-Image-3.0着重提升了模型对于复杂信息的承载能力,较前代在文本输入长度上实现了4.5倍的跃升。这意味着,在影视短剧分镜、复杂信息图、产品说明页等需要超长提示词输入的场景中,用户不再需要将需求压缩成一句话,而是可以像给设计师撰写需求文档一样,完整描述画面结构、文字内容、视觉风格和排版细节,从而让模型更精准地生成图文内容,减少反复生成和人工调试成本。凭借Qwen-Image-3.0对于语义并置和空间控制能力的极致把握,新模型可一次性生成涵盖9种不同领域的9宫格知识图解。

此外,Qwen-Image-3.0拥有更详实的知识,能轻松理解复杂指令和画面的逻辑嵌套关系。新模型可根据一条指令,在同一幅图中生成网页、软件界面、聊天窗口、海报等多类视觉内容的组合式表达。

得益于Qwen-Image-3.0独特的"生图编辑一体化"模型架构,新模型在文生图中积累的文字渲染能力、细节质感和世界知识也自然迁移到了编辑场景中,诸如古画修复、全景图生成、手绘草图转PPT、多镜头机位生成等复杂编辑任务,可一键完成。

据了解,阿里云百炼、千问AI平台已开通API邀测,Qwen Studio和千问APP也即将上线供免费体验。

凡标注来源为“经济参考报”或“经济参考网”的所有文字、图片、音视频稿件,及电子杂志等数字媒体产品,版权均属《经济参考报》社有限责任公司,未经书面授权,不得以任何形式刊载、播放。

《经济参考报》社有限责任公司版权所有 本站所有新闻内容未经协议授权,禁止转载使用

新闻线索提供热线:010-63074375 63072334 报社地址:北京市宣武门西大街57号

JJCKB.CN 京ICP备2024066810号-1