阿里云发布千问图像生成模型 Qwen-Image-3.0,支持 4.5k token 长指令、10px 小字还原与 12 国语言渲染,在 Arena.ai 榜单位列国内第一,同步开放 API 与双版本定价。
📝 详细摘要
本文是阿里云官方发布的 Qwen-Image-3.0 模型上线公告。文章介绍了该模型的核心能力:支持最长 4.5k token 的指令输入,可一次生成报纸、分镜、试卷等复杂版面;细节还原能力强,10px 小字可辨,LaTeX 公式与论文排版可逐一还原,人像毛孔、发丝、微表情经得起放大;支持 12 国语言原生渲染与 100+ 种艺术风格,内置世界知识并支持联网。文章还展示了模型在电商、短剧、广告、建筑设计等场景的应用案例,并公布了双版本定价(旗舰版 0.25 元/张起,标准版 0.18 元/张)。文章以产品发布信息为主,包含大量示例图片,属于官方产品宣发内容。
💡 主要观点
- Qwen-Image-3.0 支持最长 4.5k token 的长指令输入,可一次生成复杂版面。 模型能处理报纸、分镜、试卷、菜单等复杂排版,示例中一张九宫格知识信息图可同屏排列九个领域内容,提升了复杂场景下的生成效率。
💬 文章金句
- Qwen-Image-3.0 支持最长 4.5k token 的指令输入,报纸、分镜、试卷、菜单等复杂版面可一次生成。
- 10px 小字清晰可辨,整页代数几何学术论文的 LaTeX 公式、上下标和定理编号可逐一还原。
📊 文章信息
AI 初评:78
来源:阿里云开发者
作者:阿里云开发者
分类:人工智能
语言:中文
阅读时间:4 分钟
字数:971
标签: AI 模型, 模型发布, 图像生成, 千问, AI 产品与应用