AREX Feed Article
Qwen-Image-3.0 杀入千问 AI 平台,Arena 全球第五,0.18 元一张起
8 月 5 日,阿里巴巴千问图像生成模型 Qwen-Image-3.0 正式上线千问 AI 平台,面向所有用户开放。旗舰版 Qwen-Image-3.0-Pro 与标准版 Qwen-Image-3.0-Standard 同时开放 API,文生图 0.18 元/张起,海外用户可通过 Qwen Cloud 接入。援引阿里云消息做了上述报道。
同日宣布,该模型在 Arena.ai 文生图竞技场中位列国产模型第一、主流模型中排名第二(主流模型指日均 MaaS API 调用量超 10 万次的模型家族)。
从第 15 到第 5,一次跳了 10 个身位
Arena.ai 官方确认,Qwen-Image-3.0-Pro 以 1263 分空降 Text-to-Image Arena 全球第 5 名,较前代 Qwen-Image-2.0-Pro 的 1191 分和第 15 名大幅跃升,各分类性能均有"实质性提升"。 Qwen 官方随后感谢认可,该帖获超 1000 次点赞。
生成媒体平台 fal 同步上线了该模型,能渲染复杂密集排版的文字,在编辑修改的同时保留面部特征和身份等关键细节。
实测后评价(原文为英文):相较前代进步巨大,但整体画质和可靠性距离 GPT-Image-2 仍有明显差距。中文 AI 博主 的判断更具体:"中文和文字渲染表现不错,人物、商品图和海报类任务有一定竞争力;但在整体构图、复杂光影和综合质感上,公开反馈普遍认为与 GPT Image 2 有差距。"
7 月官宣,8 月落地
7 月 22 日,Qwen 官方长帖介绍第三代图像生成基础模型,以"实"字概括三大维度——丰富内容(4.5k token 长指令、复杂版面一次生成)、真实细节(10px 文字可读、接近摄影的皮肤质感)、深层知识(12 种语言原生渲染、100+ 艺术风格)。
彼时模型已可通过 Qwen Chat 体验,但 API 和千问 AI 平台的正式接入直到两周后才落地。期间,阿里云在 8 月 3 日旗舰大模型 Qwen3.8-Max,文本与图像两条线同期出牌。
4.5k token 长指令 + 10px 小字,不只是"好看"
显示,Qwen-Image-3.0-Pro 支持最长 4500 token 的指令输入,可将报纸版面、分镜脚本、试卷、菜单等复杂排版一次性生成;文字渲染可达 10px 清晰可读,原生支持 12 种语言和 20 余款字体。
模型同时支持文生图(T2I)和图生图/图像编辑(I2I),可基于 1-3 张参考图结合编辑指令进行精确编辑。显示,输出分辨率支持 512×512 至 2048×2048,未指定尺寸时模型自动推荐。
价格方面,国内千问 AI 平台文生图 0.18 元/张起;Qwen Cloud 海外定价为 Pro 版输出 $0.04/张(1K)、$0.075/张(2K),Standard 版 $0.03/张起。对比主流竞品, 指出 Nano Banana Pro 标准价约 $0.134/张,Seedream 5.0 Pro 约 $0.045/张,Qwen-Image-3.0 定价处于中游偏下区间。
国产图像模型不再缺席,但追赶仍在路上
前代 Qwen-Image-2.0-Pro 在 Arena 仅排第 15 名,此番跳入前五,排名跃升 10 位。Qwen3.8-Max 同期在 拿下全球第二,图像与文本两条线同时进入第一梯队。
Arena 排名反映的是用户偏好投票而不是绝对质量评测。 的判断代表了更冷静的视角:图像模型的竞争格局目前仍由 GPT-Image-2 主导,追赶者的进步真实可见,差距同样真实。
它做对了一件事:把生产力场景做深
Qwen-Image-3.0 把复杂排版、小字渲染、多语言这些被多数图像模型忽略的生产力场景做深,同时给出一个有竞争力的起步价。对于做中文海报、信息图、商品素材的团队,这是一个值得测试的选项;对于追求极致画质的创作者,更好的选择可能仍在别处。