第 18 名却是开源第一:Qwen-Image-2.1 说明图像模型的竞争已经分层

「排名第 18」和「开源第一」这两个标签贴在同一个模型上,说明图像模型的竞争已经分成两层。
Artificial Analysis 自行本地部署评测了阿里在 9 月 20 日以开源权重发布的 Qwen-Image-2.1,结果是它在 AA-Image-T2I v2.0 与 AA-Image-Editing v2.0 两个榜单上均位列第 18,同时也是这两个榜单上排名最高的开源权重模型,超过了 Ideogram 4.0(Quality)与 HunyuanImage 3.0 Instruct。
把这两个数字一起读:闭源阵营在绝对分数上仍然领先,但开源阵营的天花板被抬高了一档。而「能不能自己部署」,本身正在成为一种独立的价值。
三个值得注意的细节
- 两个榜同时进入第一,说明能力不是单点。 文生图考验的是构图与审美,图像编辑考验的是「只动该动的地方」。后者的难度更高,也离生产需求更近——现实工作中改图的需求量远大于造图。
- 编辑能力比生成能力更值钱。 生成是从零开始,错了重来就行;编辑要在保留其余部分的前提下改一处,一旦全局重绘就失去意义。这一项上的排名更有参考价值。
- 评测方自行本地部署,这件事本身就是信号。 开放权重意味着第三方可以自行复现评测、固定版本、验证宣称的能力。可复现性不是附加项,它是可信度的前提。
对读者的实际影响
对做内容管线的团队,开放权重的第一价值不是省钱,而是可控:
- 数据不出内网,涉密或客户素材才有得谈;
- 版本可以钉死,不会因为上游静默升级导致出图风格漂移;
- 可以针对自己的素材做微调,这是闭源 API 给不了的。
因此选型的顺序应该调一下:先问「能不能自部署」,再问「排第几」。 如果你只是偶尔出几张图,闭源 API 更省事;如果你要把出图嵌进一条每天跑几千张的流水线,能不能自部署的分量会远大于第 18 名和第 5 名之间的差距。