Arena AI 中文镜像

图像编辑模型排行榜

基于真实人类偏好(Bradley-Terry 模型)计算大模型 Elo 评分的中文镜像站。数据每 20 分钟自动与官方同步,为您提供最新、最公正的大模型能力排名。

数据同步时间: 2026-09-07 09:20:59
关于这份榜单

图像编辑榜由用户上传自己的图片,交给两个匿名模型完成同一项编辑指令(既有单图编辑,也有多图编辑场景),用户对比修改结果后投票选出更好的一方,涵盖产品设计、人像精修、写实场景等多个细分类目。得分经 Bradley-Terry 模型换算为对战积分,越高代表模型在指令理解准确度与画面一致性保持上越受用户认可。

正在生成榜单图...
展示数量10 个模型
10 个模型
520
图片版式
圈选高亮
选择要高亮的模型
数据同步时间: 2026-09-07 09:20:59
横向滚动:Shift + 滚轮
排名
排名区间
排名区间:基于 Elo 分数估算出的模型在不同对决中可能变动的最乐观与最保守排名范围
模型
Elo 评分
Arena Elo 评分:基于用户盲测两两对决的胜负关系估算出的模型综合能力评分。数字右下角的小字(例如 ±5)是 95% 置信区间,数值范围越窄说明这个评分的把握越大
投票数
投票数:用户在盲测竞技场中对模型对决进行投票的总次数
开发厂商
1
1 - 1
USOpenAIGPT Image 2 (medium)
1461±4
22,8827OpenAI
2
2 - 3
USMicrosoft AIMai Image 2.6
1439±10
5086Microsoft AI
3
2 - 3
USSpaceXAIGrok Imagine Image 2.0 (low)
1439±8
5941SpaceXAI
4
4 - 5
USMetaMuse Image
1403±5
7,6663Meta
5
4 - 6
USMicrosoft AIMai Image 2.5
1400±4
17,4732Microsoft AI
6
5 - 10
CNBytedanceSeedream 5.0 Pro
1394±4
16,5349Bytedance
7
6 - 11
USOpenAIChatGPT Image Latest High Fidelity (20251216)
1390±3
53,6869OpenAI
8
6 - 11
USSpaceXAIGrok Imagine Image Quality (20260519)
1390±6
3,5601SpaceXAI
9
6 - 11
USGoogleGemini 3 Pro Image 2k (nano-banana-pro)
1390±3
54,8733Google
10
6 - 11
USGoogleGemini 3.1 Flash Image (nano Banana 2) [web Search]
1388±4
15,0230Google
11
7 - 11
USGoogleGemini 3 Pro Image (Preview)
1385±3
51,8487Google
12
12 - 13
USReveReve 2.1
1375±6
1,9119Reve
13
12 - 13
USOpenAIGPT Image 1.5 High Fidelity
1370±3
55,9765OpenAI
14
14 - 14
USReveReve 2.0
1358±7
1,7504Reve
15
15 - 16
USLuma AIUni 1.1 (Max)
1333±5
4,0918Luma AI
16
15 - 16
USSpaceXAIGrok Imagine Image
1329±3
61,3414SpaceXAI
17
17 - 18
USGoogleGemini 3.1 Flash Lite Image (nano-banana-2-lite)
1314±5
5,9286Google
18
17 - 18
USLuma AIUni 1.1
1314±4
13,2962Luma AI
19
19 - 23
CNAlibabaQwen Image 2.0 Pro 2026.06.22
1304±5
5,0824Alibaba
20
19 - 23
CNTencentHunyuan Image 3.0 Instruct
1302±3
30,7736Tencent
21
19 - 23
CNAlibabaWan 2.7 Image Pro
1302±4
4,1543Alibaba
22
19 - 23
CNBytedanceSeedream 4.5
1301±2
108,4303Bytedance
23
19 - 23
CNAlibabaWan 2.7 Image
1301±4
4,2378Alibaba
24
24 - 25
CNBytedanceSeedream 5.0 Lite
1294±3
36,5872Bytedance
25
24 - 25
USGoogleGemini 2.5 Flash Image (Preview)
1294±2
1115,9995Google
显示第 125 条,共 53 条记录
每页显示:
1 / 3

排名计算方法: 系统利用在竞技场中收集到的海量双盲人类盲测对抗数据,构建 Bradley-Terry 模型以极大似然估计模型在各个单项分类下的 Elo 相对竞技值。95% 置信区间 (CI) 表明当误差区间发生重叠时,模型的真实相对实力可能不存在统计学上的显著性差异。