Arena AI 中文镜像

文生图模型排行榜

基于真实人类偏好(Bradley-Terry 模型)计算大模型 Elo 评分的中文镜像站。数据每 20 分钟自动与官方同步,为您提供最新、最公正的大模型能力排名。

数据同步时间: 2026-09-07 09:20:59
关于这份榜单

文生图榜由用户输入同一段文字描述,两个匿名模型各自生成一张图片,用户凭直觉投票选出更好的一张,场景细分为写实摄影、二次元/卡通、3D 建模、产品设计、人像与文字渲染等多个方向。得分经 Bradley-Terry 模型换算为对战积分,越高代表模型在对应风格下的生成质量、指令还原度与美学表现越受用户认可。

正在生成榜单图...
展示数量10 个模型
10 个模型
520
图片版式
圈选高亮
选择要高亮的模型
数据同步时间: 2026-09-07 09:20:59
横向滚动:Shift + 滚轮
排名
排名区间
排名区间:基于 Elo 分数估算出的模型在不同对决中可能变动的最乐观与最保守排名范围
模型
Elo 评分
Arena Elo 评分:基于用户盲测两两对决的胜负关系估算出的模型综合能力评分。数字右下角的小字(例如 ±5)是 95% 置信区间,数值范围越窄说明这个评分的把握越大
投票数
投票数:用户在盲测竞技场中对模型对决进行投票的总次数
开发厂商
1
1 - 1
USOpenAIGPT Image 2 (medium)
1382±4
7,7830OpenAI
2
2 - 3
USMicrosoft AIMai Image 2.6
1332±7
1,0086Microsoft AI
3
2 - 4
USSpaceXAIGrok Imagine Image 2.0 (low)
1315±12
2682SpaceXAI
4
3 - 4
USReveReve 2.1
1301±8
7576Reve
5
5 - 6
USMetaMuse Image
1279±6
2,4856Meta
6
5 - 7
USReveReve 2.0
1270±6
1,4636Reve
7
6 - 11
USGoogleGemini 3.1 Flash Image (nano Banana 2) [web Search]
1261±5
4,0649Google
8
7 - 11
CNBytedanceSeedream 5.0 Pro
1258±4
5,9484Bytedance
9
7 - 12
CNAlibabaQwen Image 3.0 Pro
1254±7
1,0923Alibaba
10
7 - 11
USMicrosoft AIMai Image 2.5
1254±4
5,7295Microsoft AI
11
7 - 12
USGoogleGemini 3.1 Flash Lite Image (nano-banana-2-lite)
1250±6
1,6389Google
12
10 - 12
USGoogleGemini 3 Pro Image 2k (nano-banana-pro)
1246±3
15,0932Google
13
13 - 14
USOpenAIGPT Image 1.5 High Fidelity
1239±3
15,0845OpenAI
14
13 - 14
USGoogleGemini 3 Pro Image (Preview)
1232±5
8,2744Google
15
15 - 15
USIdeogramIdeogram 4.0 Quality
1204±4
4,0898Ideogram
16
16 - 19
CNAlibabaQwen Image 2.0 Pro 2026.06.22
1191±6
1,2016Alibaba
17
16 - 19
USLuma AIUni 1.1 (Max)
1188±6
1,3477Luma AI
18
16 - 20
USMicrosoft AIMai Image 2
1183±5
4,9204Microsoft AI
19
16 - 20
USLuma AIUni 1.1
1182±5
3,3847Luma AI
20
20 - 22
USSpaceXAIGrok Imagine Image
1171±3
23,4986SpaceXAI
21
18 - 26
GBRecraftRecraft V4.1 Utility Pro
1169±11
2517Recraft
22
20 - 26
USNvidiaCosmos3 Super Text2Image (Agentic)
1168±8
6667Nvidia
23
21 - 26
DEBlack Forest LabsFlux 2 (Max)
1162±4
11,7355Black Forest Labs
24
21 - 28
USSpaceXAIGrok Imagine Image Pro
1161±4
9,3649SpaceXAI
25
21 - 29
DEBlack Forest LabsFlux 2 Flex
1157±3
14,9317Black Forest Labs
显示第 125 条,共 76 条记录
每页显示:
1 / 4

排名计算方法: 系统利用在竞技场中收集到的海量双盲人类盲测对抗数据,构建 Bradley-Terry 模型以极大似然估计模型在各个单项分类下的 Elo 相对竞技值。95% 置信区间 (CI) 表明当误差区间发生重叠时,模型的真实相对实力可能不存在统计学上的显著性差异。