跳到正文

模型能力评测

重点更新

文生图 · Arena ↗

qwen-image

关闭详情

alibaba · 文生图 · 2026-10-07

Arena 评分
1056.8
来源名次
66
对战票数
84,550
评分区间
1054.2–1059.4

偏好评分;区间重叠时差异未必稳定。

模型许可:Apache 2.0。

原始成绩 ↗
82 个模型
文生图公开偏好成绩,2026-10-07
模型/机构Arena 评分对战票数
1074.41071–107865,510
flux-2-klein-9b#62 · bfl
1070.31067–1073150,782
1060.31058–1063716,773
1058.71055–1062332,367
1058.01055–1061359,772
qwen-image#66 · alibaba
1056.81054–105984,550
ideogram-v3-quality#67 · ideogram
1048.41045–1052118,538
photon#68 · luma-ai
1035.71032–1039130,160
p-image#69 ·
1033.21030–1037109,762
flux-2-klein-4b#70 · bfl
1030.01027–1033152,389
runway-gen4#71 · runway
1024.21020–102954,361
recraft-v3#72 · recraft
1020.61017–1024195,627
flux-1.1-pro#73 · bfl
1015.61012–101970,460
ideogram-v2#74 · ideogram
1013.31010–101772,090
lucid-origin#75 · leonardo-ai
1013.01010–1016287,341
glm-image#76 · zai
1012.11003–10214,854
975.3972–979257,227
flux-1-dev-fp8#78 · bfl
969.4966–97349,221
dall-e-3#79 · openai
967.8964–972238,743
941.1937–945216,225
数据来源

Arena · CC BY 4.0 · 固定版本

用户偏好评分,非正确率。下方小字为置信区间;临时成绩状态见原榜。本站选取 overall 分类、翻译字段并舍入显示,原始值保留。

每日 08:30 同步 · 最近成功:2026/10/11 08:26(北京时间)

历史专项测试:MMLU-Pro / GenEval