LMArena · 图像理解(视觉)
定期获取并展示公开的基准测试资料(LMArena 用户投票排名、Epoch AI 测试分数、OpenRouter 使用量排名)。每个榜单均标注数据发布日期和获取日期。这些分数并非本站自行评定。
如何解读此排行榜
衡量什么: 通过比较两个模型对包含图片的问题的回答并投票得出的图像理解排名。
如何解读分数: 这是用户更偏好的回答的相对分数,并非解读照片、图表或截图的客观正确率。
注意事项: 文档小字或 Korean (Hangul) 字符识别等所需条件下的准确率需另行确认。
本次排名的解读要点
- 第 1 名 claude-fable-5-high 与第 2 名 qwen3.8-max 的 95% 置信区间重叠。仅凭本次统计难以确定两个模型的先后顺序。
- 还有 11 个模型的置信区间与第 1 名重叠。解读细微排名差异时,请结合投票数量保持谨慎。
- 前 10 个模型中,Anthropic 的模型有 5 个,数量最多。
- 第 1 名模型获得了 13,709 票,此排行榜包含 50 个模型。
图像理解(视觉) LMArena
发布日期:2026-10-02 · 获取日期:2026-10-04
圆点表示得分,横线表示 95% 置信区间。横线重叠意味着水平基本相近。 图表仅显示同一模型各推理设置(high、max 等)中排名最高的一项。表格列出所有设置各自的排名。 对话与视觉排名采用与 LMArena 网站默认设置相同的“语气与长度校正(style control)”排名。
各公司最高排名
- Anthropicclaude-fable-5-high#1
- Alibabaqwen3.8-max#2
- Googlegemini-3.7-flash-high#6
- Metamuse-spark#8
- OOpenAIgpt-6.1-sol-max#10
- xxAIgrok-4.5#28
- ZZ.aiglm-5.3-flash#30
- Moonshot AIkimi-k2.6#38
- SStepFunStep 5 Preview#45
查看表格(前 50 名)
| 排名 | 模型 | 开发方 | 分数 | 95% 置信区间 | 投票数 |
|---|---|---|---|---|---|
| 1 | #1claude-fable-5-high | Anthropic | 1309 | 1301–1316 | 13,709 |
| 2 | #2qwen3.8-max | Alibaba | 1301 | 1294–1309 | 10,040 |
| 3 | #3claude-opus-4-6-high | Anthropic | 1299 | 1293–1306 | 22,328 |
| 4 | #4claude-opus-4-7 | Anthropic | 1298 | 1292–1305 | 23,169 |
| 5 | #5claude-opus-4-7-high | Anthropic | 1298 | 1291–1304 | 22,755 |
| 6 | #6gemini-3.7-flash-high | 1296 | 1286–1306 | 3,814 | |
| 7 | #7claude-opus-4-6 | Anthropic | 1294 | 1288–1301 | 26,869 |
| 8 | #8muse-spark | Meta | 1294 | 1284–1303 | 5,868 |
| 9 | #9muse-spark-1.2 (xHigh) | Meta | 1293 | 1279–1307 | 1,951 |
| 10 | #10Ogpt-6.1-sol-max | OpenAI | 1291 | 1275–1307 | 1,408 |
| 11 | #11gemini-3.8-flash-high | 1290 | 1279–1302 | 3,086 | |
| 12 | #12muse-spark-1.3-max | Meta | 1290 | 1280–1301 | 3,843 |
| 13 | #13gemini-3-pro | 1289 | 1282–1297 | 13,620 | |
| 14 | #14claude-opus-5-high | Anthropic | 1289 | 1282–1296 | 15,900 |
| 15 | #15claude-fable-5.1-max | Anthropic | 1288 | 1278–1298 | 4,312 |
| 16 | #16Ogpt-5.5 | OpenAI | 1287 | 1281–1292 | 27,223 |
| 17 | #17claude-opus-4-8-high | Anthropic | 1286 | 1280–1293 | 18,350 |
| 18 | #18Ogpt-5.6-sol-xhigh | OpenAI | 1285 | 1277–1292 | 10,421 |
| 19 | #19gemini-3.5-flash-medium | 1284 | 1277–1291 | 12,467 | |
| 20 | #20Ogpt-6-astra-max | OpenAI | 1284 | 1273–1296 | 3,175 |
| 21 | #21gemini-3.5-flash-high | 1284 | 1277–1291 | 12,336 | |
| 22 | #22Ogpt-5.4-high | OpenAI | 1284 | 1278–1290 | 29,177 |
| 23 | #23muse-spark-1.1 | Meta | 1281 | 1274–1288 | 11,255 |
| 24 | #24Ogpt-5.5-high | OpenAI | 1281 | 1275–1287 | 25,488 |
| 25 | #25gemini-3.6-flash-high | 1280 | 1271–1288 | 7,392 | |
| 26 | #26claude-opus-4-8 | Anthropic | 1279 | 1273–1286 | 18,857 |
| 27 | #27gemini-3.1-pro-preview | 1279 | 1274–1285 | 45,558 | |
| 28 | #28xgrok-4.5 | xAI | 1279 | 1272–1286 | 11,039 |
| 29 | #29Ogpt-5.4 | OpenAI | 1279 | 1272–1285 | 22,828 |
| 30 | #30Zglm-5.3-flash | Z.ai | 1278 | 1269–1288 | 5,479 |
| 31 | #31Ogpt-5.2-chat-latest-20260210 | OpenAI | 1278 | 1271–1285 | 16,480 |
| 32 | #32Ogpt-5.5-instant | OpenAI | 1276 | 1267–1285 | 7,605 |
| 33 | #33claude-sonnet-4-6 | Anthropic | 1275 | 1269–1281 | 27,429 |
| 34 | #34gemini-3-flash | 1273 | 1268–1278 | 39,142 | |
| 35 | #35claude-sonnet-5.5-xhigh | Anthropic | 1268 | 1253–1284 | 1,608 |
| 36 | #36Ogpt-5.6-terra-xhigh | OpenAI | 1268 | 1261–1276 | 10,292 |
| 37 | #37qwen3.7-plus | Alibaba | 1265 | 1259–1272 | 13,065 |
| 38 | #38kimi-k2.6 | Moonshot AI | 1265 | 1258–1272 | 16,387 |
| 39 | #39claude-sonnet-5-high | Anthropic | 1264 | 1257–1271 | 13,029 |
| 40 | #40gemini-3.5-flash-lite | 1264 | 1256–1273 | 7,579 | |
| 41 | #41xgrok-4.6-high | xAI | 1263 | 1254–1273 | 5,736 |
| 42 | #42gemma-4-31b | 1262 | 1256–1268 | 39,111 | |
| 43 | #43gemini-3-flash (thinking-minimal) | 1260 | 1254–1265 | 37,184 | |
| 44 | #44Ogpt-5.6-luna-xhigh | OpenAI | 1260 | 1252–1267 | 10,446 |
| 45 | #45SStep 5 Preview | StepFun | 1260 | 1235–1284 | 604 |
| 46 | #46dola-seed-2.0-pro | ByteDance | 1257 | 1249–1264 | 10,981 |
| 47 | #47xgrok-4.20-beta-0309-reasoning | xAI | 1255 | 1249–1262 | 26,832 |
| 48 | #48kimi-k2.5-thinking | Moonshot AI | 1252 | 1246–1258 | 28,326 |
| 49 | #49Ogpt-5.1-high | OpenAI | 1251 | 1244–1259 | 9,842 |
| 50 | #50Ogpt-5.4-mini-high | OpenAI | 1251 | 1244–1257 | 25,734 |
数据:LMArena leaderboard dataset(CC BY 4.0)。修改:各榜单仅显示前 50 名,分数四舍五入。 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset公司标志为各公司的商标,仅用于帮助区分(图标:Simple Icons)。数据:Epoch AI — Capabilities & benchmarking(CC BY 4.0)。 https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings