LMArena · 画像理解(ビジョン)
公開されているベンチマーク資料(LMArenaのユーザー投票順位、Epoch AIのテストスコア、OpenRouterの使用量順位)を定期的に取得して表示します。各ランキングの公開日と取得日を併記します。このサイトが独自に採点したものではありません。
このランキングの読み方
測定する能力: 画像を含む質問に対する2つのモデルの回答を比較し、投票した画像理解ランキングです。
スコアの読み方: ユーザーがより好んだ回答の相対スコアです。写真・図表・スクリーンショットの読み取りの客観的な正答率ではありません。
注意点: 文書内の小さな文字やKorean (Hangul)の文字認識など、必要な条件での正確性は別途確認してください。
今回のランキングから読み取れること
- 1位のclaude-fable-5-highと2位のqwen3.8-maxの95%信頼区間は重なっています。この集計だけで2つのモデルの順位を確定するのは困難です。
- 1位と信頼区間が重なるモデルが、ほかに11件あります。小さな順位差は、投票数も踏まえて慎重に解釈してください。
- 上位10モデルのうち、Anthropicのモデルが5モデルで最も多くなっています。
- 1位のモデルが獲得した投票は13,709票で、このランキングには50件のモデルがあります。
画像理解(ビジョン) LMArena
公開日 2026-10-02 · 取得日 2026-10-04
点はスコア、横線は95%信頼区間です。線が重なる場合、実質的に同程度です。 グラフには、同じモデルの推論設定(high・maxなど)のうち、スコアが最も高いものだけを表示しています。表には設定ごとの順位をすべて掲載しています。 会話・ビジョンのランキングは、LMArenaサイトのデフォルトと同じ「口調・長さ補正(style control)」ランキングです。
企業別の最高順位
- Anthropicclaude-fable-5-high#1
- Alibabaqwen3.8-max#2
- Googlegemini-3.7-flash-high#6
- Metamuse-spark#8
- OOpenAIgpt-6.1-sol-max#10
- xxAIgrok-4.5#28
- ZZ.aiglm-5.3-flash#30
- Moonshot AIkimi-k2.6#38
- SStepFunStep 5 Preview#45
表で見る(上位50件)
| 順位 | モデル | 開発元 | スコア | 95%信頼区間 | 投票数 |
|---|---|---|---|---|---|
| 1 | #1claude-fable-5-high | Anthropic | 1309 | 1301–1316 | 13,709 |
| 2 | #2qwen3.8-max | Alibaba | 1301 | 1294–1309 | 10,040 |
| 3 | #3claude-opus-4-6-high | Anthropic | 1299 | 1293–1306 | 22,328 |
| 4 | #4claude-opus-4-7 | Anthropic | 1298 | 1292–1305 | 23,169 |
| 5 | #5claude-opus-4-7-high | Anthropic | 1298 | 1291–1304 | 22,755 |
| 6 | #6gemini-3.7-flash-high | 1296 | 1286–1306 | 3,814 | |
| 7 | #7claude-opus-4-6 | Anthropic | 1294 | 1288–1301 | 26,869 |
| 8 | #8muse-spark | Meta | 1294 | 1284–1303 | 5,868 |
| 9 | #9muse-spark-1.2 (xHigh) | Meta | 1293 | 1279–1307 | 1,951 |
| 10 | #10Ogpt-6.1-sol-max | OpenAI | 1291 | 1275–1307 | 1,408 |
| 11 | #11gemini-3.8-flash-high | 1290 | 1279–1302 | 3,086 | |
| 12 | #12muse-spark-1.3-max | Meta | 1290 | 1280–1301 | 3,843 |
| 13 | #13gemini-3-pro | 1289 | 1282–1297 | 13,620 | |
| 14 | #14claude-opus-5-high | Anthropic | 1289 | 1282–1296 | 15,900 |
| 15 | #15claude-fable-5.1-max | Anthropic | 1288 | 1278–1298 | 4,312 |
| 16 | #16Ogpt-5.5 | OpenAI | 1287 | 1281–1292 | 27,223 |
| 17 | #17claude-opus-4-8-high | Anthropic | 1286 | 1280–1293 | 18,350 |
| 18 | #18Ogpt-5.6-sol-xhigh | OpenAI | 1285 | 1277–1292 | 10,421 |
| 19 | #19gemini-3.5-flash-medium | 1284 | 1277–1291 | 12,467 | |
| 20 | #20Ogpt-6-astra-max | OpenAI | 1284 | 1273–1296 | 3,175 |
| 21 | #21gemini-3.5-flash-high | 1284 | 1277–1291 | 12,336 | |
| 22 | #22Ogpt-5.4-high | OpenAI | 1284 | 1278–1290 | 29,177 |
| 23 | #23muse-spark-1.1 | Meta | 1281 | 1274–1288 | 11,255 |
| 24 | #24Ogpt-5.5-high | OpenAI | 1281 | 1275–1287 | 25,488 |
| 25 | #25gemini-3.6-flash-high | 1280 | 1271–1288 | 7,392 | |
| 26 | #26claude-opus-4-8 | Anthropic | 1279 | 1273–1286 | 18,857 |
| 27 | #27gemini-3.1-pro-preview | 1279 | 1274–1285 | 45,558 | |
| 28 | #28xgrok-4.5 | xAI | 1279 | 1272–1286 | 11,039 |
| 29 | #29Ogpt-5.4 | OpenAI | 1279 | 1272–1285 | 22,828 |
| 30 | #30Zglm-5.3-flash | Z.ai | 1278 | 1269–1288 | 5,479 |
| 31 | #31Ogpt-5.2-chat-latest-20260210 | OpenAI | 1278 | 1271–1285 | 16,480 |
| 32 | #32Ogpt-5.5-instant | OpenAI | 1276 | 1267–1285 | 7,605 |
| 33 | #33claude-sonnet-4-6 | Anthropic | 1275 | 1269–1281 | 27,429 |
| 34 | #34gemini-3-flash | 1273 | 1268–1278 | 39,142 | |
| 35 | #35claude-sonnet-5.5-xhigh | Anthropic | 1268 | 1253–1284 | 1,608 |
| 36 | #36Ogpt-5.6-terra-xhigh | OpenAI | 1268 | 1261–1276 | 10,292 |
| 37 | #37qwen3.7-plus | Alibaba | 1265 | 1259–1272 | 13,065 |
| 38 | #38kimi-k2.6 | Moonshot AI | 1265 | 1258–1272 | 16,387 |
| 39 | #39claude-sonnet-5-high | Anthropic | 1264 | 1257–1271 | 13,029 |
| 40 | #40gemini-3.5-flash-lite | 1264 | 1256–1273 | 7,579 | |
| 41 | #41xgrok-4.6-high | xAI | 1263 | 1254–1273 | 5,736 |
| 42 | #42gemma-4-31b | 1262 | 1256–1268 | 39,111 | |
| 43 | #43gemini-3-flash (thinking-minimal) | 1260 | 1254–1265 | 37,184 | |
| 44 | #44Ogpt-5.6-luna-xhigh | OpenAI | 1260 | 1252–1267 | 10,446 |
| 45 | #45SStep 5 Preview | StepFun | 1260 | 1235–1284 | 604 |
| 46 | #46dola-seed-2.0-pro | ByteDance | 1257 | 1249–1264 | 10,981 |
| 47 | #47xgrok-4.20-beta-0309-reasoning | xAI | 1255 | 1249–1262 | 26,832 |
| 48 | #48kimi-k2.5-thinking | Moonshot AI | 1252 | 1246–1258 | 28,326 |
| 49 | #49Ogpt-5.1-high | OpenAI | 1251 | 1244–1259 | 9,842 |
| 50 | #50Ogpt-5.4-mini-high | OpenAI | 1251 | 1244–1257 | 25,734 |
データ: LMArena leaderboard dataset(CC BY 4.0)。変更: 各ランキングは上位50件のみ表示。スコアは四捨五入。 https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset企業ロゴは各社の商標であり、識別のためにのみ使用しています(アイコン:Simple Icons)。データ:Epoch AI — Capabilities & benchmarking(CC BY 4.0)。 https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings