LMArena · 이미지 이해(비전)
공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.
이 순위표 읽는 법
무엇을 재나: 이미지가 포함된 질문에 대한 두 모델의 답변을 비교해 투표한 이미지 이해 순위입니다.
점수 읽는 법: 사용자가 더 선호한 답변의 상대 점수입니다. 사진·도표·스크린샷 판독의 객관적인 정답률은 아닙니다.
주의할 점: 문서 속 작은 글씨나 한글 인식 등 필요한 조건의 정확도는 별도로 확인하세요.
이번 순위에서 읽을 점
- 1위 claude-fable-5-high와 2위 qwen3.8-max의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
- 1위와 신뢰 구간이 겹치는 모델이 11개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
- 상위 10개 중 Anthropic 모델이 5개로 가장 많습니다.
- 1위 모델이 받은 투표는 13,709표이고, 이 순위표에는 모델 50개가 있습니다.
이미지 이해(비전) LMArena
공개일 2026-10-02 · 가져온 날 2026-10-04
점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.
회사별 최고 순위
- Anthropicclaude-fable-5-high#1
- Alibabaqwen3.8-max#2
- Googlegemini-3.7-flash-high#6
- Metamuse-spark#8
- OOpenAIgpt-6.1-sol-max#10
- xxAIgrok-4.5#28
- ZZ.aiglm-5.3-flash#30
- Moonshot AIkimi-k2.6#38
- SStepFunStep 5 Preview#45
표로 보기 (상위 50개)
| 순위 | 모델 | 만든 곳 | 점수 | 95% 신뢰 구간 | 투표 수 |
|---|---|---|---|---|---|
| 1 | #1claude-fable-5-high | Anthropic | 1309 | 1301–1316 | 13,709 |
| 2 | #2qwen3.8-max | Alibaba | 1301 | 1294–1309 | 10,040 |
| 3 | #3claude-opus-4-6-high | Anthropic | 1299 | 1293–1306 | 22,328 |
| 4 | #4claude-opus-4-7 | Anthropic | 1298 | 1292–1305 | 23,169 |
| 5 | #5claude-opus-4-7-high | Anthropic | 1298 | 1291–1304 | 22,755 |
| 6 | #6gemini-3.7-flash-high | 1296 | 1286–1306 | 3,814 | |
| 7 | #7claude-opus-4-6 | Anthropic | 1294 | 1288–1301 | 26,869 |
| 8 | #8muse-spark | Meta | 1294 | 1284–1303 | 5,868 |
| 9 | #9muse-spark-1.2 (xHigh) | Meta | 1293 | 1279–1307 | 1,951 |
| 10 | #10Ogpt-6.1-sol-max | OpenAI | 1291 | 1275–1307 | 1,408 |
| 11 | #11gemini-3.8-flash-high | 1290 | 1279–1302 | 3,086 | |
| 12 | #12muse-spark-1.3-max | Meta | 1290 | 1280–1301 | 3,843 |
| 13 | #13gemini-3-pro | 1289 | 1282–1297 | 13,620 | |
| 14 | #14claude-opus-5-high | Anthropic | 1289 | 1282–1296 | 15,900 |
| 15 | #15claude-fable-5.1-max | Anthropic | 1288 | 1278–1298 | 4,312 |
| 16 | #16Ogpt-5.5 | OpenAI | 1287 | 1281–1292 | 27,223 |
| 17 | #17claude-opus-4-8-high | Anthropic | 1286 | 1280–1293 | 18,350 |
| 18 | #18Ogpt-5.6-sol-xhigh | OpenAI | 1285 | 1277–1292 | 10,421 |
| 19 | #19gemini-3.5-flash-medium | 1284 | 1277–1291 | 12,467 | |
| 20 | #20Ogpt-6-astra-max | OpenAI | 1284 | 1273–1296 | 3,175 |
| 21 | #21gemini-3.5-flash-high | 1284 | 1277–1291 | 12,336 | |
| 22 | #22Ogpt-5.4-high | OpenAI | 1284 | 1278–1290 | 29,177 |
| 23 | #23muse-spark-1.1 | Meta | 1281 | 1274–1288 | 11,255 |
| 24 | #24Ogpt-5.5-high | OpenAI | 1281 | 1275–1287 | 25,488 |
| 25 | #25gemini-3.6-flash-high | 1280 | 1271–1288 | 7,392 | |
| 26 | #26claude-opus-4-8 | Anthropic | 1279 | 1273–1286 | 18,857 |
| 27 | #27gemini-3.1-pro-preview | 1279 | 1274–1285 | 45,558 | |
| 28 | #28xgrok-4.5 | xAI | 1279 | 1272–1286 | 11,039 |
| 29 | #29Ogpt-5.4 | OpenAI | 1279 | 1272–1285 | 22,828 |
| 30 | #30Zglm-5.3-flash | Z.ai | 1278 | 1269–1288 | 5,479 |
| 31 | #31Ogpt-5.2-chat-latest-20260210 | OpenAI | 1278 | 1271–1285 | 16,480 |
| 32 | #32Ogpt-5.5-instant | OpenAI | 1276 | 1267–1285 | 7,605 |
| 33 | #33claude-sonnet-4-6 | Anthropic | 1275 | 1269–1281 | 27,429 |
| 34 | #34gemini-3-flash | 1273 | 1268–1278 | 39,142 | |
| 35 | #35claude-sonnet-5.5-xhigh | Anthropic | 1268 | 1253–1284 | 1,608 |
| 36 | #36Ogpt-5.6-terra-xhigh | OpenAI | 1268 | 1261–1276 | 10,292 |
| 37 | #37qwen3.7-plus | Alibaba | 1265 | 1259–1272 | 13,065 |
| 38 | #38kimi-k2.6 | Moonshot AI | 1265 | 1258–1272 | 16,387 |
| 39 | #39claude-sonnet-5-high | Anthropic | 1264 | 1257–1271 | 13,029 |
| 40 | #40gemini-3.5-flash-lite | 1264 | 1256–1273 | 7,579 | |
| 41 | #41xgrok-4.6-high | xAI | 1263 | 1254–1273 | 5,736 |
| 42 | #42gemma-4-31b | 1262 | 1256–1268 | 39,111 | |
| 43 | #43gemini-3-flash (thinking-minimal) | 1260 | 1254–1265 | 37,184 | |
| 44 | #44Ogpt-5.6-luna-xhigh | OpenAI | 1260 | 1252–1267 | 10,446 |
| 45 | #45SStep 5 Preview | StepFun | 1260 | 1235–1284 | 604 |
| 46 | #46dola-seed-2.0-pro | ByteDance | 1257 | 1249–1264 | 10,981 |
| 47 | #47xgrok-4.20-beta-0309-reasoning | xAI | 1255 | 1249–1262 | 26,832 |
| 48 | #48kimi-k2.5-thinking | Moonshot AI | 1252 | 1246–1258 | 28,326 |
| 49 | #49Ogpt-5.1-high | OpenAI | 1251 | 1244–1259 | 9,842 |
| 50 | #50Ogpt-5.4-mini-high | OpenAI | 1251 | 1244–1257 | 25,734 |
데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings