LMArena · 한국어
공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.
이 순위표 읽는 법
무엇을 재나: LMArena의 텍스트 대화 중 한국어로 분류된 질문의 투표를 이용해 계산한 순위입니다.
점수 읽는 법: 한국어 질문에서 투표 참여자가 더 선호한 모델을 보여 줍니다. 질문 언어가 투표자의 모국어나 신원을 뜻하지는 않습니다.
주의할 점: 언어와 모델에 따라 투표 수와 신뢰 구간 폭이 다릅니다. 새 모델은 투표 수, 업데이트 날짜와 집계 조건을 함께 확인하세요.
이번 순위에서 읽을 점
- 1위 claude-fable-5.1-max와 2위 muse-spark-1.3-max의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
- 1위와 신뢰 구간이 겹치는 모델이 24개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
- 상위 10개 중 Anthropic 모델이 4개로 가장 많습니다.
- 1위 모델이 받은 투표는 177표이고, 이 순위표에는 모델 278개가 있습니다.
한국어 LMArena
공개일 2026-10-02 · 가져온 날 2026-10-04
점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.
회사별 최고 순위
- Anthropicclaude-fable-5.1-max#1
- Metamuse-spark-1.3-max#2
- ZZ.aiglm-5.3-max#6
- Googlegemini-3.7-flash-high#7
- Moonshot AIkimi-k3-max#9
- DeepSeekdeepseek-v4-pro-high-20260813#14
- Alibabaqwen3.8-max#15
- OOpenAIgpt-5.5-instant#18
- xxAIgrok-4.20-beta1#27
표로 보기 (상위 50개)
| 순위 | 모델 | 만든 곳 | 점수 | 95% 신뢰 구간 | 투표 수 |
|---|---|---|---|---|---|
| 1 | #1claude-fable-5.1-max | Anthropic | 1514 | 1468–1560 | 177 |
| 2 | #2muse-spark-1.3-max | Meta | 1513 | 1472–1554 | 205 |
| 3 | #3claude-opus-5-max | Anthropic | 1498 | 1472–1524 | 568 |
| 4 | #4claude-fable-5-high | Anthropic | 1497 | 1473–1520 | 722 |
| 5 | #5claude-opus-5-high | Anthropic | 1493 | 1473–1513 | 1,126 |
| 6 | #6Zglm-5.3-max | Z.ai | 1481 | 1446–1515 | 298 |
| 7 | #7gemini-3.7-flash-high | 1480 | 1449–1511 | 404 | |
| 8 | #8muse-spark-1.1 | Meta | 1477 | 1453–1500 | 708 |
| 9 | #9kimi-k3-max | Moonshot AI | 1473 | 1449–1497 | 615 |
| 10 | #10muse-spark | Meta | 1472 | 1433–1511 | 252 |
| 11 | #11claude-opus-4-7 | Anthropic | 1472 | 1453–1491 | 1,144 |
| 12 | #12claude-opus-4-6 | Anthropic | 1465 | 1447–1482 | 1,486 |
| 13 | #13claude-opus-4-7-high | Anthropic | 1464 | 1444–1483 | 1,100 |
| 14 | #14deepseek-v4-pro-high-20260813 | DeepSeek | 1462 | 1421–1502 | 195 |
| 15 | #15qwen3.8-max | Alibaba | 1460 | 1432–1488 | 493 |
| 16 | #16gemini-3.1-pro-preview | 1458 | 1443–1472 | 2,145 | |
| 17 | #17gemini-3.8-flash-high | 1456 | 1427–1484 | 487 | |
| 18 | #18Ogpt-5.5-instant | OpenAI | 1451 | 1421–1481 | 432 |
| 19 | #19claude-opus-4-8-high | Anthropic | 1450 | 1431–1470 | 1,094 |
| 20 | #20Zglm-5.2-max | Z.ai | 1450 | 1429–1471 | 879 |
| 21 | #21Ogpt-5.6-sol-xhigh | OpenAI | 1449 | 1426–1473 | 723 |
| 22 | #22gemini-3-pro | 1449 | 1426–1472 | 719 | |
| 23 | #23claude-opus-4-5-20251101 | Anthropic | 1449 | 1430–1467 | 1,163 |
| 24 | #24claude-opus-4-6-high | Anthropic | 1446 | 1428–1464 | 1,310 |
| 25 | #25Ogpt-5.5-high | OpenAI | 1445 | 1427–1464 | 1,187 |
| 26 | #26gemini-3-flash | 1445 | 1420–1470 | 579 | |
| 27 | #27xgrok-4.20-beta1 | xAI | 1444 | 1416–1473 | 467 |
| 28 | #28claude-opus-4-8 | Anthropic | 1444 | 1425–1464 | 1,064 |
| 29 | #29gemini-3.5-flash-medium | 1443 | 1422–1465 | 855 | |
| 30 | #30gemini-3.5-flash-high | 1439 | 1419–1459 | 960 | |
| 31 | #31Zglm-5.3-flash | Z.ai | 1438 | 1408–1469 | 397 |
| 32 | #32gemini-3.6-flash-high | 1437 | 1414–1460 | 685 | |
| 33 | #33deepseek-v4-pro-high-preview | DeepSeek | 1437 | 1417–1457 | 980 |
| 34 | #34mimo-v2.5-pro | Xiaomi | 1436 | 1418–1454 | 1,305 |
| 35 | #35xgrok-4.20-multi-agent-beta-0309 | xAI | 1436 | 1416–1455 | 1,045 |
| 36 | #36Ogpt-5.4-high | OpenAI | 1435 | 1415–1454 | 1,106 |
| 37 | #37claude-sonnet-4-6 | Anthropic | 1434 | 1415–1452 | 1,146 |
| 38 | #38xgrok-4.20-beta-0309-reasoning | xAI | 1433 | 1414–1453 | 1,058 |
| 39 | #39xgrok-4.1 | xAI | 1432 | 1413–1450 | 1,142 |
| 40 | #40claude-sonnet-5-high | Anthropic | 1432 | 1410–1454 | 792 |
| 41 | #41xgrok-4.6-high | xAI | 1431 | 1403–1460 | 468 |
| 42 | #42Ogpt-5.5 | OpenAI | 1430 | 1411–1448 | 1,180 |
| 43 | #43gemini-3-flash (thinking-minimal) | 1429 | 1412–1446 | 1,408 | |
| 44 | #44xgrok-4.1-thinking | xAI | 1427 | 1408–1446 | 1,119 |
| 45 | #45Zglm-5 | Z.ai | 1427 | 1401–1452 | 552 |
| 46 | #46Ogpt-5.4 | OpenAI | 1426 | 1407–1446 | 1,159 |
| 47 | #47kimi-k2.6 | Moonshot AI | 1424 | 1402–1447 | 729 |
| 48 | #48Ogpt-5.2-chat-latest-20260210 | OpenAI | 1424 | 1398–1450 | 555 |
| 49 | #49Ogpt-5.6-terra-xhigh | OpenAI | 1424 | 1401–1446 | 733 |
| 50 | #50gemini-3.5-flash-lite | 1423 | 1399–1446 | 708 |
데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings