Valumigo

LMArena · 한국어

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: LMArena의 텍스트 대화 중 한국어로 분류된 질문의 투표를 이용해 계산한 순위입니다.

점수 읽는 법: 한국어 질문에서 투표 참여자가 더 선호한 모델을 보여 줍니다. 질문 언어가 투표자의 모국어나 신원을 뜻하지는 않습니다.

주의할 점: 언어와 모델에 따라 투표 수와 신뢰 구간 폭이 다릅니다. 새 모델은 투표 수, 업데이트 날짜와 집계 조건을 함께 확인하세요.

이번 순위에서 읽을 점

  • 1위 claude-fable-5.1-max와 2위 muse-spark-1.3-max의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
  • 1위와 신뢰 구간이 겹치는 모델이 24개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
  • 상위 10개 중 Anthropic 모델이 4개로 가장 많습니다.
  • 1위 모델이 받은 투표는 177표이고, 이 순위표에는 모델 278개가 있습니다.

한국어 LMArena

공개일 2026-10-02 · 가져온 날 2026-10-04

14001440148015201560
Anthropicclaude-fable-5.1-max
1514
Metamuse-spark-1.3-max
1513
Anthropicclaude-opus-5-max
1498
Anthropicclaude-fable-5-high
1497
Zglm-5.3-max
1481
Googlegemini-3.7-flash-high
1480
Metamuse-spark-1.1
1477
Moonshot AIkimi-k3-max
1473
Metamuse-spark
1472
Anthropicclaude-opus-4-7
1472
Anthropicclaude-opus-4-6
1465
DeepSeekdeepseek-v4-pro-high-20260813
1462
Alibabaqwen3.8-max
1460
Googlegemini-3.1-pro-preview
1458
Googlegemini-3.8-flash-high
1456
Ogpt-5.5-instant
1451
Anthropicclaude-opus-4-8-high
1450
Zglm-5.2-max
1450
Ogpt-5.6-sol-xhigh
1449
Googlegemini-3-pro
1449

점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.

회사별 최고 순위

  • AnthropicAnthropicclaude-fable-5.1-max#1
  • MetaMetamuse-spark-1.3-max#2
  • ZZ.aiglm-5.3-max#6
  • GoogleGooglegemini-3.7-flash-high#7
  • Moonshot AIMoonshot AIkimi-k3-max#9
  • DeepSeekDeepSeekdeepseek-v4-pro-high-20260813#14
  • AlibabaAlibabaqwen3.8-max#15
  • OOpenAIgpt-5.5-instant#18
  • xxAIgrok-4.20-beta1#27
표로 보기 (상위 50개)
순위모델만든 곳점수95% 신뢰 구간투표 수
1#1Anthropicclaude-fable-5.1-maxAnthropic15141468–1560177
2#2Metamuse-spark-1.3-maxMeta15131472–1554205
3#3Anthropicclaude-opus-5-maxAnthropic14981472–1524568
4#4Anthropicclaude-fable-5-highAnthropic14971473–1520722
5#5Anthropicclaude-opus-5-highAnthropic14931473–15131,126
6#6Zglm-5.3-maxZ.ai14811446–1515298
7#7Googlegemini-3.7-flash-highGoogle14801449–1511404
8#8Metamuse-spark-1.1Meta14771453–1500708
9#9Moonshot AIkimi-k3-maxMoonshot AI14731449–1497615
10#10Metamuse-sparkMeta14721433–1511252
11#11Anthropicclaude-opus-4-7Anthropic14721453–14911,144
12#12Anthropicclaude-opus-4-6Anthropic14651447–14821,486
13#13Anthropicclaude-opus-4-7-highAnthropic14641444–14831,100
14#14DeepSeekdeepseek-v4-pro-high-20260813DeepSeek14621421–1502195
15#15Alibabaqwen3.8-maxAlibaba14601432–1488493
16#16Googlegemini-3.1-pro-previewGoogle14581443–14722,145
17#17Googlegemini-3.8-flash-highGoogle14561427–1484487
18#18Ogpt-5.5-instantOpenAI14511421–1481432
19#19Anthropicclaude-opus-4-8-highAnthropic14501431–14701,094
20#20Zglm-5.2-maxZ.ai14501429–1471879
21#21Ogpt-5.6-sol-xhighOpenAI14491426–1473723
22#22Googlegemini-3-proGoogle14491426–1472719
23#23Anthropicclaude-opus-4-5-20251101Anthropic14491430–14671,163
24#24Anthropicclaude-opus-4-6-highAnthropic14461428–14641,310
25#25Ogpt-5.5-highOpenAI14451427–14641,187
26#26Googlegemini-3-flashGoogle14451420–1470579
27#27xgrok-4.20-beta1xAI14441416–1473467
28#28Anthropicclaude-opus-4-8Anthropic14441425–14641,064
29#29Googlegemini-3.5-flash-mediumGoogle14431422–1465855
30#30Googlegemini-3.5-flash-highGoogle14391419–1459960
31#31Zglm-5.3-flashZ.ai14381408–1469397
32#32Googlegemini-3.6-flash-highGoogle14371414–1460685
33#33DeepSeekdeepseek-v4-pro-high-previewDeepSeek14371417–1457980
34#34Xiaomimimo-v2.5-proXiaomi14361418–14541,305
35#35xgrok-4.20-multi-agent-beta-0309xAI14361416–14551,045
36#36Ogpt-5.4-highOpenAI14351415–14541,106
37#37Anthropicclaude-sonnet-4-6Anthropic14341415–14521,146
38#38xgrok-4.20-beta-0309-reasoningxAI14331414–14531,058
39#39xgrok-4.1xAI14321413–14501,142
40#40Anthropicclaude-sonnet-5-highAnthropic14321410–1454792
41#41xgrok-4.6-highxAI14311403–1460468
42#42Ogpt-5.5OpenAI14301411–14481,180
43#43Googlegemini-3-flash (thinking-minimal)Google14291412–14461,408
44#44xgrok-4.1-thinkingxAI14271408–14461,119
45#45Zglm-5Z.ai14271401–1452552
46#46Ogpt-5.4OpenAI14261407–14461,159
47#47Moonshot AIkimi-k2.6Moonshot AI14241402–1447729
48#48Ogpt-5.2-chat-latest-20260210OpenAI14241398–1450555
49#49Ogpt-5.6-terra-xhighOpenAI14241401–1446733
50#50Googlegemini-3.5-flash-liteGoogle14231399–1446708

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings