Valumigo

LMArena · 문서 이해

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: 문서(PDF 등)를 올리고 질문했을 때 두 모델의 답을 비교해 투표한 LMArena 순위입니다.

점수 읽는 법: Bradley–Terry 방식으로 추정한 상대 점수입니다. 95% 신뢰 구간이 넓으면 순위 차이를 신중히 해석하세요.

주의할 점: 다른 순위표보다 공개 주기가 길 수 있으니 공개일을 확인하세요. 문서의 종류와 언어에 따라 결과가 달라질 수 있습니다.

이번 순위에서 읽을 점

  • 1위 claude-opus-5-high와 2위 claude-fable-5.1-max의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
  • 1위와 신뢰 구간이 겹치는 모델이 3개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
  • 상위 10개 중 Anthropic 모델이 7개로 가장 많습니다.
  • 1위 모델이 받은 투표는 8,794표이고, 이 순위표에는 모델 44개가 있습니다.

문서 이해 LMArena

공개일 2026-09-13 · 가져온 날 2026-10-04

1440147015001530
Anthropicclaude-opus-5-high
1516
Anthropicclaude-fable-5.1-max
1513
Anthropicclaude-opus-4-6-high
1507
Anthropicclaude-fable-5
1496
Anthropicclaude-opus-4-7
1495
Ogpt-5.5
1486
Ogpt-5.6-sol-xhigh
1483
Anthropicclaude-sonnet-4-6
1482
Anthropicclaude-opus-4-8-high
1475
Ogpt-5.6-terra-xhigh
1472
Ogpt-5.4
1471
Metamuse-spark-1.3-max
1471
Ogpt-6-astra-max
1468
Anthropicclaude-sonnet-5-high
1466
Metamuse-spark-1.1
1465
Googlegemini-3.5-flash-medium
1463
Anthropicclaude-opus-4-5-20251101
1462
Ogpt-5.6-luna-xhigh
1457
Googlegemini-3.6-flash-high
1456
xgrok-4.6-high
1452

점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다.

회사별 최고 순위

  • AnthropicAnthropicclaude-opus-5-high#1
  • OOpenAIgpt-5.5#8
  • MetaMetamuse-spark-1.3-max#15
  • GoogleGooglegemini-3.5-flash-medium#20
  • xxAIgrok-4.6-high#25
  • Moonshot AIMoonshot AIkimi-k2.6#27
  • AlibabaAlibabaqwen3.7-plus#30
  • MiniMaxMiniMaxminimax-m3#32
  • ZZ.aiglm-5v-turbo#39
표로 보기 (상위 50개)
순위모델만든 곳점수95% 신뢰 구간투표 수
1#1Anthropicclaude-opus-5-highAnthropic15161509–15238,794
2#2Anthropicclaude-fable-5.1-maxAnthropic15131497–15281,403
3#3Anthropicclaude-opus-4-6-highAnthropic15071501–151427,929
4#4Anthropicclaude-opus-4-6Anthropic15071501–151341,260
5#5Anthropicclaude-fable-5Anthropic14961488–15048,497
6#6Anthropicclaude-opus-4-7Anthropic14951489–150122,192
7#7Anthropicclaude-opus-4-7-highAnthropic14951488–150121,957
8#8Ogpt-5.5OpenAI14861479–149221,279
9#9Ogpt-5.5-highOpenAI14841478–149120,944
10#10Ogpt-5.6-sol-xhighOpenAI14831474–14924,818
11#11Anthropicclaude-sonnet-4-6Anthropic14821476–148857,813
12#12Anthropicclaude-opus-4-8-highAnthropic14751468–148211,551
13#13Ogpt-5.6-terra-xhighOpenAI14721463–14805,787
14#14Ogpt-5.4OpenAI14711465–147733,331
15#15Metamuse-spark-1.3-maxMeta14711452–14891,006
16#16Ogpt-6-astra-maxOpenAI14681453–14821,621
17#17Anthropicclaude-sonnet-5-highAnthropic14661458–14747,411
18#18Metamuse-spark-1.1Meta14651456–14744,885
19#19Anthropicclaude-opus-4-8Anthropic14641457–147112,128
20#20Googlegemini-3.5-flash-mediumGoogle14631455–14716,500
21#21Anthropicclaude-opus-4-5-20251101Anthropic14621452–14737,981
22#22Googlegemini-3.5-flash-highGoogle14611452–14714,061
23#23Ogpt-5.6-luna-xhighOpenAI14571449–14655,766
24#24Googlegemini-3.6-flash-highGoogle14561445–14672,975
25#25xgrok-4.6-highxAI14521440–14642,258
26#26xgrok-4.5xAI14521443–14614,965
27#27Moonshot AIkimi-k2.6Moonshot AI14511443–145811,291
28#28Anthropicclaude-sonnet-4-5-20250929Anthropic14501444–145631,455
29#29Metamuse-sparkMeta14441426–14621,084
30#30Alibabaqwen3.7-plusAlibaba14441435–14534,591
31#31Googlegemini-3.1-pro-previewGoogle14441439–144949,457
32#32MiniMaxminimax-m3MiniMax14351427–14436,314
33#33Googlegemini-3-proGoogle14341425–144310,769
34#34Moonshot AIkimi-k2.5-thinkingMoonshot AI14301423–143721,569
35#35Googlegemma-4-31bGoogle14251417–143212,326
36#36Googlegemini-2.5-proGoogle14211415–142725,110
37#37Anthropicclaude-haiku-4-5-20251001Anthropic14201414–142634,677
38#38xgrok-4.20-beta-0309-reasoningxAI14161409–142320,948
39#39Zglm-5v-turboZ.ai14161407–14246,995
40#40Googlegemini-3-flashGoogle14131404–14227,158
41#41Ogpt-5.2-highOpenAI14051395–14147,108
42#42Ogpt-5.1OpenAI14031394–14138,244
43#43Ogpt-5.5-instantOpenAI14031395–14118,497
44#44Ogpt-5.2OpenAI14011395–140728,212

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings