Valumigo

LMArena · 일본어

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: LMArena의 텍스트 대화 중 일본어로 분류된 질문의 투표를 이용해 계산한 순위입니다.

점수 읽는 법: 일본어 질문에서 투표 참여자가 더 선호한 모델을 보여 줍니다. 질문 언어가 투표자의 모국어나 신원을 뜻하지는 않습니다.

주의할 점: 언어와 모델에 따라 투표 수와 신뢰 구간 폭이 다릅니다. 새 모델은 투표 수, 업데이트 날짜와 집계 조건을 함께 확인하세요.

이번 순위에서 읽을 점

  • 1위 claude-fable-5.1-max와 2위 claude-fable-5-high의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
  • 1위와 신뢰 구간이 겹치는 모델이 25개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
  • 상위 10개 중 Google 모델이 4개로 가장 많습니다.
  • 1위 모델이 받은 투표는 200표이고, 이 순위표에는 모델 274개가 있습니다.

일본어 LMArena

공개일 2026-10-02 · 가져온 날 2026-10-04

140014401480152015601600
Anthropicclaude-fable-5.1-max
1542
Anthropicclaude-fable-5-high
1524
Googlegemini-3-pro
1508
Anthropicclaude-opus-5-high
1506
Googlegemini-3.7-flash-high
1504
Ogpt-5.5-high
1503
Googlegemini-3.8-flash-high
1503
Moonshot AIkimi-k3-max
1502
Googlegemini-3.1-pro-preview
1499
Metamuse-spark-1.3-max
1498
Anthropicclaude-opus-4-6-high
1495
Ogpt-5.6-sol-xhigh
1495
Googlegemini-3-flash
1487
Alibabaqwen3.5-max-preview
1486
Anthropicclaude-opus-4-7-high
1485
Googlegemini-3.5-flash-high
1479
Ogpt-5.4-high
1479
xgrok-4.20-beta1
1478
Googlegemini-3.6-flash-high
1478
Alibabaqwen3.8-max
1473

점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.

회사별 최고 순위

  • AnthropicAnthropicclaude-fable-5.1-max#1
  • GoogleGooglegemini-3-pro#3
  • OOpenAIgpt-5.5-high#6
  • Moonshot AIMoonshot AIkimi-k3-max#8
  • MetaMetamuse-spark-1.3-max#10
  • AlibabaAlibabaqwen3.5-max-preview#15
  • xxAIgrok-4.20-beta1#20
  • DeepSeekDeepSeekdeepseek-v4-pro#31
  • ZZ.aiglm-5.2-max#33
표로 보기 (상위 50개)
순위모델만든 곳점수95% 신뢰 구간투표 수
1#1Anthropicclaude-fable-5.1-maxAnthropic15421496–1588200
2#2Anthropicclaude-fable-5-highAnthropic15241496–1551538
3#3Googlegemini-3-proGoogle15081478–1538471
4#4Anthropicclaude-opus-5-highAnthropic15061483–1528958
5#5Googlegemini-3.7-flash-highGoogle15041471–1538340
6#6Ogpt-5.5-highOpenAI15031481–1525895
7#7Googlegemini-3.8-flash-highGoogle15031473–1533462
8#8Moonshot AIkimi-k3-maxMoonshot AI15021474–1530508
9#9Googlegemini-3.1-pro-previewGoogle14991481–15171,409
10#10Metamuse-spark-1.3-maxMeta14981452–1544188
11#11Anthropicclaude-opus-5-maxAnthropic14971467–1526482
12#12Anthropicclaude-opus-4-6-highAnthropic14951473–1518845
13#13Ogpt-5.6-sol-xhighOpenAI14951468–1523549
14#14Googlegemini-3-flashGoogle14871453–1521337
15#15Alibabaqwen3.5-max-previewAlibaba14861442–1531207
16#16Anthropicclaude-opus-4-7-highAnthropic14851461–1510705
17#17Anthropicclaude-opus-4-6Anthropic14801459–1502875
18#18Googlegemini-3.5-flash-highGoogle14791454–1504672
19#19Ogpt-5.4-highOpenAI14791454–1504671
20#20xgrok-4.20-beta1xAI14781437–1518225
21#21Googlegemini-3.6-flash-highGoogle14781452–1504598
22#22Ogpt-5.5OpenAI14771454–1501800
23#23Alibabaqwen3.8-maxAlibaba14731442–1505402
24#24Anthropicclaude-opus-4-7Anthropic14731450–1496797
25#25Metamuse-spark-1.1Meta14711445–1496633
26#26Ogpt-5.6-terra-xhighOpenAI14661439–1494559
27#27Googlegemini-3.5-flash-mediumGoogle14611436–1486668
28#28Ogpt-5.1-highOpenAI14601432–1488458
29#29Ogpt-5.5-instantOpenAI14601422–1498258
30#30Anthropicclaude-opus-4-8Anthropic14581436–1480874
31#31DeepSeekdeepseek-v4-proDeepSeek14571433–1481715
32#32Anthropicclaude-opus-4-8-highAnthropic14561434–1478881
33#33Zglm-5.2-maxZ.ai14551431–1480702
34#34Zglm-5.3-maxZ.ai14541420–1488327
35#35Ogpt-5.2-chat-latest-20260210OpenAI14491412–1485266
36#36Googlegemini-3.5-flash-liteGoogle14461419–1473565
37#37Googlegemini-2.5-proGoogle14451430–14602,037
38#38Ogpt-5.4OpenAI14451421–1469680
39#39Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14441413–1476376
40#40Anthropicclaude-opus-4-5-20251101Anthropic14411417–1466633
41#41Moonshot AIkimi-k2.6Moonshot AI14411413–1469497
42#42Anthropicclaude-sonnet-5-highAnthropic14411416–1466662
43#43xgrok-4.5xAI14401412–1468522
44#44Zglm-4.7Z.ai14401385–1494123
45#45Anthropicclaude-sonnet-4-6Anthropic14401417–1462792
46#46Ogpt-4.5-preview-2025-02-27OpenAI14391401–1477271
47#47Ogpt-5.2-highOpenAI14371407–1467443
48#48Zglm-5.1Z.ai14361412–1459754
49#49Googlegemini-3-flash (thinking-minimal)Google14341412–1456847
50#50Zglm-5.3-flashZ.ai14331402–1464408

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings