Valumigo

LMArena · 독일어

공개된 벤치마크 자료(LMArena 사용자 투표 순위, Epoch AI 시험 점수, OpenRouter 사용량 순위)를 정기적으로 받아 보여 줍니다. 각 순위표의 공개일과 가져온 날을 함께 표시합니다. 이 사이트가 직접 매긴 점수가 아닙니다.

LMArena 점수는 사람들이 두 모델의 답을 나란히 보고 더 나은 쪽에 투표한 결과(Elo 방식)입니다. 점수 차이가 신뢰 구간 안이면 사실상 비슷한 수준으로 보세요.

이 순위표 읽는 법

무엇을 재나: LMArena의 텍스트 대화 중 독일어로 분류된 질문의 투표를 이용해 계산한 순위입니다.

점수 읽는 법: 독일어 질문에서 투표 참여자가 더 선호한 모델을 보여 줍니다. 질문 언어가 투표자의 모국어나 신원을 뜻하지는 않습니다.

주의할 점: 언어와 모델에 따라 투표 수와 신뢰 구간 폭이 다릅니다. 새 모델은 투표 수, 업데이트 날짜와 집계 조건을 함께 확인하세요.

이번 순위에서 읽을 점

  • 1위 gemini-3-pro와 2위 glm-5.3-max의 95% 신뢰 구간이 겹칩니다. 이 집계만으로 두 모델의 순서를 확정하기는 어렵습니다.
  • 1위와 신뢰 구간이 겹치는 모델이 32개 더 있습니다. 작은 순위 차이는 투표 수와 함께 신중히 해석하세요.
  • 상위 10개 중 Anthropic 모델이 4개로 가장 많습니다.
  • 1위 모델이 받은 투표는 805표이고, 이 순위표에는 모델 307개가 있습니다.

독일어 LMArena

공개일 2026-10-02 · 가져온 날 2026-10-04

144014701500153015601590
Googlegemini-3-pro
1522
Zglm-5.3-max
1520
Metamuse-spark-1.3-max
1519
Metamuse-spark
1511
Anthropicclaude-opus-4-6-high
1510
Anthropicclaude-opus-5-max
1506
Anthropicclaude-opus-4-7-high
1505
Anthropicclaude-fable-5-high
1503
Ogpt-5.6-sol-xhigh
1501
Googlegemini-3-flash
1499
Googlegemini-3.1-pro-preview
1495
Moonshot AIkimi-k3-max
1492
Googlegemini-3.5-flash-medium
1492
Anthropicclaude-opus-4-8-high
1491
Ogpt-5.5
1490
Alibabaqwen3.8-max
1490
xgrok-4.20-beta1
1489
Anthropicclaude-fable-5.1-max
1487
Googlegemini-3.7-flash-high
1487
Ogpt-5.6-terra-xhigh
1482

점은 점수, 가로선은 95% 신뢰 구간입니다. 선이 겹치면 사실상 비슷한 수준입니다. 그래프에는 같은 모델의 추론 설정(high·max 등) 중 가장 높은 하나만 표시합니다. 표에는 설정별 순위가 모두 나옵니다. 대화·비전 순위는 LMArena 사이트의 기본값과 같은 '말투·길이 보정(style control)' 순위입니다.

회사별 최고 순위

  • GoogleGooglegemini-3-pro#1
  • ZZ.aiglm-5.3-max#2
  • MetaMetamuse-spark-1.3-max#3
  • AnthropicAnthropicclaude-opus-4-6-high#5
  • OOpenAIgpt-5.6-sol-xhigh#9
  • Moonshot AIMoonshot AIkimi-k3-max#13
  • AlibabaAlibabaqwen3.8-max#17
  • xxAIgrok-4.20-beta1#19
  • BaiduBaiduernie-5.1#38
표로 보기 (상위 50개)
순위모델만든 곳점수95% 신뢰 구간투표 수
1#1Googlegemini-3-proGoogle15221500–1545805
2#2Zglm-5.3-maxZ.ai15201486–1554282
3#3Metamuse-spark-1.3-maxMeta15191477–1562182
4#4Metamuse-sparkMeta15111471–1551237
5#5Anthropicclaude-opus-4-6-highAnthropic15101492–15271,251
6#6Anthropicclaude-opus-5-maxAnthropic15061478–1534489
7#7Anthropicclaude-opus-4-7-highAnthropic15051486–15241,014
8#8Anthropicclaude-fable-5-highAnthropic15031478–1528586
9#9Ogpt-5.6-sol-xhighOpenAI15011476–1526566
10#10Googlegemini-3-flashGoogle14991474–1524572
11#11Anthropicclaude-opus-4-7Anthropic14971477–15161,035
12#12Googlegemini-3.1-pro-previewGoogle14951480–15102,025
13#13Moonshot AIkimi-k3-maxMoonshot AI14921466–1518547
14#14Googlegemini-3.5-flash-mediumGoogle14921469–1514741
15#15Anthropicclaude-opus-4-8-highAnthropic14911472–15101,061
16#16Ogpt-5.5OpenAI14901471–15091,105
17#17Alibabaqwen3.8-maxAlibaba14901460–1519362
18#18Anthropicclaude-opus-4-6Anthropic14901472–15071,277
19#19xgrok-4.20-beta1xAI14891461–1517442
20#20Anthropicclaude-fable-5.1-maxAnthropic14871448–1527220
21#21Googlegemini-3.7-flash-highGoogle14871454–1520313
22#22Anthropicclaude-opus-5-highAnthropic14871466–1508917
23#23Googlegemini-3.5-flash-highGoogle14831460–1505762
24#24Ogpt-5.6-terra-xhighOpenAI14821458–1507592
25#25Ogpt-5.2-chat-latest-20260210OpenAI14811456–1506564
26#26Googlegemini-3.6-flash-highGoogle14791454–1504571
27#27Anthropicclaude-opus-4-5-20251101Anthropic14781460–14971,129
28#28Ogpt-4.5-preview-2025-02-27OpenAI14771445–1509319
29#29Googlegemini-3-flash (thinking-minimal)Google14771460–14931,464
30#30Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14771453–1500662
31#31Metamuse-spark-1.1Meta14761453–1500687
32#32Ogpt-5.6-luna-xhighOpenAI14761452–1500655
33#33Ogpt-5.4-highOpenAI14761457–14951,088
34#34xgrok-4.20-multi-agent-beta-0309xAI14751456–14951,046
35#35Zglm-5.2-maxZ.ai14731451–1494805
36#36Alibabaqwen3.5-max-previewAlibaba14721442–1502382
37#37Googlegemini-3.5-flash-liteGoogle14721448–1495637
38#38Baiduernie-5.1Baidu14721449–1494749
39#39Anthropicclaude-opus-4-8Anthropic14721453–14901,082
40#40Googlegemini-3.8-flash-highGoogle14721443–1500398
41#41Ogpt-5.5-highOpenAI14711452–14901,050
42#42Googlegemini-2.5-proGoogle14701457–14832,638
43#43DeepSeekdeepseek-v4-proDeepSeek14681449–1488999
44#44Anthropicclaude-sonnet-5-highAnthropic14681445–1491719
45#45Alibabaqwen3.7-plusAlibaba14661444–1488760
46#46xgrok-4.1xAI14661448–14841,248
47#47Ogpt-5.5-instantOpenAI14651436–1494427
48#48Zglm-5.3-flashZ.ai14651435–1494395
49#49Xiaomimimo-v2.5-proXiaomi14641445–14821,198
50#50Zglm-5.1Z.ai14641444–1484928

데이터: LMArena leaderboard dataset (CC BY 4.0). 변경: 각 순위표의 상위 50개만 표시, 점수는 반올림. https://huggingface.co/datasets/lmarena-ai/leaderboard-dataset회사 로고는 각 회사의 상표이며 구분을 돕기 위해서만 씁니다(아이콘: Simple Icons).데이터: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings