Valumigo

LMArena · Koreanisch

Wir rufen regelmäßig öffentliche Benchmark-Daten ab und zeigen sie an: Ranglisten aus LMArena-Nutzerabstimmungen, Epoch AI-Testergebnisse und OpenRouter-Nutzungsranglisten. Für jede Rangliste zeigen wir das Veröffentlichungsdatum und das Abrufdatum. Die Bewertungen stammen nicht von dieser Website.

LMArena-Werte entstehen, indem Menschen zwei Modellantworten vergleichen und für die bessere stimmen (Elo-Verfahren). Liegt der Punkteunterschied innerhalb des Konfidenzintervalls, solltest du die Modelle als etwa gleichwertig ansehen.

So lesen Sie diese Rangliste

Was wird gemessen: Diese Rangliste wird aus den Abstimmungen zu Fragen berechnet, die in den Textdialogen von LMArena als Koreanisch klassifiziert wurden.

So lesen Sie die Werte: Die Rangliste zeigt, welche Modelle Abstimmende bei Fragen auf Koreanisch bevorzugten. Die Sprache der Frage gibt keinen Aufschluss über die Muttersprache oder Identität der Abstimmenden.

Zu beachten: Die Anzahl der Stimmen und die Breite der Konfidenzintervalle unterscheiden sich je nach Sprache und Modell. Prüfen Sie bei neuen Modellen auch die Stimmenzahl, das Aktualisierungsdatum und die Auswertungsbedingungen.

Was diese Rangliste zeigt

  • Die 95%-Konfidenzintervalle von claude-fable-5.1-max auf Platz 1 und muse-spark-1.3-max auf Platz 2 überlappen sich. Aus dieser Auswertung allein lässt sich die Reihenfolge der beiden Modelle schwer eindeutig bestimmen.
  • Bei 24 weiteren Modellen überlappt das Konfidenzintervall mit dem von Platz 1. Interpretieren Sie kleine Rangunterschiede vorsichtig und unter Berücksichtigung der Stimmenzahl.
  • Unter den besten 10 Modellen ist Anthropic mit 4 Modellen am häufigsten vertreten.
  • Das Modell auf Platz 1 hat 177 Stimmen erhalten. Diese Rangliste umfasst 278 Modelle.

Koreanisch LMArena

Veröffentlicht am 2026-10-02 · Abgerufen am 2026-10-04

14001440148015201560
Anthropicclaude-fable-5.1-max
1514
Metamuse-spark-1.3-max
1513
Anthropicclaude-opus-5-max
1498
Anthropicclaude-fable-5-high
1497
Zglm-5.3-max
1481
Googlegemini-3.7-flash-high
1480
Metamuse-spark-1.1
1477
Moonshot AIkimi-k3-max
1473
Metamuse-spark
1472
Anthropicclaude-opus-4-7
1472
Anthropicclaude-opus-4-6
1465
DeepSeekdeepseek-v4-pro-high-20260813
1462
Alibabaqwen3.8-max
1460
Googlegemini-3.1-pro-preview
1458
Googlegemini-3.8-flash-high
1456
Ogpt-5.5-instant
1451
Anthropicclaude-opus-4-8-high
1450
Zglm-5.2-max
1450
Ogpt-5.6-sol-xhigh
1449
Googlegemini-3-pro
1449

Punkte zeigen den Wert, horizontale Linien das 95%-Konfidenzintervall. Überlappende Linien deuten auf ein ähnliches Niveau hin. Das Diagramm zeigt pro Modell nur die am höchsten platzierte Schlussfolgerungseinstellung (high, max usw.). Die Tabelle enthält die Platzierungen aller Einstellungen. Die Ranglisten für Dialog und Bildverständnis verwenden die um Tonfall und Antwortlänge bereinigte Auswertung (style control), die auch auf der LMArena-Website standardmäßig angezeigt wird.

Beste Platzierung je Unternehmen

  • AnthropicAnthropicclaude-fable-5.1-max#1
  • MetaMetamuse-spark-1.3-max#2
  • ZZ.aiglm-5.3-max#6
  • GoogleGooglegemini-3.7-flash-high#7
  • Moonshot AIMoonshot AIkimi-k3-max#9
  • DeepSeekDeepSeekdeepseek-v4-pro-high-20260813#14
  • AlibabaAlibabaqwen3.8-max#15
  • OOpenAIgpt-5.5-instant#18
  • xxAIgrok-4.20-beta1#27
Als Tabelle anzeigen (Top 50)
RangModellAnbieterPunkte95%-KonfidenzintervallStimmen
1#1Anthropicclaude-fable-5.1-maxAnthropic15141468–1560177
2#2Metamuse-spark-1.3-maxMeta15131472–1554205
3#3Anthropicclaude-opus-5-maxAnthropic14981472–1524568
4#4Anthropicclaude-fable-5-highAnthropic14971473–1520722
5#5Anthropicclaude-opus-5-highAnthropic14931473–15131,126
6#6Zglm-5.3-maxZ.ai14811446–1515298
7#7Googlegemini-3.7-flash-highGoogle14801449–1511404
8#8Metamuse-spark-1.1Meta14771453–1500708
9#9Moonshot AIkimi-k3-maxMoonshot AI14731449–1497615
10#10Metamuse-sparkMeta14721433–1511252
11#11Anthropicclaude-opus-4-7Anthropic14721453–14911,144
12#12Anthropicclaude-opus-4-6Anthropic14651447–14821,486
13#13Anthropicclaude-opus-4-7-highAnthropic14641444–14831,100
14#14DeepSeekdeepseek-v4-pro-high-20260813DeepSeek14621421–1502195
15#15Alibabaqwen3.8-maxAlibaba14601432–1488493
16#16Googlegemini-3.1-pro-previewGoogle14581443–14722,145
17#17Googlegemini-3.8-flash-highGoogle14561427–1484487
18#18Ogpt-5.5-instantOpenAI14511421–1481432
19#19Anthropicclaude-opus-4-8-highAnthropic14501431–14701,094
20#20Zglm-5.2-maxZ.ai14501429–1471879
21#21Ogpt-5.6-sol-xhighOpenAI14491426–1473723
22#22Googlegemini-3-proGoogle14491426–1472719
23#23Anthropicclaude-opus-4-5-20251101Anthropic14491430–14671,163
24#24Anthropicclaude-opus-4-6-highAnthropic14461428–14641,310
25#25Ogpt-5.5-highOpenAI14451427–14641,187
26#26Googlegemini-3-flashGoogle14451420–1470579
27#27xgrok-4.20-beta1xAI14441416–1473467
28#28Anthropicclaude-opus-4-8Anthropic14441425–14641,064
29#29Googlegemini-3.5-flash-mediumGoogle14431422–1465855
30#30Googlegemini-3.5-flash-highGoogle14391419–1459960
31#31Zglm-5.3-flashZ.ai14381408–1469397
32#32Googlegemini-3.6-flash-highGoogle14371414–1460685
33#33DeepSeekdeepseek-v4-pro-high-previewDeepSeek14371417–1457980
34#34Xiaomimimo-v2.5-proXiaomi14361418–14541,305
35#35xgrok-4.20-multi-agent-beta-0309xAI14361416–14551,045
36#36Ogpt-5.4-highOpenAI14351415–14541,106
37#37Anthropicclaude-sonnet-4-6Anthropic14341415–14521,146
38#38xgrok-4.20-beta-0309-reasoningxAI14331414–14531,058
39#39xgrok-4.1xAI14321413–14501,142
40#40Anthropicclaude-sonnet-5-highAnthropic14321410–1454792
41#41xgrok-4.6-highxAI14311403–1460468
42#42Ogpt-5.5OpenAI14301411–14481,180
43#43Googlegemini-3-flash (thinking-minimal)Google14291412–14461,408
44#44xgrok-4.1-thinkingxAI14271408–14461,119
45#45Zglm-5Z.ai14271401–1452552
46#46Ogpt-5.4OpenAI14261407–14461,159
47#47Moonshot AIkimi-k2.6Moonshot AI14241402–1447729
48#48Ogpt-5.2-chat-latest-20260210OpenAI14241398–1450555
49#49Ogpt-5.6-terra-xhighOpenAI14241401–1446733
50#50Googlegemini-3.5-flash-liteGoogle14231399–1446708

Daten: LMArena leaderboard dataset (CC BY 4.0). Änderungen: Nur die Top 50 jeder Rangliste, gerundete Werte. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetFirmenlogos sind Marken der jeweiligen Unternehmen und dienen nur zur Unterscheidung (Icons: Simple Icons).Daten: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings