Valumigo

LMArena · Spanisch

Wir rufen regelmäßig öffentliche Benchmark-Daten ab und zeigen sie an: Ranglisten aus LMArena-Nutzerabstimmungen, Epoch AI-Testergebnisse und OpenRouter-Nutzungsranglisten. Für jede Rangliste zeigen wir das Veröffentlichungsdatum und das Abrufdatum. Die Bewertungen stammen nicht von dieser Website.

LMArena-Werte entstehen, indem Menschen zwei Modellantworten vergleichen und für die bessere stimmen (Elo-Verfahren). Liegt der Punkteunterschied innerhalb des Konfidenzintervalls, solltest du die Modelle als etwa gleichwertig ansehen.

So lesen Sie diese Rangliste

Was wird gemessen: Diese Rangliste wird aus den Abstimmungen zu Fragen berechnet, die in den Textdialogen von LMArena als Spanisch klassifiziert wurden.

So lesen Sie die Werte: Die Rangliste zeigt, welche Modelle Abstimmende bei Fragen auf Spanisch bevorzugten. Die Sprache der Frage gibt keinen Aufschluss über die Muttersprache oder Identität der Abstimmenden.

Zu beachten: Die Anzahl der Stimmen und die Breite der Konfidenzintervalle unterscheiden sich je nach Sprache und Modell. Prüfen Sie bei neuen Modellen auch die Stimmenzahl, das Aktualisierungsdatum und die Auswertungsbedingungen.

Was diese Rangliste zeigt

  • Die 95%-Konfidenzintervalle von claude-fable-5-high auf Platz 1 und claude-opus-4-6 auf Platz 2 überlappen sich. Aus dieser Auswertung allein lässt sich die Reihenfolge der beiden Modelle schwer eindeutig bestimmen.
  • Bei 27 weiteren Modellen überlappt das Konfidenzintervall mit dem von Platz 1. Interpretieren Sie kleine Rangunterschiede vorsichtig und unter Berücksichtigung der Stimmenzahl.
  • Unter den besten 10 Modellen ist Anthropic mit 6 Modellen am häufigsten vertreten.
  • Das Modell auf Platz 1 hat 1,167 Stimmen erhalten. Diese Rangliste umfasst 295 Modelle.

Spanisch LMArena

Veröffentlicht am 2026-10-02 · Abgerufen am 2026-10-04

14401470150015301560
Anthropicclaude-fable-5-high
1507
Anthropicclaude-opus-4-6
1500
Anthropicclaude-opus-4-7-high
1499
Googlegemini-4-argon-high
1497
Googlegemini-3.7-flash-high
1494
Anthropicclaude-fable-5.1-max
1487
Ogpt-5.5-instant
1485
Moonshot AIkimi-k3-max
1485
Anthropicclaude-opus-5-max
1484
Alibabaqwen3.8-max
1483
Metamuse-spark-1.3-max
1482
Googlegemini-3.1-pro-preview
1481
Anthropicclaude-opus-4-8-high
1481
Metamuse-spark
1480
Googlegemini-3-flash
1478
DeepSeekdeepseek-v4.1-flash-max
1478
Zglm-5.2-max
1477
Googlegemini-3.8-flash-high
1476
Metamuse-spark-1.1
1476
Anthropicclaude-opus-4-5-20251101-high-32k
1476

Punkte zeigen den Wert, horizontale Linien das 95%-Konfidenzintervall. Überlappende Linien deuten auf ein ähnliches Niveau hin. Das Diagramm zeigt pro Modell nur die am höchsten platzierte Schlussfolgerungseinstellung (high, max usw.). Die Tabelle enthält die Platzierungen aller Einstellungen. Die Ranglisten für Dialog und Bildverständnis verwenden die um Tonfall und Antwortlänge bereinigte Auswertung (style control), die auch auf der LMArena-Website standardmäßig angezeigt wird.

Beste Platzierung je Unternehmen

  • AnthropicAnthropicclaude-fable-5-high#1
  • GoogleGooglegemini-4-argon-high#4
  • OOpenAIgpt-5.5-instant#8
  • Moonshot AIMoonshot AIkimi-k3-max#9
  • AlibabaAlibabaqwen3.8-max#11
  • MetaMetamuse-spark-1.3-max#12
  • DeepSeekDeepSeekdeepseek-v4.1-flash-max#17
  • ZZ.aiglm-5.2-max#18
  • BaiduBaiduernie-5.0-preview-1203#28
Als Tabelle anzeigen (Top 50)
RangModellAnbieterPunkte95%-KonfidenzintervallStimmen
1#1Anthropicclaude-fable-5-highAnthropic15071489–15251,167
2#2Anthropicclaude-opus-4-6Anthropic15001487–15132,707
3#3Anthropicclaude-opus-4-7-highAnthropic14991484–15132,043
4#4Googlegemini-4-argon-highGoogle14971456–1538201
5#5Googlegemini-3.7-flash-highGoogle14941471–1518639
6#6Anthropicclaude-opus-4-6-highAnthropic14931480–15062,627
7#7Anthropicclaude-fable-5.1-maxAnthropic14871457–1516375
8#8Ogpt-5.5-instantOpenAI14851463–1507811
9#9Moonshot AIkimi-k3-maxMoonshot AI14851465–1505843
10#10Anthropicclaude-opus-5-maxAnthropic14841463–1506803
11#11Alibabaqwen3.8-maxAlibaba14831459–1506689
12#12Metamuse-spark-1.3-maxMeta14821451–1514365
13#13Googlegemini-3.1-pro-previewGoogle14811470–14923,868
14#14Anthropicclaude-opus-4-8-highAnthropic14811466–14961,840
15#15Metamuse-sparkMeta14801453–1507518
16#16Googlegemini-3-flashGoogle14781460–1497999
17#17DeepSeekdeepseek-v4.1-flash-maxDeepSeek14781442–1513274
18#18Zglm-5.2-maxZ.ai14771460–14941,314
19#19Googlegemini-3.8-flash-highGoogle14761456–1497848
20#20Metamuse-spark-1.1Meta14761458–14951,106
21#21Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14761459–14941,137
22#22Googlegemini-3.6-flash-highGoogle14761456–1497914
23#23Ogpt-5.2-chat-latest-20260210OpenAI14751457–14921,206
24#24Anthropicclaude-opus-4-7Anthropic14741460–14882,099
25#25Anthropicclaude-opus-5-highAnthropic14741458–14901,676
26#26Googlegemini-3-proGoogle14721454–14891,215
27#27Googlegemini-3.5-flash-highGoogle14711455–14881,410
28#28Baiduernie-5.0-preview-1203Baidu14701433–1507238
29#29Ogpt-5.5-highOpenAI14691455–14841,937
30#30ByteDancedola-seed-2.0-proByteDance14691456–14822,565
31#31Thy3Tencent14691439–1498371
32#32xgrok-4.20-beta1xAI14681449–1488952
33#33Anthropicclaude-opus-4-1-20250805Anthropic14681454–14812,293
34#34Ogpt-5.6-sol-xhighOpenAI14671448–14861,040
35#35Googlegemini-3.5-flash-mediumGoogle14671450–14851,274
36#36Anthropicclaude-sonnet-4-6Anthropic14661452–14802,177
37#37Anthropicclaude-opus-4-8Anthropic14661452–14811,918
38#38Anthropicclaude-opus-4-1-20250805-thinking-16kAnthropic14661448–14831,292
39#39Zglm-5.3-flashZ.ai14661444–1487792
40#40xgrok-4.1-thinkingxAI14661451–14801,944
41#41xgrok-4.20-multi-agent-beta-0309xAI14651451–14801,997
42#42Anthropicclaude-opus-4-5-20251101Anthropic14651452–14792,156
43#43Anthropicclaude-sonnet-4-5-20250929Anthropic14651453–14782,487
44#44Zglm-5.1Z.ai14651450–14791,897
45#45Xiaomimimo-v2.5-proXiaomi14641450–14792,126
46#46Ogpt-5.6-luna-xhighOpenAI14631444–14821,070
47#47xgrok-4.20-beta-0309-reasoningxAI14621448–14762,057
48#48Ogpt-5.6-terra-xhighOpenAI14621443–14811,083
49#49Ogpt-5.4OpenAI14611446–14752,037
50#50Moonshot AIkimi-k2.6Moonshot AI14601443–14761,371

Daten: LMArena leaderboard dataset (CC BY 4.0). Änderungen: Nur die Top 50 jeder Rangliste, gerundete Werte. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetFirmenlogos sind Marken der jeweiligen Unternehmen und dienen nur zur Unterscheidung (Icons: Simple Icons).Daten: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings