Valumigo

LMArena · Allemand

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Ce classement est calculé à partir des votes sur les questions classées comme étant en Allemand dans les conversations textuelles de LMArena.

Comment lire le score : Ce classement montre les modèles préférés par les votants pour les questions en Allemand. La langue de la question ne renseigne pas sur la langue maternelle ou l’identité des votants.

Points à surveiller : Le nombre de votes et la largeur des intervalles de confiance varient selon la langue et le modèle. Pour un nouveau modèle, vérifiez aussi le nombre de votes, la date de mise à jour et les conditions d’agrégation.

Ce que révèle ce classement

  • Les intervalles de confiance à 95% de gemini-3-pro, en 1re place, et de glm-5.3-max, en 2e place, se chevauchent. Cette agrégation seule permet difficilement de déterminer leur ordre.
  • 32 autres modèles ont un intervalle de confiance qui chevauche celui du premier. Interprétez les petits écarts de classement avec prudence, en tenant compte du nombre de votes.
  • Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 4 modèles.
  • Le modèle en 1re place a reçu 805 votes, et ce classement comprend 307 modèles.

Allemand LMArena

Publié le 2026-10-02 · Récupéré le 2026-10-04

144014701500153015601590
Googlegemini-3-pro
1522
Zglm-5.3-max
1520
Metamuse-spark-1.3-max
1519
Metamuse-spark
1511
Anthropicclaude-opus-4-6-high
1510
Anthropicclaude-opus-5-max
1506
Anthropicclaude-opus-4-7-high
1505
Anthropicclaude-fable-5-high
1503
Ogpt-5.6-sol-xhigh
1501
Googlegemini-3-flash
1499
Googlegemini-3.1-pro-preview
1495
Moonshot AIkimi-k3-max
1492
Googlegemini-3.5-flash-medium
1492
Anthropicclaude-opus-4-8-high
1491
Ogpt-5.5
1490
Alibabaqwen3.8-max
1490
xgrok-4.20-beta1
1489
Anthropicclaude-fable-5.1-max
1487
Googlegemini-3.7-flash-high
1487
Ogpt-5.6-terra-xhigh
1482

Les points indiquent les scores, les lignes horizontales les intervalles de confiance à 95 %. Si les lignes se chevauchent, les performances sont globalement similaires. Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages. Les classements de conversation et de vision utilisent la correction du style et de la longueur (style control), comme le réglage par défaut du site LMArena.

Meilleur classement par entreprise

  • GoogleGooglegemini-3-pro#1
  • ZZ.aiglm-5.3-max#2
  • MetaMetamuse-spark-1.3-max#3
  • AnthropicAnthropicclaude-opus-4-6-high#5
  • OOpenAIgpt-5.6-sol-xhigh#9
  • Moonshot AIMoonshot AIkimi-k3-max#13
  • AlibabaAlibabaqwen3.8-max#17
  • xxAIgrok-4.20-beta1#19
  • BaiduBaiduernie-5.1#38
Voir le tableau (top 50)
RangModèleDéveloppeurScoreIntervalle de confiance à 95%Nombre de votes
1#1Googlegemini-3-proGoogle15221500–1545805
2#2Zglm-5.3-maxZ.ai15201486–1554282
3#3Metamuse-spark-1.3-maxMeta15191477–1562182
4#4Metamuse-sparkMeta15111471–1551237
5#5Anthropicclaude-opus-4-6-highAnthropic15101492–15271,251
6#6Anthropicclaude-opus-5-maxAnthropic15061478–1534489
7#7Anthropicclaude-opus-4-7-highAnthropic15051486–15241,014
8#8Anthropicclaude-fable-5-highAnthropic15031478–1528586
9#9Ogpt-5.6-sol-xhighOpenAI15011476–1526566
10#10Googlegemini-3-flashGoogle14991474–1524572
11#11Anthropicclaude-opus-4-7Anthropic14971477–15161,035
12#12Googlegemini-3.1-pro-previewGoogle14951480–15102,025
13#13Moonshot AIkimi-k3-maxMoonshot AI14921466–1518547
14#14Googlegemini-3.5-flash-mediumGoogle14921469–1514741
15#15Anthropicclaude-opus-4-8-highAnthropic14911472–15101,061
16#16Ogpt-5.5OpenAI14901471–15091,105
17#17Alibabaqwen3.8-maxAlibaba14901460–1519362
18#18Anthropicclaude-opus-4-6Anthropic14901472–15071,277
19#19xgrok-4.20-beta1xAI14891461–1517442
20#20Anthropicclaude-fable-5.1-maxAnthropic14871448–1527220
21#21Googlegemini-3.7-flash-highGoogle14871454–1520313
22#22Anthropicclaude-opus-5-highAnthropic14871466–1508917
23#23Googlegemini-3.5-flash-highGoogle14831460–1505762
24#24Ogpt-5.6-terra-xhighOpenAI14821458–1507592
25#25Ogpt-5.2-chat-latest-20260210OpenAI14811456–1506564
26#26Googlegemini-3.6-flash-highGoogle14791454–1504571
27#27Anthropicclaude-opus-4-5-20251101Anthropic14781460–14971,129
28#28Ogpt-4.5-preview-2025-02-27OpenAI14771445–1509319
29#29Googlegemini-3-flash (thinking-minimal)Google14771460–14931,464
30#30Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14771453–1500662
31#31Metamuse-spark-1.1Meta14761453–1500687
32#32Ogpt-5.6-luna-xhighOpenAI14761452–1500655
33#33Ogpt-5.4-highOpenAI14761457–14951,088
34#34xgrok-4.20-multi-agent-beta-0309xAI14751456–14951,046
35#35Zglm-5.2-maxZ.ai14731451–1494805
36#36Alibabaqwen3.5-max-previewAlibaba14721442–1502382
37#37Googlegemini-3.5-flash-liteGoogle14721448–1495637
38#38Baiduernie-5.1Baidu14721449–1494749
39#39Anthropicclaude-opus-4-8Anthropic14721453–14901,082
40#40Googlegemini-3.8-flash-highGoogle14721443–1500398
41#41Ogpt-5.5-highOpenAI14711452–14901,050
42#42Googlegemini-2.5-proGoogle14701457–14832,638
43#43DeepSeekdeepseek-v4-proDeepSeek14681449–1488999
44#44Anthropicclaude-sonnet-5-highAnthropic14681445–1491719
45#45Alibabaqwen3.7-plusAlibaba14661444–1488760
46#46xgrok-4.1xAI14661448–14841,248
47#47Ogpt-5.5-instantOpenAI14651436–1494427
48#48Zglm-5.3-flashZ.ai14651435–1494395
49#49Xiaomimimo-v2.5-proXiaomi14641445–14821,198
50#50Zglm-5.1Z.ai14641444–1484928

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings