Valumigo

LMArena · Coréen

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Ce classement est calculé à partir des votes sur les questions classées comme étant en Coréen dans les conversations textuelles de LMArena.

Comment lire le score : Ce classement montre les modèles préférés par les votants pour les questions en Coréen. La langue de la question ne renseigne pas sur la langue maternelle ou l’identité des votants.

Points à surveiller : Le nombre de votes et la largeur des intervalles de confiance varient selon la langue et le modèle. Pour un nouveau modèle, vérifiez aussi le nombre de votes, la date de mise à jour et les conditions d’agrégation.

Ce que révèle ce classement

  • Les intervalles de confiance à 95% de claude-fable-5.1-max, en 1re place, et de muse-spark-1.3-max, en 2e place, se chevauchent. Cette agrégation seule permet difficilement de déterminer leur ordre.
  • 24 autres modèles ont un intervalle de confiance qui chevauche celui du premier. Interprétez les petits écarts de classement avec prudence, en tenant compte du nombre de votes.
  • Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 4 modèles.
  • Le modèle en 1re place a reçu 177 votes, et ce classement comprend 278 modèles.

Coréen LMArena

Publié le 2026-10-02 · Récupéré le 2026-10-04

14001440148015201560
Anthropicclaude-fable-5.1-max
1514
Metamuse-spark-1.3-max
1513
Anthropicclaude-opus-5-max
1498
Anthropicclaude-fable-5-high
1497
Zglm-5.3-max
1481
Googlegemini-3.7-flash-high
1480
Metamuse-spark-1.1
1477
Moonshot AIkimi-k3-max
1473
Metamuse-spark
1472
Anthropicclaude-opus-4-7
1472
Anthropicclaude-opus-4-6
1465
DeepSeekdeepseek-v4-pro-high-20260813
1462
Alibabaqwen3.8-max
1460
Googlegemini-3.1-pro-preview
1458
Googlegemini-3.8-flash-high
1456
Ogpt-5.5-instant
1451
Anthropicclaude-opus-4-8-high
1450
Zglm-5.2-max
1450
Ogpt-5.6-sol-xhigh
1449
Googlegemini-3-pro
1449

Les points indiquent les scores, les lignes horizontales les intervalles de confiance à 95 %. Si les lignes se chevauchent, les performances sont globalement similaires. Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages. Les classements de conversation et de vision utilisent la correction du style et de la longueur (style control), comme le réglage par défaut du site LMArena.

Meilleur classement par entreprise

  • AnthropicAnthropicclaude-fable-5.1-max#1
  • MetaMetamuse-spark-1.3-max#2
  • ZZ.aiglm-5.3-max#6
  • GoogleGooglegemini-3.7-flash-high#7
  • Moonshot AIMoonshot AIkimi-k3-max#9
  • DeepSeekDeepSeekdeepseek-v4-pro-high-20260813#14
  • AlibabaAlibabaqwen3.8-max#15
  • OOpenAIgpt-5.5-instant#18
  • xxAIgrok-4.20-beta1#27
Voir le tableau (top 50)
RangModèleDéveloppeurScoreIntervalle de confiance à 95%Nombre de votes
1#1Anthropicclaude-fable-5.1-maxAnthropic15141468–1560177
2#2Metamuse-spark-1.3-maxMeta15131472–1554205
3#3Anthropicclaude-opus-5-maxAnthropic14981472–1524568
4#4Anthropicclaude-fable-5-highAnthropic14971473–1520722
5#5Anthropicclaude-opus-5-highAnthropic14931473–15131,126
6#6Zglm-5.3-maxZ.ai14811446–1515298
7#7Googlegemini-3.7-flash-highGoogle14801449–1511404
8#8Metamuse-spark-1.1Meta14771453–1500708
9#9Moonshot AIkimi-k3-maxMoonshot AI14731449–1497615
10#10Metamuse-sparkMeta14721433–1511252
11#11Anthropicclaude-opus-4-7Anthropic14721453–14911,144
12#12Anthropicclaude-opus-4-6Anthropic14651447–14821,486
13#13Anthropicclaude-opus-4-7-highAnthropic14641444–14831,100
14#14DeepSeekdeepseek-v4-pro-high-20260813DeepSeek14621421–1502195
15#15Alibabaqwen3.8-maxAlibaba14601432–1488493
16#16Googlegemini-3.1-pro-previewGoogle14581443–14722,145
17#17Googlegemini-3.8-flash-highGoogle14561427–1484487
18#18Ogpt-5.5-instantOpenAI14511421–1481432
19#19Anthropicclaude-opus-4-8-highAnthropic14501431–14701,094
20#20Zglm-5.2-maxZ.ai14501429–1471879
21#21Ogpt-5.6-sol-xhighOpenAI14491426–1473723
22#22Googlegemini-3-proGoogle14491426–1472719
23#23Anthropicclaude-opus-4-5-20251101Anthropic14491430–14671,163
24#24Anthropicclaude-opus-4-6-highAnthropic14461428–14641,310
25#25Ogpt-5.5-highOpenAI14451427–14641,187
26#26Googlegemini-3-flashGoogle14451420–1470579
27#27xgrok-4.20-beta1xAI14441416–1473467
28#28Anthropicclaude-opus-4-8Anthropic14441425–14641,064
29#29Googlegemini-3.5-flash-mediumGoogle14431422–1465855
30#30Googlegemini-3.5-flash-highGoogle14391419–1459960
31#31Zglm-5.3-flashZ.ai14381408–1469397
32#32Googlegemini-3.6-flash-highGoogle14371414–1460685
33#33DeepSeekdeepseek-v4-pro-high-previewDeepSeek14371417–1457980
34#34Xiaomimimo-v2.5-proXiaomi14361418–14541,305
35#35xgrok-4.20-multi-agent-beta-0309xAI14361416–14551,045
36#36Ogpt-5.4-highOpenAI14351415–14541,106
37#37Anthropicclaude-sonnet-4-6Anthropic14341415–14521,146
38#38xgrok-4.20-beta-0309-reasoningxAI14331414–14531,058
39#39xgrok-4.1xAI14321413–14501,142
40#40Anthropicclaude-sonnet-5-highAnthropic14321410–1454792
41#41xgrok-4.6-highxAI14311403–1460468
42#42Ogpt-5.5OpenAI14301411–14481,180
43#43Googlegemini-3-flash (thinking-minimal)Google14291412–14461,408
44#44xgrok-4.1-thinkingxAI14271408–14461,119
45#45Zglm-5Z.ai14271401–1452552
46#46Ogpt-5.4OpenAI14261407–14461,159
47#47Moonshot AIkimi-k2.6Moonshot AI14241402–1447729
48#48Ogpt-5.2-chat-latest-20260210OpenAI14241398–1450555
49#49Ogpt-5.6-terra-xhighOpenAI14241401–1446733
50#50Googlegemini-3.5-flash-liteGoogle14231399–1446708

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings