Valumigo

LMArena · Écriture créative

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Ce classement repose sur les votes concernant les questions classées comme relevant de l’écriture créative dans les conversations textuelles de LMArena : fiction, poésie, textes publicitaires, etc.

Comment lire le score : Il s’agit d’un classement relatif des réponses préférées par les utilisateurs aux questions d’écriture créative. L’intérêt du texte et le style ne font pas l’objet de notes objectives distinctes.

Points à surveiller : Pour vérifier si un modèle convient à votre usage et à vos préférences stylistiques, comparez directement les résultats avec la même demande.

Ce que révèle ce classement

  • Les intervalles de confiance à 95% de gemini-4-argon-high, en 1re place, et de claude-opus-5.5-high, en 2e place, se chevauchent. Cette agrégation seule permet difficilement de déterminer leur ordre.
  • 4 autres modèles ont un intervalle de confiance qui chevauche celui du premier. Interprétez les petits écarts de classement avec prudence, en tenant compte du nombre de votes.
  • Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 6 modèles.
  • Le modèle en 1re place a reçu 1,097 votes, et ce classement comprend 411 modèles.

Écriture créative LMArena

Publié le 2026-10-02 · Récupéré le 2026-10-04

14401470150015301560
Googlegemini-4-argon-high
1519
Anthropicclaude-opus-5.5-high
1516
Anthropicclaude-fable-5-high
1503
Anthropicclaude-opus-4-6-high
1501
Googlegemini-3.7-flash-high
1493
Anthropicclaude-opus-4-7-high
1489
Googlegemini-3.8-flash-high
1485
Googlegemini-3-pro
1484
Anthropicclaude-fable-5.1-max
1482
Googlegemini-3.1-pro-preview
1480
Anthropicclaude-opus-5-high
1471
Googlegemini-3.6-flash-high
1471
Anthropicclaude-opus-4-5-20251101-high-32k
1470
Anthropicclaude-opus-4-8-high
1470
Googlegemini-3.5-flash-medium
1469
Ogpt-5.6-sol-xhigh
1468
Alibabaqwen3.8-max
1468
Metamuse-spark
1465
xgrok-4.20-beta1
1463
Anthropicclaude-opus-4-5-20251101
1462

Les points indiquent les scores, les lignes horizontales les intervalles de confiance à 95 %. Si les lignes se chevauchent, les performances sont globalement similaires. Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages. Les classements de conversation et de vision utilisent la correction du style et de la longueur (style control), comme le réglage par défaut du site LMArena.

Meilleur classement par entreprise

  • GoogleGooglegemini-4-argon-high#1
  • AnthropicAnthropicclaude-opus-5.5-high#2
  • OOpenAIgpt-5.6-sol-xhigh#19
  • AlibabaAlibabaqwen3.8-max#20
  • MetaMetamuse-spark#21
  • xxAIgrok-4.20-beta1#24
  • Moonshot AIMoonshot AIkimi-k3-max#26
  • ZZ.aiglm-5.2-max#32
  • XiaomiXiaomimimo-v2.6-pro#47
Voir le tableau (top 50)
RangModèleDéveloppeurScoreIntervalle de confiance à 95%Nombre de votes
1#1Googlegemini-4-argon-highGoogle15191499–15381,097
2#2Anthropicclaude-opus-5.5-highAnthropic15161497–15361,058
3#3Anthropicclaude-fable-5-highAnthropic15031495–15108,182
4#4Anthropicclaude-opus-4-6-highAnthropic15011494–150714,085
5#5Googlegemini-3.7-flash-highGoogle14931484–15034,776
6#6Anthropicclaude-opus-4-7-highAnthropic14891482–149611,812
7#7Googlegemini-3.8-flash-highGoogle14851476–14945,697
8#8Googlegemini-3-proGoogle14841476–14936,510
9#9Anthropicclaude-opus-4-7Anthropic14831476–149012,043
10#10Anthropicclaude-fable-5.1-maxAnthropic14821469–14942,645
11#11Googlegemini-3.1-pro-previewGoogle14801475–148622,309
12#12Anthropicclaude-opus-4-6Anthropic14791473–148514,240
13#13Anthropicclaude-opus-5-highAnthropic14711465–147813,263
14#14Googlegemini-3.6-flash-highGoogle14711463–14797,580
15#15Anthropicclaude-opus-5-maxAnthropic14711462–14796,526
16#16Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14701461–14785,676
17#17Anthropicclaude-opus-4-8-highAnthropic14701463–147612,798
18#18Googlegemini-3.5-flash-mediumGoogle14691461–14769,445
19#19Ogpt-5.6-sol-xhighOpenAI14681460–14767,537
20#20Alibabaqwen3.8-maxAlibaba14681458–14784,555
21#21Metamuse-sparkMeta14651452–14792,040
22#22Googlegemini-3.5-flash-highGoogle14641457–14719,476
23#23Anthropicclaude-opus-4-8Anthropic14631457–147012,836
24#24xgrok-4.20-beta1xAI14631453–14734,158
25#25Anthropicclaude-opus-4-5-20251101Anthropic14621456–146811,392
26#26Moonshot AIkimi-k3-maxMoonshot AI14601451–14695,694
27#27Ogpt-6.1-sol-maxOpenAI14601436–1483686
28#28Metamuse-spark-1.3-maxMeta14591446–14712,631
29#29Googlegemini-3-flashGoogle14571448–14664,814
30#30Ogpt-5.5-instantOpenAI14561447–14664,346
31#31Metamuse-spark-1.2 (xHigh)Meta14551435–1476852
32#32Zglm-5.2-maxZ.ai14541447–14628,979
33#33Anthropicclaude-sonnet-4-5-20250929Anthropic14541448–146012,367
34#34Zglm-5.3-maxZ.ai14541444–14644,034
35#35Ogpt-5.5-highOpenAI14511445–145813,120
36#36xgrok-4.5xAI14501443–14588,291
37#37Anthropicclaude-sonnet-4-5-20250929-high-32kAnthropic14501444–145612,644
38#38Anthropicclaude-sonnet-4-6Anthropic14491443–145612,339
39#39Ogpt-6-astra-maxOpenAI14491435–14632,029
40#40Zglm-5Z.ai14491440–14584,837
41#41Ogpt-5.5OpenAI14481442–145513,354
42#42Anthropicclaude-sonnet-5.5-xhighAnthropic14471424–1471658
43#43Metamuse-spark-1.1Meta14471439–14557,706
44#44xgrok-4.20-multi-agent-beta-0309xAI14471440–145411,279
45#45Googlegemini-3-flash (thinking-minimal)Google14471441–145315,198
46#46Zglm-5.1Z.ai14461440–145311,254
47#47Xiaomimimo-v2.6-proXiaomi14461425–1467788
48#48DeepSeekdeepseek-v4-proDeepSeek14461439–14539,721
49#49Anthropicclaude-opus-4-1-20250805-thinking-16kAnthropic14461438–14536,815
50#50xgrok-4.20-beta-0309-reasoningxAI14451439–145211,425

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings