Valumigo

Design Arena · Design de sites web

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Ce classement repose sur les votes de personnes qui comparent, sur Design Arena, des sites web créés à partir d’une même demande.

Comment lire le score : Il s’agit d’un score relatif selon la méthode Elo : plus il est élevé, plus les personnes ont préféré le résultat. Le taux de victoire est également affiché.

Points à surveiller : Ces votes reflètent les préférences esthétiques et ne mesurent pas directement la qualité du code ou sa facilité de maintenance.

Ce que révèle ce classement

  • Le meilleur score est de 1365, obtenu par Muse Spark 1.3 (xhigh).
  • Parmi les 10 premiers, les modèles de Meta sont les plus nombreux, avec 3 modèles.

Design de sites web Design Arena

Publié le 2026-10-05 · Récupéré le 2026-10-05

128013001320134013601380
MetaMuse Spark 1.3 (xhigh)
1365
MetaMuse Spark 1.3 Max
1352
Moonshot AIKimi K3
1344
AnthropicClaude Opus 5.5
1343
AnthropicClaude Fable 5.1
1320
MetaMuse Spark 1.2
1320
XiaomiMiMo-V2.6-Pro
1319
AnthropicClaude Opus 5
1315
GoogleGemini 3.7 Flash
1311
GoogleGemini 3.8 Flash
1309
ZGLM-5.3
1308
GoogleGemini 3.6 Flash
1306
AnthropicClaude Fable 5
1302
AnthropicClaude Opus 4.6
1298
xGrok 4.6
1298
ZGLM 5.2
1294
AnthropicClaude Opus 4.6 (Thinking)
1293
AnthropicClaude Sonnet 4.6
1291
ZGLM 5.1
1290
xGrok 4.5
1289

Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages.

Voir le tableau (top 60)
RangModèleDéveloppeurScoreTaux de victoire
1#1MetaMuse Spark 1.3 (xhigh)Meta136558.4%
2#2MetaMuse Spark 1.3 MaxMeta135256%
3#3Moonshot AIKimi K3Moonshot AI134459.9%
4#4AnthropicClaude Opus 5.5Anthropic134357.7%
5#5AnthropicClaude Fable 5.1Anthropic132056.3%
6#6MetaMuse Spark 1.2Meta132052.2%
7#7XiaomiMiMo-V2.6-ProXiaomi131951.6%
8#8AnthropicClaude Opus 5Anthropic131556.1%
9#9GoogleGemini 3.7 FlashGoogle131154.5%
10#10GoogleGemini 3.8 FlashGoogle130950.4%
11#11ZGLM-5.3Z.ai130855%
12#12GoogleGemini 3.6 FlashGoogle130655.4%
13#13AnthropicClaude Fable 5Anthropic130256%
14#14AnthropicClaude Opus 4.6Anthropic129861.2%
15#15xGrok 4.6xAI129852.6%
16#16ZGLM 5.2Z.ai129450.1%
17#17AnthropicClaude Opus 4.6 (Thinking)Anthropic129360.2%
18#18AnthropicClaude Sonnet 4.6Anthropic129160%
19#19ZGLM 5.1Z.ai129055.1%
20#20xGrok 4.5xAI128952.9%
21#21AnthropicClaude Sonnet 5Anthropic128352.9%
22#22AlibabaQwen3.8 MaxAlibaba128351.5%
23#23ZGLM-5.3-FlashZ.ai128048.5%
24#24AlibabaQwen3.7 MaxAlibaba128054.8%
25#25AlibabaQwen3.7 PlusAlibaba127751%
26#26MetaMuse Spark 1.1Meta127651.6%
27#27Moonshot AIKimi K2.6Moonshot AI127654.2%
28#28XiaomiMiMo-V2.5-ProXiaomi127551.2%
29#29ZGLM 5.1Z.ai127252.5%
30#30GoogleGemini 3.5 FlashGoogle127253.9%
31#31Moonshot AIKimi K2.7 CodeMoonshot AI127251.7%
32#32XiaomiMiMo-V2.5Xiaomi127253.8%
33#33ZGLM 5 TurboZ.ai127053.4%
34#34MiniMaxMiniMax M3MiniMax126451.9%
35#35AnthropicClaude Opus 4.8Anthropic126353.1%
36#36OGPT-5.5OpenAI126352.8%
37#37GoogleGemini 3 Pro PreviewGoogle125964.4%
38#38Moonshot AIKimi K2.5 (Thinking)Moonshot AI125555.2%
39#39ZGLM 5Z.ai125455%
40#40AnthropicClaude Opus 4.5Anthropic125359.7%
41#41MiniMaxMiniMax M2.7MiniMax124951.5%
42#42AlibabaQwen3.6 PlusAlibaba124850.4%
43#43DeepSeekDeepSeek-V4-Flash-0731DeepSeek124546.7%
44#44DeepSeekDeepSeek-V4-ProDeepSeek124150.5%
45#45GoogleGemini 3.1 Pro PreviewGoogle124053.8%
46#46xGrok 4.7xAI123943.2%
47#47ZGLM 5V TurboZ.ai123749.2%
48#48AnthropicClaude 3.7 SonnetAnthropic123658.3%
49#49xGrok 4.20 Beta (Reasoning)xAI123651.8%
50#50ZGLM 4.7Z.ai123255.3%
51#51MiniMaxMiniMax M2.5MiniMax122957.5%
52#52TInklingThinkingmachines122944.3%
53#53NNex N2 ProNex Agi122845.8%
54#54xGrok 4.20 BetaxAI122750.5%
55#55OGPT-5.4 (Design Skill, Medium)OpenAI122652.5%
56#56OGPT-5.4 (Medium)OpenAI122252.7%
57#57DeepSeekDeepSeek-V4-FlashDeepSeek121449.1%
58#58XiaomiMiMo-V2-FlashXiaomi120949.9%
59#59MiniMaxMiniMax M2.1MiniMax120855.4%
60#60OGPT-5.4 (Low)OpenAI120550.5%

Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings