Valumigo

Design Arena · Diseño de sitios web

Recopilamos y mostramos periódicamente datos públicos de benchmarks (clasificaciones por votos de usuarios de LMArena, puntuaciones de pruebas de Epoch AI y clasificaciones de uso de OpenRouter). Cada clasificación indica tanto la fecha de publicación como la fecha de recopilación. Las puntuaciones no las asigna este sitio.

Las puntuaciones de LMArena se basan en votos de personas que comparan las respuestas de dos modelos y eligen la mejor (sistema Elo). Si la diferencia queda dentro del intervalo de confianza, considera que los modelos tienen un nivel similar.

Cómo interpretar esta clasificación

Qué mide: Es una clasificación basada en los votos de personas que comparan sitios web creados a partir de la misma solicitud en Design Arena.

Cómo interpretar la puntuación: Es una puntuación relativa basada en Elo: un valor más alto indica que las personas lo prefirieron con mayor frecuencia. También se muestra la tasa de victorias.

Precauciones: Los votos reflejan preferencias de diseño, por lo que no miden directamente la calidad del código ni su facilidad de mantenimiento.

Claves para interpretar esta clasificación

  • La puntuación más alta es 1365, obtenida por Muse Spark 1.3 (xhigh).
  • Entre los 10 modelos mejor clasificados, Meta tiene la mayor cantidad, con 3 modelos.

Diseño de sitios web Design Arena

Publicado el 2026-10-05 · Obtenido el 2026-10-05

128013001320134013601380
MetaMuse Spark 1.3 (xhigh)
1365
MetaMuse Spark 1.3 Max
1352
Moonshot AIKimi K3
1344
AnthropicClaude Opus 5.5
1343
AnthropicClaude Fable 5.1
1320
MetaMuse Spark 1.2
1320
XiaomiMiMo-V2.6-Pro
1319
AnthropicClaude Opus 5
1315
GoogleGemini 3.7 Flash
1311
GoogleGemini 3.8 Flash
1309
ZGLM-5.3
1308
GoogleGemini 3.6 Flash
1306
AnthropicClaude Fable 5
1302
AnthropicClaude Opus 4.6
1298
xGrok 4.6
1298
ZGLM 5.2
1294
AnthropicClaude Opus 4.6 (Thinking)
1293
AnthropicClaude Sonnet 4.6
1291
ZGLM 5.1
1290
xGrok 4.5
1289

El gráfico muestra solo la configuración de razonamiento de cada modelo (high, max, etc.) con la puntuación más alta. La tabla muestra las posiciones de todas las configuraciones.

Ver tabla (los 60 mejores)
PuestoModeloDesarrolladorPuntuaciónTasa de victorias
1#1MetaMuse Spark 1.3 (xhigh)Meta136558.4%
2#2MetaMuse Spark 1.3 MaxMeta135256%
3#3Moonshot AIKimi K3Moonshot AI134459.9%
4#4AnthropicClaude Opus 5.5Anthropic134357.7%
5#5AnthropicClaude Fable 5.1Anthropic132056.3%
6#6MetaMuse Spark 1.2Meta132052.2%
7#7XiaomiMiMo-V2.6-ProXiaomi131951.6%
8#8AnthropicClaude Opus 5Anthropic131556.1%
9#9GoogleGemini 3.7 FlashGoogle131154.5%
10#10GoogleGemini 3.8 FlashGoogle130950.4%
11#11ZGLM-5.3Z.ai130855%
12#12GoogleGemini 3.6 FlashGoogle130655.4%
13#13AnthropicClaude Fable 5Anthropic130256%
14#14AnthropicClaude Opus 4.6Anthropic129861.2%
15#15xGrok 4.6xAI129852.6%
16#16ZGLM 5.2Z.ai129450.1%
17#17AnthropicClaude Opus 4.6 (Thinking)Anthropic129360.2%
18#18AnthropicClaude Sonnet 4.6Anthropic129160%
19#19ZGLM 5.1Z.ai129055.1%
20#20xGrok 4.5xAI128952.9%
21#21AnthropicClaude Sonnet 5Anthropic128352.9%
22#22AlibabaQwen3.8 MaxAlibaba128351.5%
23#23ZGLM-5.3-FlashZ.ai128048.5%
24#24AlibabaQwen3.7 MaxAlibaba128054.8%
25#25AlibabaQwen3.7 PlusAlibaba127751%
26#26MetaMuse Spark 1.1Meta127651.6%
27#27Moonshot AIKimi K2.6Moonshot AI127654.2%
28#28XiaomiMiMo-V2.5-ProXiaomi127551.2%
29#29ZGLM 5.1Z.ai127252.5%
30#30GoogleGemini 3.5 FlashGoogle127253.9%
31#31Moonshot AIKimi K2.7 CodeMoonshot AI127251.7%
32#32XiaomiMiMo-V2.5Xiaomi127253.8%
33#33ZGLM 5 TurboZ.ai127053.4%
34#34MiniMaxMiniMax M3MiniMax126451.9%
35#35AnthropicClaude Opus 4.8Anthropic126353.1%
36#36OGPT-5.5OpenAI126352.8%
37#37GoogleGemini 3 Pro PreviewGoogle125964.4%
38#38Moonshot AIKimi K2.5 (Thinking)Moonshot AI125555.2%
39#39ZGLM 5Z.ai125455%
40#40AnthropicClaude Opus 4.5Anthropic125359.7%
41#41MiniMaxMiniMax M2.7MiniMax124951.5%
42#42AlibabaQwen3.6 PlusAlibaba124850.4%
43#43DeepSeekDeepSeek-V4-Flash-0731DeepSeek124546.7%
44#44DeepSeekDeepSeek-V4-ProDeepSeek124150.5%
45#45GoogleGemini 3.1 Pro PreviewGoogle124053.8%
46#46xGrok 4.7xAI123943.2%
47#47ZGLM 5V TurboZ.ai123749.2%
48#48AnthropicClaude 3.7 SonnetAnthropic123658.3%
49#49xGrok 4.20 Beta (Reasoning)xAI123651.8%
50#50ZGLM 4.7Z.ai123255.3%
51#51MiniMaxMiniMax M2.5MiniMax122957.5%
52#52TInklingThinkingmachines122944.3%
53#53NNex N2 ProNex Agi122845.8%
54#54xGrok 4.20 BetaxAI122750.5%
55#55OGPT-5.4 (Design Skill, Medium)OpenAI122652.5%
56#56OGPT-5.4 (Medium)OpenAI122252.7%
57#57DeepSeekDeepSeek-V4-FlashDeepSeek121449.1%
58#58XiaomiMiMo-V2-FlashXiaomi120949.9%
59#59MiniMaxMiniMax M2.1MiniMax120855.4%
60#60OGPT-5.4 (Low)OpenAI120550.5%

Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.

Datos: LMArena leaderboard dataset (CC BY 4.0). Cambios: Solo se muestran los 50 primeros de cada clasificación; las puntuaciones se redondean. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLos logotipos son marcas comerciales de sus respectivas empresas y solo se usan para identificarlas (iconos: Simple Icons).Datos: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings