Valumigo

LMArena · Escritura creativa

Recopilamos y mostramos periódicamente datos públicos de benchmarks (clasificaciones por votos de usuarios de LMArena, puntuaciones de pruebas de Epoch AI y clasificaciones de uso de OpenRouter). Cada clasificación indica tanto la fecha de publicación como la fecha de recopilación. Las puntuaciones no las asigna este sitio.

Las puntuaciones de LMArena se basan en votos de personas que comparan las respuestas de dos modelos y eligen la mejor (sistema Elo). Si la diferencia queda dentro del intervalo de confianza, considera que los modelos tienen un nivel similar.

Cómo interpretar esta clasificación

Qué mide: Es una clasificación basada en los votos de preguntas clasificadas como escritura creativa, como ficción, poesía o textos publicitarios, en las conversaciones de texto de LMArena.

Cómo interpretar la puntuación: Es una clasificación relativa de las respuestas preferidas por los usuarios en preguntas de escritura creativa. No evalúa objetivamente y por separado el interés o el estilo.

Precauciones: Comprueba si se adapta a tu uso y a tus preferencias de estilo comparando directamente los resultados con la misma solicitud.

Claves para interpretar esta clasificación

  • Los intervalos de confianza del 95% de gemini-4-argon-high, en 1.º lugar, y claude-opus-5.5-high, en 2.º, se solapan. Esta agregación por sí sola no permite establecer con certeza el orden de ambos modelos.
  • Hay otros 4 modelos cuyos intervalos de confianza se solapan con el del 1.º. Interpreta con cautela las diferencias pequeñas de posición, teniendo en cuenta el número de votos.
  • Entre los 10 modelos mejor clasificados, Anthropic tiene la mayor cantidad, con 6 modelos.
  • El modelo en 1.º lugar recibió 1,097 votos y esta clasificación incluye 411 modelos.

Escritura creativa LMArena

Publicado el 2026-10-02 · Obtenido el 2026-10-04

14401470150015301560
Googlegemini-4-argon-high
1519
Anthropicclaude-opus-5.5-high
1516
Anthropicclaude-fable-5-high
1503
Anthropicclaude-opus-4-6-high
1501
Googlegemini-3.7-flash-high
1493
Anthropicclaude-opus-4-7-high
1489
Googlegemini-3.8-flash-high
1485
Googlegemini-3-pro
1484
Anthropicclaude-fable-5.1-max
1482
Googlegemini-3.1-pro-preview
1480
Anthropicclaude-opus-5-high
1471
Googlegemini-3.6-flash-high
1471
Anthropicclaude-opus-4-5-20251101-high-32k
1470
Anthropicclaude-opus-4-8-high
1470
Googlegemini-3.5-flash-medium
1469
Ogpt-5.6-sol-xhigh
1468
Alibabaqwen3.8-max
1468
Metamuse-spark
1465
xgrok-4.20-beta1
1463
Anthropicclaude-opus-4-5-20251101
1462

Los puntos indican la puntuación y las líneas horizontales, el intervalo de confianza del 95%. Si las líneas se solapan, los resultados son prácticamente equivalentes. El gráfico muestra solo la configuración de razonamiento de cada modelo (high, max, etc.) con la puntuación más alta. La tabla muestra las posiciones de todas las configuraciones. Las clasificaciones de conversación y visión usan el ajuste de tono y longitud (style control), igual que la opción predeterminada del sitio de LMArena.

Mejor posición por empresa

  • GoogleGooglegemini-4-argon-high#1
  • AnthropicAnthropicclaude-opus-5.5-high#2
  • OOpenAIgpt-5.6-sol-xhigh#19
  • AlibabaAlibabaqwen3.8-max#20
  • MetaMetamuse-spark#21
  • xxAIgrok-4.20-beta1#24
  • Moonshot AIMoonshot AIkimi-k3-max#26
  • ZZ.aiglm-5.2-max#32
  • XiaomiXiaomimimo-v2.6-pro#47
Ver tabla (los 50 mejores)
PuestoModeloDesarrolladorPuntuaciónIntervalo de confianza del 95%Votos
1#1Googlegemini-4-argon-highGoogle15191499–15381,097
2#2Anthropicclaude-opus-5.5-highAnthropic15161497–15361,058
3#3Anthropicclaude-fable-5-highAnthropic15031495–15108,182
4#4Anthropicclaude-opus-4-6-highAnthropic15011494–150714,085
5#5Googlegemini-3.7-flash-highGoogle14931484–15034,776
6#6Anthropicclaude-opus-4-7-highAnthropic14891482–149611,812
7#7Googlegemini-3.8-flash-highGoogle14851476–14945,697
8#8Googlegemini-3-proGoogle14841476–14936,510
9#9Anthropicclaude-opus-4-7Anthropic14831476–149012,043
10#10Anthropicclaude-fable-5.1-maxAnthropic14821469–14942,645
11#11Googlegemini-3.1-pro-previewGoogle14801475–148622,309
12#12Anthropicclaude-opus-4-6Anthropic14791473–148514,240
13#13Anthropicclaude-opus-5-highAnthropic14711465–147813,263
14#14Googlegemini-3.6-flash-highGoogle14711463–14797,580
15#15Anthropicclaude-opus-5-maxAnthropic14711462–14796,526
16#16Anthropicclaude-opus-4-5-20251101-high-32kAnthropic14701461–14785,676
17#17Anthropicclaude-opus-4-8-highAnthropic14701463–147612,798
18#18Googlegemini-3.5-flash-mediumGoogle14691461–14769,445
19#19Ogpt-5.6-sol-xhighOpenAI14681460–14767,537
20#20Alibabaqwen3.8-maxAlibaba14681458–14784,555
21#21Metamuse-sparkMeta14651452–14792,040
22#22Googlegemini-3.5-flash-highGoogle14641457–14719,476
23#23Anthropicclaude-opus-4-8Anthropic14631457–147012,836
24#24xgrok-4.20-beta1xAI14631453–14734,158
25#25Anthropicclaude-opus-4-5-20251101Anthropic14621456–146811,392
26#26Moonshot AIkimi-k3-maxMoonshot AI14601451–14695,694
27#27Ogpt-6.1-sol-maxOpenAI14601436–1483686
28#28Metamuse-spark-1.3-maxMeta14591446–14712,631
29#29Googlegemini-3-flashGoogle14571448–14664,814
30#30Ogpt-5.5-instantOpenAI14561447–14664,346
31#31Metamuse-spark-1.2 (xHigh)Meta14551435–1476852
32#32Zglm-5.2-maxZ.ai14541447–14628,979
33#33Anthropicclaude-sonnet-4-5-20250929Anthropic14541448–146012,367
34#34Zglm-5.3-maxZ.ai14541444–14644,034
35#35Ogpt-5.5-highOpenAI14511445–145813,120
36#36xgrok-4.5xAI14501443–14588,291
37#37Anthropicclaude-sonnet-4-5-20250929-high-32kAnthropic14501444–145612,644
38#38Anthropicclaude-sonnet-4-6Anthropic14491443–145612,339
39#39Ogpt-6-astra-maxOpenAI14491435–14632,029
40#40Zglm-5Z.ai14491440–14584,837
41#41Ogpt-5.5OpenAI14481442–145513,354
42#42Anthropicclaude-sonnet-5.5-xhighAnthropic14471424–1471658
43#43Metamuse-spark-1.1Meta14471439–14557,706
44#44xgrok-4.20-multi-agent-beta-0309xAI14471440–145411,279
45#45Googlegemini-3-flash (thinking-minimal)Google14471441–145315,198
46#46Zglm-5.1Z.ai14461440–145311,254
47#47Xiaomimimo-v2.6-proXiaomi14461425–1467788
48#48DeepSeekdeepseek-v4-proDeepSeek14461439–14539,721
49#49Anthropicclaude-opus-4-1-20250805-thinking-16kAnthropic14461438–14536,815
50#50xgrok-4.20-beta-0309-reasoningxAI14451439–145211,425

Datos: LMArena leaderboard dataset (CC BY 4.0). Cambios: Solo se muestran los 50 primeros de cada clasificación; las puntuaciones se redondean. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLos logotipos son marcas comerciales de sus respectivas empresas y solo se usan para identificarlas (iconos: Simple Icons).Datos: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings