Valumigo

LMArena · Coreano

Recopilamos y mostramos periódicamente datos públicos de benchmarks (clasificaciones por votos de usuarios de LMArena, puntuaciones de pruebas de Epoch AI y clasificaciones de uso de OpenRouter). Cada clasificación indica tanto la fecha de publicación como la fecha de recopilación. Las puntuaciones no las asigna este sitio.

Las puntuaciones de LMArena se basan en votos de personas que comparan las respuestas de dos modelos y eligen la mejor (sistema Elo). Si la diferencia queda dentro del intervalo de confianza, considera que los modelos tienen un nivel similar.

Cómo interpretar esta clasificación

Qué mide: Es una clasificación calculada con los votos de preguntas clasificadas como Coreano en las conversaciones de texto de LMArena.

Cómo interpretar la puntuación: Muestra qué modelo prefieren los votantes en preguntas en Coreano. El idioma de la pregunta no indica la lengua materna ni la identidad de quien vota.

Precauciones: El número de votos y la amplitud de los intervalos de confianza varían según el idioma y el modelo. Para los modelos nuevos, comprueba también el número de votos, la fecha de actualización y las condiciones de agregación.

Claves para interpretar esta clasificación

  • Los intervalos de confianza del 95% de claude-fable-5.1-max, en 1.º lugar, y muse-spark-1.3-max, en 2.º, se solapan. Esta agregación por sí sola no permite establecer con certeza el orden de ambos modelos.
  • Hay otros 24 modelos cuyos intervalos de confianza se solapan con el del 1.º. Interpreta con cautela las diferencias pequeñas de posición, teniendo en cuenta el número de votos.
  • Entre los 10 modelos mejor clasificados, Anthropic tiene la mayor cantidad, con 4 modelos.
  • El modelo en 1.º lugar recibió 177 votos y esta clasificación incluye 278 modelos.

Coreano LMArena

Publicado el 2026-10-02 · Obtenido el 2026-10-04

14001440148015201560
Anthropicclaude-fable-5.1-max
1514
Metamuse-spark-1.3-max
1513
Anthropicclaude-opus-5-max
1498
Anthropicclaude-fable-5-high
1497
Zglm-5.3-max
1481
Googlegemini-3.7-flash-high
1480
Metamuse-spark-1.1
1477
Moonshot AIkimi-k3-max
1473
Metamuse-spark
1472
Anthropicclaude-opus-4-7
1472
Anthropicclaude-opus-4-6
1465
DeepSeekdeepseek-v4-pro-high-20260813
1462
Alibabaqwen3.8-max
1460
Googlegemini-3.1-pro-preview
1458
Googlegemini-3.8-flash-high
1456
Ogpt-5.5-instant
1451
Anthropicclaude-opus-4-8-high
1450
Zglm-5.2-max
1450
Ogpt-5.6-sol-xhigh
1449
Googlegemini-3-pro
1449

Los puntos indican la puntuación y las líneas horizontales, el intervalo de confianza del 95%. Si las líneas se solapan, los resultados son prácticamente equivalentes. El gráfico muestra solo la configuración de razonamiento de cada modelo (high, max, etc.) con la puntuación más alta. La tabla muestra las posiciones de todas las configuraciones. Las clasificaciones de conversación y visión usan el ajuste de tono y longitud (style control), igual que la opción predeterminada del sitio de LMArena.

Mejor posición por empresa

  • AnthropicAnthropicclaude-fable-5.1-max#1
  • MetaMetamuse-spark-1.3-max#2
  • ZZ.aiglm-5.3-max#6
  • GoogleGooglegemini-3.7-flash-high#7
  • Moonshot AIMoonshot AIkimi-k3-max#9
  • DeepSeekDeepSeekdeepseek-v4-pro-high-20260813#14
  • AlibabaAlibabaqwen3.8-max#15
  • OOpenAIgpt-5.5-instant#18
  • xxAIgrok-4.20-beta1#27
Ver tabla (los 50 mejores)
PuestoModeloDesarrolladorPuntuaciónIntervalo de confianza del 95%Votos
1#1Anthropicclaude-fable-5.1-maxAnthropic15141468–1560177
2#2Metamuse-spark-1.3-maxMeta15131472–1554205
3#3Anthropicclaude-opus-5-maxAnthropic14981472–1524568
4#4Anthropicclaude-fable-5-highAnthropic14971473–1520722
5#5Anthropicclaude-opus-5-highAnthropic14931473–15131,126
6#6Zglm-5.3-maxZ.ai14811446–1515298
7#7Googlegemini-3.7-flash-highGoogle14801449–1511404
8#8Metamuse-spark-1.1Meta14771453–1500708
9#9Moonshot AIkimi-k3-maxMoonshot AI14731449–1497615
10#10Metamuse-sparkMeta14721433–1511252
11#11Anthropicclaude-opus-4-7Anthropic14721453–14911,144
12#12Anthropicclaude-opus-4-6Anthropic14651447–14821,486
13#13Anthropicclaude-opus-4-7-highAnthropic14641444–14831,100
14#14DeepSeekdeepseek-v4-pro-high-20260813DeepSeek14621421–1502195
15#15Alibabaqwen3.8-maxAlibaba14601432–1488493
16#16Googlegemini-3.1-pro-previewGoogle14581443–14722,145
17#17Googlegemini-3.8-flash-highGoogle14561427–1484487
18#18Ogpt-5.5-instantOpenAI14511421–1481432
19#19Anthropicclaude-opus-4-8-highAnthropic14501431–14701,094
20#20Zglm-5.2-maxZ.ai14501429–1471879
21#21Ogpt-5.6-sol-xhighOpenAI14491426–1473723
22#22Googlegemini-3-proGoogle14491426–1472719
23#23Anthropicclaude-opus-4-5-20251101Anthropic14491430–14671,163
24#24Anthropicclaude-opus-4-6-highAnthropic14461428–14641,310
25#25Ogpt-5.5-highOpenAI14451427–14641,187
26#26Googlegemini-3-flashGoogle14451420–1470579
27#27xgrok-4.20-beta1xAI14441416–1473467
28#28Anthropicclaude-opus-4-8Anthropic14441425–14641,064
29#29Googlegemini-3.5-flash-mediumGoogle14431422–1465855
30#30Googlegemini-3.5-flash-highGoogle14391419–1459960
31#31Zglm-5.3-flashZ.ai14381408–1469397
32#32Googlegemini-3.6-flash-highGoogle14371414–1460685
33#33DeepSeekdeepseek-v4-pro-high-previewDeepSeek14371417–1457980
34#34Xiaomimimo-v2.5-proXiaomi14361418–14541,305
35#35xgrok-4.20-multi-agent-beta-0309xAI14361416–14551,045
36#36Ogpt-5.4-highOpenAI14351415–14541,106
37#37Anthropicclaude-sonnet-4-6Anthropic14341415–14521,146
38#38xgrok-4.20-beta-0309-reasoningxAI14331414–14531,058
39#39xgrok-4.1xAI14321413–14501,142
40#40Anthropicclaude-sonnet-5-highAnthropic14321410–1454792
41#41xgrok-4.6-highxAI14311403–1460468
42#42Ogpt-5.5OpenAI14301411–14481,180
43#43Googlegemini-3-flash (thinking-minimal)Google14291412–14461,408
44#44xgrok-4.1-thinkingxAI14271408–14461,119
45#45Zglm-5Z.ai14271401–1452552
46#46Ogpt-5.4OpenAI14261407–14461,159
47#47Moonshot AIkimi-k2.6Moonshot AI14241402–1447729
48#48Ogpt-5.2-chat-latest-20260210OpenAI14241398–1450555
49#49Ogpt-5.6-terra-xhighOpenAI14241401–1446733
50#50Googlegemini-3.5-flash-liteGoogle14231399–1446708

Datos: LMArena leaderboard dataset (CC BY 4.0). Cambios: Solo se muestran los 50 primeros de cada clasificación; las puntuaciones se redondean. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLos logotipos son marcas comerciales de sus respectivas empresas y solo se usan para identificarlas (iconos: Simple Icons).Datos: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings