Valumigo

Artificial Analysis · Índice de inteligencia

Recopilamos y mostramos periódicamente datos públicos de benchmarks (clasificaciones por votos de usuarios de LMArena, puntuaciones de pruebas de Epoch AI y clasificaciones de uso de OpenRouter). Cada clasificación indica tanto la fecha de publicación como la fecha de recopilación. Las puntuaciones no las asigna este sitio.

Las puntuaciones de LMArena se basan en votos de personas que comparan las respuestas de dos modelos y eligen la mejor (sistema Elo). Si la diferencia queda dentro del intervalo de confianza, considera que los modelos tienen un nivel similar.

Cómo interpretar esta clasificación

Qué mide: Es un índice global de inteligencia que reúne varias evaluaciones ejecutadas directamente por Artificial Analysis. Lo obtuvimos a través de la API de datos públicos de OpenRouter.

Cómo interpretar la puntuación: Un valor más alto indica buenos resultados de forma equilibrada en varias pruebas. Un mismo modelo aparece por separado según su configuración de razonamiento (Max, High, etc.).

Precauciones: Artificial Analysis puede cambiar las pruebas incluidas en el índice en cada versión, por lo que no debes comparar puntuaciones de distintos períodos.

Claves para interpretar esta clasificación

  • La puntuación más alta es 57.6, obtenida por Claude Opus 5.5 (Max, Default Fallback).
  • La diferencia entre el 1.º y el 5.º puesto es de 4.9.
  • Entre los 10 modelos mejor clasificados, Anthropic tiene la mayor cantidad, con 5 modelos.

Índice de inteligencia Artificial Analysis

Publicado el 2026-10-05 · Obtenido el 2026-10-05

AnthropicClaude Opus 5.5 (Max, Default Fallback)
57.6
AnthropicClaude Sonnet 5.5 (Max, Default Fallback)
56.0
AnthropicClaude Fable 5.1 (Max, Default Fallback)
53.4
AlibabaQwen3.8 Max
53.4
OGPT-6 Astra (max)
52.7
OGPT-6.1 Sol (max)
51.8
AnthropicClaude Opus 5 (Max)
50.8
AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)
49.6
OGPT-6 Sol (Max)
47.6
OGPT-5.6 Sol (Max)
47.0
xGrok 4.7 (Xhigh)
46.4
XiaomiMiMo-V2.6-Pro
46.3
AlibabaQwen3.8 Max (0902)
45.4
ZGLM-5.3 (Max)
44.8
xGrok 4.6 (High)
44.3
Moonshot AIKimi K3 (Max)
43.6
OGPT-5.6 Terra (Max)
42.1
AnthropicClaude Opus 4.8 (Max)
41.8
ZGLM 5.3 Flash
41.8
iLing 3.1 Flash
41.1

El gráfico muestra solo la configuración de razonamiento de cada modelo (high, max, etc.) con la puntuación más alta. La tabla muestra las posiciones de todas las configuraciones.

Ver tabla (los 60 mejores)
PuestoModeloDesarrolladorPuntuación
1#1AnthropicClaude Opus 5.5 (Max, Default Fallback)Anthropic57.6
2#2AnthropicClaude Sonnet 5.5 (Max, Default Fallback)Anthropic56
3#3AnthropicClaude Fable 5.1 (Max, Default Fallback)Anthropic53.4
4#4AlibabaQwen3.8 MaxAlibaba53.4
5#5OGPT-6 Astra (max)OpenAI52.7
6#6OGPT-6.1 Sol (max)OpenAI51.8
7#7AnthropicClaude Opus 5 (Max)Anthropic50.8
8#8AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)Anthropic49.6
9#9OGPT-6 Sol (Max)OpenAI47.6
10#10OGPT-5.6 Sol (Max)OpenAI47
11#11xGrok 4.7 (Xhigh)xAI46.4
12#12XiaomiMiMo-V2.6-ProXiaomi46.3
13#13AlibabaQwen3.8 Max (0902)Alibaba45.4
14#14ZGLM-5.3 (Max)Z.ai44.8
15#15xGrok 4.6 (High)xAI44.3
16#16Moonshot AIKimi K3 (Max)Moonshot AI43.6
17#17OGPT-5.6 Terra (Max)OpenAI42.1
18#18AnthropicClaude Opus 4.8 (Max)Anthropic41.8
19#19ZGLM 5.3 FlashZ.ai41.8
20#20iLing 3.1 FlashinclusionAI41.1
21#21GoogleGemini 3.8 Flash (High)Google40.9
22#22AlibabaQwen3.8 2.4T A95BAlibaba39.9
23#23MetaMuse Spark 1.2 (Xhigh)Meta39.6
24#24DeepSeekDeepSeek V4.1 Flash (Reasoning, Max Effort)DeepSeek39.5
25#25GoogleGemini 3.7 Flash (High)Google39.1
26#26xGrok 4.5 (High)xAI38.8
27#27OGPT-5.5 (Xhigh)OpenAI38.4
28#28AnthropicClaude Sonnet 5 (Max)Anthropic38.2
29#29OGPT-6 Luna (Max)OpenAI38.1
30#30XiaomiMiMo-V2.6-FlashXiaomi37.9
31#31OGPT-5.6 Luna (Max)OpenAI37.3
32#32DeepSeekDeepSeek V4 Pro 0813 (Max)DeepSeek36
33#33DeepSeekDeepSeek V4 Flash 0731 (Max)DeepSeek34.3
34#34GoogleGemini 3.6 Flash (High)Google34
35#35MetaMuse Spark 1.1 (Xhigh)Meta33.7
36#36ZGLM-5.2 (Max)Z.ai33.7
37#37AlibabaQwen3.8 27B (Xhigh)Alibaba33.7
38#38GoogleGemini 3.5 Flash (High)Google32.6
39#39DeepSeekDeepSeek V4 Pro 0424 (Max)DeepSeek30.4
40#40AnthropicClaude Sonnet 4.6 (Max)Anthropic30.1
41#41GoogleGemini 3.1 Pro PreviewGoogle29.7
42#42AlibabaQwen3.7 MaxAlibaba29.5
43#43MiniMaxMiniMax-M3MiniMax29.2
44#44Moonshot AIKimi K2.6 (Reasoning)Moonshot AI27
45#45ZGLM-5.1 (Reasoning)Z.ai26.1
46#46XiaomiMiMo-V2.5-Pro (Reasoning)Xiaomi26
47#47Moonshot AIKimi K2.7 CodeMoonshot AI25.8
48#48TInkling SmallThinkingmachines25.7
49#49THy3Tencent25.3
50#50AlibabaQwen3.7 PlusAlibaba25.2
51#51TInkling (Xhigh)Thinkingmachines25
52#52xGrok 4.3 (High)xAI24.9
53#53iLing-3.0-flash-VLinclusionAI24.6
54#54DeepSeekDeepSeek V4 Flash 0420 (High)DeepSeek24.4
55#55OGPT-5.4 mini (Xhigh)OpenAI24.1
56#56USolar Mini 4Upstage24.1
57#57NVIDIANemotron 3 Ultra 550B A55B (Reasoning)NVIDIA22.9
58#58MiniMaxMiniMax-M2.7MiniMax22.8
59#59iLing-3.0-flash-FininclusionAI22.6
60#60GoogleGemini 3.5 Flash-LiteGoogle22.2

Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.

Datos: LMArena leaderboard dataset (CC BY 4.0). Cambios: Solo se muestran los 50 primeros de cada clasificación; las puntuaciones se redondean. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLos logotipos son marcas comerciales de sus respectivas empresas y solo se usan para identificarlas (iconos: Simple Icons).Datos: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings