Epoch AI · Índice de capacidad general (ECI)
Recopilamos y mostramos periódicamente datos públicos de benchmarks (clasificaciones por votos de usuarios de LMArena, puntuaciones de pruebas de Epoch AI y clasificaciones de uso de OpenRouter). Cada clasificación indica tanto la fecha de publicación como la fecha de recopilación. Las puntuaciones no las asigna este sitio.
Cómo interpretar esta clasificación
Qué mide: Es un índice de capacidad general de Epoch AI que combina puntuaciones de varios benchmarks en una escala común. Estima estadísticamente la dificultad y las características de variación de las puntuaciones de cada benchmark para poder comparar modelos evaluados con pruebas diferentes.
Cómo interpretar la puntuación: Es una estimación de capacidad relativa, no una tasa de aciertos. Las diferencias de puntuación no pueden convertirse directamente en diferencias percibidas durante el uso real. Sirve como referencia para observar la posición general en varias pruebas.
Precauciones: Para capacidades de usos específicos, consulta también el benchmark correspondiente. Las estimaciones y su incertidumbre pueden cambiar al añadirse resultados de evaluación o benchmarks.
Claves para interpretar esta clasificación
- La puntuación más alta es 167.4, obtenida por Claude Opus 5.5.
- La diferencia entre el 1.º y el 5.º puesto es de 4.5.
- Entre los 10 modelos mejor clasificados, Anthropic tiene la mayor cantidad, con 5 modelos.
- Hay 60 modelos con resultados publicados para esta prueba.
Índice de capacidad general (ECI) Epoch AI
ECI es un índice general de Epoch AI que combina los resultados de varias pruebas. Una puntuación más alta indica una mayor capacidad general. · Obtenido el 2026-10-04
Ver tabla (los 40 mejores)
| Puesto | Modelo | Desarrollador | Fecha de lanzamiento | Puntuación |
|---|---|---|---|---|
| 1 | #1Claude Opus 5.5 | Anthropic | 2026-09-22 | 167.4 |
| 2 | #2OGPT-6 Astra | OpenAI | 2026-09-03 | 166.5 |
| 3 | #3Claude Sonnet 5.5 | Anthropic | 2026-09-28 | 165.2 |
| 4 | #4Claude Fable 5.1 | Anthropic | 2026-09-01 | 164.8 |
| 5 | #5Claude Opus 5 | Anthropic | 2026-07-24 | 162.9 |
| 6 | #6OGPT-5.5 Pro | OpenAI | 2026-04-23 | 162.4 |
| 7 | #7Claude Fable 5 | Anthropic | 2026-06-09 | 162.2 |
| 8 | #8OGPT-5.6 Sol | OpenAI | 2026-07-09 | 161.8 |
| 9 | #9OGPT-5.6 Terra | OpenAI | 2026-07-09 | 159.8 |
| 10 | #10OGPT-5.5 | OpenAI | 2026-04-23 | 159.2 |
| 11 | #11OGPT-5.4 Pro | OpenAI | 2026-03-05 | 159.1 |
| 12 | #12Claude Opus 4.8 | Anthropic | 2026-05-28 | 158.3 |
| 13 | #13Kimi K3 | Moonshot AI | 2026-07-16 | 157.6 |
| 14 | #14Gemini 3.7 Flash | 2026-08-13 | 157.4 | |
| 15 | #15Gemini 3.8 Flash | 2026-09-02 | 156.9 | |
| 16 | #16OGPT-5.4 | OpenAI | 2026-03-05 | 156.9 |
| 17 | #17Muse Spark 1.3 | Meta | 2026-09-02 | 156.9 |
| 18 | #18OGPT-5.3 Codex | OpenAI | 2026-02-05 | 156.8 |
| 19 | #19xGrok 4.6 | xAI | 2026-08-12 | 156.6 |
| 20 | #20Qwen 3.8 Max | Alibaba | 2026-08-02 | 156.6 |
| 21 | #21OGPT-5.6 Luna | OpenAI | 2026-07-09 | 156.5 |
| 22 | #22Claude Opus 4.7 | Anthropic | 2026-04-16 | 156.4 |
| 23 | #23Claude Sonnet 5 | Anthropic | 2026-06-30 | 156.3 |
| 24 | #24ZGLM-5.3 | Z.ai | 2026-08-14 | 155.8 |
| 25 | #25OGPT-5.2 Pro | OpenAI | 2025-12-11 | 155.4 |
| 26 | #26DeepSeek V4 Pro 0813 | DeepSeek | 2026-08-13 | 155.4 |
| 27 | #27Claude Opus 4.6 | Anthropic | 2026-02-05 | 155.3 |
| 28 | #28Qwen3.8 Max (0902) | Alibaba | 2026-09-01 | 155.2 |
| 29 | #29DeepSeek V4.1 Flash | DeepSeek | 2026-09-09 | 155 |
| 30 | #30Muse Spark 1.2 | Meta | 2026-08-05 | 155 |
| 31 | #31Gemini 3.1 Pro | 2026-02-19 | 154.8 | |
| 32 | #32DeepSeek V4 Flash 0731 | DeepSeek | 2026-07-31 | 154.5 |
| 33 | #33Gemini 3.5 Flash | 2026-05-19 | 154.5 | |
| 34 | #34Gemini 3.6 Flash | 2026-07-21 | 154.3 | |
| 35 | #35Muse Spark 1.1 | Meta | 2026-07-09 | 154.3 |
| 36 | #36xGrok 4.5 | xAI | 2026-07-08 | 154 |
| 37 | #37Qwen3.7-Max | Alibaba | 2026-05-19 | 153.7 |
| 38 | #38OGPT-5.2 | OpenAI | 2025-12-11 | 153.5 |
| 39 | #39Gemini 3 Pro | 2025-11-18 | 153 | |
| 40 | #40Claude Sonnet 4.6 | Anthropic | 2026-02-17 | 152.3 |
Datos: LMArena leaderboard dataset (CC BY 4.0). Cambios: Solo se muestran los 50 primeros de cada clasificación; las puntuaciones se redondean. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLos logotipos son marcas comerciales de sus respectivas empresas y solo se usan para identificarlas (iconos: Simple Icons).Datos: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings