Epoch AI · Indice global de capacité (ECI)
Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.
Comment lire ce classement
Ce qui est mesuré : Cet indice global de capacités, créé par Epoch AI, combine plusieurs scores de benchmarks sur une échelle commune. Il estime statistiquement la difficulté et les variations de score propres à chaque benchmark afin de comparer des modèles ayant passé des tests différents.
Comment lire le score : Il s’agit d’une estimation relative des capacités, et non d’un taux de bonnes réponses. Un écart de score ne se traduit pas directement par un écart perceptible en usage réel. Utilisez cet indice pour situer globalement les modèles sur plusieurs tests.
Points à surveiller : Pour une capacité liée à un usage précis, consultez aussi le benchmark correspondant. L’ajout de résultats ou de benchmarks peut modifier les estimations et leur incertitude.
Ce que révèle ce classement
- Le meilleur score est de 167.4, obtenu par Claude Opus 5.5.
- L’écart entre la 1re et la 5e place est de 4.5.
- Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 5 modèles.
- Les résultats de ce test sont publics pour 60 modèles.
Indice global de capacité (ECI) Epoch AI
ECI est un indice global créé par Epoch AI à partir des résultats de plusieurs tests. Un score plus élevé indique de meilleures capacités générales. · Récupéré le 2026-10-04
Voir le tableau (top 40)
| Rang | Modèle | Développeur | Date de sortie | Score |
|---|---|---|---|---|
| 1 | #1Claude Opus 5.5 | Anthropic | 2026-09-22 | 167.4 |
| 2 | #2OGPT-6 Astra | OpenAI | 2026-09-03 | 166.5 |
| 3 | #3Claude Sonnet 5.5 | Anthropic | 2026-09-28 | 165.2 |
| 4 | #4Claude Fable 5.1 | Anthropic | 2026-09-01 | 164.8 |
| 5 | #5Claude Opus 5 | Anthropic | 2026-07-24 | 162.9 |
| 6 | #6OGPT-5.5 Pro | OpenAI | 2026-04-23 | 162.4 |
| 7 | #7Claude Fable 5 | Anthropic | 2026-06-09 | 162.2 |
| 8 | #8OGPT-5.6 Sol | OpenAI | 2026-07-09 | 161.8 |
| 9 | #9OGPT-5.6 Terra | OpenAI | 2026-07-09 | 159.8 |
| 10 | #10OGPT-5.5 | OpenAI | 2026-04-23 | 159.2 |
| 11 | #11OGPT-5.4 Pro | OpenAI | 2026-03-05 | 159.1 |
| 12 | #12Claude Opus 4.8 | Anthropic | 2026-05-28 | 158.3 |
| 13 | #13Kimi K3 | Moonshot AI | 2026-07-16 | 157.6 |
| 14 | #14Gemini 3.7 Flash | 2026-08-13 | 157.4 | |
| 15 | #15Gemini 3.8 Flash | 2026-09-02 | 156.9 | |
| 16 | #16OGPT-5.4 | OpenAI | 2026-03-05 | 156.9 |
| 17 | #17Muse Spark 1.3 | Meta | 2026-09-02 | 156.9 |
| 18 | #18OGPT-5.3 Codex | OpenAI | 2026-02-05 | 156.8 |
| 19 | #19xGrok 4.6 | xAI | 2026-08-12 | 156.6 |
| 20 | #20Qwen 3.8 Max | Alibaba | 2026-08-02 | 156.6 |
| 21 | #21OGPT-5.6 Luna | OpenAI | 2026-07-09 | 156.5 |
| 22 | #22Claude Opus 4.7 | Anthropic | 2026-04-16 | 156.4 |
| 23 | #23Claude Sonnet 5 | Anthropic | 2026-06-30 | 156.3 |
| 24 | #24ZGLM-5.3 | Z.ai | 2026-08-14 | 155.8 |
| 25 | #25OGPT-5.2 Pro | OpenAI | 2025-12-11 | 155.4 |
| 26 | #26DeepSeek V4 Pro 0813 | DeepSeek | 2026-08-13 | 155.4 |
| 27 | #27Claude Opus 4.6 | Anthropic | 2026-02-05 | 155.3 |
| 28 | #28Qwen3.8 Max (0902) | Alibaba | 2026-09-01 | 155.2 |
| 29 | #29DeepSeek V4.1 Flash | DeepSeek | 2026-09-09 | 155 |
| 30 | #30Muse Spark 1.2 | Meta | 2026-08-05 | 155 |
| 31 | #31Gemini 3.1 Pro | 2026-02-19 | 154.8 | |
| 32 | #32DeepSeek V4 Flash 0731 | DeepSeek | 2026-07-31 | 154.5 |
| 33 | #33Gemini 3.5 Flash | 2026-05-19 | 154.5 | |
| 34 | #34Gemini 3.6 Flash | 2026-07-21 | 154.3 | |
| 35 | #35Muse Spark 1.1 | Meta | 2026-07-09 | 154.3 |
| 36 | #36xGrok 4.5 | xAI | 2026-07-08 | 154 |
| 37 | #37Qwen3.7-Max | Alibaba | 2026-05-19 | 153.7 |
| 38 | #38OGPT-5.2 | OpenAI | 2025-12-11 | 153.5 |
| 39 | #39Gemini 3 Pro | 2025-11-18 | 153 | |
| 40 | #40Claude Sonnet 4.6 | Anthropic | 2026-02-17 | 152.3 |
Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings