Valumigo

Epoch AI · Indice global de capacité (ECI)

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Cet indice global de capacités, créé par Epoch AI, combine plusieurs scores de benchmarks sur une échelle commune. Il estime statistiquement la difficulté et les variations de score propres à chaque benchmark afin de comparer des modèles ayant passé des tests différents.

Comment lire le score : Il s’agit d’une estimation relative des capacités, et non d’un taux de bonnes réponses. Un écart de score ne se traduit pas directement par un écart perceptible en usage réel. Utilisez cet indice pour situer globalement les modèles sur plusieurs tests.

Points à surveiller : Pour une capacité liée à un usage précis, consultez aussi le benchmark correspondant. L’ajout de résultats ou de benchmarks peut modifier les estimations et leur incertitude.

Ce que révèle ce classement

  • Le meilleur score est de 167.4, obtenu par Claude Opus 5.5.
  • L’écart entre la 1re et la 5e place est de 4.5.
  • Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 5 modèles.
  • Les résultats de ce test sont publics pour 60 modèles.

Indice global de capacité (ECI) Epoch AI

ECI est un indice global créé par Epoch AI à partir des résultats de plusieurs tests. Un score plus élevé indique de meilleures capacités générales. · Récupéré le 2026-10-04

156159162165168
AnthropicClaude Opus 5.5
167.4
OGPT-6 Astra
166.5
AnthropicClaude Sonnet 5.5
165.2
AnthropicClaude Fable 5.1
164.8
AnthropicClaude Opus 5
162.9
OGPT-5.5 Pro
162.4
AnthropicClaude Fable 5
162.2
OGPT-5.6 Sol
161.8
OGPT-5.6 Terra
159.8
OGPT-5.5
159.2
OGPT-5.4 Pro
159.1
AnthropicClaude Opus 4.8
158.3
Moonshot AIKimi K3
157.6
GoogleGemini 3.7 Flash
157.4
GoogleGemini 3.8 Flash
156.9
OGPT-5.4
156.9
MetaMuse Spark 1.3
156.9
OGPT-5.3 Codex
156.8
xGrok 4.6
156.6
AlibabaQwen 3.8 Max
156.6
Voir le tableau (top 40)
RangModèleDéveloppeurDate de sortieScore
1#1AnthropicClaude Opus 5.5Anthropic2026-09-22167.4
2#2OGPT-6 AstraOpenAI2026-09-03166.5
3#3AnthropicClaude Sonnet 5.5Anthropic2026-09-28165.2
4#4AnthropicClaude Fable 5.1Anthropic2026-09-01164.8
5#5AnthropicClaude Opus 5Anthropic2026-07-24162.9
6#6OGPT-5.5 ProOpenAI2026-04-23162.4
7#7AnthropicClaude Fable 5Anthropic2026-06-09162.2
8#8OGPT-5.6 SolOpenAI2026-07-09161.8
9#9OGPT-5.6 TerraOpenAI2026-07-09159.8
10#10OGPT-5.5OpenAI2026-04-23159.2
11#11OGPT-5.4 ProOpenAI2026-03-05159.1
12#12AnthropicClaude Opus 4.8Anthropic2026-05-28158.3
13#13Moonshot AIKimi K3Moonshot AI2026-07-16157.6
14#14GoogleGemini 3.7 FlashGoogle2026-08-13157.4
15#15GoogleGemini 3.8 FlashGoogle2026-09-02156.9
16#16OGPT-5.4OpenAI2026-03-05156.9
17#17MetaMuse Spark 1.3Meta2026-09-02156.9
18#18OGPT-5.3 CodexOpenAI2026-02-05156.8
19#19xGrok 4.6xAI2026-08-12156.6
20#20AlibabaQwen 3.8 MaxAlibaba2026-08-02156.6
21#21OGPT-5.6 LunaOpenAI2026-07-09156.5
22#22AnthropicClaude Opus 4.7Anthropic2026-04-16156.4
23#23AnthropicClaude Sonnet 5Anthropic2026-06-30156.3
24#24ZGLM-5.3Z.ai2026-08-14155.8
25#25OGPT-5.2 ProOpenAI2025-12-11155.4
26#26DeepSeekDeepSeek V4 Pro 0813DeepSeek2026-08-13155.4
27#27AnthropicClaude Opus 4.6Anthropic2026-02-05155.3
28#28AlibabaQwen3.8 Max (0902)Alibaba2026-09-01155.2
29#29DeepSeekDeepSeek V4.1 FlashDeepSeek2026-09-09155
30#30MetaMuse Spark 1.2Meta2026-08-05155
31#31GoogleGemini 3.1 ProGoogle2026-02-19154.8
32#32DeepSeekDeepSeek V4 Flash 0731DeepSeek2026-07-31154.5
33#33GoogleGemini 3.5 FlashGoogle2026-05-19154.5
34#34GoogleGemini 3.6 FlashGoogle2026-07-21154.3
35#35MetaMuse Spark 1.1Meta2026-07-09154.3
36#36xGrok 4.5xAI2026-07-08154
37#37AlibabaQwen3.7-MaxAlibaba2026-05-19153.7
38#38OGPT-5.2OpenAI2025-12-11153.5
39#39GoogleGemini 3 ProGoogle2025-11-18153
40#40AnthropicClaude Sonnet 4.6Anthropic2026-02-17152.3

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings