Valumigo

Artificial Analysis · Indice de programmation

Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.

Les scores LMArena proviennent des votes de personnes qui comparent les réponses de deux modèles et choisissent la meilleure (méthode Elo). Si l’écart entre les scores reste dans l’intervalle de confiance, considérez les modèles comme de niveau similaire.

Comment lire ce classement

Ce qui est mesuré : Cet indice de programmation regroupe des évaluations liées au code réalisées par Artificial Analysis.

Comment lire le score : Un indice plus élevé indique de meilleurs résultats aux évaluations de rédaction et de modification de code.

Points à surveiller : Ces résultats portent sur la programmation interactive et peuvent différer des capacités d’un agent à travailler sur un dépôt entier. Consultez également nos comptes rendus de tests pratiques de programmation.

Ce que révèle ce classement

  • Le meilleur score est de 81.6, obtenu par Claude Fable 5.1 (Max, Default Fallback).
  • L’écart entre la 1re et la 5e place est de 4.8.
  • Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 3 modèles.

Indice de programmation Artificial Analysis

Publié le 2026-10-05 · Récupéré le 2026-10-05

AnthropicClaude Fable 5.1 (Max, Default Fallback)
81.6
OGPT-5.6 Sol (Xhigh)
78.3
AnthropicClaude Opus 5 (Max)
78.0
OGPT-6 Astra (max)
76.9
xGrok 4.6 (High)
76.8
OGPT-5.6 Terra (Max)
76.7
AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)
76.5
GoogleGemini 3.8 Flash (High)
76.3
Moonshot AIKimi K3 (Max)
76.2
AlibabaQwen3.8 Max (0902)
76.2
GoogleGemini 3.7 Flash (High)
76.1
OGPT-5.5 (Xhigh)
74.9
ZGLM-5.3 (Max)
74.8
AnthropicClaude Opus 4.8 (Max)
74.3
AnthropicClaude Opus 4.7 (Max)
73.6
xGrok 4.5 (High)
72.4
MetaMuse Spark 1.2 (Xhigh)
72.2
AlibabaQwen3.8 2.4T A95B
71.9
AnthropicClaude Sonnet 5 (Max)
71.5
ZGLM 5.3 Flash
71.5

Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages.

Voir le tableau (top 60)
RangModèleDéveloppeurScore
1#1AnthropicClaude Fable 5.1 (Max, Default Fallback)Anthropic81.6
2#2OGPT-5.6 Sol (Xhigh)OpenAI78.3
3#3AnthropicClaude Opus 5 (Max)Anthropic78
4#4OGPT-6 Astra (max)OpenAI76.9
5#5xGrok 4.6 (High)xAI76.8
6#6OGPT-5.6 Terra (Max)OpenAI76.7
7#7AnthropicClaude Fable 5 (Max, Opus 4.8 Fallback)Anthropic76.5
8#8GoogleGemini 3.8 Flash (High)Google76.3
9#9Moonshot AIKimi K3 (Max)Moonshot AI76.2
10#10AlibabaQwen3.8 Max (0902)Alibaba76.2
11#11GoogleGemini 3.7 Flash (High)Google76.1
12#12OGPT-5.5 (Xhigh)OpenAI74.9
13#13ZGLM-5.3 (Max)Z.ai74.8
14#14AnthropicClaude Opus 4.8 (Max)Anthropic74.3
15#15AnthropicClaude Opus 4.7 (Max)Anthropic73.6
16#16xGrok 4.5 (High)xAI72.4
17#17MetaMuse Spark 1.2 (Xhigh)Meta72.2
18#18AlibabaQwen3.8 2.4T A95BAlibaba71.9
19#19AnthropicClaude Sonnet 5 (Max)Anthropic71.5
20#20ZGLM 5.3 FlashZ.ai71.5
21#21OGPT-5.6 Luna (Max)OpenAI71.4
22#22MetaMuse Spark 1.1 (Xhigh)Meta71.3
23#23OGPT-5.4 (Xhigh)OpenAI71.1
24#24GoogleGemini 3.5 Flash (High)Google70.1
25#25GoogleGemini 3.6 Flash (High)Google69.2
26#26DeepSeekDeepSeek V4 Flash 0731 (Max)DeepSeek69.1
27#27AlibabaQwen3.8 MaxAlibaba68.9
28#28ZGLM-5.2 (Max)Z.ai68.8
29#29GoogleGemini 3.1 Pro PreviewGoogle68.8
30#30DeepSeekDeepSeek V4 Pro 0813 (Max)DeepSeek68.8
31#31AlibabaQwen3.8 27B (Xhigh)Alibaba68.1
32#32AlibabaQwen3.7 MaxAlibaba66
33#33AnthropicClaude Sonnet 4.6 (Max)Anthropic63
34#34Moonshot AIKimi K2.6 (Reasoning)Moonshot AI61.8
35#35Moonshot AIKimi K2.7 CodeMoonshot AI60.8
36#36XiaomiMiMo-V2.5-Pro (Reasoning)Xiaomi60.2
37#37KKAT Coder Pro V2Kwaipilot59.5
38#38DeepSeekDeepSeek V4 Pro 0424 (Max)DeepSeek59.4
39#39NNex-N2-Pro (Based on Qwen3.5-397B-A17B)Nex Agi59.1
40#40THy3Tencent58.8
41#41MiniMaxMiniMax-M3MiniMax58.6
42#42iLing-3.0-flash-VLinclusionAI57
43#43XiaomiMiMo-V2.5Xiaomi56.8
44#44DeepSeekDeepSeek V4 Flash 0420 (Max)DeepSeek56.2
45#45OGPT-5.4 nano (Xhigh)OpenAI56.1
46#46OGPT-5.4 mini (Xhigh)OpenAI56.1
47#47AlibabaQwen3.7 PlusAlibaba55.9
48#48ZGLM-5.1 (Reasoning)Z.ai55.8
49#49iLing-3.0-flash-FininclusionAI55.6
50#50AlibabaQwen3.6 PlusAlibaba54.5
51#51AlibabaQwen3.6 27B (Reasoning)Alibaba53.7
52#52TInkling SmallThinkingmachines52.9
53#53USolar Pro 4Upstage52.7
54#54MiniMaxMiniMax-M2.7MiniMax52.6
55#55AnthropicClaude 4.5 Sonnet (Reasoning)Anthropic52.1
56#56TInkling (Xhigh)Thinkingmachines52.1
57#57xGrok Build 0.1 0616xAI51.5
58#58iLing 3.0 FlashinclusionAI50.6
59#59XiaomiMiMo-V2-Flash (Non-reasoning)Xiaomi49.8
60#60OGPT-5.1 (High)OpenAI49.4

Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.

Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings