Artificial Analysis · Indice de programmation
Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.
Comment lire ce classement
Ce qui est mesuré : Cet indice de programmation regroupe des évaluations liées au code réalisées par Artificial Analysis.
Comment lire le score : Un indice plus élevé indique de meilleurs résultats aux évaluations de rédaction et de modification de code.
Points à surveiller : Ces résultats portent sur la programmation interactive et peuvent différer des capacités d’un agent à travailler sur un dépôt entier. Consultez également nos comptes rendus de tests pratiques de programmation.
Ce que révèle ce classement
- Le meilleur score est de 81.6, obtenu par Claude Fable 5.1 (Max, Default Fallback).
- L’écart entre la 1re et la 5e place est de 4.8.
- Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 3 modèles.
Indice de programmation Artificial Analysis
Publié le 2026-10-05 · Récupéré le 2026-10-05
Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages.
Voir le tableau (top 60)
| Rang | Modèle | Développeur | Score |
|---|---|---|---|
| 1 | #1Claude Fable 5.1 (Max, Default Fallback) | Anthropic | 81.6 |
| 2 | #2OGPT-5.6 Sol (Xhigh) | OpenAI | 78.3 |
| 3 | #3Claude Opus 5 (Max) | Anthropic | 78 |
| 4 | #4OGPT-6 Astra (max) | OpenAI | 76.9 |
| 5 | #5xGrok 4.6 (High) | xAI | 76.8 |
| 6 | #6OGPT-5.6 Terra (Max) | OpenAI | 76.7 |
| 7 | #7Claude Fable 5 (Max, Opus 4.8 Fallback) | Anthropic | 76.5 |
| 8 | #8Gemini 3.8 Flash (High) | 76.3 | |
| 9 | #9Kimi K3 (Max) | Moonshot AI | 76.2 |
| 10 | #10Qwen3.8 Max (0902) | Alibaba | 76.2 |
| 11 | #11Gemini 3.7 Flash (High) | 76.1 | |
| 12 | #12OGPT-5.5 (Xhigh) | OpenAI | 74.9 |
| 13 | #13ZGLM-5.3 (Max) | Z.ai | 74.8 |
| 14 | #14Claude Opus 4.8 (Max) | Anthropic | 74.3 |
| 15 | #15Claude Opus 4.7 (Max) | Anthropic | 73.6 |
| 16 | #16xGrok 4.5 (High) | xAI | 72.4 |
| 17 | #17Muse Spark 1.2 (Xhigh) | Meta | 72.2 |
| 18 | #18Qwen3.8 2.4T A95B | Alibaba | 71.9 |
| 19 | #19Claude Sonnet 5 (Max) | Anthropic | 71.5 |
| 20 | #20ZGLM 5.3 Flash | Z.ai | 71.5 |
| 21 | #21OGPT-5.6 Luna (Max) | OpenAI | 71.4 |
| 22 | #22Muse Spark 1.1 (Xhigh) | Meta | 71.3 |
| 23 | #23OGPT-5.4 (Xhigh) | OpenAI | 71.1 |
| 24 | #24Gemini 3.5 Flash (High) | 70.1 | |
| 25 | #25Gemini 3.6 Flash (High) | 69.2 | |
| 26 | #26DeepSeek V4 Flash 0731 (Max) | DeepSeek | 69.1 |
| 27 | #27Qwen3.8 Max | Alibaba | 68.9 |
| 28 | #28ZGLM-5.2 (Max) | Z.ai | 68.8 |
| 29 | #29Gemini 3.1 Pro Preview | 68.8 | |
| 30 | #30DeepSeek V4 Pro 0813 (Max) | DeepSeek | 68.8 |
| 31 | #31Qwen3.8 27B (Xhigh) | Alibaba | 68.1 |
| 32 | #32Qwen3.7 Max | Alibaba | 66 |
| 33 | #33Claude Sonnet 4.6 (Max) | Anthropic | 63 |
| 34 | #34Kimi K2.6 (Reasoning) | Moonshot AI | 61.8 |
| 35 | #35Kimi K2.7 Code | Moonshot AI | 60.8 |
| 36 | #36MiMo-V2.5-Pro (Reasoning) | Xiaomi | 60.2 |
| 37 | #37KKAT Coder Pro V2 | Kwaipilot | 59.5 |
| 38 | #38DeepSeek V4 Pro 0424 (Max) | DeepSeek | 59.4 |
| 39 | #39NNex-N2-Pro (Based on Qwen3.5-397B-A17B) | Nex Agi | 59.1 |
| 40 | #40THy3 | Tencent | 58.8 |
| 41 | #41MiniMax-M3 | MiniMax | 58.6 |
| 42 | #42iLing-3.0-flash-VL | inclusionAI | 57 |
| 43 | #43MiMo-V2.5 | Xiaomi | 56.8 |
| 44 | #44DeepSeek V4 Flash 0420 (Max) | DeepSeek | 56.2 |
| 45 | #45OGPT-5.4 nano (Xhigh) | OpenAI | 56.1 |
| 46 | #46OGPT-5.4 mini (Xhigh) | OpenAI | 56.1 |
| 47 | #47Qwen3.7 Plus | Alibaba | 55.9 |
| 48 | #48ZGLM-5.1 (Reasoning) | Z.ai | 55.8 |
| 49 | #49iLing-3.0-flash-Fin | inclusionAI | 55.6 |
| 50 | #50Qwen3.6 Plus | Alibaba | 54.5 |
| 51 | #51Qwen3.6 27B (Reasoning) | Alibaba | 53.7 |
| 52 | #52TInkling Small | Thinkingmachines | 52.9 |
| 53 | #53USolar Pro 4 | Upstage | 52.7 |
| 54 | #54MiniMax-M2.7 | MiniMax | 52.6 |
| 55 | #55Claude 4.5 Sonnet (Reasoning) | Anthropic | 52.1 |
| 56 | #56TInkling (Xhigh) | Thinkingmachines | 52.1 |
| 57 | #57xGrok Build 0.1 0616 | xAI | 51.5 |
| 58 | #58iLing 3.0 Flash | inclusionAI | 50.6 |
| 59 | #59MiMo-V2-Flash (Non-reasoning) | Xiaomi | 49.8 |
| 60 | #60OGPT-5.1 (High) | OpenAI | 49.4 |
Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.
Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings