LMArena · Développement web
Nous récupérons régulièrement les données publiques de benchmarks (classements issus des votes des utilisateurs de LMArena, scores aux tests d’Epoch AI et classements d’utilisation d’OpenRouter) pour les afficher. Chaque classement indique sa date de publication et sa date de récupération. Ces scores ne sont pas attribués par ce site.
Comment lire ce classement
Ce qui est mesuré : Ce classement WebDev Arena repose sur la génération de pages ou d’applications web à partir d’une même demande, suivie d’une comparaison anonyme des résultats exécutés et d’un vote.
Comment lire le score : Il s’agit d’un score relatif des résultats exécutés préférés par les utilisateurs. Ce n’est ni un taux objectif de réussite aux tests fonctionnels ni une note de maintenabilité.
Points à surveiller : L’évaluation se limite aux frameworks pris en charge et aux conditions de génération et d’exécution. Elle ne garantit donc pas la capacité à maintenir de grands projets sur le long terme.
Ce que révèle ce classement
- Les intervalles de confiance à 95% de claude-opus-5.5-max, en 1re place, et de gpt-6-astra-max, en 2e place, ne se chevauchent pas. Cette agrégation fournit des éléments relativement clairs en faveur de l’avance du premier.
- Parmi les 10 premiers, les modèles de Anthropic sont les plus nombreux, avec 5 modèles.
- Le modèle en 1re place a reçu 2,062 votes, et ce classement comprend 50 modèles.
Développement web LMArena
Publié le 2026-10-01 · Récupéré le 2026-10-04
Les points indiquent les scores, les lignes horizontales les intervalles de confiance à 95 %. Si les lignes se chevauchent, les performances sont globalement similaires. Le graphique affiche uniquement le meilleur score parmi les réglages de raisonnement d’un même modèle (high, max, etc.). Le tableau présente les classements de tous les réglages.
Meilleur classement par entreprise
- Anthropicclaude-opus-5.5-max#1
- OOpenAIgpt-6-astra-max#2
- Googlegemini-4-argon-high#9
- Alibabaqwen3.8-max#10
- Moonshot AIkimi-k3-max#13
- Metamuse-spark-1.3-max#14
- xxAIgrok-4.7-xhigh#15
- TTencenthy4-preview#17
- ZZ.aiglm-5.3-max#20
Voir le tableau (top 50)
| Rang | Modèle | Développeur | Score | Intervalle de confiance à 95% | Nombre de votes |
|---|---|---|---|---|---|
| 1 | #1claude-opus-5.5-max | Anthropic | 1815 | 1799–1831 | 2,062 |
| 2 | #2Ogpt-6-astra-max | OpenAI | 1788 | 1777–1798 | 6,123 |
| 3 | #3claude-sonnet-5.5-xhigh | Anthropic | 1786 | 1768–1804 | 1,531 |
| 4 | #4Ogpt-6.1-sol-max | OpenAI | 1758 | 1741–1775 | 1,620 |
| 5 | #5claude-fable-5.1-max | Anthropic | 1749 | 1740–1759 | 6,318 |
| 6 | #6claude-sonnet-5.5-high | Anthropic | 1715 | 1702–1729 | 2,527 |
| 7 | #7claude-opus-5-max | Anthropic | 1695 | 1689–1701 | 16,954 |
| 8 | #8Ogpt-6-sol-max | OpenAI | 1689 | 1678–1700 | 3,411 |
| 9 | #9gemini-4-argon-high | 1680 | 1666–1693 | 2,422 | |
| 10 | #10qwen3.8-max | Alibaba | 1671 | 1659–1683 | 3,454 |
| 11 | #11qwen3.8-max-0902 | Alibaba | 1670 | 1662–1678 | 9,485 |
| 12 | #12claude-opus-5-high | Anthropic | 1660 | 1654–1666 | 21,506 |
| 13 | #13kimi-k3-max | Moonshot AI | 1658 | 1651–1664 | 16,513 |
| 14 | #14muse-spark-1.3-max | Meta | 1657 | 1648–1665 | 7,249 |
| 15 | #15xgrok-4.7-xhigh | xAI | 1638 | 1626–1649 | 3,216 |
| 16 | #16qwen3.8-flash-next | Alibaba | 1637 | 1629–1646 | 6,193 |
| 17 | #17Thy4-preview | Tencent | 1633 | 1624–1643 | 5,088 |
| 18 | #18claude-fable-5-high | Anthropic | 1625 | 1619–1632 | 14,126 |
| 19 | #19muse-spark-1.3 (xHigh) | Meta | 1624 | 1616–1633 | 6,326 |
| 20 | #20Zglm-5.3-max | Z.ai | 1623 | 1615–1631 | 7,658 |
| 21 | #21deepseek-v4.1-flash-max | DeepSeek | 1620 | 1609–1630 | 3,960 |
| 22 | #22Ogpt-5.6-sol-xhigh (codex-harness) | OpenAI | 1620 | 1614–1626 | 17,128 |
| 23 | #23xgrok-4.6-high | xAI | 1620 | 1612–1627 | 8,315 |
| 24 | #24mimo-v2.6-pro | Xiaomi | 1618 | 1606–1631 | 2,734 |
| 25 | #25Zglm-5.3-flash | Z.ai | 1616 | 1608–1623 | 10,355 |
| 26 | #26Zglm-5.2-max | Z.ai | 1605 | 1599–1611 | 14,729 |
| 27 | #27gemini-3.7-flash-high | 1592 | 1584–1599 | 9,624 | |
| 28 | #28qwen3.8-27b | Alibaba | 1591 | 1584–1598 | 12,388 |
| 29 | #29gemini-3.8-flash-high | 1583 | 1575–1591 | 8,524 | |
| 30 | #30deepseek-v4-pro-high-20260813 | DeepSeek | 1583 | 1573–1592 | 4,882 |
| 31 | #31deepseek-v4-flash-high | DeepSeek | 1581 | 1572–1590 | 5,040 |
| 32 | #32Ogpt-6-luna-max | OpenAI | 1579 | 1570–1587 | 6,429 |
| 33 | #33Sstep-5-preview-high | StepFun | 1570 | 1557–1583 | 2,506 |
| 34 | #34claude-opus-4-7-high | Anthropic | 1557 | 1552–1563 | 17,982 |
| 35 | #35claude-opus-4-8-high | Anthropic | 1556 | 1550–1561 | 18,908 |
| 36 | #36claude-opus-4-7 | Anthropic | 1555 | 1550–1561 | 18,174 |
| 37 | #37xgrok-4.5 | xAI | 1552 | 1545–1558 | 11,393 |
| 38 | #38claude-opus-4-6-high | Anthropic | 1546 | 1540–1551 | 19,519 |
| 39 | #39muse-spark-1.1 | Meta | 1542 | 1534–1549 | 8,070 |
| 40 | #40claude-sonnet-5-high | Anthropic | 1539 | 1533–1546 | 14,130 |
| 41 | #41claude-opus-4-6 | Anthropic | 1537 | 1532–1542 | 20,762 |
| 42 | #42gemini-3.6-flash-high | 1536 | 1529–1544 | 8,823 | |
| 43 | #43claude-opus-4-8 | Anthropic | 1534 | 1528–1540 | 17,880 |
| 44 | #44muse-spark-1.2 (xHigh) | Meta | 1532 | 1518–1545 | 2,183 |
| 45 | #45claude-sonnet-4-6 | Anthropic | 1521 | 1516–1527 | 22,960 |
| 46 | #46Ogpt-5.6-terra-xhigh (codex-harness) | OpenAI | 1519 | 1513–1526 | 12,526 |
| 47 | #47Ogpt-5.6-luna-xhigh (codex-harness) | OpenAI | 1518 | 1512–1524 | 12,776 |
| 48 | #48seed-2.1-pro-preview | ByteDance | 1517 | 1511–1523 | 13,312 |
| 49 | #49qwen3.7-max-20260517 | Alibaba | 1515 | 1508–1522 | 8,922 |
| 50 | #50Ogpt-5.5-xhigh (codex-harness) | OpenAI | 1512 | 1506–1518 | 15,873 |
Données : LMArena leaderboard dataset (CC BY 4.0). Modifications : Seuls les 50 premiers de chaque classement sont affichés. Les scores sont arrondis.. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetLes logos sont des marques de leurs entreprises respectives et servent uniquement à les distinguer (icônes : Simple Icons).Données : Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: OpenRouter (openrouter.ai/rankings), as of 2026-10-04. Licensed under CC BY 4.0. https://openrouter.ai/rankings