Artificial Analysis · Coding-Index
Wir rufen regelmäßig öffentliche Benchmark-Daten ab und zeigen sie an: Ranglisten aus LMArena-Nutzerabstimmungen, Epoch AI-Testergebnisse und OpenRouter-Nutzungsranglisten. Für jede Rangliste zeigen wir das Veröffentlichungsdatum und das Abrufdatum. Die Bewertungen stammen nicht von dieser Website.
So lesen Sie diese Rangliste
Was wird gemessen: Ein Coding-Index, für den Artificial Analysis Bewertungen zu Programmieraufgaben zusammenfasst.
So lesen Sie die Werte: Höhere Werte bedeuten bessere Ergebnisse beim Schreiben und Bearbeiten von Code.
Zu beachten: Die Ergebnisse stammen aus dialogbasierten Coding-Bewertungen und können daher von den Fähigkeiten bei Agentenaufgaben über ganze Repositories abweichen. Sehen Sie sich auch unsere eigenen Coding-Testberichte an.
Was diese Rangliste zeigt
- Den höchsten Wert erreicht Claude Fable 5.1 (Max, Default Fallback) mit 81.6.
- Der Abstand zwischen Platz 1 und Platz 5 beträgt 4.8.
- Unter den besten 10 Modellen ist Anthropic mit 3 Modellen am häufigsten vertreten.
Coding-Index Artificial Analysis
Veröffentlicht am 2026-10-05 · Abgerufen am 2026-10-05
Das Diagramm zeigt pro Modell nur die am höchsten platzierte Schlussfolgerungseinstellung (high, max usw.). Die Tabelle enthält die Platzierungen aller Einstellungen.
Als Tabelle anzeigen (Top 60)
| Rang | Modell | Anbieter | Punkte |
|---|---|---|---|
| 1 | #1Claude Fable 5.1 (Max, Default Fallback) | Anthropic | 81.6 |
| 2 | #2OGPT-5.6 Sol (Xhigh) | OpenAI | 78.3 |
| 3 | #3Claude Opus 5 (Max) | Anthropic | 78 |
| 4 | #4OGPT-6 Astra (max) | OpenAI | 76.9 |
| 5 | #5xGrok 4.6 (High) | xAI | 76.8 |
| 6 | #6OGPT-5.6 Terra (Max) | OpenAI | 76.7 |
| 7 | #7Claude Fable 5 (Max, Opus 4.8 Fallback) | Anthropic | 76.5 |
| 8 | #8Gemini 3.8 Flash (High) | 76.3 | |
| 9 | #9Kimi K3 (Max) | Moonshot AI | 76.2 |
| 10 | #10Qwen3.8 Max (0902) | Alibaba | 76.2 |
| 11 | #11Gemini 3.7 Flash (High) | 76.1 | |
| 12 | #12OGPT-5.5 (Xhigh) | OpenAI | 74.9 |
| 13 | #13ZGLM-5.3 (Max) | Z.ai | 74.8 |
| 14 | #14Claude Opus 4.8 (Max) | Anthropic | 74.3 |
| 15 | #15Claude Opus 4.7 (Max) | Anthropic | 73.6 |
| 16 | #16xGrok 4.5 (High) | xAI | 72.4 |
| 17 | #17Muse Spark 1.2 (Xhigh) | Meta | 72.2 |
| 18 | #18Qwen3.8 2.4T A95B | Alibaba | 71.9 |
| 19 | #19Claude Sonnet 5 (Max) | Anthropic | 71.5 |
| 20 | #20ZGLM 5.3 Flash | Z.ai | 71.5 |
| 21 | #21OGPT-5.6 Luna (Max) | OpenAI | 71.4 |
| 22 | #22Muse Spark 1.1 (Xhigh) | Meta | 71.3 |
| 23 | #23OGPT-5.4 (Xhigh) | OpenAI | 71.1 |
| 24 | #24Gemini 3.5 Flash (High) | 70.1 | |
| 25 | #25Gemini 3.6 Flash (High) | 69.2 | |
| 26 | #26DeepSeek V4 Flash 0731 (Max) | DeepSeek | 69.1 |
| 27 | #27Qwen3.8 Max | Alibaba | 68.9 |
| 28 | #28ZGLM-5.2 (Max) | Z.ai | 68.8 |
| 29 | #29Gemini 3.1 Pro Preview | 68.8 | |
| 30 | #30DeepSeek V4 Pro 0813 (Max) | DeepSeek | 68.8 |
| 31 | #31Qwen3.8 27B (Xhigh) | Alibaba | 68.1 |
| 32 | #32Qwen3.7 Max | Alibaba | 66 |
| 33 | #33Claude Sonnet 4.6 (Max) | Anthropic | 63 |
| 34 | #34Kimi K2.6 (Reasoning) | Moonshot AI | 61.8 |
| 35 | #35Kimi K2.7 Code | Moonshot AI | 60.8 |
| 36 | #36MiMo-V2.5-Pro (Reasoning) | Xiaomi | 60.2 |
| 37 | #37KKAT Coder Pro V2 | Kwaipilot | 59.5 |
| 38 | #38DeepSeek V4 Pro 0424 (Max) | DeepSeek | 59.4 |
| 39 | #39NNex-N2-Pro (Based on Qwen3.5-397B-A17B) | Nex Agi | 59.1 |
| 40 | #40THy3 | Tencent | 58.8 |
| 41 | #41MiniMax-M3 | MiniMax | 58.6 |
| 42 | #42iLing-3.0-flash-VL | inclusionAI | 57 |
| 43 | #43MiMo-V2.5 | Xiaomi | 56.8 |
| 44 | #44DeepSeek V4 Flash 0420 (Max) | DeepSeek | 56.2 |
| 45 | #45OGPT-5.4 nano (Xhigh) | OpenAI | 56.1 |
| 46 | #46OGPT-5.4 mini (Xhigh) | OpenAI | 56.1 |
| 47 | #47Qwen3.7 Plus | Alibaba | 55.9 |
| 48 | #48ZGLM-5.1 (Reasoning) | Z.ai | 55.8 |
| 49 | #49iLing-3.0-flash-Fin | inclusionAI | 55.6 |
| 50 | #50Qwen3.6 Plus | Alibaba | 54.5 |
| 51 | #51Qwen3.6 27B (Reasoning) | Alibaba | 53.7 |
| 52 | #52TInkling Small | Thinkingmachines | 52.9 |
| 53 | #53USolar Pro 4 | Upstage | 52.7 |
| 54 | #54MiniMax-M2.7 | MiniMax | 52.6 |
| 55 | #55Claude 4.5 Sonnet (Reasoning) | Anthropic | 52.1 |
| 56 | #56TInkling (Xhigh) | Thinkingmachines | 52.1 |
| 57 | #57xGrok Build 0.1 0616 | xAI | 51.5 |
| 58 | #58iLing 3.0 Flash | inclusionAI | 50.6 |
| 59 | #59MiMo-V2-Flash (Non-reasoning) | Xiaomi | 49.8 |
| 60 | #60OGPT-5.1 (High) | OpenAI | 49.4 |
Source: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0.
Daten: LMArena leaderboard dataset (CC BY 4.0). Änderungen: Nur die Top 50 jeder Rangliste, gerundete Werte. https://huggingface.co/datasets/lmarena-ai/leaderboard-datasetFirmenlogos sind Marken der jeweiligen Unternehmen und dienen nur zur Unterscheidung (Icons: Simple Icons).Daten: Epoch AI — Capabilities & benchmarking (CC BY 4.0). https://epoch.ai/benchmarksSource: Artificial Analysis (artificialanalysis.ai) via OpenRouter (openrouter.ai/rankings). Source: OpenRouter evals (openrouter.ai) via OpenRouter (openrouter.ai/rankings). Source: Design Arena (www.designarena.ai) via OpenRouter (openrouter.ai/rankings). Licensed under CC BY 4.0. Source: OpenRouter (openrouter.ai/rankings), as of 2026-10-05. Licensed under CC BY 4.0. https://openrouter.ai/rankings