Valumigo

Claude Opus 5

Anthropic · 2026-07-24

Grundlegende Informationen

Entwickler
AnthropicAnthropic
Veröffentlichungsdatum
2026-07-24
Gesamtleistungsindex (ECI)
162.9

Testergebnisse (Epoch AI)

Für jeden Test wird auch die Platzierung unter den bewerteten Modellen angezeigt.

AnthropicWissenschaftsfragen auf Promotionsniveau (GPQA Diamond) · Platz 12 von 30
93.9%
AnthropicMathematik auf höchstem Niveau (FrontierMath) · Platz 11 von 30
85.6%
AnthropicUnbekannte Rätsel durch Schlussfolgern lösen (ARC-AGI-2) · Platz 4 von 30
90.4%
AnthropicGenauigkeit bei Faktenfragen (SimpleQA Verified) · Platz 16 von 30
59.9%
AnthropicBedienung grafischer Oberflächen (OSWorld 2.0) · Platz 1 von 9
31.4%

Balken zeigen den Anteil korrekter Antworten (%) und beginnen bei 0%.

Ranglisten nach Nutzerabstimmungen (LMArena)

Diese Ranglisten beruhen auf Abstimmungen, bei denen Menschen die Antworten zweier Modelle vergleichen. In Ranglisten mit noch zu wenigen Stimmen wird das Modell nicht aufgeführt.

  • GesamtPlatz 4 von 413 · 1504
  • DeutschPlatz 6 von 307 · 1506
  • WebentwicklungPlatz 1 von 50 · 1815
  • DokumentverständnisPlatz 1 von 44 · 1516
  • Kreatives SchreibenPlatz 2 von 411 · 1516
  • ChinesischPlatz 2 von 389 · 1571
  • Agenten gesamtPlatz 2 von 50 · 0.138
  • MathematikPlatz 3 von 396 · 1521
  • KoreanischPlatz 3 von 278 · 1498
  • JapanischPlatz 4 von 274 · 1506
  • Aufgabenerfolg von AgentenPlatz 4 von 50 · 0.141
  • EnglischPlatz 6 von 413 · 1506
  • SpanischPlatz 10 von 295 · 1484
  • ProgrammierenPlatz 12 von 408 · 1538
  • Bildverständnis (Vision)Platz 14 von 50 · 1289
  • FranzösischPlatz 17 von 290 · 1506

Wo ist das Modell verfügbar?

Die Modelle von Anthropic sind hauptsächlich über Claude verfügbar. Die verfügbaren Modelle und Nutzungskontingente unterscheiden sich je nach Tarif. Prüfen Sie daher die Seite zu Preisen und kostenloser Nutzung.

Preise und kostenlose Nutzung von Claude ansehen →

Praxistests

Nach der Kritik, die Aufgaben der ersten Runde seien zu einfach gewesen, haben wir in einem kleinen Shop-Projekt dateiübergreifende Fehler, eine Funktion nach Spezifikation und einen Nebenläufigkeitsfehler bearbeiten lassen. Wir veröffentlichen die 18 Durchlaufprotokolle und die Aufgabendateien.

Claude Code vs Codex, Runde 2: 3 praxisnahe Aufgaben über mehrere Dateien, jeweils 3-mal getestet
Ergebnisse und Platzierungen wurden unverändert aus öffentlichen Quellen übernommen und nicht von dieser Website selbst gemessen. Da die Modellnamen je nach Quelle leicht abweichen und automatisch zugeordnet wurden, kann es in seltenen Fällen zu einer Vermischung mit anderen Versionen kommen.

Quelle: Epoch AI (CC BY 4.0) · Geprüft 2026-10-04 · LMArena (CC BY 4.0) · Geprüft 2026-10-04