Valumigo

Claude Opus 5

Anthropic · 2026-07-24

Información básica

Desarrollador
AnthropicAnthropic
Fecha de lanzamiento
2026-07-24
Índice de capacidad general (ECI)
162.9

Puntuaciones en pruebas (Epoch AI)

También mostramos la posición del modelo entre los evaluados en cada prueba.

AnthropicPreguntas científicas de nivel doctoral (GPQA Diamond) · Puesto 12 de 30
93.9%
AnthropicMatemáticas de máxima dificultad (FrontierMath) · Puesto 11 de 30
85.6%
AnthropicRazonamiento con acertijos nuevos (ARC-AGI-2) · Puesto 4 de 30
90.4%
AnthropicPrecisión en preguntas sobre hechos (SimpleQA Verified) · Puesto 16 de 30
59.9%
AnthropicInteracción con interfaces de ordenador (OSWorld 2.0) · Puesto 1 de 9
31.4%

Las barras indican el porcentaje de aciertos y parten del 0%.

Clasificación por votos de usuarios (LMArena)

Esta clasificación se basa en los votos de personas que comparan las respuestas de dos modelos. El modelo no aparece en las clasificaciones en las que aún no tiene suficientes votos.

  • GeneralPuesto 4 de 413 · 1504
  • EspañolPuesto 10 de 295 · 1484
  • Desarrollo webPuesto 1 de 50 · 1815
  • Comprensión de documentosPuesto 1 de 44 · 1516
  • Escritura creativaPuesto 2 de 411 · 1516
  • ChinoPuesto 2 de 389 · 1571
  • Evaluación general de agentesPuesto 2 de 50 · 0.138
  • MatemáticasPuesto 3 de 396 · 1521
  • CoreanoPuesto 3 de 278 · 1498
  • JaponésPuesto 4 de 274 · 1506
  • Éxito de las tareas de agentesPuesto 4 de 50 · 0.141
  • InglésPuesto 6 de 413 · 1506
  • AlemánPuesto 6 de 307 · 1506
  • ProgramaciónPuesto 12 de 408 · 1538
  • Comprensión de imágenes (visión)Puesto 14 de 50 · 1289
  • FrancésPuesto 17 de 290 · 1506

Dónde usarlo

Los modelos de Anthropic se pueden usar principalmente en Claude. Los modelos disponibles y los límites de uso varían según el plan; consulte la página de precios y opciones gratuitas.

Ver precios y opciones gratuitas de Claude →

Pruebas prácticas

Tras las críticas de que las tareas de la primera ronda eran demasiado fáciles, planteamos correcciones de errores en varios archivos, una función basada en especificaciones y un error de concurrencia en el código de una pequeña tienda. Publicamos los registros de las 18 ejecuciones y los archivos de las tareas.

Claude Code vs. Codex, segunda ronda: 3 tareas prácticas con varios archivos, repetidas 3 veces
Las puntuaciones y posiciones se reproducen tal como aparecen en fuentes públicas y no son mediciones realizadas por este sitio. Como los nombres de los modelos varían ligeramente entre fuentes, se han vinculado automáticamente; en casos excepcionales, los datos pueden mezclarse con los de otras versiones.

Fuente: Epoch AI (CC BY 4.0) · Verificado 2026-10-04 · LMArena (CC BY 4.0) · Verificado 2026-10-04