
Claude Opus 5 ya está disponible hoy. Es más económico para las empresas que el modelo principal de Anthropic, Claude Fable 5, que la compañía había posicionado como el producto de vanguardia para usuarios de pago. Además, Opus 5 también lo supera en benchmarks significativos.
Para entender dónde encaja Opus 5: la línea de Anthropic consta de cuatro niveles. Haiku es rápido y económico. Sonnet es de gama media. Opus es el caballo de batalla pesado. Por encima se encuentra la clase Mythos, un nivel que Anthropic introdujo esta primavera, que incluye Claude Fable 5 para el público, y Claude Mythos 5, una versión con menos restricciones reservada a través del Proyecto Glasswing para investigadores de ciberseguridad verificados y operadores de infraestructura crítica.
Fable 5 ha tenido un recorrido difícil como buque insignia para los suscriptores. Fue lanzado el 9 de junio, retirado globalmente tres días después de que el gobierno de EE. UU. emitiera una orden de control de exportaciones de emergencia citando una vulnerabilidad de jailbreak, y regresó el 30 de junio, solo para pasar inmediatamente a un modelo basado únicamente en créditos, ya no incluido en los planes estándar. Opus 5 ahora ocupa el lugar que Fable 5 no pudo mantener.
Lovable, una plataforma para desarrolladores con millones de usuarios, ejecutó Opus 5 en sus evaluaciones internas y observó que las mejoras van más allá de las puntuaciones brutas: "No solo es mejor en nuestras tareas de codificación con agentes más difíciles, con un aumento del 22% sobre Opus 4.7, sino que es más estable, con mucha menos varianza entre ejecuciones", dijo Fabian Hedin en un comunicado compartido por Anthropic.
Puede sonar extraño, pero Opus supera a Fable en casi todo lo que le importará al usuario promedio, sin ser etiquetado como de clase Mythos, a diferencia de Fable.
En Frontier-Bench v0.1, un benchmark que evalúa si los agentes de codificación de IA pueden completar tareas reales de ingeniería de software de principio a fin, puntuado como porcentaje de tareas aprobadas, Opus 5 alcanzó el 43.3%. Fable 5 obtuvo un 33.7%. El GPT-5.6 Sol de OpenAI, el principal rival comercial de Anthropic, obtuvo un 34.4%.
La mayor diferencia se observa en ARC-AGI-3, una prueba de verdadera resolución de problemas basada en rompecabezas novedosos que un modelo no podría haber memorizado de los datos de entrenamiento, puntuado como porcentaje de rompecabezas resueltos. Opus 5 alcanzó un 30.2%; GPT-5.6 Sol obtuvo un 7.8%; y Fable 5 no fue evaluado en absoluto. En GDPval-AA v2, un benchmark de trabajo de conocimiento puntuado mediante calificaciones Elo, el sistema de clasificación estilo ajedrez utilizado para medir el rendimiento relativo en tareas profesionales reales, Opus 5 alcanzó 1,861 frente a los 1,747 de Fable 5 y los 1,736 de GPT-5.6 Sol.
Zapier probó Opus 5 en AutomationBench, una evaluación que mide si un modelo puede llevar a cabo un flujo de trabajo empresarial completo de principio a fin sin ayuda humana. Su veredicto: el modelo "tomó un libro de trabajo de salud de cuentas en bruto y ejecutó una secuencia completa de prevención de abandono de principio a fin: marcando cuentas en riesgo, alertando al propietario correcto y resumiendo para las operaciones de retención. Los modelos anteriores no pasaron; Opus 5 alcanzó el 100%".
Anthropic también está presentando Opus 5 como una mejora para la investigación. Ultima Genomics, una empresa de secuenciación de ADN, afirmó que el modelo "se comporta más como un científico cuidadoso que cualquier modelo que hayamos utilizado. Busca las pruebas estadísticas adecuadas para descartar factores de confusión, verifica sus propios resultados mediante métodos independientes y se mantiene en el camino a través de análisis largos y de múltiples pasos".
Dicho esto, estas dos áreas —legal y salud— son las únicas en las que Fable 5 sobresale por un pequeño margen.
El lanzamiento se produce una semana después de que Moonshot AI, una startup con sede en Beijing respaldada por Alibaba, presentara Kimi K3, un modelo de código abierto con 2.8 billones de parámetros (lo que significa que cualquiera puede descargar el código subyacente para ejecutarlo de forma independiente) que Moonshot describe como el sistema de IA abierto más grande del mundo. Los benchmarks independientes sitúan consistentemente a Kimi K3 en tercer lugar general, detrás de Fable 5 y GPT-5.6 Sol, superando a estos dos en áreas específicas.
Opus 5 ya está disponible a través de API a $5 por millón de tokens de entrada y $25 por millón de salida. (Los tokens son la unidad básica de información que un modelo de IA puede procesar tanto en la entrada como en la salida). También está disponible un modo Rápido que funciona aproximadamente 2.5 veces más rápido que la velocidad predeterminada, al doble del precio base: $10 por millón de tokens de entrada y $50 por millón de salida.
Este lanzamiento podría poner fin a la ansiedad por la falta de disponibilidad pública de Fable 5. Opus también está disponible mediante suscripción para todos.