
Anthropic lanzó Claude Fable 5.1 y Claude Mythos 5.1 el martes, su primera actualización de la línea de modelos de clase Mythos desde que Fable 5 se lanzó el 9 de junio.
La compañía afirma que los nuevos modelos de IA son los “más avanzados del mundo para codificación y trabajo de conocimiento”, y llegan tres meses después de un ciclo de lanzamiento que ya ha incluido un cierre de control de exportaciones de 18 días, una disputa de precios a mediados de verano sobre el acceso a suscripciones, y un lanzamiento en julio de Claude Opus 5 que superó a Fable 5 en precio.
Fable 5.1 y Mythos 5.1 son, según Anthropic, el mismo modelo subyacente con diferentes filtros de seguridad incorporados. Fable 5.1 está generalmente disponible para cualquier persona con una cuenta de Claude. Mythos 5.1 permanece restringido a profesionales verificados de ciberseguridad y ciencias de la vida a través del Programa de Verificación Cibernética y el Programa de Verificación de Ciencias de la Vida de Anthropic, el sucesor de la vía de acceso Project Glasswing que restringió Mythos 5.
Qué miden realmente los puntos de referencia
El número principal de Anthropic proviene de Terminal-Bench-Science 0.1, un punto de referencia que prueba si un agente de IA puede llevar a cabo tareas de investigación científica dentro de un entorno de línea de comandos, puntuado como una tasa de aprobación.
Fable 5.1 alcanzó un 52.6% frente al 24.7% de Fable 5 y el 29.0% de Opus 5, más del doble que su predecesor.
Terminal-Bench 4.0 prueba la codificación agencial realizada a través de una terminal—escribir, ejecutar y depurar código a través de sesiones de línea de comandos de varios pasos, puntuado como un porcentaje de tareas completadas correctamente. Fable 5.1 obtuvo un 55.8%, superando el 42.0% de Fable 5 y el 52.3% de Opus 5.
Mythos 5.1, ejecutándose con filtros de ciberseguridad más ligeros, obtuvo un 60.9% en la misma prueba; Anthropic dice que la brecha refleja tareas que sus salvaguardias interceptaron y redirigieron a Opus 4.8.
En Humanity's Last Exam, una prueba de razonamiento multidisciplinaria construida a partir de preguntas de nivel experto en docenas de campos académicos y puntuado como una tasa de aprobación, Fable 5.1 alcanzó un 60.9% sin herramientas externas y un 65.0% con ellas, ambos por delante de Opus 5, demostrando que este es el modelo más avanzado de Anthropic para fines académicos.
Donde supera a Opus 5, y donde los números se vuelven más confusos
Opus 5 se lanzó en julio costando la mitad del precio por token de Fable 5, superando a Fable 5 en la mayoría de los principales puntos de referencia, haciendo que el modelo insignia fuera redundante para la mayoría de los usuarios de pago.
Fable 5.1 revierte eso: ahora supera a Opus 5 en todos los puntos de referencia publicados por Anthropic, incluidos aquellos donde Opus 5 había superado previamente a Fable 5.
Pero Fable 5.1 sigue costando el doble por token que Opus 5: $10 de entrada y $50 de salida frente a los $5 y $25 de Opus 5. Los tokens son la cantidad básica de información que un modelo puede manejar (normalmente alrededor de dos tercios de una palabra promedio en inglés), y las empresas pagan por el uso porque los flujos de trabajo pesados suelen agotar las cuotas establecidas en los planes de suscripción muy rápidamente.
La propia propuesta de Anthropic para el modelo se basa en los niveles de esfuerzo en lugar de las puntuaciones brutas: dice que ejecutar Fable 5.1 con un esfuerzo de razonamiento bajo o medio iguala o supera los antiguos resultados de Fable 5 a un costo mucho menor, mientras reserva los niveles de esfuerzo superiores para problemas que superan a todo lo demás.
Para el trabajo rutinario, ese argumento para omitir Opus 5 por completo se debilita cuanto menor sea el nivel de esfuerzo.
El acceso sigue la misma división que se aplicó a Fable 5 después de meses de que Anthropic ajustara los términos. En los planes Pro y asientos estándar de Equipo o Empresa, Fable 5.1 se financia completamente con créditos de uso de pago por consumo facturados a la tarifa de la API, ya que no forma parte de los límites semanales de esos planes. En los planes Max y asientos premium de Equipo o Empresa, se incluye como parte estándar de la suscripción hasta el 50% del uso semanal.
Claude Fable 5.1 ya está disponible en la API de Claude, Amazon Bedrock, Google Cloud y Microsoft Foundry, bajo la identificación de modelo "claude-fable-5-1."








