InícioCentro de Notícias da LBank
Anthropic lança Claude Fable 5.1, mais que dobrando seu antecessor em benchmark-chave
anthropic-claude-fable-5-1
Anthropic lança Claude Fable 5.1, mais que dobrando seu antecessor em benchmark-chave
Fable 5.1 e seu irmão restrito Mythos 5.1 chegam três meses depois que controles de exportação forçaram a Anthropic a retirar o Fable 5 do ar por 18 dias
2026-09-01 Fonte:decrypt.co

Em resumo

  • A Anthropic lançou o Claude Fable 5.1 e o Claude Mythos 5.1 em 1º de setembro, marcando 52,6% no Terminal-Bench-Science 0.1 contra 24,7% do Fable 5, e 55,8% no Terminal-Bench 4.0 contra 42,0%.
  • As leituras de cache agora custam 75% menos, cortando os custos típicos de carga de trabalho em aproximadamente 25% e as cargas de trabalho altamente agênticas em até 45%, com preço base inalterado em US$ 10/US$ 50 por milhão de tokens.
  • O Fable 5.1 não está incluído em planos Pro ou assentos Team padrão, que o executam com créditos de uso; assentos Max e Team ou Enterprise premium o têm incluído por até 50% dos limites semanais.

A Anthropic lançou o Claude Fable 5.1 e o Claude Mythos 5.1 na terça-feira, sua primeira atualização para a linha de modelos da classe Mythos desde que o Fable 5 foi lançado em 9 de junho.

A empresa afirma que os novos modelos de IA são os “mais avançados do mundo para codificação e trabalho de conhecimento”, e isso ocorre três meses após um ciclo de lançamento que já incluiu um desligamento de 18 dias de controle de exportação, uma disputa de preços no meio do verão sobre acesso por assinatura e um lançamento em julho do Claude Opus 5 que superou o Fable 5 em preço.

Myriad: Quando a OpenAI lançará o GPT-6? Clique para fazer sua previsão.

Fable 5.1 e Mythos 5.1 são, de acordo com a Anthropic, o mesmo modelo subjacente com diferentes filtros de segurança acoplados. O Fable 5.1 está geralmente disponível para qualquer pessoa com uma conta Claude. O Mythos 5.1 permanece restrito a profissionais de cibersegurança e ciências da vida verificados através do Programa de Verificação Cibernética e do Programa de Verificação de Ciências da Vida da Anthropic, o sucessor da trilha de acesso Project Glasswing que limitava o Mythos 5.

O que os benchmarks realmente medem

O número principal da Anthropic vem do Terminal-Bench-Science 0.1, um benchmark que testa se um agente de IA pode realizar tarefas de pesquisa científica dentro de um ambiente de linha de comando, pontuado como uma taxa de aprovação.

O Fable 5.1 atingiu 52,6% contra 24,7% do Fable 5 e 29,0% do Opus 5, mais que o dobro de seu predecessor.

O Terminal-Bench 4.0 testa a codificação agêntica feita através de um terminal — escrever, executar e depurar código em sessões de linha de comando de várias etapas, pontuado como uma porcentagem de tarefas concluídas corretamente. O Fable 5.1 marcou 55,8%, acima dos 42,0% do Fable 5 e à frente dos 52,3% do Opus 5.

O Mythos 5.1, rodando com filtros de cibersegurança mais leves, obteve 60,9% no mesmo teste; a Anthropic diz que a diferença reflete tarefas que suas salvaguardas interceptaram e redirecionaram para o Opus 4.8.

No Humanity's Last Exam, um teste de raciocínio multidisciplinar construído a partir de questões de nível especialista em dezenas de campos acadêmicos e pontuado como uma taxa de aprovação, o Fable 5.1 atingiu 60,9% sem ferramentas externas e 65,0% com elas, ambos à frente do Opus 5, mostrando que este é o modelo mais avançado da Anthropic para fins acadêmicos.

Onde ele supera o Opus 5, e onde a matemática fica mais complexa

O Opus 5 foi lançado em julho custando metade do preço por token do Fable 5, enquanto superava o Fable 5 na maioria dos benchmarks importantes, tornando efetivamente o modelo principal redundante para a maioria dos usuários pagantes.

O Fable 5.1 inverte isso: ele agora supera o Opus 5 em todos os benchmarks publicados pela Anthropic, incluindo aqueles onde o Opus 5 havia superado o Fable 5 anteriormente.

Mas o Fable 5.1 ainda custa o dobro por token que o Opus 5 — US$ 10 de entrada e US$ 50 de saída versus US$ 5 e US$ 25 do Opus 5. Tokens são a quantidade básica de informação que um modelo pode processar (geralmente cerca de dois terços de uma palavra média em inglês), e as empresas pagam pelo uso porque fluxos de trabalho pesados geralmente esgotam rapidamente as cotas estabelecidas nos planos de assinatura.

A própria proposta da Anthropic para o modelo se baseia em níveis de esforço, e não em pontuações brutas: ela afirma que executar o Fable 5.1 em esforço de raciocínio baixo ou médio iguala ou supera os resultados antigos do Fable 5 a um custo muito menor, enquanto reserva os níveis de esforço superiores para problemas que superam todos os outros.

Para trabalhos de rotina, esse argumento para pular o Opus 5 inteiramente fica mais fraco quanto menor for o nível de esforço.

O acesso segue a mesma divisão aplicada ao Fable 5 após meses de ajustes dos termos pela Anthropic. Em planos Pro e assentos Team ou Enterprise padrão, o Fable 5.1 utiliza integralmente créditos de uso pré-pago cobrados pela taxa da API, já que não faz parte dos limites semanais desses planos. Em planos Max e assentos Team ou Enterprise premium, ele está incluído como parte padrão da assinatura por até 50% do uso semanal.

O Claude Fable 5.1 já está disponível na API Claude, Amazon Bedrock, Google Cloud e Microsoft Foundry, sob o ID de modelo "claude-fable-5-1."