
O Claude Opus 5 foi lançado hoje. É mais barato para as empresas operarem do que o modelo líder da Anthropic, Claude Fable 5, que a empresa havia posicionado como o produto de ponta diário para usuários pagantes. Além disso, o Opus 5 também o supera em benchmarks significativos.
Para entender onde o Opus 5 se encaixa: a linha de produtos da Anthropic possui quatro níveis. Haiku é rápido e barato. Sonnet é de médio porte. Opus é o "cavalo de batalha" para tarefas pesadas. Acima disso, encontra-se a classe Mythos — um nível que a Anthropic introduziu nesta primavera — que inclui o Claude Fable 5 para o público e o Claude Mythos 5, uma versão com menos restrições reservada através do Projeto Glasswing para pesquisadores de cibersegurança e operadores de infraestrutura crítica verificados.
O Fable 5 teve um percurso difícil como o principal modelo para assinantes. Foi lançado em 9 de junho, retirado globalmente três dias depois, após o governo dos EUA emitir uma ordem de controle de exportação de emergência citando uma vulnerabilidade de jailbreak, e voltou em 30 de junho — apenas para mudar imediatamente para um modelo somente por créditos, não mais incluído nos planos padrão. O Opus 5 agora preenche a lacuna que o Fable 5 não conseguiu manter.
Lovable, uma plataforma de desenvolvedores com milhões de usuários, executou o Opus 5 em suas avaliações internas e observou que os ganhos se estendem além das pontuações brutas: "Não é apenas melhor em nossas tarefas de codificação agêntica mais difíceis, com um aumento de 22% em relação ao Opus 4.7, é mais estável, com muito menos variância de execução para execução", disse Fabian Hedin em um comunicado compartilhado pela Anthropic.
Pode parecer estranho, mas o Opus supera o Fable em quase tudo o que será importante para o usuário comum, sem ser rotulado como classe Mythos, como o Fable.
No Frontier-Bench v0.1 — um benchmark que testa se agentes de codificação de IA podem completar tarefas reais de engenharia de software de ponta a ponta, pontuado como uma porcentagem de tarefas aprovadas — o Opus 5 atingiu 43,3%. O Fable 5 obteve 33,7%. O GPT-5.6 Sol da OpenAI, principal rival comercial da Anthropic, pontuou 34,4%.
A maior margem está no ARC-AGI-3, um teste de resolução genuína de problemas construído em torno de quebra-cabeças novos que um modelo não poderia ter memorizado dos dados de treinamento, pontuado como uma porcentagem de quebra-cabeças resolvidos. O Opus 5 atingiu 30,2%; o GPT-5.6 Sol pontuou 7,8%; e o Fable 5 não foi testado. No GDPval-AA v2 — um benchmark de trabalho do conhecimento pontuado através de classificações Elo, o sistema de classificação estilo xadrez usado para medir o desempenho relativo em tarefas profissionais reais — o Opus 5 alcançou 1.861 contra 1.747 do Fable 5 e 1.736 do GPT-5.6 Sol.
A Zapier testou o Opus 5 no AutomationBench, uma avaliação que pontua se um modelo pode realizar um fluxo de trabalho empresarial completo do início ao fim sem ajuda humana. O veredito deles: o modelo "pegou uma pasta de trabalho bruta de saúde da conta e executou uma sequência completa de prevenção de churn de ponta a ponta: sinalizando contas em risco, alertando o proprietário correto e resumindo para operações de retenção. Modelos anteriores não passaram; o Opus 5 atingiu 100%."
A Anthropic também está apresentando o Opus 5 como uma atualização para pesquisa. A Ultima Genomics, uma empresa de sequenciamento de DNA, disse que o modelo "se comporta mais como um cientista cuidadoso do que qualquer modelo que já executamos. Ele busca os testes estatísticos corretos para eliminar variáveis de confusão, verifica seus próprios resultados por métodos independentes e permanece no caminho certo através de longas análises multi-etapas."
Dito isso, estas duas áreas — legal e saúde — são as únicas em que o Fable 5 se destaca por uma pequena margem.
O lançamento ocorre uma semana depois que a Moonshot AI, uma startup de Pequim apoiada pela Alibaba, revelou o Kimi K3 — um modelo de peso aberto de 2,8 trilhões de parâmetros (o que significa que qualquer pessoa pode baixar o código subjacente para executá-lo de forma independente) que a Moonshot descreve como o maior sistema de IA aberto do mundo. Benchmarks independentes consistentemente colocam o Kimi K3 em terceiro lugar geral, atrás do Fable 5 e do GPT-5.6 Sol, superando esses dois em áreas específicas.
O Opus 5 está disponível agora via API por US$ 5 por milhão de tokens de entrada e US$ 25 por milhão de saída. (Tokens são a unidade básica de informação que um modelo de IA pode processar tanto na entrada quanto na saída). Um modo Rápido, executando a aproximadamente 2,5 vezes a velocidade padrão, também está disponível, pelo dobro do preço base — US$ 10 por milhão de tokens de entrada e US$ 50 por milhão de saída.
Este lançamento pode acabar com a ansiedade sobre a falta de disponibilidade pública do Fable 5. O Opus também está disponível por assinatura para todos.





