
A Anthropic alocou cerca de seis engenheiros dentro da Agência de Segurança Nacional (NSA) para ajudar a implementar o Mythos — seu modelo de IA mais capaz — para operações cibernéticas ofensivas, relatou o Financial Times na quinta-feira.
Os engenheiros são funcionários destacados, personalizando o modelo para aplicações específicas. Uma fonte disse ao FT que ele poderia ser útil para infiltrar redes em países como China e Irã.
Não está confirmado se esses engenheiros estão envolvidos em operações ativas. O que está confirmado: Mythos é o mesmo modelo que a Anthropic se recusou a lançar publicamente, citando risco de uso indevido. A empresa o limitou a parceiros verificados através do Projeto Glasswing — uma coalizão restrita que inclui Microsoft, Apple e Amazon.
A Anthropic também está processando o Pentágono. No final de fevereiro, o Secretário de Defesa Pete Hegseth designou a empresa como um risco de cadeia de suprimentos — um rótulo historicamente reservado para adversários estrangeiros como a Huawei — depois que um contrato de US$ 200 milhões foi desfeito. O ponto de discórdia: a Anthropic se recusou a permitir que o Departamento de Defesa (DoD) usasse Claude para armas totalmente autônomas ou vigilância em massa doméstica. O contrato da NSA foi isento dessa proibição.
Um juiz da Califórnia bloqueou a inclusão na lista negra como uma aparente retaliação da Primeira Emenda. Um tribunal de apelações de D.C. negou o pedido da Anthropic para suspender o processo enquanto a litigação se desenrola. A NSA continuou usando o Mythos o tempo todo, de acordo com a reportagem do FT.
Como parar a IA que constrói IA
No mesmo dia em que a história da NSA foi divulgada, o instituto de pesquisa interno da Anthropic publicou "Quando a IA se constrói", uma análise de quão longe Claude chegou na automação de seu próprio desenvolvimento. Nele, a empresa defende essencialmente uma moratória global na corrida armamentista da IA — e até a comparou aos tratados nucleares da era da Guerra Fria firmados entre os Estados Unidos e a Rússia.
Para entender o porquê, a empresa forneceu este pedaço de contexto:
Claude agora escreve mais de 80% do código incorporado na base de código de produção da Anthropic — um aumento em relação aos baixos percentuais antes do lançamento do Claude Code no início de 2025. Os engenheiros entregam aproximadamente oito vezes mais código por dia do que em 2024.
Os autores do relatório — a líder do Anthropic Institute, Marina Favaro, e o cofundador Jack Clark — argumentam que essa trajetória está caminhando para o que eles chamam de autoaperfeiçoamento recursivo: sistemas de IA que autonomamente projetam, constroem e treinam seus próprios sucessores, com os humanos desempenhando um papel cada vez menor em cada etapa.
Em uma representação visual, os pesquisadores mostram uma linha do tempo na qual a primeira forma de usar a IA no trabalho é os humanos solicitando ao computador um resultado, com automações crescentes terminando com Agentes de IA solicitando subagentes até que o resultado seja alcançado, sem envolvimento humano.
O dado mais marcante que eles citam: Em abril, agentes Claude foram encarregados de um problema aberto de segurança da IA — se um modelo mais fraco pode supervisionar confiavelmente um mais forte — e deixados para executá-lo. Dois pesquisadores humanos, ao longo de cerca de uma semana, recuperaram 23% da diferença de desempenho entre os modelos. Os agentes recuperaram 97%, ao longo de 800 horas cumulativas de computação. Humanos definiram a pergunta. Os agentes projetaram cada experimento. É o primeiro caso publicado de Claude exercendo julgamento de pesquisa, não apenas executando tarefas especificadas por outra pessoa.
Essa é a linha que a Anthropic está preocupada em cruzar. Uma vez que a IA escolhe quais experimentos valem a pena ser executados — e não apenas os executa — os humanos perdem o último papel significativo no ciclo de desenvolvimento. Pequenos desalinhamentos visíveis nos modelos atuais podem se acumular ao longo de gerações autoaperfeiçoadoras até que ninguém possa corrigi-los.
Sua solução proposta é uma pausa global verificável — múltiplos laboratórios de fronteira parando simultaneamente, com verificação independente de que todos realmente pararam. A Anthropic disse que se juntaria a uma. Uma desaceleração unilateral, eles reconhecem, apenas entrega a liderança a quem continuar.
Já vimos esse filme antes. Os laboratórios que constroem a IA são os mesmos que alertam sobre o quão perigosa a IA é. No entanto, a IA é o negócio mais lucrativo da década, então ninguém quer parar — nem mesmo aqueles que alertam sobre a IA.
Em 2023, mais de uma centena de grandes nomes da comunidade de pesquisa em IA assinaram uma carta aberta pedindo um esforço global para mitigar o risco de extinção que o desenvolvimento da IA intrinsecamente possui. Alguns meses antes, outra carta aberta exigia que a OpenAI pausasse os avanços no ChatGPT devido à sua natureza perigosa.
Ninguém parou após a carta aberta de 2023. A OpenAI não parou. A Anthropic não parou. O prazo do Pentágono para remover Claude de seus sistemas cai em agosto, aproximadamente na mesma época em que o IPO da Anthropic deve tornar suas finanças públicas.





