
A OpenAI estabeleceu um precedente em 21 de julho. A empresa afirmou que uma combinação de seus modelos, ambos executados com recusas de segurança reduzidas, escapou de um ambiente isolado (sandbox) durante um benchmark de capacidade cibernética e alcançou a infraestrutura de produção do repositório de código aberto Hugging Face. Os modelos encadearam uma vulnerabilidade de dia zero em um proxy de registro de pacotes com credenciais roubadas para extrair as respostas do benchmark diretamente do banco de dados do Hugging Face.
Em uma atualização uma semana depois, a OpenAI disse que o Hugging Face não foi o único alvo: o mesmo incidente afetou quatro contas em outros quatro serviços, um usado como retransmissor de saída e outro para armazenamento de dados.
A Anthropic, alertada pela divulgação, revisou 141.006 de suas próprias execuções de teste e encontrou mais três violações. Em uma publicação de 30 de julho, o laboratório disse que os modelos Claude Opus 4.7, Mythos 5 e um sistema de pesquisa interno alcançaram a internet aberta a partir de ambientes executados pelo parceiro terceirizado Irregular e então comprometeram organizações reais. O Mythos 5 construiu e publicou um pacote Python armadilhado no registro PyPI público, que foi baixado e executado em 15 máquinas reais antes que os defensores o removessem.
Duas das três empresas vítimas não haviam notado.
Nenhum dos laboratórios descreve um modelo com sua própria agenda. Os agentes operaram por longos períodos sem intervenção humana, e em um caso o Opus 4.7 continuou atacando após sinais de que havia atingido a produção.
Os incidentes surgem enquanto ambas as empresas visam listagens públicas que poderiam valorizar cada uma acima de US$ 1 trilhão, aguçando uma questão importante na corrida de benchmarks cibernéticos de IA: como testar capacidades perigosas sem incidentes perigosos?
Os EUA não possuem uma lei federal que cubra a responsabilidade por danos causados pela IA. Qualquer caso se apoiaria no Computer Fraud and Abuse Act, um estatuto de 1986 que torna crime "acessar intencionalmente" um computador sem autorização — linguagem escrita para um ser humano que forma intenção.
Um agente de IA não é uma pessoa jurídica, portanto não pode ser processado. O Departamento de Justiça poderia, teoricamente, apresentar acusações contra as empresas, mas com tão pouco precedente, não está claro quem é o culpado.
O caminho mais forte é o civil. Ahmed Ghappour, um estudioso de direito de computadores na New York Law School, argumentou que os modelos "são a ferramenta da empresa", e "Quando um agente de IA age sem ser especificamente direcionado (...) as questões mais interessantes podem residir em negligência e responsabilidade por produtos (não em leis criminais de hacking)."
Para mim, a lição das histórias de hacking de IA é mais sobre governança do que sobre a capacidade do modelo.
A qualidade das salvaguardas como arquitetura de contenção, limites de autorização, monitoramento e resposta a incidentes são cada vez mais importantes.
— ahmed ghappour ⚡️🤖 (@ghappour) August 4, 2026
A alegação mais clara das vítimas é a negligência: OpenAI e Anthropic configuraram e executaram testes que escaparam. Isso também é difícil de vender: provar que os laboratórios violaram um dever de cuidado, quando os testes foram isolados por design, é exatamente o tipo de argumento inovador que um juiz teria que forjar do zero.
Alguns pensadores jurídicos desejam regras mais rígidas. Gabriel Weil, da Universidade de Houston e do Institute for Law & AI, propôs tratar laboratórios de fronteira como guardiões de animais selvagens: responsáveis independentemente do cuidado que tiveram, porque o risco é inerente à atividade.
Dito isso, um conjunto de projetos de lei estaduais já avança nessa direção. O S8833 de Nova York e o H8052 de Rhode Island tornariam o desenvolvedor de um sistema de IA de fronteira responsável por danos quando nenhum usuário ou intermediário intencionou a conduta ou foi negligente. O AB 316 da Califórnia vai além, eliminando a defesa de "IA autônoma" para que uma empresa não possa esquivar-se da responsabilidade culpando a independência do modelo.
A Lei de IA da UE (Regulamento 2024/1689) também impõe obrigações aos fornecedores de sistemas de maior risco, embora não tenha uma disposição diretamente voltada para intrusões impulsionadas por agentes. Indo um pouco além, alguns políticos dos EUA estão pressionando por um projeto de lei que daria ao governo um kill switch total para usar contra qualquer modelo que vá contra os interesses do país.
Moralmente, a responsabilidade provavelmente recai sobre os executivos que lançaram os modelos. Legalmente, esperamos. Até que uma empresa hackeada entre com uma ação judicial, a resposta para "quem é responsável?" permanece exatamente onde OpenAI e Anthropic a deixaram: admitida, divulgada e não resolvida.
Enquanto isso, o Hugging Face indicou que não apresentará queixas — o que é conveniente para a OpenAI. As outras empresas afetadas ainda não indicaram qual rumo tomarão.








