InícioCentro de Notícias da LBank
Anthropic está marcando discretamente com marca d'água todas as respostas do Claude AI. Os desenvolvedores já estão tentando quebrá-la
anthropic-quietly-watermarking-ai-claude-output-builders-break
Anthropic está marcando discretamente com marca d'água todas as respostas do Claude AI. Os desenvolvedores já estão tentando quebrá-la
A Anthropic está inserindo uma marca d’água invisível e legível por máquinas em cada palavra que seus modelos Claude mais recentes escrevem — e não disse como.
2026-08-13 Fonte:decrypt.co

Em resumo

  • Novos modelos Claude lançados na UE a partir de 2 de agosto de 2026 incorporam uma marca d'água legível por máquina em cada pedaço de texto gerado, aplicada no nível do modelo.
  • As marcações são aplicadas globalmente em Claude, na API, no Claude Code e em parceiros de nuvem.
  • Projetos de código aberto para removê-las surgiram em poucos dias.

A Anthropic começou a incorporar uma marca d'água imperceptível em todo o texto que seus modelos Claude mais recentes geram. A mudança entrou em vigor para modelos lançados na UE em 2 de agosto de 2026, e a Anthropic afirma que ela será aplicada em todo o mundo.

A Anthropic apresentou o plano em um artigo de suporte após assinar o Código de Conduta do Ato de IA da UE sobre transparência. Em outras palavras, não está exatamente se voluntariando para fazer isso. A marca alcança todas as superfícies do Claude, desde o chatbot e API até o Claude Code e parceiros de nuvem como AWS, Google Cloud e Microsoft Foundry.

Myriad: Quando a OpenAI lançará o GPT-6? Clique para fazer sua previsão.

“Quando um modelo Claude suportado gera texto, ele tece uma marca d'água imperceptível diretamente no próprio texto. Você não a verá, e ela não altera o significado, a qualidade ou a legibilidade da resposta do Claude,” disse a Anthropic. “Como a marca d'água faz parte do texto, ela viajará com o texto quando for copiada e colada em outro lugar, e pode persistir através de alguma edição.”

Portanto, é um pouco mais complexo do que os métodos usuais que os usuários tendem a pensar. Quando um modelo Claude suportado escreve texto, ele tece uma marca d'água imperceptível diretamente nas palavras, sem uma tag visível. Como a marca faz parte do texto, ela sobrevive ao copiar e colar e, a Anthropic admite, "pode persistir através de alguma edição." Os arquivos recebem uma segunda camada: metadados assinados sob o padrão aberto C2PA (pense em um manifesto de envio digital que registra quem produziu um arquivo e se alguém o alterou depois).

O método permanece secreto

A Anthropic não revelou como a marca d'água é feita. O artigo de suporte a descreve como sendo de nível de modelo (o modelo é treinado com ela) e nativa do texto (não é uma ferramenta externa como um gerador de metadados, por exemplo), mas a documentação de detecção e a técnica exata ainda não foram divulgadas.

Pesquisadores inferem que é uma assinatura estatística: o modelo orienta suas escolhas de palavras para um viés sutil e detectável, a mesma família de abordagem que o Google usa no SynthID Text. Isso permanece uma suposição até que a Anthropic publique o detector.

Mas isso não está afastando os entusiastas da privacidade, e alguns especialistas já estão trabalhando em métodos para quebrar a marca d'água secreta da Anthropic. mikiane/claude-watermark-cleaner (106 estrelas no Github) remove Unicode invisível e, em seguida, reescreve o texto com um modelo não-Claude para perturbar o padrão de tokens.

Um projeto maior, guillaumemeyer/watermarks-remover (4,6k estrelas no Github), remove marcas de texto do Claude, além de sinais C2PA e de classe SynthID em PNG, JPEG, SVG, PDF e DOCX. Os autores argumentam que uma marca de texto estatística "não é uma maneira confiável de provar a origem" e principalmente leva os usuários a gastar uma segunda passagem do modelo para limpar sua própria escrita. Nenhuma remoção pode ser garantida até que a Anthropic envie seu detector e limiares.

A própria história da Anthropic torna a reação de privacidade mais acentuada. A empresa removeu um rastreador oculto do Claude Code em março depois que pesquisadores descobriram que ele estava marcando a localização e o uso de proxy de alguns usuários por meio de marcadores Unicode não divulgados – a mesma técnica de marcação silenciosa que agora está no centro do plano de marca d'água.

A marca prova que o Claude teve participação no texto, não que ele o escreveu por completo, então ele tratará uma escrita original com uma pequena edição da mesma forma que um texto totalmente gerado por IA. Peça ao Claude para revisar ou traduzir seu parágrafo e a saída ainda poderá conter o sinal. A Anthropic é franca ao dizer que uma edição pesada pode removê-la, e que uma marca ausente não prova que um humano escreveu algo.

Um projeto de lei dos EUA, o COPIED Act, impulsiona a mesma ideia: uma forma padronizada de marcar conteúdo de IA com marca d'água para que as plataformas possam rastrear sua origem. Como o problema de chantagem do Claude mostrou, os modelos da empresa já atraem intenso escrutínio sobre o que fazem com o texto que tocam.

A Anthropic não informou quando publicará as ferramentas de detecção que permitiriam a qualquer pessoa verificar a marca.