Anthropic introduz marcas d'água invisíveis no Claude: da detecção passiva à rastreabilidade ativa de conteúdo

Editado por: Svitlana Velhush

Every Claude text now has a watermark. It survives copy-paste. Anthropic rolled out invisible marks for the EU AI Act: - Statistical signal baked into the text - Holds up through light editing - Applied worldwide, not just EU users Your AI-written docs just got traceable.

Reply

Em 2 de agosto de 2026, a Anthropic começou a incorporar marcas d'água invisíveis nas novas versões do Claude — etiquetas legíveis por máquina que permanecem na distribuição estatística do texto e persistem após a cópia e a edição parcial. Esta não é apenas uma atualização técnica, mas uma mudança estratégica de tentativas de detectar conteúdo de IA post-factum para a incorporação proativa de provas de origem já na fase de geração.

O mecanismo funciona ao nível dos tokens: o modelo altera as probabilidades de escolha das palavras de modo a que surja um padrão estatisticamente detetável na sequência, sem afetar o significado, a qualidade e a legibilidade. A empresa promete ferramentas de verificação, mas os detalhes do algoritmo e a resistência a ataques (tradução, paráfrase, mistura com texto humano) ainda não foram totalmente revelados. Ao contrário das abordagens anteriores, baseadas na análise de estilo e frequência, a marca d'água da Anthropic é um sinal ativo, incorporado pelo fabricante.

A metodologia da Anthropic baseia-se nos requisitos do artigo 50 do EU AI Act, que entraram em vigor precisamente a 2 de agosto. O regulador exige que os sistemas de IA generativa adicionem etiquetas legíveis por máquina para identificar conteúdo de IA. Isto explica a sincronia com outros intervenientes: a Google está a expandir o SynthID para texto, a OpenAI está a promover o C2PA e marcas d'água digitais, e a Meta está a testar soluções semelhantes. No entanto, a Anthropic destaca-se por ligar a marca d'água diretamente ao compliance, e não apenas a iniciativas internas de segurança.

Em comparação com os detetores de IA tradicionais (que analisam a perplexidade e a burstiness), a marca d'água fornece um sinal mais fiável sobre um modelo específico, mas não resolve o problema da autoria mista. Um estudo publicado a 8 de agosto no arXiv sublinha: na era da colaboração humano-IA, a divisão binária "humano ou IA" está obsoleta. A marca d'água regista o facto de o Claude ter sido utilizado, mas não mostra que proporção do texto pertence ao humano, que edições foram feitas e quem assume a responsabilidade final.

As limitações são evidentes. A edição em larga escala, a tradução ou a mistura com outro conteúdo podem destruir o sinal. A ausência de uma marca d'água não prova a autoria humana — significa apenas que a etiqueta não foi incorporada ou foi removida. Assim, a ferramenta é útil para plataformas e editores como um sinal adicional, mas não como uma "prova irrefutável".

Para a indústria, isto significa uma transição para um ecossistema de proveniência: no futuro, os modelos não só gerarão texto, como também deixarão vestígios verificáveis criptograficamente. Isto simplificará a moderação, mas complicará as questões de autoria, citação e responsabilidade jurídica. Os investigadores terão de responder à forma como as marcas d'água de diferentes fornecedores irão interagir e se é possível criar um padrão universal de deteção.

Em última análise, as marcas d'água da Anthropic mostram que a regulamentação já está a definir a agenda técnica: a rastreabilidade do conteúdo está a tornar-se uma propriedade obrigatória dos modelos, e não uma funcionalidade opcional.

26 Visualizações

Fontes

  • 隐形水印上线,AI写作开始留痕

Leia mais artigos sobre este tema:

This feels like another “DeepSeek” moment coming out of China. ByteDance just released Seed 2.0, also called Doubao 2.0, and it’s apparently outperforming top tier models across multimodal tasks, advanced math, STEM benchmarks, and even agent style reasoning. On top of that,

Image
Reply
Encontrou um erro ou imprecisão?Vamos considerar seus comentários assim que possível.