stamatios
← Voltar ao feed
Borracha apaga uma marca d'água fresca de um documento, fragilidade dos selos de texto gerado por IA.
IA & Modelos · Trabalho & Gestão

Watermarks de texto por IA serão triviais de remover

resumo de ~3 min

Contexto: AI Act e a exigência de marca d’água

Com a entrada em vigor do AI Act da União Europeia em agosto de 2026, provedores de IA precisarão garantir que suas saídas sejam detectáveis como geradas artificialmente. O autor, Sean Goedecke, argumenta que marcas d’água em texto serão sempre triviais de remover, ao contrário do que ocorre com imagens.

Por que texto é difícil de marcar

Textos são um meio comprimido: qualquer alteração perceptível compromete a qualidade. A solução envolve esteganografia sutil, como ajustar a amostragem de tokens ou usar caracteres Unicode invisíveis. O Google adota o SynthID, que atribui pontuações matemáticas a tokens para influenciar a escolha durante a geração. Já OpenAI e Anthropic, segundo o autor, parecem usar “homoglifos” - caracteres Unicode quase idênticos a espaços comuns - para criar padrões detectáveis.

Fragilidade das marcas

Todas essas técnicas podem ser facilmente anuladas: homoglifos podem ser substituídos por caracteres normais, e o SynthID pode ser removido pedindo a outro modelo para parafrasear o texto. Além disso, o AI Act exige interoperabilidade, o que forçaria os provedores a revelar seus métodos - minando a segurança por obscuridade em que essas marcas dependem.

C2PA não resolve

Metadados assinados digitalmente, como o padrão C2PA, funcionam para arquivos, mas não para texto simples de chat ou respostas de agentes. Para Goedecke, a tendência é que provedores adotem algum sampler baseado em SynthID, ofereçam ferramentas de verificação e, mesmo assim, usuários técnicos consigam remover as marcas facilmente.