OpenAI anunciou que iniciará a adição de marcas d'água invisíveis em textos gerados pelo ChatGPT e Codex na União Europeia para cumprir com a Lei de IA da UE. A medida entra em vigor nas próximas semanas para usuários elegíveis em todos os planos, exclusivamente no território europeu.
Conformidade regulatória
As regras de transparência da Lei de IA da UE, que entraram em vigor em 2 de agosto, exigem que empresas de IA marquem conteúdo gerado por sistemas de inteligência artificial de forma que outros sistemas possam identificar. A marca d'água de OpenAI funciona através de padrões subtis nas escolhas de palavras, criando um rastro invisível ao leitor, mas detectável por sistemas apropriados.
Funcionamento técnico
A tecnologia, denominada textGrain, foi desenvolvida em colaboração com pesquisadores das universidades de Pensilvânia e Yale. O método utiliza uma chave secreta para ordenar predições de palavras seguintes, adicionando centenas de pequenos ajustes que permitem detectar conteúdo gerado por IA usando apenas o texto e a chave. A marca d'água não identifica o usuário e não causou mudanças significativas no desempenho dos modelos.

Imagem: TechCrunch / OpenAI (opens in a new window. Image Credits:OpenAI (opens in a new window)
Limitações e vulnerabilidades
OpenAI identificou que a marca d'água pode ser removida ou enfraquecida através de edição. Em testes, substituir 10% das palavras por sinônimos reduziu a detecção de aproximadamente 92% para 66%. Passagens curtas, respostas matemáticas e texto traduzido também apresentaram maior dificuldade de detecção.
A empresa ressalvou que uma marca d'água ausente "não prova autoria humana", pois o texto pode ser muito curto, excessivamente editado ou originário de outro sistema de IA.
Disponibilidade
Desenvolvedor utilizando a API do OpenAI em qualquer parte do mundo podem ativar a marca d'água manualmente para modelos selecionados a partir de agora, com a funcionalidade desativada por padrão. OpenAI não está implementando watermarking como padrão global no lançamento inicial.
O acesso inicial ao detector foi restrito apenas a pesquisadores aprovados e organizações especializadas para avaliação de confiabilidade e usos responsáveis.
Contexto de mercado
O anúncio ocorre dois meses após Anthropic anunciar marcação de texto gerado por Claude em escala global, decisão que gerou críticas de usuários que argumentaram fornecer instruções e contexto enquanto Claude era apenas a ferramenta. OpenAI havia desenvolvido marca d'água para texto anteriormente, mas reteve seu lançamento por preocupações de migração de usuários para concorrentes sem watermarking, conforme relatado em 2024.
Anthropic, Google, Meta, Microsoft e OpenAI estão entre as empresas comprometidas com o código de práticas da UE sobre conteúdo gerado por IA.










