OpenAI cria marca-d’água para texto na Europa e deixa API opcional no mundo
Para atender ao EU AI Act, empresa adota o sistema textGrain no ChatGPT e no Codex na União Europeia, mas mantém a ferramenta desativada por padrão para desenvolvedores globais.
Por que importa. A decisão evita fricção técnica na API consumida por produtos no Brasil e no mundo, mas antecipa a engenharia de conformidade necessária para sistemas que operam no mercado europeu.
A OpenAI começou a implementar uma marca-d’água invisível nas saídas de texto geradas pelo ChatGPT e pelo Codex na União Europeia. A medida responde às exigências de transparência do EU AI Act, que entraram em vigor em 2 de agosto e determinam a identificação legível por máquina de conteúdo sintético. Para clientes de API fora da Europa, contudo, o mecanismo não será imposto: o recurso funcionará como opcional e continuará desligado por padrão.
O sistema recebeu o nome de textGrain e foi detalhado em um relatório técnico assinado em conjunto com pesquisadores da Universidade da Pensilvânia e da Universidade Yale. Em vez de adicionar símbolos visíveis ou metadados de arquivo, a técnica introduz um sinal estatístico sutil na escolha das palavras sucessivas calculadas pelo modelo, guiado por uma chave secreta. Como a marcação é incorporada ao próprio vocabulário da resposta, ela acompanha o texto mesmo em operações de copiar e colar.
Divergência de estratégia com a Anthropic
A postura da OpenAI em relação aos desenvolvedores contrasta com o caminho escolhido pela Anthropic. Em agosto, a concorrente anunciou a introdução do SynthID, tecnologia desenvolvida pelo Google DeepMind, de forma obrigatória e com abrangência global para o Claude, incluindo todas as chamadas de API. A medida da Anthropic gerou protestos de usuários e construtores de produtos, que argumentavam que a ferramenta fornecia apenas contexto operacional para criações essencialmente humanas.
Ao adotar a abordagem regional e tornar o textGrain opt-in na API global, a OpenAI busca mitigar o receio de perda de clientes para modelos de pesos abertos ou rivais que não aplicam rastreamento textual. Segundo o The Wall Street Journal, a companhia já havia desenvolvido protótipos de marcação textual em 2024, mas hesitou em colocá-los em produção por preocupações competitivas. A empresa também informou que trabalha com provedores de nuvem parceiros, como a Microsoft Azure, para oferecer a opção nas próximas semanas.
Limitações de detecção e evasão por edição
Os testes publicados pela OpenAI mostram que a eficácia da detecção varia de acordo com o tamanho do texto e a natureza do conteúdo. Em trechos de 400 tokens sobre psicologia, o detector alcançou cerca de 95% de precisão sob taxa de 1% de falsos positivos. Em passagens de 200 tokens, o índice recuou para 80%. Em matérias exatas como matemática, onde a margem para variação de vocabulário é restrita, as taxas foram substancialmente menores.
A marca-d’água também se mostrou vulnerável a pequenas edições manuais. No relatório técnico, a substituição de apenas 10% dos termos por sinônimos derrubou o índice de detecção de 92% para 66% em blocos de 400 tokens. Quando 25% do texto foi modificado, a capacidade de identificação caiu para 17%. Textos curtos ou traduzidos também oferecem barreiras significativas para a identificação confiável.
Acesso restrito e impacto em produtos
Por causa do risco de falsos positivos e de leituras incompletas, a OpenAI não liberou a ferramenta de detecção para o público geral. Inicialmente, o acesso será concedido caso a caso para pesquisadores e organizações especializadas credenciadas sob o código de prática da União Europeia. O validador apenas informa se encontrou a assinatura da OpenAI, sem identificar o usuário original ou expor os prompts da sessão.
A OpenAI ressaltou ainda que a presença da marca não define propriedade intelectual, veracidade da informação ou o grau de intervenção criativa humana em um material. Da mesma forma, a ausência de registro estatístico não comprova autoria humana. Em benchmarks técnicos como GPQA Diamond e DeepSWE, a empresa afirma que o modelo frontier Astra não apresentou degradação de desempenho cognitivo com a marca ativada, mas a precisão prática do rastreamento permanece dependente da preservação integral do texto gerado.
Fontes
- TechCrunch: OpenAI will start watermarking ChatGPT’s text in the EU
- The Verge: OpenAI is adding text watermarking in ChatGPT and Codex
- Tecnoblog: OpenAI anuncia marca-d’água invisível para textos do ChatGPT
- The Decoder: OpenAI will watermark ChatGPT text in the EU but makes it optional for API users worldwide
- Mobile Time: OpenAI aplica mais marca d’água para se adaptar às regras da UE
Reportagem produzida pela redação do Flipters com apoio de inteligência artificial, a partir das fontes acima. Como trabalhamos.

