Pular para o conteúdo
NovidadesIA

Modelos e LLMs

OpenAI cria marca invisível no ChatGPT, mas detector falha com pouca edição

Sistema textGrain marca textos para cumprir regras da União Europeia, permite desligar rastreio na API e perde eficácia se o usuário trocar 25% das palavras.

Edição: Anderson Gomes · texto gerado por IA
· 3 min de leitura

Imagem: Reprodução · The Decoder · licença livre · licença mit

Texto gerado por IA, com revisão automática. Esta matéria foi escrita por um modelo de linguagem a partir da fonte indicada e passou por verificações automáticas de formato, de voz e de título; não houve leitura humana antes da publicação. Como funciona o método · Fonte original: Comunicado oficial

A OpenAI anunciou em 5 de outubro de 2026 a inclusão do textGrain, uma tecnologia de marca d'água invisível que insere sinais estatísticos nas palavras geradas pelo ChatGPT e pelo Codex na União Europeia. O sistema atende às exigências do AI Act do bloco europeu, mas deixa a identificação opcional para clientes de API no mundo inteiro. Em testes internos com passagens de 400 tokens, o detector acerta até 95% dos casos, mas essa taxa despenca para 17% quando o usuário troca um quarto dos termos por sinônimos. A mudança atinge quem consome IA na Europa e desenvolvedores integrados via nuvem.

A tecnologia funciona de maneira parecida com a marca d'água do Claude, da Anthropic, que adota o SynthID de código aberto do Google. A OpenAI afirma que o textGrain empatou ou superou abordagens rivais em avaliações internas, incluindo o próprio SynthID para texto. Enquanto a Anthropic impõe a marcação globalmente a todos os usuários do Claude, a OpenAI escolheu o modelo opt-in para sua API em escala mundial. Clientes corporativos também vão acessar o recurso por meio de parceiros de nuvem como a Microsoft Azure nas próximas semanas. A empresa promete liberar o código do textGrain no futuro.

Troca de sinônimos derruba identificação do texto

A eficácia do rastreio varia conforme a extensão do texto e o assunto abordado. Em passagens de 400 tokens sobre psicologia, com a taxa de falsos positivos calibrada em 1%, o detector encontrou a marca d'água em cerca de 95% das amostras. Quando o tamanho cai para 200 tokens, o índice recua para cerca de 80%. Em temas exatos, o desempenho piora bastante. Em textos de matemática com 400 tokens, o índice de acerto fica em torno de 60%, contra 94% em psicologia. A OpenAI explica que o modelo tem menos liberdade para variar vocabulário em equações e raciocínios formais.

Qualquer edição manual enfraquece o sinal estatístico de forma drástica. A substituição de apenas 10% das palavras por sinônimos derruba a taxa de detecção de 92% para 66% em trechos de 400 tokens. Se o leitor trocar 25% dos termos, a taxa cai para 17%. O texto fica praticamente indetectável. Essa fragilidade técnica joga contra a confiabilidade do sistema, mas pode frear a fuga de usuários para modelos de pesos abertos. A Anthropic ainda não divulgou taxas de detecção do Claude, embora afirme que sua ferramenta resiste bem a edições.

Empresa restringe acesso ao detector e avalia modelo Astra

A OpenAI afirma que a marca d'água não degrada o desempenho dos modelos e cita testes com o Astra. Em oito benchmarks técnicos, incluindo GPQA Diamond, BrowseComp e DeepSWE, a companhia não registrou diferenças relevantes com o recurso ligado ou desligado. Esses testes medem capacidade de resolução de problemas, mas não comprovam se o estilo da escrita sofre alterações. A empresa admite ainda que encontrar a marca d'água não prova autoria humana nem revela responsabilidade sobre o conteúdo. Da mesma forma, a ausência do sinal não garante que uma pessoa escreveu o texto, já que traduções ou cortes apagam o rastro.

O acesso à ferramenta de detecção segue fechado para o público geral. Apenas pesquisadores selecionados e organizações especializadas recebem permissão após preencherem um formulário de inscrição. A OpenAI faz essa liberação caso a caso, com base no Código de Prática da União Europeia. A empresa barra o público porque o detector ainda gera falsos positivos e ignora marcas reais. A ferramenta informa apenas se detectou a marca da OpenAI, sem expor identidade de usuário, conversas ou comandos. Outros verificadores para imagem e áudio continuam abertos no endereço openai.com/verify e pela Content Provenance API.

  • The Decoder
  • Modelos e LLMs