Em 5 de outubro de 2026, a OpenAI (abre em nova aba) anunciou a introdução do textGrain, uma tecnologia projetada para inserir uma marca d'água imperceptível aos olhos humanos em textos gerados por inteligência artificial. O objetivo central dessa novidade é atender às exigências de procedência estabelecidas pelo EU AI Act, o regulamento de inteligência artificial da União Europeia, que determina maior clareza sobre quando um conteúdo foi criado ou modificado por máquinas.
O que é a tecnologia e por que ela importa
Muitas pessoas conhecem as marcas d'água tradicionais em cédulas de dinheiro ou fotos, que são figuras ou selos visíveis quando colocados contra a luz. Em textos digitais, no entanto, adicionar um logotipo visível não faz sentido, pois qualquer pessoa poderia simplesmente apagá-lo.
A proposta do textGrain é criar uma marca d'água digital e invisível. Ela não altera as letras para símbolos estranhos nem insere caracteres ocultos. Em vez disso, a tecnologia organiza as escolhas de palavras de forma estatisticamente planejada. A iniciativa importa porque governos e a sociedade buscam maneiras confiáveis de identificar a procedência de materiais digitais, combatendo enganos e garantindo transparência, tudo sem prejudicar a clareza da leitura diária.
Ao comunicar publicamente a iniciativa em seus canais oficiais na mesma data do lançamento, a empresa contextualizou a novidade como parte de um esforço mais amplo de rastreabilidade:
Estamos expandindo nossa abordagem de procedência de conteúdo para incluir texto em resposta aos requisitos regulatórios da UE, ao mesmo tempo em que reconhecemos as limitações significativas da tecnologia atual de marca d'água em texto. Nossas ferramentas já ajudam a verificar se um arquivo de imagem ou áudio foi criado com nossos modelos. Este trabalho se baseia nesses esforços para ajudar as pessoas a entender melhor quando um conteúdo pode ter sido gerado ou editado com um modelo da OpenAI. Na UE, começaremos a aplicar marcas d'água em textos elegíveis do ChatGPT e Codex ao longo das próximas semanas para cumprir o EU AI Act. Clientes que utilizam nossa API podem ativar a marca d'água em texto para modelos selecionados em todo o mundo a partir de hoje.

Como o textGrain funciona na prática
Para entender o funcionamento, imagine um professor de redação que possui uma lista de vários sinônimos possíveis para expressar a mesma ideia. Ao escrever uma frase, em vez de escolher palavras de maneira puramente aleatória, esse professor segue uma cadência matemática predeterminada, guiada por uma chave secreta.
De acordo com o relatório técnico da OpenAI (abre em nova aba), o método conecta a geração de tokens (que são pedaços de palavras processados pelo modelo) a uma aleatoriedade controlada por chave. Isso é feito por meio de um cálculo chamado transporte ótimo com regularização matemática, agrupando blocos de vocabulário para manter o sistema rápido.
Para o leitor, a frase soa totalmente natural e mantém o mesmo sentido. No entanto, quando um detector especializado analisa o texto com a chave secreta em mãos, ele procura esse sinal estatístico específico para confirmar se aquele padrão veio de um modelo da OpenAI. O sistema foi projetado para equilibrar a força desse sinal sem degradar a qualidade da escrita: nos testes realizados com o Astra, o modelo de fronteira mais recente da organização, não foram observadas diferenças significativas de desempenho com ou sem a marca.
| Extensão do texto | Tipo de conteúdo avaliado | Taxa de identificação da marca d'água |
|---|---|---|
| 200 tokens (curto) | Psicologia | Cerca de 80% |
| 400 tokens (médio) | Psicologia | Cerca de 95% |
| Qualquer extensão | Matemática | Substancialmente menor |
Limitações e desafios cotidianos
Apesar da alta taxa de acerto em textos comuns, a tecnologia apresenta limites importantes. Em conteúdos que exigem respostas exatas, como problemas de matemática, o modelo quase não tem liberdade para variar as palavras, o que torna as taxas de detecção consideravelmente menores.
Outro ponto reside nas edições posteriores feitas por humanos:
- Trocar 10% das palavras por sinônimos em um trecho de 400 tokens reduziu a capacidade de detecção de 92% para 66%.
- Trocar 25% das palavras derrubou a identificação para apenas 17%.
Disponibilidade e passos para verificação
O cronograma de liberação foi organizado em etapas diferentes para cada serviço:
- Interface de Programação de Aplicativos (API global): clientes do mundo todo podem ativar voluntariamente o recurso para modelos selecionados. A função permanece desativada por padrão.
- ChatGPT e Codex: nas semanas seguintes ao anúncio, a marca d'água invisível passa a cobrir textos elegíveis de usuários em todos os planos, mas exclusivamente dentro da União Europeia.
Para checagem e auditoria, a empresa abriu inscrições para pesquisadores aprovados e organizações especializadas. A ferramenta de verificação indica unicamente se encontrou a marca da OpenAI, preservando a privacidade das pessoas: ela não identifica qual usuário gerou a resposta nem revela os comandos originais ou o conteúdo completo das conversas.

