Resumo:
A OpenAI está gradualmente adicionando marcas d'água invisíveis aos textos gerados pelo ChatGPT e Codex na União Europeia para atender aos requisitos da Lei de Inteligência Artificial da UE para a legibilidade do conteúdo gerado por IA. OpenAI disse que esta tecnologia de marca d'água de texto chamada textGrain não adiciona caracteres ocultos, espaços invisíveis ou pontuação especial ao artigo. Em vez disso, ajusta o método de seleção de palavras quando o modelo gera texto, formando uma característica estatística em todo o texto que não pode ser detectada diretamente pelo olho humano, mas pode ser reconhecida pela máquina.

De acordo com informações divulgadas pela OpenAI, os requisitos de transparência relevantes da Lei de Inteligência Artificial da União Europeia entrarão em vigor em 2 de agosto de 2026. Os provedores de serviços de IA generativa são obrigados a ter conteúdo gerado por IA com marcas reconhecíveis por máquina. A OpenAI, portanto, planeja lançar gradualmente marcas d'água de texto para usuários qualificados do ChatGPT e Codex na UE nas próximas semanas, e esta implantação cobrirá todos os pacotes ChatGPT, não apenas os usuários pagantes.
Esse tipo de marca d'água é diferente de "texto oculto" no sentido tradicional. Quando os usuários copiam o conteúdo gerado pelo ChatGPT, um caractere oculto não será copiado ao mesmo tempo e nenhum símbolo especial será encontrado no texto. O que textGrain realmente muda é a probabilidade de seleção aleatória do modelo quando confrontado com múltiplas palavras possíveis. As alterações numa única palavra podem ser completamente indetectáveis, mas quando um grande número de palavras é combinado, pode ser formado um padrão estatístico que o sistema de detecção pode reconhecer.
A OpenAI afirmou que a vantagem deste design é que ele não altera significativamente a saída normal do texto. Os testes da empresa descobriram que a diferença no desempenho do modelo entre adicionar marcas d'água e sem adicionar marcas d'água estava dentro da faixa normal de flutuação do teste, e o impacto na velocidade de geração de texto também foi muito pequeno. Durante os testes internos anteriores do ChatGPT da OpenAI, não foi descoberto que a função de marca d'água levasse a um aumento nas avaliações negativas dos usuários.
No entanto, a OpenAI também admitiu que a marca d’água de texto não é um método 100% confiável para identificar conteúdo de IA. Existem dois erros possíveis na detecção de marca d'água. Uma é que o texto sem marca d'água é mal interpretado como tendo marca d'água, e a outra é que o texto na verdade tem uma marca d'água, mas o sistema de detecção não a reconhece.
O comprimento do texto também é um fator importante que afeta os resultados da detecção. Textos mais curtos têm menos espaço para o modelo ajustar a seleção de palavras, tornando mais difícil formar um sinal estatístico estável. As regras publicadas pela OpenAI também mostram que, de acordo com as especificações de transparência de IA da UE, a produção de menos de 200 tokens, cerca de 150 palavras em inglês e trechos de código não é necessária para adicionar marcas d’água de texto.
Também existem diferenças nos resultados de detecção entre diferentes idiomas. A OpenAI testou todos os 24 idiomas oficiais da União Europeia. Embora mantendo uma taxa de falsos positivos de 1%, a taxa de detecção do espanhol atingiu um máximo de 69%, enquanto a taxa de detecção do romeno foi de apenas 42,2%. Para idiomas com efeitos de detecção fracos, o OpenAI pode aumentar a força da marca d’água para aprimorar os recursos de detecção.
Isso significa que textGrain não pode ser entendido como uma tecnologia que pode provar 100% que foi gerada pelo ChatGPT quando você vê a marca d’água. A OpenAI deixa claro que mesmo que o texto original não tenha sido modificado, não há garantia de que o sistema de detecção será capaz de detectar a marca d’água, principalmente quando o texto é curto ou o intervalo de palavras selecionáveis é pequeno.
Ao mesmo tempo, existem diferenças óbvias entre marcas d'água de texto e detectores de texto de IA atualmente no mercado. Ferramentas de detecção de IA de terceiros, como o Pangram, usam principalmente classificadores para determinar se um trecho de texto tem probabilidade de ser gerado pela IA, analisando a escolha de palavras, estrutura de frase e outros recursos de linguagem. Este método analisa o texto depois de gerado, enquanto textGrain deixa diretamente um sinal estatístico legível por máquina durante o processo de geração de texto.
A OpenAI acredita que esta abordagem está mais alinhada com os requisitos da Lei de IA da UE para sinais identificáveis “incorporados”.
A OpenAI não adotou diretamente o SynthID do Google DeepMind ou outras soluções existentes de marca d'água de texto, mas desenvolveu o textGrain por conta própria. A empresa disse que sua tecnologia autodesenvolvida permite ajustar com mais flexibilidade o equilíbrio entre a detectabilidade das marcas d'água e a diversidade dos resultados do modelo. Em testes internos, o textGrain reconheceu texto com marca d’água a uma taxa igual ou superior a outras soluções testadas pela empresa, incluindo SynthID para texto.
A OpenAI também planeja abrir a tecnologia textGrain de código-fonte, esperando que outras instituições de pesquisa e empresas possam usar essa tecnologia para pesquisar mais e melhorar o reconhecimento de fontes de texto por IA. No entanto, a OpenAI não abrirá imediatamente o detector de marca d'água de texto ao público, mas primeiro fornecerá canais de aplicação para pesquisadores e instituições profissionais aprovados.
Esses pesquisadores e instituições autorizados podem usar as ferramentas de detecção da OpenAI para determinar se um trecho de texto contém uma marca d’água gerada pela OpenAI, mas os resultados da detecção não revelarão a identidade do usuário, palavras de alerta ou registros de bate-papo correspondentes ao conteúdo gerado. A OpenAI acredita que, como a tecnologia atual ainda apresenta riscos de falsos positivos e falsos negativos, abrir diretamente as ferramentas de detecção para todos pode levar a uma interpretação exagerada dos resultados da detecção de marcas d’água.
É importante notar que desta vez a OpenAI não planeja habilitar marcas d'água de texto por padrão em todo o mundo. A empresa afirmou que as marcas d’água de texto ChatGPT e Codex serão gradualmente implementadas apenas para a região da UE nesta fase. Esta implantação regional permitirá que a OpenAI observe o desempenho em ambientes de uso real e ajuste a tecnologia com base no feedback real.
Para desenvolvedores de API, a situação é diferente. A OpenAI começou a permitir que clientes globais de API ativassem ativamente a função de marca d'água de texto para alguns modelos, mas ela ainda está desativada por padrão. Isso significa que as empresas podem decidir se devem colocar marca d’água no texto gerado por meio de APIs com base em seus próprios requisitos de transparência.
A OpenAI também está em coordenação com parceiros de serviços em nuvem, esperando que nas próximas semanas o conteúdo qualificado gerado pela chamada de modelos OpenAI por meio dessas plataformas em nuvem também receba sinais de origem correspondentes.
No entanto, as marcas d'água de texto não substituirão outros métodos de identificação de conteúdo de IA. A OpenAI enfatiza que as informações de origem, como marcas d'água legíveis por máquina e C2PA, não podem substituir declarações públicas, como rótulos de IA visíveis e banners imediatos exigidos por lei ou plataforma. Eles resolvem problemas de origem de conteúdo em diferentes níveis.
Para usuários comuns, o mais notável sobre essa mudança é: se você estiver na UE e usar o ChatGPT para gerar textos longos, a partir do momento em que o sistema de marca d'água cobrir oficialmente sua conta, o conteúdo gerado já poderá conter sinais de origem invisíveis a olho nu. A cópia direta do texto original geralmente não destruirá esse sinal, mas se o texto for significativamente reescrito, reformulado ou traduzido, a detectabilidade da marca d'água poderá ser significativamente reduzida.
A OpenAI também reconhece explicitamente esta limitação. O sinal do textGrain existe na seleção de palavras do modelo, e não como um caractere invisível anexado independentemente ao arquivo de texto. Portanto, uma reescrita suficiente do texto pode destruir o padrão estatístico original. É por isso que a OpenAI enfatiza que as marcas d’água de texto são atualmente mais adequadas como um sinal de julgamento da fonte e não podem ser consideradas um “certificado de identificação de IA” absolutamente confiável.
De modo geral, desta vez a OpenAI lançou o textGrain na UE, principalmente para se adaptar aos novos requisitos regulatórios trazidos pela Lei de IA. Também representa que a identificação da fonte do texto gerado por IA está evoluindo das tradicionais “etiquetas declarativas” para sinais reconhecíveis por máquina. Isso não alterará o texto que os usuários veem, nem caracteres misteriosos aparecerão ao copiar o texto, mas permitirá que sistemas com permissões de detecção tentem determinar se um conteúdo vem de um modelo OpenAI.
No entanto, como as marcas d'água de texto ainda apresentam problemas como diferenças de idioma, restrições de comprimento de texto e enfraquecimento do sinal após reescrita, atualmente são mais adequadas como evidência auxiliar no sistema de rastreabilidade de conteúdo de IA, em vez de serem usadas sozinhas para determinar se um artigo foi "escrito por IA".
Comentários