Pular para o conteúdo
Tecnologia

ChatGPT vai esconder uma marca invisível em seus textos — mas ela não funciona como muita gente imagina

A OpenAI começará a marcar textos produzidos pelo ChatGPT na União Europeia. O sinal será invisível aos leitores e poderá sobreviver a algumas alterações, mas está longe de ser infalível.
Por

Tempo de leitura: 4 minutos

Copiar um texto do ChatGPT e colá-lo em outro lugar pode deixar uma pista que os olhos humanos simplesmente não conseguem encontrar. A OpenAI anunciou uma tecnologia capaz de inserir uma espécie de assinatura estatística nas respostas de seus modelos. A novidade começará pela União Europeia e pretende atender às novas regras de transparência para inteligência artificial. Mas há um detalhe fundamental: essa “marca d’água” não prova sozinha quem escreveu um texto.

A marca está escondida nas próprias palavras

A tecnologia da OpenAI se chama textGrain e funciona de maneira diferente das marcas d’água que costumamos encontrar em fotografias.

Não haverá símbolo, mensagem oculta, caracteres invisíveis ou espaços secretos adicionados ao texto. Em vez disso, o sistema modifica sutilmente a maneira como o modelo escolhe entre diferentes palavras ou fragmentos de palavras possíveis durante a geração de uma resposta.

Ao longo de um texto suficientemente grande, essas pequenas decisões formam um padrão estatístico que pode ser identificado por um detector específico.

Segundo a explicação oficial da OpenAI sobre o textGrain, a empresa começará a incorporar a marca nas próximas semanas em conteúdos elegíveis produzidos pelo ChatGPT e pelo Codex na União Europeia. Clientes da API em outros países poderão ativá-la voluntariamente.

A decisão está relacionada às exigências de transparência do AI Act europeu, que determina que provedores de sistemas generativos tornem determinados conteúdos produzidos por máquinas identificáveis em formato legível por sistemas automatizados.

Isso significa que qualquer professor poderá detectar ChatGPT?

Não exatamente.

Inicialmente, o detector da OpenAI não será disponibilizado para qualquer pessoa. O acesso ficará restrito a pesquisadores aprovados e organizações especializadas enquanto a empresa avalia a confiabilidade da tecnologia.

E existe uma razão importante para essa cautela.

Nos testes divulgados pela OpenAI, considerando uma taxa-alvo de falsos positivos de 1%, aproximadamente 80% dos textos de 200 tokens em determinados testes de psicologia foram corretamente identificados. Quando os textos tinham 400 tokens, o índice chegou a cerca de 95%.

O desempenho, porém, varia conforme o assunto e o idioma. Conteúdos matemáticos, por exemplo, oferecem menos liberdade para escolher palavras e são mais difíceis de marcar.

Isso significa que a tecnologia não pode ser interpretada simplesmente como uma máquina capaz de responder com certeza se alguém “usou ChatGPT”.

A ausência da marca também não demonstra que um texto tenha sido escrito por uma pessoa.

Existe uma maneira relativamente simples de enfraquecer o sinal

ChatGPT vai esconder uma marca invisível em seus textos — mas ela não funciona como muita gente imagina
© Liudmyla Shalimova – Pexels

Outro problema aparece quando alguém modifica o conteúdo.

Nos experimentos da OpenAI com textos de aproximadamente 400 tokens, substituir 10% das palavras por sinônimos reduziu a taxa de detecção de cerca de 92% para 66%. Com 25% das palavras substituídas, ela despencou para apenas 17%.

Reescrever, resumir ou traduzir um conteúdo também pode prejudicar o sinal.

Isso acontece justamente porque não existe um código secreto anexado ao documento. A marca está distribuída pelas escolhas linguísticas realizadas durante a geração.

A própria OpenAI reconhece que falsos positivos e falsos negativos são possíveis. Por isso, a empresa alerta que a detecção de textGrain não determina quem utilizou o sistema, quanto uma pessoa contribuiu para aquele conteúdo, quem possui sua autoria legal ou se as informações presentes nele são verdadeiras.

A Europa está mudando a maneira como textos de IA são identificados

A OpenAI não está sozinha nesse movimento.

A Anthropic também adotou uma marca invisível para conteúdos produzidos por seus modelos Claude em resposta às exigências europeias.

A diferença em relação aos tradicionais detectores de IA é importante. Muitas ferramentas existentes tentam analisar um texto pronto e calcular a probabilidade de ele ter sido produzido por uma máquina, mesmo sem qualquer sinal inserido durante sua criação.

Uma marca d’água funciona de outra maneira: o próprio sistema gerador deixa deliberadamente uma característica estatística que poderá ser procurada posteriormente.

A OpenAI afirma que seus testes não encontraram diferenças significativas de desempenho entre modelos usando ou não a marcação. Mesmo assim, reconhece que a tecnologia ainda está em desenvolvimento.

Uma assinatura invisível que não deve ser tratada como prova

A novidade pode ser especialmente relevante para universidades, editoras, plataformas digitais e organizações que precisam identificar a procedência de conteúdos.

Mas provavelmente não será o detector definitivo que encerra a discussão sobre textos produzidos por inteligência artificial.

Um documento pode ter sido escrito por uma pessoa e posteriormente revisado pelo ChatGPT. Outro pode ter começado como uma resposta inteiramente gerada por IA e depois passado por uma profunda edição humana. E um terceiro pode ter sido produzido por outro modelo que simplesmente não utiliza a tecnologia da OpenAI.

O textGrain consegue procurar uma pista específica dentro desse cenário. Não consegue reconstruir toda a história por trás de um texto.

É justamente essa limitação que torna a nova marca tão interessante: pela primeira vez, o ChatGPT começará a deixar deliberadamente uma assinatura invisível em parte do que escreve. Detectá-la será possível. Interpretar corretamente o que ela significa continuará sendo a parte difícil.

Partilhe este artigo

Artigos relacionados