OpenAI está se preparando para adicionar marcas d’água invisíveis a textos gerados pelo ChatGPT e Codex na União Europeia.
A marca d’água não ficará visível ao ler ou copiar o texto. Em vez disso, a OpenAI afirma que sua nova tecnologia textGrain altera ligeiramente as escolhas de palavras do modelo para criar um padrão estatístico que pode ser detectado posteriormente.
“Nas próximas semanas, adicionaremos uma marca d’água invisível aos textos gerados pelo ChatGPT e pelo Codex que atendam aos requisitos de compatibilidade na União Europeia”, explicou a OpenAI .
A OpenAI ainda não tornou isso um padrão global.
A partir de hoje, desenvolvedores de API em todo o mundo podem optar por adicionar marcas d’água aos modelos compatíveis, mas essa opção permanece desativada por padrão.
A empresa também está abrindo inscrições para seu detector de marcas d’água, embora o acesso seja inicialmente limitado a pesquisadores aprovados e organizações especializadas.
A OpenAI admite que sua marca d’água de IA pode desaparecer ao editar o texto.
A marca d’água em textos está longe de ser perfeita, e os próprios testes da OpenAI mostram que edições relativamente comuns podem reduzir significativamente sua capacidade de detectar textos gerados por IA.
“Em uma avaliação de trechos de 400 tokens, substituir 10% das palavras por sinônimos reduziu a detecção de cerca de 92% para 66%. Substituir 25% das palavras reduziu para 17%”, observou a OpenAI.
Com uma taxa de falsos positivos de 1%, a OpenAI detectou a marca d’água em cerca de 80% das respostas de psicologia com 200 tokens, em comparação com aproximadamente 95% quando o texto atingiu 400 tokens.
A detecção foi ainda pior em disciplinas como matemática, onde o modelo tem menos liberdade para escolher palavras diferentes.
“A ausência de uma marca d’água detectada não comprova a autoria humana”, alertou a OpenAI. “O texto gerado com as ferramentas da OpenAI pode ser muito curto, editado ou traduzido para que a detecção funcione de forma confiável.”
A OpenAI também afirma que uma marca d’água detectada não revela quem gerou o texto, sua conta, o prompt ou a conversa, e não permite determinar quanto do trabalho final foi escrito ou editado por um humano.
Curiosamente, a OpenAI afirma que a marca d’água não afeta significativamente a qualidade do GPT-6 Astra, com os resultados dos testes de desempenho permanecendo bastante semelhantes quando o textGrain está ativado.
