A OpenAI iniciará a adição de uma marca d'água imperceptível aos textos criados pelo ChatGPT e pelo Codex dentro da União Europeia. Este anúncio, feito na segunda-feira (5), prevê implementação nas próximas semanas para usuários elegíveis, como parte do cumprimento das diretrizes de transparência estabelecidas pelo EU AI Act, que exige que conteúdos gerados por inteligência artificial possam ser identificados por outros sistemas.
Esta tecnologia será aplicada a todos os planos de usuários do ChatGPT e do Codex na União Europeia. Para desenvolvedores que utilizam a API da OpenAI, a marca d'água estará acessível globalmente para certos modelos a partir desta segunda-feira, embora permaneça desativada por padrão. A companhia declarou que, por enquanto, não tem intenção de tornar este recurso um padrão mundial.
A marca d'água não se manifesta como um símbolo ou elemento visual no material. De acordo com a OpenAI, o sistema realiza modificações sutis nas seleções de palavras feitas pelo modelo, gerando um padrão estatístico que pode ser detectado por uma ferramenta específica. Essa tecnologia, denominada textGrain, integra-se ao próprio texto, acompanhando-o mesmo quando copiado e colado.
A OpenAI assegura que a marca d'água não identifica o usuário e que seus testes não indicaram alterações significativas no desempenho dos modelos com o recurso ativo. O método técnico utiliza uma chave secreta para estruturar as previsões de palavras subsequentes do modelo. A repetição dessas alterações possibilita que um detector busque o padrão no texto e verifique a presença da marca d'água da OpenAI.
Apesar do funcionamento do sistema, a própria OpenAI reconhece suas restrições. Em um teste realizado, a substituição de dez por cento das palavras por sinônimos reduziu a taxa de detecção de cerca de noventa e dois por cento para sessenta e seis por cento. Os testes também demonstraram que a detecção melhora à medida que aumenta a quantidade de texto analisado, sendo mais difícil identificar textos curtos, respostas matemáticas e conteúdos traduzidos.
Outro aspecto enfatizado pela OpenAI é que a ausência da marca d'água não prova que um texto foi escrito por um ser humano. Isso ocorre porque o conteúdo pode ser muito breve, ter sofrido diversas edições ou ter sido produzido por uma IA de outra empresa. Além disso, o sinal não permite determinar qual foi a contribuição humana na criação do texto; ele apenas indica se um sistema da OpenAI gerou ou processou parte do conteúdo, sem revelar o grau de julgamento, edição ou criatividade humana envolvida.
Inicialmente, a OpenAI optou por restringir o acesso ao detector de marcas d'água a pesquisadores credenciados e organizações especializadas. O propósito dessa limitação é avaliar a confiabilidade da tecnologia e seus usos responsáveis. A ferramenta apenas notificará se encontrou uma marca d'água da OpenAI, sem expor o usuário, os comandos utilizados ou as conversas associadas ao conteúdo, devido à consideração de possíveis falsos positivos e falsos negativos.
A empresa planeja revisar sua estratégia conforme a evolução da tecnologia, dos padrões e das evidências sobre o funcionamento das marcas d'água. Há também planos para disponibilizar a tecnologia em código aberto, permitindo que outras entidades desenvolvam soluções baseadas nela. A OpenAI reitera que a função da marca d'água é limitada: ela não define a propriedade do texto, a legalidade do uso do conteúdo ou quem deve ser responsabilizado por ele, nem verifica se a informação é verdadeira, enganosa, prejudicial ou contextualizada corretamente.
