A OpenAI apresentou um lançamento faseado de watermarking de texto destinado a responder às exigências de transparência do EU AI Act. Desde 5 de outubro, clientes da API em todo o mundo podem ativar a funcionalidade em modelos selecionados. Nas próximas semanas, a empresa prevê adicionar uma marca de água invisível a conteúdos de texto elegíveis do ChatGPT e Codex na União Europeia. O mecanismo não será ativado globalmente por defeito nesta fase.
A tecnologia chama-se textGrain e altera padrões estatísticos na escolha de palavras do modelo, em vez de inserir etiquetas visíveis ou caracteres ocultos. Um detetor procura depois esse sinal no texto. A OpenAI pretende disponibilizar a tecnologia em código aberto, mas o acesso inicial ao detetor ficará limitado a investigadores e organizações especializadas aprovadas.
As próprias avaliações da empresa mostram limitações importantes. A deteção melhora com textos mais longos e pode ser significativamente pior em conteúdos com menor liberdade de escolha lexical. A substituição de palavras por sinónimos também enfraquece rapidamente o sinal. Estes resultados são testes do fornecedor e não equivalem a validação independente.
A OpenAI sublinha ainda que uma marca detetada não prova autoria, propriedade, identidade do utilizador ou veracidade do conteúdo. Da mesma forma, a ausência de deteção não demonstra que o texto foi escrito por uma pessoa. O watermarking é apresentado como apenas uma camada de uma estratégia mais ampla de proveniência.
O The Verge confirmou de forma independente os elementos principais do lançamento. Para empresas e programadores que operam na UE, a proveniência passa assim de tema experimental para requisito operacional e de conformidade. Continua por esclarecer até que ponto o sinal será fiável depois de edição normal, tradução ou colaboração entre humanos e sistemas de IA.