OpenAI a présenté un déploiement progressif du watermarking de texte destiné à répondre aux obligations de transparence du EU AI Act. Depuis le 5 octobre, les clients de l’API peuvent activer cette fonction dans le monde pour certains modèles. Dans les prochaines semaines, une marque invisible doit être ajoutée aux textes éligibles produits par ChatGPT et Codex dans l’Union européenne. Le dispositif ne devient pas pour autant une option activée par défaut à l’échelle mondiale.
La technologie, baptisée textGrain, modifie statistiquement les choix de mots du modèle au lieu d’insérer des caractères cachés ou un marquage visible. Un détecteur recherche ensuite ce signal. OpenAI prévoit de publier la technologie en open source, mais réserve dans un premier temps l’accès au détecteur à des chercheurs et organisations expertes approuvés.
Les évaluations publiées par OpenAI montrent les limites du procédé. La détection est meilleure sur les passages longs et se dégrade dans les domaines où le choix lexical est plus contraint. La substitution de mots par des synonymes peut également réduire fortement le taux de détection. Ces chiffres proviennent du fournisseur et ne constituent pas une validation indépendante.
OpenAI précise qu’un watermark détecté ne prouve ni la propriété du texte, ni l’identité de l’utilisateur, ni le niveau de contribution humaine, ni l’exactitude du contenu. À l’inverse, l’absence de signal détectable ne démontre pas une rédaction humaine. Le watermarking n’est donc qu’un élément d’une stratégie de provenance plus large.
The Verge a confirmé indépendamment les principaux éléments du déploiement. Pour les développeurs et organisations présents dans l’UE, la provenance des textes devient ainsi un sujet concret de conformité et d’architecture. La robustesse du signal après réécriture, traduction ou édition humaine reste cependant une question centrale.