OpenAI affichera un filigrane invisible, détectable par machine, sur les textes générés par ChatGPT et Codex au sein de l’Union Européenne. Ce système, baptisé textGrain, permettra d’identifier l’origine des contenus créés par l’IA afin de se conformer aux nouvelles obligations de transparence imposées par la loi sur l’IA. Anthropic a déjà mis en place un procédé similaire avec Claude.

textGrain, le filigrane d’OpenAI dans ChatGPT et Codex
OpenAI prévoit d’activer textGrain dans les semaines à venir pour les utilisateurs éligibles de ChatGPT et Codex au sein de l’Union Européenne, indépendamment de leur abonnement. La société n’a pas l’intention de rendre cette fonctionnalité activée par défaut dans le reste du monde lors de son lancement, préférant d’abord évaluer son fonctionnement dans des conditions réelles et recueillir les retours des utilisateurs européens.
Contrairement aux marques visibles, textGrain ne génère pas de caractères cachés, d’espaces invisibles ou de signes de ponctuation spéciaux. Ce système modifie subtilement les probabilités utilisées par le modèle d’IA pour choisir des mots et des fragments de mots, créant ainsi un motif statistique qui peut ensuite être recherché par un outil de détection dans le texte.
Cependant, cette méthode n’est pas infaillible. OpenAI indique que la détection varie selon les langues et que des taux différents sont observés parmi les 24 langues officielles de l’Union Européenne. En outre, une réécriture, un paraphrasage ou une traduction significatifs peuvent rendre le signal moins fiable. Les textes courts offrent également moins de contenu pour détecter le filigrane.
Néanmoins, OpenAI affirme que textGrain produit des résultats comparables ou meilleurs par rapport à d’autres approches de filigranage de texte, y compris SynthID de Google DeepMind. Selon leurs tests, l’ajout du filigrane n’entraîne pas de baisse significative des performances des modèles d’IA, et son impact sur la vitesse de génération demeure négligeable.
Une réponse aux nouvelles normes européennes
Ce déploiement répond directement à l’article 50 de la loi sur l’IA, dont les obligations de transparence entreront en vigueur le 2 août 2026. La réglementation exige notamment que les entreprises de systèmes d’IA générative conçoivent leurs systèmes de manière à permettre l’identification des contenus générés ou manipulés par l’IA grâce à un marquage lisible par machine.

Cependant, OpenAI adopte une approche différente pour son API. À partir du 5 octobre, les clients de l’API à l’échelle mondiale pourront activer volontairement le filigranage sur certains modèles, bien que cette fonctionnalité reste désactivée par défaut. La société collabore également avec ses partenaires cloud pour proposer ce filtrage sur les versions des modèles d’OpenAI distribuées par leurs services.
OpenAI proposera également un accès à son outil de détection aux chercheurs et organisations spécialisées approuvés. Cet outil indiquera uniquement s’il détecte un filigrane d’OpenAI, sans révéler l’identité de l’utilisateur, ses requêtes ou ses conversations. La société ne prévoit pas de rendre ce détecteur accessible au grand public pour le moment, en raison des risques de faux positifs et de détections manquées.
Enfin, il est important de noter que le filigrane ne doit pas être considéré comme une preuve absolue de l’origine ou de l’auteur d’un texte. OpenAI précise qu’elle ne peut pas déterminer qui possède le contenu, quelle part a été écrite par l’IA ou quelle part provient d’un travail humain. C’est simplement un indice que le contenu a probablement été généré ou traité par un modèle d’OpenAI.






