Résumé :
OpenAI ajoute progressivement des filigranes invisibles aux textes générés par ChatGPT et Codex dans l'Union européenne afin de répondre aux exigences de la loi européenne sur l'intelligence artificielle concernant la lisibilité du contenu généré par l'IA. OpenAI a déclaré que cette technologie de filigrane de texte appelée textGrain n'ajoute pas de caractères cachés, d'espaces invisibles ou de ponctuation spéciale à l'article. Au lieu de cela, il ajuste la méthode de sélection des mots lorsque le modèle génère du texte, formant ainsi une caractéristique statistique dans l'ensemble du texte qui ne peut pas être directement détectée par l'œil humain mais peut être reconnue par la machine.

Selon les informations publiées par OpenAI, les exigences de transparence pertinentes de la loi sur l'intelligence artificielle de l'Union européenne entreront en vigueur le 2 août 2026. Les fournisseurs de services d'IA générative sont tenus de disposer de contenus générés par l'IA avec des marques reconnaissables par machine. OpenAI prévoit donc de déployer progressivement les filigranes de texte pour les utilisateurs éligibles de ChatGPT et du Codex dans l'UE au cours des prochaines semaines, et ce déploiement couvrira tous les packages ChatGPT, pas seulement les utilisateurs payants.
Ce type de filigrane est différent du « texte caché » au sens traditionnel du terme. Lorsque les utilisateurs copient le contenu généré par ChatGPT, aucun caractère masqué ne sera copié en même temps et aucun symbole spécial ne sera trouvé dans le texte. Ce que textGrain change réellement, c'est la probabilité de sélection aléatoire du modèle face à plusieurs mots possibles. Les changements dans un seul mot peuvent être totalement indétectables, mais lorsqu'un grand nombre de mots sont combinés, un modèle statistique peut se former que le système de détection peut reconnaître.
OpenAI a déclaré que l'avantage de cette conception est qu'elle ne modifie pas de manière significative la sortie de texte normale. Les tests de la société ont révélé que la différence de performances du modèle entre l'ajout et la non-ajout de filigranes se situait dans la plage de fluctuation normale des tests, et que l'impact sur la vitesse de génération de texte était également très faible. Lors des précédents tests internes de ChatGPT par OpenAI, il n'a pas été constaté que la fonction de filigrane entraînait une augmentation des avis négatifs des utilisateurs.
Cependant, OpenAI a également admis que le filigrane de texte n'est pas une méthode fiable à 100 % pour identifier le contenu de l'IA. Il existe deux erreurs possibles dans la détection du filigrane. L’une est qu’un texte sans filigrane est considéré à tort comme comportant un filigrane, et l’autre est que le texte comporte en réalité un filigrane, mais que le système de détection ne le reconnaît pas.
La longueur du texte est également un facteur important affectant les résultats de détection. Un texte plus court laisse moins de place au modèle pour ajuster la sélection des mots, ce qui rend plus difficile la formation d'un signal statistique stable. Les règles publiées par OpenAI montrent également que, conformément aux spécifications de transparence de l'IA de l'UE, la production de moins de 200 jetons, d'environ 150 mots anglais et d'extraits de code n'est pas nécessaire pour ajouter des filigranes de texte.
Il existe également des différences dans les résultats de détection entre les différentes langues. OpenAI a testé les 24 langues officielles de l'Union européenne. Tout en maintenant un taux de faux positifs de 1%, le taux de détection de l'espagnol a atteint un maximum de 69%, tandis que le taux de détection du roumain n'était que de 42,2%. Pour les langages avec de faibles effets de détection, OpenAI peut augmenter la force du filigrane pour améliorer les capacités de détection.
Cela signifie que textGrain ne peut pas être compris comme une technologie capable de prouver à 100 % qu'il a été généré par ChatGPT lorsque vous voyez le filigrane. OpenAI précise que même si le texte original n'a pas été modifié, rien ne garantit que le système de détection sera capable de détecter le filigrane, surtout lorsque le texte est court ou que la gamme de mots sélectionnables est petite.
Dans le même temps, il existe des différences évidentes entre les filigranes de texte et les détecteurs de texte IA actuellement sur le marché. Les outils de détection d'IA tiers tels que Pangram utilisent principalement des classificateurs pour déterminer si un morceau de texte est susceptible d'être généré par l'IA en analysant le choix des mots, la structure des phrases et d'autres caractéristiques du langage. Cette méthode analyse le texte après sa génération, tandis que textGrain laisse directement un signal statistique lisible par machine pendant le processus de génération de texte.
OpenAI estime que cette approche est plus conforme aux exigences de la loi européenne sur l'IA en matière de signaux identifiables « intégrés ».
OpenAI n'a pas directement adopté SynthID de Google DeepMind ou d'autres solutions de filigrane de texte existantes, mais a développé textGrain lui-même. La société a déclaré que sa technologie auto-développée lui permet d'ajuster de manière plus flexible l'équilibre entre la détectabilité des filigranes et la diversité des sorties du modèle. Lors de tests internes, textGrain a reconnu le texte filigrané à un taux égal ou supérieur à celui des autres solutions testées par la société, notamment SynthID pour le texte.
OpenAI prévoit également de rendre la technologie textGrain open source, en espérant que d'autres instituts de recherche et entreprises pourront utiliser cette technologie pour approfondir la recherche et améliorer la reconnaissance des sources de texte par l'IA. Cependant, OpenAI n'ouvrira pas immédiatement le détecteur de filigrane de texte au public, mais fournira d'abord des canaux de candidature aux chercheurs et aux institutions professionnelles agréés.
Ces chercheurs et institutions autorisés peuvent utiliser les outils de détection d'OpenAI pour déterminer si un morceau de texte contient un filigrane généré par OpenAI, mais les résultats de la détection ne révéleront pas l'identité de l'utilisateur, les mots d'invite ou les enregistrements de discussion correspondant au contenu généré. OpenAI estime que, étant donné que la technologie actuelle présente encore des risques de faux positifs et de faux négatifs, ouvrir directement les outils de détection à tout le monde peut conduire à une surinterprétation des résultats de détection des filigranes.
Il convient de noter qu'OpenAI ne prévoit pas d'activer les filigranes de texte par défaut à l'échelle mondiale cette fois-ci. La société a déclaré qu’à ce stade, les filigranes de texte ChatGPT et Codex seraient progressivement déployés uniquement pour la région de l’UE. Ce déploiement régional permettra à OpenAI d'observer les performances dans des environnements d'utilisation réels et d'ajuster la technologie en fonction des retours réels.
Pour les développeurs d'API, la situation est différente. OpenAI a commencé à permettre aux clients d'API mondiaux d'activer activement la fonction de filigrane de texte pour certains modèles, mais elle est toujours désactivée par défaut. Cela signifie que les entreprises peuvent décider de filigraner ou non le texte généré via les API en fonction de leurs propres exigences de transparence.
OpenAI se coordonne également avec les partenaires de services cloud, en espérant que dans les prochaines semaines, le contenu éligible généré en appelant des modèles OpenAI via ces plates-formes cloud recevra également les signaux sources correspondants.
Cependant, les filigranes textuels ne remplaceront pas les autres méthodes d'identification de contenu IA. OpenAI souligne que les informations sources telles que les filigranes lisibles par machine et le C2PA ne peuvent pas remplacer les déclarations publiques telles que les étiquettes d'IA visibles et les bannières d'invite requises par la loi ou la plateforme. Ils résolvent les problèmes de source de contenu à différents niveaux.
Pour les utilisateurs ordinaires, la chose la plus remarquable à propos de ce changement est la suivante : si vous résidez dans l'UE et utilisez ChatGPT pour générer du texte long, alors à partir du moment où le système de filigrane couvre officiellement votre compte, le contenu généré peut déjà contenir des signaux sources invisibles à l'œil nu. La copie directe du texte original ne détruira généralement pas ce signal, mais si le texte est considérablement réécrit, reformulé ou traduit, la détectabilité du filigrane peut être considérablement réduite.
OpenAI reconnaît également explicitement cette limitation. Le signal de textGrain existe dans la sélection de mots du modèle, plutôt que sous la forme d'un caractère invisible attaché indépendamment au fichier texte. Par conséquent, une réécriture suffisante du texte peut détruire le modèle statistique original. C'est pourquoi OpenAI souligne que les filigranes textuels sont actuellement plus appropriés comme signal de jugement de source et ne peuvent pas être considérés comme un « certificat d'identification IA » absolument fiable.
De manière générale, OpenAI a lancé textGrain dans l'UE cette fois principalement pour s'adapter aux nouvelles exigences réglementaires apportées par la loi sur l'IA. Cela signifie également que l'identification de la source du texte généré par l'IA évolue des « balises déclaratives » traditionnelles vers des signaux reconnaissables par machine. Cela ne changera pas le texte que les utilisateurs voient, et des caractères mystérieux n'apparaîtront pas lors de la copie du texte, mais cela permettra aux systèmes dotés d'autorisations de détection d'essayer de déterminer si un élément de contenu provient d'un modèle OpenAI.
Cependant, étant donné que les filigranes de texte présentent toujours des problèmes tels que des différences de langue, des restrictions de longueur de texte et un affaiblissement du signal après la réécriture, ils sont actuellement plus appropriés comme preuve auxiliaire dans le système de traçabilité du contenu de l'IA, plutôt que d'être utilisés seuls pour déterminer si un article a été « écrit par l'IA ».
Commentaires