ChatGPT : un filigrane invisible, sans option, en Europe
OpenAI va insérer un filigrane statistique invisible dans les textes de ChatGPT et Codex dans l'Union européenne, pour répondre à l'AI Act. L'entreprise reconnaît elle-même que de simples retouches peuvent fortement l'affaiblir.
OpenAI va ajouter, « dans les prochaines semaines », un filigrane invisible aux textes de ChatGPT et Codex produits dans l'Union européenne. Baptisée textGrain, la technique ne laisse aucune trace visible : elle modifie légèrement le choix des mots du modèle pour y inscrire un motif statistique, qu'un détecteur peut ensuite repérer. Le déploiement répond à l'article 50 de l'AI Act, mais l'entreprise admet que le procédé est loin d'être infaillible.
Obligatoire en Europe, optionnel ailleurs
Selon Gizmodo, le filigrane s'appliquera automatiquement aux utilisateurs européens, sans possibilité de le désactiver. Ailleurs, il reste une option. Les développeurs utilisant l'API, partout dans le monde, peuvent l'activer dès maintenant pour certains modèles, mais il est désactivé par défaut, précise BleepingComputer. Engadget note que la liste des modèles concernés n'a pas été détaillée.
D'après The Verge, OpenAI présente cette approche régionale comme un moyen d'apprendre de l'usage réel et des retours. Elle travaille aussi avec des partenaires cloud pour étendre l'option aux modèles accessibles via leurs services.
Côté calendrier réglementaire, l'article 50 impose aux fournisseurs d'IA générative de rendre leurs textes identifiables par machine. Les nouveaux entrants y sont déjà soumis. Les acteurs existants, dont OpenAI, Anthropic, Microsoft, Google et Meta, ont jusqu'au 2 décembre, rappelle Engadget. Anthropic a déjà fait ce choix en août, et Google DeepMind filigrane ses sorties depuis plusieurs années avec SynthID. OpenAI affirme que textGrain a « égalé ou dépassé » ces approches, et Engadget indique qu'elle prévoit de publier la technologie en open source.
Gizmodo souligne un contraste : les filigranes d'Anthropic et de Google s'appliquent ou s'appliquaient aussi aux utilisateurs américains, pas celui d'OpenAI. Le site cite un sondage du Rainey Center selon lequel près de huit personnes sur dix aux États-Unis soutiennent une obligation de filigrane. Sans règle fédérale, estime Gizmodo, l'entreprise n'a guère de raison de s'y plier de son propre chef.
Une détection fragile
Le rapport technique d'OpenAI décrit un filigrane « non biaisé » : en moyenne sur les clés secrètes, la distribution des mots reste celle du modèle d'origine. Les auteurs étudient aussi la diversité des réponses, car certaines méthodes produisent des réponses identiques pour une même requête avec la même clé. textGrain limite donc la perte d'aléa à un budget d'entropie fixé. Le détecteur n'a besoin que du texte et de la clé secrète.
Les performances mesurées par OpenAI, reprises par BleepingComputer, montrent les limites :
- sur des passages de 400 tokens (mots ou fragments de mots), remplacer 10 % des mots par des synonymes fait passer la détection d'environ 92 % à 66 % ;
- avec 25 % de mots remplacés, elle tombe à 17 % ;
- avec un taux de faux positifs fixé à 1 %, le filigrane est détecté dans environ 80 % des réponses de psychologie de 200 tokens, contre environ 95 % à 400 tokens ;
- la détection est encore moins bonne en mathématiques, où le modèle dispose de moins de liberté de formulation.
« L'absence de filigrane détecté ne prouve pas qu'un texte est d'origine humaine », prévient OpenAI (traduction), cité par BleepingComputer. Un texte trop court, édité ou traduit peut échapper au détecteur. Un filigrane détecté ne révèle pas non plus l'auteur, le compte, la requête ou la conversation, ni la part de travail humain. Selon Engadget, OpenAI reconnaît que de bonnes performances en conditions idéales ne garantissent pas une détection fiable au quotidien.
L'entreprise ajoute que la qualité de GPT-6 Astra n'est pas sensiblement affectée : les résultats aux tests de référence restent globalement proches avec textGrain activé.
Un détecteur réservé aux experts
Le détecteur ne sera pas public au lancement, en raison des risques de filigranes manqués et de faux positifs. Les chercheurs et organisations expertes peuvent déposer une demande dès maintenant. L'accès sera accordé « au cas par cas », conformément au code de bonnes pratiques européen, pour évaluer et améliorer la traçabilité des textes. L'outil indiquera seulement si un filigrane OpenAI est détecté, sans identifier l'utilisateur.
Aucune date précise n'est donnée pour le déploiement européen, annoncé « dans les prochaines semaines ». Les acteurs déjà présents sur le marché ont, eux, jusqu'au 2 décembre pour se conformer.
Sources
- textGrain technical report — OpenAI
- OpenAI is adding invisible watermarks to ChatGPT and Codex text in the EU — BleepingComputer
- OpenAI is adding text watermarking in ChatGPT and Codex — The Verge
- OpenAI Is Adding Text Watermarks in the EU Because Regulation Works — Gizmodo
- OpenAI will add a digital watermark to text and code generated in the EU - Engadget — Engadget