Alsace·AI Le Bretzel

OpenAI ·

ChatGPT va signer ses textes en Europe, mais qui pourra vérifier ?

Pour se conformer à l’AI Act, OpenAI glisse un filigrane invisible dans les textes de ChatGPT en Europe. Mais l’API y échappe par défaut, et le détecteur reste réservé à quelques-uns.

ChatGPT va signer ses textes en Europe, mais qui pourra vérifier ?

Les textes rédigés par ChatGPT en Europe vont porter une signature invisible. OpenAI a annoncé le 5 octobre « textGrain », un filigrane glissé dans les réponses de ChatGPT et de son assistant de programmation Codex pour les utilisateurs de l’Union européenne, offre gratuite comprise. Le déploiement se fera progressivement dans les prochaines semaines. L’objectif : se conformer au règlement européen sur l’IA, qui impose de rendre les contenus générés reconnaissables par une machine. Reste une question que l’annonce laisse en suspens : qui pourra vérifier ?

Une signature dans le choix des mots

Rien n’est ajouté au texte : ni caractère caché, ni espace invisible. Le filigrane se loge dans la façon dont le modèle choisit ses mots. Une clé secrète, combinée aux mots qui précèdent, oriente légèrement chaque choix, sans changer le sens ni la qualité perçue. Un texte copié-collé garde donc sa signature. Selon OpenAI, le marquage n’identifie ni l’utilisateur ni son compte : il dit seulement « ce texte vient probablement d’un modèle d’OpenAI ».

Le rapport technique publié avec l’annonce, cosigné par des chercheurs d’OpenAI, de l’université de Pennsylvanie et de Yale, donne des chiffres qui invitent à la prudence. Sur un passage d’environ 200 tokens (une centaine et demie de mots), la détection fonctionne dans à peu près 80 % des cas, et 95 % sur un texte deux fois plus long. Elle chute vite dès qu’on retouche : si l’on remplace un mot sur dix par un synonyme, le taux passe de 92 % à 66 %, et à 17 % quand on en remplace un sur quatre. Une paraphrase appuyée ou une traduction peuvent l’effacer complètement. OpenAI annonce enfin un taux de faux positifs d’environ 1 %, calculé sur des hypothèses théoriques. Et l’entreprise le reconnaît elle-même : l’absence de filigrane ne prouve pas qu’un humain a écrit le texte.

L’Europe oblige, l’API attendra

C’est l’article 50 de l’AI Act qui pousse OpenAI à agir. Depuis le 2 août, les fournisseurs de systèmes qui génèrent du texte doivent marquer leurs productions. Le « digital omnibus » adopté cet été n’a pas reporté cette obligation, mais il laisse aux services déjà sur le marché, comme ChatGPT, jusqu’au 2 décembre pour s’y conformer. OpenAI arrive donc dans les temps, pas en avance.

Le périmètre, lui, est soigneusement délimité. Le filigrane est activé par défaut dans ChatGPT et Codex, mais seulement dans l’Union européenne. Pour les développeurs qui passent par l’API, c’est une option, désactivée par défaut. Autrement dit, une entreprise française qui intègre GPT dans son propre produit n’aura pas de marquage, sauf à le demander. Anthropic a fait un autre choix : depuis août, le filigrane de ses modèles Claude s’applique dans le monde entier. Google avait ouvert dès 2024 le code de son propre système, SynthID-Text.

Un filigrane que personne ne peut lire

Le point le plus discutable est ailleurs : le détecteur n’est pas public. Il est réservé à des chercheurs et à des organisations agréés. Un enseignant qui soupçonne une copie, un journaliste face à un faux communiqué, un citoyen devant un texte douteux ne pourront rien vérifier eux-mêmes. Des chercheurs pointaient dès septembre ce problème des « filigranes sans vérification » : un marquage dont seul l’émetteur détient la clé relève davantage de l’affichage de conformité que de la transparence.

Il y a aussi une ironie. En 2024, le Wall Street Journal révélait qu’OpenAI disposait depuis un an d’un filigrane de texte qu’elle refusait de déployer. L’entreprise expliquait alors qu’il était trop facile à contourner et qu’il risquait de stigmatiser l’usage de l’IA, notamment chez les non-anglophones. Ces deux limites n’ont pas disparu ; c’est la loi qui a changé.

Ce n’est pas une raison pour jeter l’idée. Un marquage, même imparfait, rend la fraude massive plus coûteuse, et l’obligation européenne a le mérite d’exister. Mais un filigrane n’a de valeur que si d’autres que son auteur peuvent le contrôler. Le code de bonnes pratiques signé par les éditeurs prévoit une détection interopérable d’ici février 2027. C’est sur ce point qu’il faudra les juger.

Sources

ChatGPTEuropeIA générativeOpenAIRégulation

Vous êtes arrivé au bout — merci

Le Bretzel

La suite chaque lundi matin : le récap de la semaine passée en IA, noué en cinq minutes. Gratuit, sans pub, sans pistage.

Une lettre par semaine, le lundi matin. Votre adresse ne sert qu’à ça — confidentialité. Désinscription en un clic.

À lire ensuite