Accueil ChatGPT ChatGPT va tatouer discrètement ses textes en Europe pour se conformer à...

ChatGPT va tatouer discrètement ses textes en Europe pour se conformer à l’AI Act

Ce visuel a été créé grâce à l'IA.

OpenAI va ajouter dans les prochaines semaines un filigrane invisible aux textes générés par ChatGPT et Codex dans l’Union européenne. Baptisée textGrain, cette technologie doit permettre d’identifier plus facilement certains contenus issus de ses modèles, conformément aux nouvelles obligations de transparence prévues par l’AI Act.

Un signal caché dans le choix des mots

Le filigrane ne prendra pas la forme d’un caractère invisible ou d’une balise ajoutée au texte. Avec textGrain, OpenAI modifie légèrement la manière dont son modèle choisit entre différents mots ou fragments de mots possibles au moment de générer une réponse. Pris individuellement, ces choix restent invisibles pour le lecteur. Mais accumulés sur un passage suffisamment long, ils forment un motif statistique qu’un détecteur peut rechercher.

OpenAI prévoit de déployer ce mécanisme dans les prochaines semaines sur les sorties textuelles éligibles de ChatGPT et Codex dans l’Union européenne, tous abonnements confondus. Les clients de son API peuvent, eux, activer le filigranage de manière optionnelle depuis le 5 octobre, y compris hors d’Europe.

La mesure répond à l’article 50 de l’AI Act, qui impose notamment aux fournisseurs de systèmes d’IA générative de rendre leurs contenus détectables comme artificiellement générés ou manipulés, à l’aide d’un marquage lisible par machine.

Pas un détecteur universel de textes écrits par IA

OpenAI insiste toutefois sur les limites du dispositif. La présence d’un filigrane indique qu’un système OpenAI a probablement généré ou traité le texte, mais elle ne permet pas de savoir quelle part du contenu vient réellement de l’IA, si une personne l’a largement retravaillé ensuite, ni même qui a utilisé le modèle.

À l’inverse, l’absence de signal ne permet pas davantage de conclure qu’un texte a été écrit par un humain. Les passages courts sont plus difficiles à identifier, tout comme les textes offrant peu de latitude dans le choix des mots. Une réécriture importante, une paraphrase ou une traduction peuvent également diminuer la fiabilité de la détection.

Le centre d’aide d’OpenAI précise ainsi que le marquage ne détermine ni l’auteur, ni la propriété du contenu, ni la responsabilité juridique. Il ne permet pas non plus de distinguer un texte entièrement produit par ChatGPT d’un document simplement corrigé ou retravaillé avec le modèle.

Le détecteur restera fermé au grand public dans un premier temps

Autre limite importante : tout le monde ne pourra pas immédiatement vérifier la présence du filigrane. OpenAI ouvre les candidatures pour accéder à son détecteur, mais réserve pour l’instant l’outil à des chercheurs et organisations expertes approuvés. L’entreprise justifie cette prudence par le risque de faux positifs et de faux négatifs, qui pourraient conduire à attribuer à tort un texte à une IA. Son outil indiquera uniquement si un filigrane OpenAI est détecté, sans permettre d’identifier l’utilisateur, ses prompts ou ses conversations.

Le marquage ne remplace d’ailleurs pas nécessairement les obligations d’information visibles prévues par l’AI Act. La Commission européenne distingue le marquage technique apposé par les fournisseurs des obligations qui peuvent incomber aux organisations publiant certains contenus générés par IA, notamment lorsqu’ils portent sur des sujets d’intérêt public et n’ont pas fait l’objet d’un contrôle humain ou éditorial.

Avec textGrain, OpenAI ne prétend donc pas avoir trouvé le détecteur infaillible du texte généré par IA. Le groupe met surtout en place une trace technique supplémentaire, appelée à accompagner la généralisation des contenus synthétiques tout en restant, pour l’instant, imparfaite et difficile à interpréter hors contexte.