En Europe, OpenAI tatoue les textes de ChatGPT pour se conformer à l’AI Act
OpenAI déploie en Europe textGrain, un outil de filigrane appliqué aux textes générés par ChatGPT. Cette fonctionnalité, réservée au Vieux Continent, répond à l'AI Act, dont l'obligation de marquage technique est en vigueur depuis début août. Les systèmes déjà sur le marché ont jusqu'au 2 décembre pour s'y conformer. Le procédé ajoute un « signal statistique invisible » en modifiant subtilement la façon dont le modèle choisit entre plusieurs mots ou fragments de mots possibles. Sur un passage entier, ces choix dessinent un motif qu'un détecteur peut repérer, sans caractère caché, espace invisible ni ponctuation inhabituelle. Anthropic avait ouvert la voie avec une approche similaire pour Claude, depuis Fable 5.1. Sur des passages de 400 tokens, avec un taux de faux positifs cible de 1 %, le détecteur identifie le filigrane dans 95 % des cas. Les contenus vérifiés par un humain échappent à l'obligation de tatouage.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Next INpact. Lire l'article original →
Les performances restent toutefois inégales. Dans les tests d'OpenAI, menés sur 500 prompts générés en anglais puis traduits, l'espagnol obtient le meilleur taux de détection (69 %) et le roumain le plus faible (42,2 %). Le français dépasse 60 %. Le domaine compte aussi : la détection est très élevée sur la psychologie, beaucoup moins en mathématiques, où le choix des mots est plus contraint. Le procédé ne fonctionne pas sur les textes courts, et le code de bonnes pratiques européen n'impose aucun filigrane sous 200 tokens, soit environ 150 mots en anglais. Surtout, la protection se dégrade dès qu'on retouche le texte. Un taux de détection de 92 % tombe à 66 % si 10 % des mots sont remplacés par des synonymes, et à 17 % si 25 % le sont. Un utilisateur motivé peut donc brouiller la trace sans grand effort.
Ce dispositif se distingue des détecteurs comme Pangram, très commentés ces dernières semaines après l'affaire Thélyson Orélien. Ces outils analysent un texte après coup, à partir de ses caractéristiques stylistiques, sans rechercher de signal intégré à la génération. Plusieurs tests récents ont d'ailleurs montré les limites de ces détecteurs, dont une évaluation de plus de 5 000 textes soumis à 75 outils gratuits, qualifiée d'échec. L'AI Act pousse donc les fournisseurs vers une traçabilité à la source, avec des garanties imparfaites. OpenAI propose un paramètre d'intensité du signal, qui permet de relever le taux de détection des langues passant sous le seuil de 60 %, et dit vouloir publier sa technologie en open source. Reste à savoir si ces marquages, faciles à atténuer par réécriture, suffiront à répondre à l'objectif de transparence voulu par Bruxelles à l'échéance du 2 décembre.
OpenAI déploie en Europe un filigrane statistique sur les textes de ChatGPT pour répondre à l'obligation de marquage de l'AI Act, avec une échéance de conformité au 2 décembre pour les systèmes déjà sur le marché.