Inutile de mentir ! Claude marque désormais ses textes avec un filigrane
Anthropic a annoncé le déploiement d'un filigrane invisible intégré aux textes générés par ses modèles Claude, applicable à tous les nouveaux modèles lancés depuis le 2 août 2026, avec une extension prévue à certaines versions antérieures. Ce marquage, indétectable à l'œil nu, est conçu pour résister aux copier-coller et aux modifications mineures du texte. L'entreprise déploie ce système à l'échelle mondiale, y compris via les services cloud, et prévoit de fournir des outils permettant à des tiers de détecter ces filigranes. Pour les images générées par ses modèles, Anthropic utilise une méthode différente, reposant sur des métadonnées signées conformes à la norme C2PA. Cette initiative répond directement aux nouvelles règles européennes sur l'intelligence artificielle et la transparence des contenus générés par IA, entrées en vigueur le 2 août.
Résumé et traduction réalisés par Le Fil IA à partir de Le Big Data. Lire l'article original →
Également couvert par Blog du Modérateur.
Cette mesure pourrait bouleverser les pratiques de nombreux utilisateurs qui présentent des contenus générés par IA comme entièrement rédigés par des humains, notamment dans l'édition ou le milieu scolaire. Le secteur littéraire a déjà connu plusieurs controverses révélatrices : un agent littéraire a retiré son soutien au roman "Call Me, I'll Hide the Body" de Jerry Falade après des soupçons d'usage d'IA, que l'auteur a contestés, tandis que l'éditeur Hachette a retiré "Shy Girl", un roman d'horreur de Mia Ballard, suite à des accusations similaires, l'autrice affirmant qu'un éditeur freelance avait ajouté du contenu généré par IA sans son accord. Le filigrane d'Anthropic pourrait donc offrir aux éditeurs et institutions un indice supplémentaire pour repérer ces pratiques, sans toutefois constituer une preuve absolue puisque traductions, paraphrases importantes ou réécritures peuvent altérer suffisamment le marquage pour le rendre indétectable.
Cette nouveauté s'inscrit dans un contexte plus large où les éditeurs et plateformes cherchent des moyens fiables de distinguer les contenus humains de ceux produits avec l'aide de l'IA, alors que la réglementation européenne pousse les entreprises du secteur vers davantage de transparence. La mesure divise déjà les utilisateurs : certains saluent un outil utile pour repérer les contenus IA, quand d'autres redoutent un système renforçant le contrôle des plateformes sur les utilisateurs, notamment ceux disposant d'un abonnement payant. Face à cette nouvelle couche de traçabilité, une partie des utilisateurs se tourne déjà vers des modèles open source échappant à ce type de marquage, tandis que d'autres cherchent activement des outils capables de faire disparaître ces filigranes, ouvrant la voie à une course technologique entre détection et contournement dans les mois à venir.
Ce filigrane permet a Anthropic de se conformer aux nouvelles obligations de transparence de l'AI Act europeen entrees en vigueur le 2 aout 2026, offrant aux utilisateurs et institutions francaises et europeennes un outil de tracabilite des contenus generes par IA.