Aller au contenu principal
Régulation · Reglementation ·

Anthropic : le tatouage de Claude se niche dans le choix des mots

Anthropic a détaillé, dans un billet de blog publié en fin de semaine dernière, la méthode technique utilisée pour "tatouer" les textes générés par Claude, une obligation de l'AI Act européen entrée en vigueur le 2 août 2026. Une page d'assistance publiée le 11 août en avait déjà posé le principe, sans entrer dans les détails. Le système repose sur SynthID-Text, technologie développée par Google DeepMind : quand Claude doit choisir entre plusieurs mots équivalents, le choix n'est plus aléatoire mais influencé par une clé secrète et par les mots précédents. Exemple donné par Anthropic : après "Aujourd'hui, il faisait froid et...", le mot "sucré" est très improbable, contrairement à "gris" ou "couvert", et c'est la préférence statistique pour l'un ou l'autre qui forme, répétée sur tout le texte, une signature invisible mais détectable avec la bonne clé, sans ajout d'aucun caractère caché.

2 min de lecturePertinence 59
Source

Résumé et traduction réalisés par Le Fil IA à partir de Next INpact. Lire l'article original →

Cette approche vise à répondre à un enjeu grandissant : distinguer les contenus générés par IA à mesure qu'ils se multiplient en ligne, dans l'éducation ou le journalisme. Anthropic affirme, tests internes à l'appui, que la méthode n'affecte ni la qualité, ni la créativité, ni la lisibilité des textes de Claude, contrairement à d'autres techniques de marquage jugées plus intrusives. Pour l'un des modèles les plus utilisés par les entreprises, cette mise en conformité démontre qu'il est possible de respecter l'AI Act sans dégrader l'expérience utilisateur. Sa portée reste toutefois limitée à une estimation de probabilité : le procédé ne prouve rien avec certitude et ne permet ni de garantir qu'un texte est humain, ni d'identifier un contenu produit par un modèle concurrent.

Cette annonce s'inscrit dans l'application progressive de l'AI Act, dont les obligations de transparence sur les contenus générés par IA sont entrées en vigueur début août 2026, incitant les grands fournisseurs de modèles à développer leurs propres mécanismes de marquage. Anthropic reconnaît elle-même les limites de sa solution : la détection reste peu fiable sur les textes courts, faute de choix lexicaux suffisants pour dégager un signal exploitable, et échoue presque systématiquement sur les passages factuels, les calculs ou le code. Une légère réécriture ne devrait pas effacer le tatouage, mais une reformulation complète du texte peut le faire disparaître, laissant une marge de contournement. Reste à voir si d'autres éditeurs adopteront une méthode compatible, ou si la fragmentation des systèmes de tatouage limitera leur efficacité face à la désinformation.

Impact France / UEChamp produit par Le Fil IA

Cette mise en conformite avec l'AI Act, entre en vigueur le 2 aout 2026, illustre les obligations de transparence desormais imposees aux fournisseurs de modeles d'IA operant dans l'UE.

À lire ensuite

01Anthropic explique le fonctionnement des filigranes invisibles de Claude60The Verge AIRégulation 02Anthropic relance Claude Fable 5 dans le monde après la levée des restrictions américaines à l'export49VentureBeat AIRégulation 03Claude Max : un abonné accuse Anthropic de l’avoir trompé, la justice s’en mêle48Le Big DataRégulation 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.