Aller au contenu principal
Sécurité · Opinion ·

Tatouage de Claude, Gemini et GPT : on a vérifié le code censé casser la protection, voici ce qu’on a trouvé

Depuis plusieurs jours, des publications sur X et sur Reddit affirment qu'Anthropic aurait intégré un système de « tatouage » dans les textes générés par Claude, permettant d'identifier a posteriori qu'un contenu a été écrit par une intelligence artificielle. Ces mêmes publications prétendent qu'un développeur serait parvenu à casser cette protection en examinant le code concerné. Le site Frandroid a voulu vérifier cette affirmation et a soumis le code en question à Claude lui-même, ligne par ligne, pour en analyser le fonctionnement réel. Conclusion de cette vérification : l'idée d'une protection contournée est fausse, et le mécanisme réellement à l'œuvre derrière les productions de Claude diffère de ce qui circulait en ligne, de façon plus surprenante que ce que la rumeur laissait entendre.

1 min de lecturePertinence 48
Source

Résumé et traduction réalisés par Le Fil IA à partir de Frandroid. Lire l'article original →

Cet épisode illustre la vitesse à laquelle des affirmations techniques non vérifiées sur les grands modèles de langage se propagent sur les réseaux sociaux avant tout contrôle factuel, avec un risque de désinformation sur des sujets sensibles comme la traçabilité des contenus générés par IA. Pour les utilisateurs, les éditeurs de contenu et les plateformes, la question de savoir si un texte produit par Claude, Gemini ou GPT peut être identifié comme tel a des implications concrètes en matière de lutte contre la désinformation, de droit d'auteur et de modération.

Ce type de rumeur s'inscrit dans un débat plus large sur le marquage des contenus générés par IA, un enjeu suivi de près par Anthropic, OpenAI et Google face à la pression réglementaire et à la défiance croissante du public envers les contenus synthétiques, sans qu'un standard technique commun et fiable ne se soit encore imposé.

Impact France / UEChamp produit par Le Fil IA

Le debat sur le marquage des contenus IA rejoint les enjeux de desinformation suivis par les regulateurs europeens, sans impact direct sur une loi francaise ou europeenne actuelle.

À lire ensuite

01Anthropic lance une API de détection de filigrane pour repérer les textes générés par Claude51The DecoderSécurité 02Le système de tatouage numérique IA de Google a-t-il été percé ?48The Verge AISécurité 03Vérification d’identité obligatoire sur Claude, l’erreur fatale d’Anthropic ?53Le Big DataSécurité 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.