Anthropic explique le fonctionnement des filigranes invisibles de Claude
Anthropic a détaillé, vendredi, le fonctionnement du système de filigrane invisible qu'elle compte appliquer aux textes générés par Claude. Cette technologie repose sur une version adaptée de SynthID-Text, une méthode open source développée par Google DeepMind qui insère des motifs détectables en s'appuyant sur les probabilités de choix des mots lors de la génération. Le dispositif s'accompagne d'un support du standard C2PA pour les images traitées par Claude, permettant d'authentifier leur origine. Ces deux mesures répondent aux obligations imposées par l'AI Act, le règlement européen sur l'intelligence artificielle, qui impose que les contenus synthétiques, qu'il s'agisse d'audio, d'image, de vidéo ou de texte, portent des marques lisibles par machine.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Verge AI. Lire l'article original →
Également couvert par TechCrunch AI.
Cette annonce marque une étape concrète dans la mise en conformité des grands fournisseurs de modèles avec la réglementation européenne, à un moment où la distinction entre contenu humain et contenu généré par IA devient un enjeu central pour la confiance du public, la lutte contre la désinformation et la protection de l'intégrité de l'information en ligne. Pour les utilisateurs professionnels de Claude, notamment les éditeurs, chercheurs et entreprises soumis à des obligations de traçabilité, disposer d'un mécanisme de marquage fiable et documenté facilite l'adoption de l'outil dans des contextes réglementés.
L'AI Act européen, entré en application progressive, impose aux fournisseurs de systèmes d'IA générative des obligations de transparence de plus en plus strictes. En s'appuyant sur SynthID-Text, une technologie déjà éprouvée par Google DeepMind sur ses propres modèles, Anthropic évite de développer un système propriétaire depuis zéro tout en profitant d'une approche reconnue par la communauté technique. D'autres acteurs majeurs du secteur devraient suivre une trajectoire similaire pour se conformer aux mêmes exigences réglementaires.
Cette mesure aide Anthropic a se conformer aux obligations de transparence de l'AI Act européen sur le marquage des contenus synthétiques.
Le filigrane invisible, c'est le genre de truc qu'on attendait depuis que l'AI Act a posé ses exigences de traçabilité. Anthropic ne réinvente rien, elle reprend SynthID-Text de Google DeepMind, et c'est plutôt malin : pas besoin de repartir de zéro, la techno est déjà éprouvée. Reste que ça fixe un précédent : le vrai enjeu réglementaire pour les IA génératives en 2026, ce n'est plus la puissance des modèles, c'est la capacité à prouver qu'un texte vient d'une machine.