Aller au contenu principal
Sécurité · Actu ·

Anthropic filigrane désormais toutes les productions de Claude, des marques qui « peuvent survivre à certaines modifications

Anthropic a annoncé l'intégration systématique de filigranes invisibles dans l'ensemble des textes générés par ses modèles Claude, une mesure applicable à l'échelle mondiale. Selon l'entreprise, ces marques numériques, conçues pour identifier l'origine du contenu, pourraient « persister à travers certaines modifications » apportées ultérieurement au texte. Les nouveaux modèles déployés à partir d'août 2026 intégreront ce dispositif de marquage dès leur conception. Anthropic prévoit également de fournir des outils de détection permettant à des tiers de vérifier si un texte donné provient bien de Claude, une démarche de transparence renforcée par le recours au standard C2PA (Coalition for Content Provenance and Authenticity) pour signer les fichiers produits.

1 min de lecturePertinence 42

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Cette initiative répond à une préoccupation croissante concernant la traçabilité des contenus générés par intelligence artificielle, alors que la prolifération de textes produits par des modèles comme Claude, GPT ou Gemini complique la distinction entre production humaine et production automatisée. En rendant ses sorties identifiables même après édition partielle, Anthropic cherche à limiter les usages trompeurs, qu'il s'agisse de désinformation, de fraude académique ou de manipulation de l'opinion. Pour les entreprises et plateformes qui intègrent Claude dans leurs services, cette fonctionnalité pourrait devenir un argument de confiance, notamment dans des secteurs sensibles comme le journalisme ou l'éducation.

Cette décision s'inscrit dans un mouvement plus large de standardisation de la provenance des contenus numériques, porté notamment par la coalition C2PA qui rassemble des acteurs technologiques et médiatiques autour de normes communes d'authentification. D'autres laboratoires d'IA, confrontés aux mêmes pressions réglementaires et sociétales, pourraient être incités à adopter des mécanismes similaires. Reste à savoir si ces filigranes résisteront réellement à des tentatives de contournement plus poussées, et si leur adoption deviendra un standard imposé par la régulation plutôt qu'une initiative volontaire des entreprises du secteur.

Impact France / UEChamp produit par Le Fil IA

Le marquage des contenus IA rejoint les exigences de transparence de l'AI Act européen sur l'identification des contenus générés par IA, sans qu'aucun acteur français ou européen ne soit directement implique.

À lire ensuite

01Anthropic lance une API de détection de filigrane pour repérer les textes générés par Claude44The DecoderSécurité 02Vérification d’identité obligatoire sur Claude, l’erreur fatale d’Anthropic ?53Le Big DataSécurité 03Anthropic détecte des "émotions fonctionnelles" chez Claude qui influencent son comportement53The DecoderSécurité 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.