Aller au contenu principal
Sécurité · Actu ·

Anthropic lance une API de détection de filigrane pour repérer les textes générés par Claude

Anthropic prépare le lancement d'une API de détection de filigrane numérique permettant à des tiers de vérifier si un texte a été rédigé par son modèle Claude. Cette technologie s'appuie sur la méthode SynthID, développée par Google, et fonctionne en modifiant subtilement le hasard qui intervient dans le choix des mots générés par le modèle, sans que cela n'altère la qualité ou la lisibilité du texte produit. Concrètement, chaque texte généré par Claude porterait ainsi une signature statistique invisible à l'œil nu, mais détectable par un outil dédié que des entreprises, plateformes ou institutions pourraient interroger via cette nouvelle API.

1 min de lecturePertinence 55
Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Cette annonce s'inscrit dans un contexte où la capacité à distinguer un texte généré par intelligence artificielle d'un texte écrit par un humain devient un enjeu majeur, que ce soit pour lutter contre la désinformation, détecter la fraude académique, ou simplement garantir la transparence sur l'origine des contenus en ligne. En ouvrant cet outil à des tiers, Anthropic se positionne comme un acteur responsable face aux inquiétudes croissantes autour de la prolifération de textes générés par IA indétectables, un sujet qui préoccupe autant les éditeurs de presse que les établissements scolaires ou les régulateurs.

Toutefois, l'entreprise reconnaît elle-même les limites de cette approche : la détection devient nettement moins fiable sur des textes très factuels, sur du code informatique, ou lorsque le texte original a été fortement réécrit ou reformulé par la suite. Google avait déjà rencontré des limites similaires avec SynthID, la méthode dont s'inspire directement Anthropic pour construire son propre système de filigrane.

Impact France / UEChamp produit par Le Fil IA

Cet outil de détection de filigrane pourrait aider les entreprises et éditeurs européens à se conformer aux exigences de transparence sur le contenu généré par IA prévues par l'AI Act.

À lire ensuite

01Anthropic filigrane désormais toutes les productions de Claude, des marques qui « peuvent survivre à certaines modifications47The DecoderSécurité 02Anthropic réclame des sanctions contre Alibaba pour la plus grande attaque de clonage de Claude52Ars Technica AISécurité 03Anthropic face à un dilemme : son modèle Claude Mythos serait trop puissant pour être lancé41Siècle DigitalSécurité 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.