Aller au contenu principal
SécuritéThe Decoder · 1 min de lecture

Anthropic affirme que son modèle Mythos a découvert des vulnérabilités dans des algorithmes cryptographiques qui sécurisent internet

Source originale ↗·

Anthropic a annoncé que son modèle Claude Mythos Preview a découvert des faiblesses dans plusieurs algorithmes cryptographiques réputés parmi les plus solides de l'industrie. Le résultat le plus marquant concerne HAWK, un schéma de signature post-quantique que des experts humains avaient examiné pendant plus de deux ans sans y déceler de faille majeure. Mythos a trouvé une attaque plus efficace contre ce schéma en seulement 60 heures de calcul, pour un coût API estimé à environ 100 000 dollars. Anthropic précise que ces découvertes ne compromettent aucun système actuellement déployé, HAWK n'étant pas encore utilisé en production à grande échelle.

L'enjeu dépasse toutefois le cas particulier de cet algorithme. Si un modèle d'IA peut égaler, voire dépasser, des années de travail collectif de cryptographes chevronnés en quelques jours, cela bouleverse la manière dont l'industrie évalue la robustesse des systèmes censés protéger les communications, les transactions bancaires et les infrastructures numériques critiques. Les institutions qui standardisent la cryptographie post-quantique, comme le NIST aux Etats-Unis, pourraient devoir intégrer des évaluations assistées par IA dans leurs processus de validation, en plus des revues par des experts humains.

Ce test s'inscrit dans les efforts plus larges d'Anthropic pour démontrer les capacités de ses modèles en matière de recherche scientifique et de sécurité informatique, un domaine où l'entreprise cherche aussi à positionner Claude comme outil de cyberdéfense. La transition mondiale vers des algorithmes résistants aux ordinateurs quantiques, encore en cours de standardisation, rend ces découvertes particulièrement sensibles: elles interviennent au moment même où gouvernements et entreprises choisissent les futurs standards censés sécuriser internet pour les décennies à venir.

Impact France/UE

Les futurs standards de cryptographie post-quantique, en cours d'adoption par les administrations et entreprises europeennes, pourraient devoir integrer des evaluations assistees par IA, mais aucune entite francaise ou europeenne n'est directement concernee par cette annonce.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Cisco Foundation AI lance Antares : des modèles ouverts de 350M et 1B qui localisent les vulnérabilités connues dans du code réel
1MarkTechPost 

Cisco Foundation AI lance Antares : des modèles ouverts de 350M et 1B qui localisent les vulnérabilités connues dans du code réel

Cisco Foundation AI a publié Antares, une famille de petits modèles de langage spécialisés (SLM) dédiés à une tâche unique en sécurité informatique : la localisation de vulnérabilités. À partir d'une description de faille et d'un dépôt de code, le modèle doit identifier les fichiers concernés. Deux versions sont disponibles en poids ouverts sur Hugging Face sous licence Apache 2.0, Antares-350M et Antares-1B, tandis qu'une troisième, Antares-3B, reste non publiée. Les trois modèles sont des transformeurs décodeurs initialisés à partir des checkpoints IBM Granite 4.0, partageant attention par groupes de requêtes, couches SwiGLU, normalisation RMSNorm et encodage RoPE. Cisco a également mis en ligne, sous la même licence, VLoc Bench, un benchmark agentique de 500 tâches issues de 290 dépôts réels couvrant six écosystèmes (npm, pip, Maven, Go, Rust, Composer) et 147 catégories CWE, dont 78% associées à un identifiant CVE officiel. Le résultat marquant n'est pas un record absolu mais un écart de performance à taille égale : Antares-1B atteint un score File F1 de 0,209, dépassant GLM-5.2, un modèle ouvert de 753 milliards de paramètres, plafonné à 0,186. Antares-3B grimpe à 0,223, juste sous GPT-5.5 en mode de raisonnement maximal à 0,229. Antares-1B affiche par ailleurs le meilleur rappel de tous les systèmes testés, à 0,224. Ce résultat illustre qu'un entraînement ciblé sur une tâche précise peut surpasser la simple augmentation du nombre de paramètres. Pour les équipes de sécurité, cela signifie qu'un modèle léger, peu coûteux à faire tourner, peut accélérer la première étape de triage lors d'une alerte de vulnérabilité, celle où un développeur doit fouiller un code source volumineux et mal connu pour localiser un fichier fautif. Les outils d'analyse statique classiques testés dans le même cadre restent nettement en retrait, avec 0,086 pour Semgrep, 0,023 pour CodeQL et seulement 0,020 pour Horusec, preuve que les scanners à base de règles peinent à s'adapter au contexte réel d'un dépôt. Cisco précise toutefois qu'Antares ne remplace aucun autre maillon de la chaîne de sécurité applicative : l'analyse des dépendances, la détection de secrets, les tests dynamiques ou la revue par des experts restent indispensables. Concrètement, Antares fonctionne comme un agent limité à 15 appels de terminal en lecture seule dans un bac à sable Docker sans accès réseau, ne recevant qu'une description de catégorie CWE, sans texte d'avis ni indice de fichier. Il conclut sa tâche en soumettant une liste classée de fichiers suspects ou en signalant l'absence de vulnérabilité. Le benchmark VLoc évalue aussi cette seconde capacité, en testant sur du code déjà corrigé si le modèle déclenche une fausse alerte. Cette approche s'inscrit dans une tendance plus large où l'industrie cherche à automatiser les tâches de sécurité répétitives et coûteuses en temps d'ingénieur, à mesure que le volume de vulnérabilités signalées dans les bases publiques continue de croître.

UELes equipes de securite europeennes pourront tester ces modeles ouverts pour accelerer le triage de vulnerabilites dans leur code, sans lien direct avec une entreprise ou reglementation francaise ou europeenne.

SécuritéActu
1 source
OpenAI affirme que GPT-5.5-Cyber surpasse Mythos d'Anthropic sur les benchmarks de cybersécurité
2The Decoder 

OpenAI affirme que GPT-5.5-Cyber surpasse Mythos d'Anthropic sur les benchmarks de cybersécurité

OpenAI a officiellement lancé GPT-5.5-Cyber, un modèle dédié à la cybersécurité qui surpasse selon la société le modèle Mythos d'Anthropic sur les benchmarks spécialisés du secteur. Ce lancement s'inscrit dans l'expansion de l'initiative Daybreak d'OpenAI, qui comprend désormais une version mise à jour du plugin Codex Security ainsi qu'un réseau de partenaires regroupant plus de 25 entreprises de sécurité et plusieurs gouvernements. Le changement de cap est significatif : là où les outils précédents se concentraient sur la détection de vulnérabilités, GPT-5.5-Cyber vise à les corriger automatiquement. Cette capacité de remédiation autonome représente un saut qualitatif pour l'industrie de la sécurité informatique, où le délai entre la découverte d'une faille et son colmatage constitue une fenêtre d'exposition critique. Pour les entreprises partenaires et les gouvernements impliqués, cela ouvre la voie à des cycles de défense beaucoup plus rapides, potentiellement en temps réel. La compétition entre OpenAI et Anthropic sur le terrain de la cybersécurité s'intensifie, chaque acteur cherchant à s'imposer auprès des grandes organisations gouvernementales et des entreprises critiques. OpenAI avait lancé Daybreak début 2025 pour structurer ses efforts dans ce domaine sensible, conscient que les modèles d'IA puissants représentent à la fois un outil défensif précieux et un vecteur d'attaque potentiel. La constitution d'un réseau de plus de 25 partenaires sécurité signale une volonté de déploiement industriel, et non plus seulement de démonstration technique.

UELes équipes sécurité et gouvernements européens partenaires pourraient bénéficier de cycles de remédiation automatisée plus rapides, mais aucune institution européenne n'est nommée parmi les 25+ partenaires officiels.

SécuritéOpinion
1 source
Anthropic : le modèle Mythos marque un tournant pour les risques de cybersécurité liés à l'IA
3The Information AI 

Anthropic : le modèle Mythos marque un tournant pour les risques de cybersécurité liés à l'IA

Anthropic a involontairement rendu public un brouillon de billet de blog révélant l'existence d'un nouveau modèle d'IA baptisé "Mythos", spécialement conçu pour la génération et la révision de code informatique. Selon ce document, le modèle serait capable d'exploiter des vulnérabilités de sécurité "d'une manière qui dépasse largement les efforts des défenseurs". La société a déjà commencé à briefer des chercheurs en cybersécurité et leur accorde un accès anticipé afin de recueillir des retours avant un lancement officiel. L'enjeu est considérable : si un tel modèle tombait entre de mauvaises mains, il permettrait à des hackers peu qualifiés de mener des attaques sophistiquées à grande échelle, creusant davantage l'écart entre attaquants et défenseurs. Anthropic cherche précisément à identifier ces risques avant la mise sur le marché, en s'appuyant sur la communauté des chercheurs pour "red-teamer" le modèle et réduire son potentiel offensif. Cette démarche illustre la tension croissante entre les capacités des LLMs spécialisés dans le code et les impératifs de sécurité. Cette initiative s'inscrit dans une tendance plus large où les grands laboratoires d'IA, OpenAI, Google DeepMind, et désormais Anthropic, développent des modèles hautement performants pour le code, tout en faisant face à des questions épineuses sur leur double usage. Anthropic, qui se positionne comme un acteur responsable de l'IA via sa politique d'"IA constitutionnelle", se retrouve confronté au paradoxe fondamental du domaine : les mêmes capacités qui accélèrent la défense peuvent aussi armer les adversaires. La divulgation accidentelle du brouillon suggère que la pression autour de Mythos est déjà forte en interne.

UELes capacités offensives de modèles comme Mythos représentent une menace directe pour les infrastructures numériques européennes et soulèvent des questions de conformité avec l'AI Act concernant les systèmes IA à double usage.

💬 Un modèle qui dépasse les défenseurs sur leur propre terrain, c'est le scénario qu'on redoutait depuis que les LLMs de code sont vraiment capables. Ce qui compte, c'est qu'Anthropic le dit franchement et organise le red-teaming avant le lancement, pas après. La fuite du draft, c'est maladroit, mais ça confirme surtout que la pression en interne est déjà énorme.

SécuritéOpinion
1 source
Les IA de détection de vulnérabilités réduisent les coûts de sécurité en entreprise
4AI News 

Les IA de détection de vulnérabilités réduisent les coûts de sécurité en entreprise

L'équipe d'ingénierie de Mozilla Firefox a annoncé avoir identifié et corrigé 271 vulnérabilités de sécurité dans la version 150 du navigateur, grâce à une évaluation menée avec Claude Mythos Preview, le modèle frontier d'Anthropic. Cette collaboration fait suite à un premier partenariat avec Anthropic utilisant Claude Opus 4.6, qui avait permis de détecter 22 corrections sensibles sur le plan sécuritaire dans la version 148. En quelques semaines, l'IA a donc fait remonter des centaines de failles dans un codebase mature et massif, un résultat que des équipes humaines auraient mis des mois à produire. Les ingénieurs de Firefox ont également noté qu'ils n'ont trouvé aucune catégorie de faille, ni aucun niveau de complexité, que l'humain puisse identifier et que le modèle ne puisse pas. Symétriquement, aucun bug détecté par l'IA n'était hors de portée d'un chercheur humain d'élite. Ce résultat renverse une dynamique économique qui favorisait structurellement les attaquants depuis des décennies. La doctrine défensive classique consistait à rendre les attaques suffisamment coûteuses pour décourager tous sauf les acteurs disposant de budgets illimités. Avec l'IA, c'est désormais la découverte de vulnérabilités qui devient bon marché et systématique du côté des défenseurs. Pour les entreprises, le calcul est limpide : dans un environnement réglementaire strict, le coût d'un audit automatisé continu est sans commune mesure avec celui d'une violation de données ou d'une attaque par ransomware. L'automatisation réduit aussi la dépendance aux consultants externes spécialisés, dont la rareté et le coût représentaient jusqu'ici un frein réel pour les équipes de sécurité interne. L'enjeu dépasse largement Firefox. Pendant des années, les chercheurs en sécurité d'élite compensaient les limites du fuzzing automatisé en raisonnant manuellement sur le code source pour détecter des failles logiques, un travail lent, coûteux et contraint par la rareté des experts. L'intégration de modèles comme Mythos Preview supprime cette contrainte humaine. Des outils capables d'un tel raisonnement étaient inimaginables il y a quelques mois. Cette évolution profite aussi aux entreprises incapables de se permettre une réécriture complète de leur base de code C++ en Rust ou dans d'autres langages sécurisés par construction : l'IA leur offre un moyen de sécuriser du code legacy sans engager une refonte financièrement prohibitive. Si d'autres éditeurs de logiciels critiques exposés sur internet adoptent des méthodes similaires, le niveau de référence de la sécurité logicielle pourrait franchir un seuil structurel, réduisant durablement l'avantage offensif dont bénéficiaient jusqu'ici les acteurs malveillants.

UEDans un contexte réglementaire européen strict (NIS2, RGPD), l'audit de sécurité automatisé continu offre aux entreprises européennes une réponse économiquement viable à leurs obligations de conformité et réduit le risque financier lié aux violations de données.

💬 271 failles dans Firefox, en quelques semaines. Depuis des décennies, le bras de fer penchait côté attaque : trouver une faille a toujours coûté moins cher que la corriger, et les équipes sécu passaient leur temps à rendre les attaques suffisamment chères pour décourager les petits budgets, pas les gros. Si l'IA systématise la découverte du côté défenseur, ça change le calcul, et pour les boîtes avec du legacy C++ qu'elles ne peuvent pas réécrire, c'est presque une bouée de sauvetage.

SécuritéOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic