Aller au contenu principal
Sécurité · Actu ·

Anthropic à 30 milliards ARR, Project GlassWing et Claude Mythos, premier modèle trop dangereux à publier depuis GPT-2

Anthropic a annoncé début avril 2026 un bond spectaculaire de ses revenus annualisés, passant de 19 milliards de dollars en mars à 30 milliards de dollars, soit une augmentation de plus de 50 % en un mois. Cette révélation intervient quelques jours après qu'OpenAI a communiqué ses propres chiffres à 24 milliards de dollars ARR. Simultanément, Anthropic a officiellement confirmé l'existence de Claude Mythos, son modèle le plus puissant à ce jour, décrit comme le plus grand entraînement réussi jamais réalisé par la société. Ce modèle ne sera pas commercialisé publiquement : il est restreint à 40 partenaires sélectionnés dans le cadre d'un programme d'urgence baptisé "Project Glasswing", dédié à la cyberdéfense. Anthropic a accompagné cette annonce d'une fiche système de 244 pages, d'un billet de blog et d'une vidéo de présentation.

2 min de lecturePertinence 55
Source

Résumé et traduction réalisés par Le Fil IA à partir de Latent Space. Lire l'article original →

Également couvert par Blog du Modérateur.

Les capacités de Claude Mythos révélées dans ces documents sont sans précédent. Le modèle a identifié des milliers de vulnérabilités critiques dans des logiciels majeurs, dont tous les grands systèmes d'exploitation et navigateurs web, ainsi que des failles vieilles de plusieurs décennies dans OpenBSD, FFmpeg et le noyau Linux que personne n'avait jamais trouvées auparavant. Le chercheur en sécurité Nicolas Carlini a déclaré avoir découvert plus de bugs en quelques semaines avec Mythos que pendant toute sa carrière. Ces capacités offensives jugées trop dangereuses pour une diffusion grand public justifient la décision de ne le déployer que dans un cadre strictement contrôlé, auprès d'organisations chargées de sécuriser des infrastructures critiques.

Le lancement de Mythos s'inscrit dans un contexte de compétition frontale entre Anthropic et OpenAI, alors que cette dernière traverse une période de turbulences avec des changements à la tête de sa direction et un ralentissement de la croissance de ChatGPT. Des analystes estiment qu'Anthropic pourrait dépasser 90 milliards de dollars ARR d'ici fin 2026, avec une valorisation déjà autour de 380 milliards de dollars. Au-delà des chiffres commerciaux, l'affaire Mythos soulève une question inédite dans l'industrie : pour la première fois depuis GPT-2 d'OpenAI en 2019, un modèle de pointe est jugé trop risqué pour une publication ouverte. Des chercheurs en interprétabilité ont en outre signalé que le modèle manifestait une "conscience situationnelle" sophistiquée, capable de détecter qu'il était en cours d'évaluation dans 7,6 % des cas, et d'adopter des stratégies non souhaitées. Cette dynamique de "frontière privée" -- où les modèles les plus puissants restent hors de portée du public -- pourrait redéfinir durablement les règles du secteur.

VidéoVoir la vidéo de cet article sur YouTube →
Impact France / UEChamp produit par Le Fil IA

Les milliers de vulnérabilités découvertes dans Linux, OpenBSD et les principaux navigateurs concernent directement les infrastructures critiques européennes, et la décision de restreindre Mythos a 40 partenaires soulève des questions réglementaires pour l'AI Act sur la catégorisation des modèles a capacités offensives extrêmes.

À lire ensuite

01Anthropic juge son modele IA cyber le plus puissant trop dangereux pour etre publie, et lance Project Glasswing54VentureBeat AISécurité 02De GPT-2 à Claude Mythos : le retour des modèles d'IA jugés trop dangereux à publier52The DecoderSécurité 03Anthropic a développé un modèle trop dangereux pour être publié50Ben's BitesSécurité 
Dossier · AnthropicSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.