Le nouveau Claude Mythos 5.1 d’Anthropic: une révolution de l’IA en 2026 ?
Anthropic a mis en ligne le 1er septembre 2026 deux nouveaux modèles d'intelligence artificielle, Fable 5.1 et Claude Mythos 5.1, construits sur le même moteur mais dotés de garde-fous distincts. Fable 5.1 reste ouvert à tous les utilisateurs, tandis que Claude Mythos 5.1, réservé aux chercheurs certifiés, assouplit certaines restrictions pour permettre des travaux scientifiques sensibles et des missions de cyberdéfense, sous un accès très encadré. Les deux modèles disposent d'une fenêtre de contexte d'un million de jetons et peuvent générer jusqu'à 128 000 jetons en sortie, avec un mode de raisonnement qui ajuste automatiquement la profondeur de calcul selon la complexité de la tâche. Sur le plan des performances, Claude Mythos 5.1 obtient 60,9% au test Terminal-Bench 4.0, contre 55,8% pour Fable 5.1 et seulement 42% pour l'ancienne génération Fable 5. Sur Humanity's Last Exam, il atteint 60,9% sans outils externes et 65,0% avec outils de calcul connectés. Le bond est encore plus marqué sur Terminal-Bench-Science 0.1, où le score passe de 24,7% à 52,6%. En biologie computationnelle, le modèle affiche un taux de réussite proche de 50% sur douze cibles de conception moléculaire, et l'organisation Adaptyv Bio mesure des affinités dix fois supérieures sur trois d'entre elles. Anthropic met aussi en avant une nouvelle cartographie de Vénus, produite à partir des données radar Magellan de la NASA, avec une précision améliorée de 20 à 2 kilomètres.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Le Big Data. Lire l'article original →
Ces gains concernent en priorité les usages professionnels les plus exigeants. Le dispositif Enterprise Frontier Safeguards permet aux entreprises de conserver leurs données sensibles exclusivement dans leur propre infrastructure cloud, avec une politique de rétention zéro, un argument de poids pour les secteurs réglementés comme la finance. La société Millennium cite déjà un cas concret : l'outil lui a permis d'identifier la cause d'un bug système resté insoluble pendant plus de cinq ans. Pour les équipes de recherche en biologie ou en cybersécurité, la possibilité de travailler avec un modèle aux garde-fous ajustés, sous accès certifié, ouvre la voie à des usages jusque-là freinés par les politiques de sécurité standard des IA génériques, sans pour autant lever tout contrôle. Cette segmentation entre un modèle grand public et un modèle expert marque une inflexion dans la stratégie d'Anthropic, qui cherche à répondre aux critiques sur la rigidité de ses garde-fous tout en gardant la maîtrise des usages les plus sensibles.
Ce lancement s'inscrit dans la succession rapide des générations de modèles chez Anthropic, Claude Mythos 5.1 prenant la suite de Fable 5, dont les performances plafonnaient nettement en dessous des nouveaux scores. Le déploiement complet des accès certifiés à Mythos 5.1 est prévu pour l'automne 2026, ce qui laisse encore les organisations éligibles dans une phase de montée en charge progressive. La question des garde-fous différenciés selon les publics illustre un débat plus large dans l'industrie de l'IA : comment concilier ouverture à la recherche de pointe, notamment en biologie moléculaire où les risques de double usage sont réels, et sécurité face à des usages malveillants potentiels. Le rapprochement avec la cyberdéfense, domaine où les capacités de raisonnement autonome deviennent stratégiques, place également Anthropic en concurrence directe avec les autres grands laboratoires d'IA sur les marchés gouvernementaux et de sécurité nationale. Les prochains mois diront si cette approche à deux vitesses, un modèle universel et un modèle sous accès restreint, devient un standard pour l'ensemble du secteur.
Pas d'impact direct sur la France/UE