Aller au contenu principal

Claude Fable 5· sujet

274 articlesmis à jour le 15 juin 2026

Claude Fable 5, le modèle grand public le plus puissant d'Anthropic (tier Mythos-class), suspendu le 12 juin 2026 sur directive de contrôle export américaine : faits, précédent et conséquences pour la souveraineté IA.

Hub d'actualité sur Claude Fable 5, agrégé en continu depuis 72 sources éditoriales. Pour les analyses long-form, voir /analyses.

Claude Fable 5 est le modèle qu'Anthropic a lancé le 9 juin 2026, puis vu débrancher trois jours plus tard. Présenté comme son modèle grand public le plus puissant, il partage le moteur du tier « Mythos-class », qu'Anthropic situe au-dessus de sa classe Opus, mais avec des garde-fous qui basculent vers Opus 4.8 sur les sujets sensibles (cybersécurité offensive, biologie, chimie). Le 12 juin à 17h21, une directive du Bureau of Industry and Security (BIS), le bureau de l'industrie et de la sécurité, a imposé d'en suspendre l'accès pour tout ressortissant étranger. Incapable de filtrer ses utilisateurs par nationalité en temps réel, Anthropic a coupé Fable 5 et Mythos 5 pour l'ensemble de ses clients, partout.

Ce qui fait de cet épisode un précédent, ce n'est pas la dispute entre une entreprise et un État. C'est la nature de la mesure : pour la première fois, un contrôle export ne vise ni une puce ni des poids de modèle, mais l'accès en temps réel à un modèle en service. Désormais, la frontière passe par l'appel d'API.

Comment lire ce hub

Si vous suivez l'actualité au quotidien, c'est votre flux par défaut sur Fable 5 : toutes les publications agrégées de nos sources éditoriales. Si vous arrivez par une recherche, la chronologie remet les épisodes-clés en ordre, les essentiels couvrent les angles lancement, suspension, précédent et parité GPT-5.5, et la FAQ tranche les questions courantes.

Hub d'actualité, pas analyse éditoriale

Ce hub agrège et oriente. La lecture verticale (le précédent du kill-switch souverain, les conséquences pour la souveraineté européenne) se déploie dans nos analyses.

Pourquoi Claude Fable 5 compte

Fable 5 compte moins pour ses performances que pour ce que sa suspension révèle.

D'abord, un précédent juridique. Le mécanisme du « deemed export », pensé pour empêcher de remettre un plan sensible à un ingénieur étranger, est ici appliqué à l'accès à un service vivant. Le contrôle export passe des objets (les puces) aux capacités servies à distance. C'est une bascule de nature, pas de degré.

Ensuite, une démonstration de dépendance. Une organisation européenne qui avait bâti un produit sur Fable 5 a perdu son accès sans préavis, sans même avoir été la cible de la décision. L'accès à l'IA frontière s'est révélé une capacité sous juridiction, révocable à distance par l'État qui contrôle le fournisseur.

Enfin, un débat ouvert sur le motif. La version officielle est la sécurité nationale (un contournement possible du modèle, un soupçon d'accès étranger). Des lectures alternatives circulent, liées au litige entre Anthropic et l'administration ou à des signalements de concurrents, mais elles restent plausibles et non démontrées. À la mi-juin, près de 150 responsables de la cybersécurité, menés par Alex Stamos, ont demandé la levée des restrictions, estimant que ces capacités ne sont pas propres à Anthropic et que la mesure affaiblit les défenseurs.

Chronologie

  1. 9 juin 2026Anthropic lance Claude Fable 5 (grand public) et Mythos 5 (accès restreint), tier Mythos-class au-dessus d'Opus
  2. 11 juin 2026Benchmarks contrastés : GPT-5.5 devance Fable 5 sur Agents' Last Exam, Fable 5 devance GPT-5.5 sur FrontierMath
  3. 12 juin 2026, 17h21 ETDirective du bureau de l'industrie et de la sécurité (BIS), signée Howard Lutnick : suspension de l'accès pour tout ressortissant étranger
  4. 12-13 juin 2026Anthropic désactive Fable 5 et Mythos 5 pour tous ses clients ; Opus 4.8, Sonnet et Haiku restent accessibles
  5. 13 juin 2026Vague de réactions politiques françaises et européennes, la souveraineté IA revient au premier plan
  6. 14 juin 2026Plusieurs médias rapportent le rôle d'un avertissement d'Amazon dans la décision
  7. 14 juin 2026Lettre ouverte de responsables cyber (menés par Alex Stamos), bientôt près de 150 signataires, demandant la levée des restrictions

Cinq articles essentiels

Sélection éditoriale. Ces cinq pièces couvrent les angles les plus utiles pour comprendre Claude Fable 5 en 2026.

  1. Le point de départ : ce qu'est Fable 5, le modèle grand public le plus puissant d'Anthropic, et ce qu'il promet.

  2. L'événement : le gouvernement américain contraint Anthropic à désactiver Fable 5 et Mythos 5 dans le monde entier.

  3. Le cadrage du précédent : la Fable, le Mythos et la raison d'État, quand le contrôle export atteint l'accès à une IA.

  4. La conséquence : les contrôles export d'Anthropic déclenchent une course mondiale à la souveraineté en IA.

  5. Le contexte capacité : GPT-5.5 devance Fable 5 sur un benchmark agentique, à l'appui de l'argument du modèle non unique.

  6. Le réflexe entreprise : ce que les organisations devraient faire face à la coupure d'accès.

Analyses long-form sur Claude Fable 5

Quand un sujet mérite un format long, c'est ici.

Questions fréquentes

Qu'est-ce que Claude Fable 5 ?

Fable 5 est le modèle grand public le plus puissant d'Anthropic, lancé le 9 juin 2026. Il partage le moteur du tier Mythos-class, situé au-dessus de la classe Opus, avec des garde-fous qui basculent vers Opus 4.8 sur les sujets sensibles.

Pourquoi Claude Fable 5 est-il indisponible ?

Le 12 juin 2026, le gouvernement américain a ordonné, au titre du contrôle export, de suspendre l'accès à Fable 5 et Mythos 5 pour tout ressortissant étranger. Incapable de filtrer ses utilisateurs par nationalité en temps réel, Anthropic a désactivé les deux modèles pour tous ses clients.

Quelle est la différence entre Fable 5 et Mythos 5 ?

Les deux partagent le même modèle sous-jacent. Fable 5 est la version grand public avec garde-fous ; Mythos 5 a certains garde-fous levés et n'était ouvert qu'à des organisations approuvées.

Les autres modèles Claude sont-ils touchés ?

Non. Opus 4.8, Sonnet et Haiku restent accessibles. Seuls Fable 5 et Mythos 5 sont concernés par la suspension.

Qu'est-ce qu'un deemed export ?

Dans le droit export américain, donner accès à une technologie contrôlée à une personne étrangère équivaut à l'exporter vers son pays, même sur le sol américain. La directive du 12 juin applique cette logique, pour la première fois, à l'accès en temps réel à un modèle en service.

Toute l'actualité Claude Fable 5

Flux automatique. Articles classés par pertinence, agrégés en continu.

1Latent Space LLMsActu

OpenAI réinitialise plusieurs fois les quotas après un lancement mouvementé de GPT-5.6

OpenAI a déployé cette semaine sa nouvelle famille de modèles GPT-5.6, remplaçant l'ancien sélecteur unique par une architecture à trois niveaux baptisés Luna, Terra et Sol, chacun décliné en plusieurs niveaux d'effort de calcul. Résultat pour les utilisateurs de l'API : jusqu'à 36 variantes différentes du modèle, même si la plupart des usages courants peuvent se limiter à trois configurations de base. Selon des ingénieurs d'OpenAI, le mode Max fait passer un seul modèle plus de temps sur un problème complexe, tandis que le mode Ultra répartit le travail entre plusieurs sous-agents en parallèle ; les réglages d'effort de la version 5.5 ne sont d'ailleurs pas directement comparables à ceux de la 5.6. Le lancement s'est toutefois révélé plus chaotique que prévu : la nouvelle séparation entre ChatGPT Work et Codex a dérouté de nombreux utilisateurs, rendant l'accès aux conversations et projets plus difficile, avec une consommation de quota bien plus rapide qu'anticipé. Face aux critiques, OpenAI a réinitialisé plusieurs fois les limites d'usage et reconnu publiquement que les réglages par défaut poussaient vers des configurations trop coûteuses, promettant de restaurer une navigation plus familière. Cette refonte a des conséquences concrètes pour les développeurs et les entreprises qui budgétisent leurs usages d'IA. Les premiers résultats de benchmarks montrent un GPT-5.6 particulièrement performant en codage agentique, en présentation et sur certaines tâches scientifiques : il obtient par exemple la première place ex aequo sur Code Arena Frontend, à un coût environ deux fois inférieur à Claude Fable 5, ainsi qu'un bond d'environ 500 points sur l'indice de présentation AA-Briefcase par rapport à GPT-5.5. Mais le modèle n'est pas dominant partout, avec des problèmes signalés de suivi d'instructions, d'efficacité inégale en tokens et des inquiétudes sur sa vulnérabilité au jailbreak. Un point opérationnel préoccupant a également émergé : les sous-agents générés automatiquement héritent des réglages premium du modèle parent, ce qui peut vider un quota beaucoup plus vite que prévu, sans que l'utilisateur puisse choisir le modèle ou le niveau d'effort de ces agents. Au-delà des chiffres, ce lancement illustre un tournant stratégique chez OpenAI : la version Sol s'illustre surtout comme planificateur et orchestrateur capable de mobiliser des sous-agents pour des tâches complexes, notamment dans l'automatisation d'interfaces graphiques ou des logiciels comme Blender. OpenAI mise sur ChatGPT Work pour amener ces capacités d'agents jusqu'aux usages mobiles grand public. Cette évolution s'inscrit dans une tendance plus large du secteur où la qualité brute du modèle compte de moins en moins face à la sophistication du système d'orchestration qui l'entoure, un terrain où la concurrence avec Anthropic et d'autres acteurs va continuer de s'intensifier dans les prochains mois.

1 source
2Latent Space 

GPT-5.6 Sol/Terra/Luna d'OpenAI arrive, Codex devient une superapp ChatGPT

OpenAI a dévoilé le 9 juillet 2026 une nouvelle famille de modèles baptisée GPT-5.6, déclinée en trois tailles : Sol, Terra et Luna, du nom du Soleil, de la Terre et de la Lune. L'entreprise introduit aussi un nouveau niveau d'effort de raisonnement appelé "ultra", qui coordonne par défaut quatre agents en parallèle pour accélérer la résolution de tâches complexes, en plus du niveau "max" déjà existant qui laisse au modèle plus de temps que le niveau "xhigh" pour explorer des solutions et vérifier son travail. Selon OpenAI, Terra se situe juste au-dessus de Claude Fable 5 et Luna dépasse Claude Opus 4.8, tout en tournant environ trois fois plus vite, avec deux fois moins de tokens de sortie et un coût quatre fois inférieur. Les nouveaux modèles établissent aussi des records sur les benchmarks Terminal-Bench 2.1 et DeepSWE, qui évaluent respectivement les tâches en ligne de commande et l'ingénierie logicielle sur le long terme. Sol atteint un score inédit de 53,6 sur l'évaluation Agents' Last Exam, devançant Claude Fable 5 adaptive de 13,1 points. Côté tarifs, l'accès via l'API coûte 5 et 30 dollars par million de tokens en entrée et sortie pour Sol, 2,5 et 15 dollars pour Terra, 1 et 6 dollars pour Luna, avec pour la première fois une tarification pour l'écriture en cache et une réduction de 90% conservée pour la lecture en cache. Les abonnés Plus, Pro, Business et Enterprise de ChatGPT accèdent à Sol dès le niveau d'effort moyen, tandis que Pro et Enterprise peuvent choisir GPT-5.6 Pro pour les tâches les plus exigeantes. Ce lancement s'accompagne d'un remaniement de toute la gamme de produits d'OpenAI. L'entreprise a introduit ChatGPT Work, une nouvelle application de bureau fusionnant Codex et ChatGPT, une version bêta de Sites, l'appel programmatique d'outils, ainsi qu'une fonctionnalité multi-agents en bêta dans l'API Responses. Pour le PDG Sam Altman, GPT-5.6 est "sans doute le meilleur modèle que nous ayons jamais produit", et Sol représente selon lui "une avancée majeure en matière de coût par tâche" pour les entreprises. Le président Greg Brockman a de son côté résumé l'objectif de la maison comme la recherche du "meilleur prix pour chaque niveau de performance visé", combiné à un plafond de capacité toujours plus élevé. Ces gains d'efficacité comptent particulièrement pour les entreprises qui déploient l'IA à grande échelle sur des tâches d'agents, de codage ou de génération de documents, où le rapport coût-performance détermine directement la rentabilité des projets. La fusion de Codex et ChatGPT dans une seule application confirme aussi une stratégie de "superapp" évoquée par les observateurs dès avril, dernière étape avant que la question du navigateur agentique ne soit tranchée. Cette annonce intervient après une prévisualisation de GPT-5.6 quelques semaines plus tôt, dans l'attente d'une validation réglementaire mentionnée par OpenAI. Elle survient aussi le même jour que le lancement, par les Meta Superintelligence Labs, du modèle Muse Spark 1.1, jugé étonnamment compétitif et intégré pour la première fois à l'API Meta Model, un signe de confiance de Meta envers ses propres modèles. La compétition entre laboratoires d'IA générative s'intensifie ainsi sur deux fronts simultanés : la performance brute sur des benchmarks d'agents et de programmation, et l'efficacité économique par tâche accomplie, un critère de plus en plus déterminant pour les entreprises clientes. OpenAI mise sur cette structure à trois modèles pour couvrir tout le spectre des besoins, de l'usage ponctuel à très haute exigence avec Sol jusqu'au traitement massif et rapide avec Luna, en passant par Terra comme compromis intermédiaire. Les mois à venir devraient montrer si ces gains de performance et de coût se traduisent en adoption réelle chez les développeurs et les entreprises, et si Anthropic ou Google répondent avec leurs propres annonces face à cette offensive tarifaire et technique d'OpenAI.

💬 Le vrai chiffre à retenir, c'est pas le score sur Agents' Last Exam, c'est le coût quatre fois inférieur pour une vitesse trois fois supérieure. Pour les boîtes qui font tourner des agents à grande échelle, c'est ce ratio-là qui décide si le projet est rentable, pas la médaille du benchmark du mois. Et la fusion de Codex dans ChatGPT confirme ce que tout le monde sentait venir depuis avril : OpenAI construit sa superapp avant que la guerre du navigateur agentique n'éclate pour de bon.

LLMsActu
1 source
3MarkTechPost 

OpenAI lance GPT-5.6 (Sol, Terra, Luna), une famille de trois modèles avec appel d'outils programmatique dans l'API Responses

OpenAI a fait passer sa famille GPT-5.6 en disponibilité générale après une période de test limitée, avec trois modèles distincts plutôt qu'un seul. Sol est le modèle phare, Terra la version équilibrée pour un usage quotidien, et Luna la variante la plus économique. Les prix par million de tokens s'échelonnent de 1 dollar en entrée et 6 dollars en sortie pour Luna, à 2,50 et 15 dollars pour Terra, jusqu'à 5 et 30 dollars pour Sol. L'accès varie selon les plateformes : dans ChatGPT, les abonnés Plus, Pro, Business et Enterprise obtiennent Sol en effort moyen ou supérieur, les comptes Pro et Enterprise pouvant aussi choisir une version Sol Pro. Sur Codex et ChatGPT Work, les utilisateurs gratuits accèdent à Terra tandis que les payants choisissent librement entre les trois modèles. Les trois tiers sont également disponibles via l'API, qui introduit une fonctionnalité baptisée Programmatic Tool Calling permettant au modèle d'exécuter du code JavaScript qu'il a lui-même écrit, dans un environnement V8 isolé sans accès réseau. La mise en cache des prompts évolue aussi, avec une durée de vie minimale de 30 minutes, une facturation des écritures en cache à 1,25 fois le tarif standard, et une remise de 90% conservée pour les lectures. Sur le plan des performances, Sol s'impose avec un score de 80 sur l'indice de codage agentique d'Artificial Analysis, soit 2,8 points de plus que Claude Fable 5, tout en consommant moins de la moitié des tokens de sortie et du temps nécessaires. En activant un mode appelé ultra, qui fait tourner quatre agents en parallèle, Sol grimpe à 91,9% sur Terminal-Bench 2.1, contre 88,8% en configuration standard. Le modèle atteint aussi 92,2% sur BrowseComp et dépasse Claude Opus 4.8 sur OSWorld 2.0 avec 85% de tokens en moins. Ces gains concrets touchent directement les développeurs et les équipes qui automatisent des tâches complexes via des agents, en réduisant coûts et temps d'exécution. Mais Sol accuse un retard net sur SWE-Bench Pro, où il plafonne à 64,6% contre 80,3% pour Claude Mythos 5, un écart de quinze points sur un benchmark de codage très suivi. Claude Fable 5 garde aussi l'avantage sur l'indice d'intelligence générale d'Artificial Analysis et sur l'usage d'outils via Toolathlon. Cette sortie s'inscrit dans une compétition serrée entre OpenAI, Anthropic et Google autour des agents autonomes capables de mener des tâches professionnelles longues et complexes, mesurées notamment par le test Agents' Last Exam couvrant 55 métiers, où Sol revendique un score de 53,6, largement devant Fable 5. La stratégie de tarification par paliers et la diversification des surfaces d'accès traduisent une volonté de capter aussi bien les usages grand public que les déploiements d'agents en entreprise, un terrain où la bataille des benchmarks continue de s'intensifier.

LLMsActu
1 source
4The Decoder 

GPT-5.6 Sol égale presque Fable 5 sur les benchmarks agrégés, pour un tiers du coût

OpenAI a présenté GPT-5.6 Sol, une nouvelle version de son modèle phare, qui obtient 59 points sur l'Artificial Analysis Intelligence Index, un indice qui agrège plusieurs benchmarks pour évaluer les capacités des grands modèles de langage. Ce score place Sol à seulement un point derrière Claude Fable 5, le modèle le plus avancé d'Anthropic, considéré jusqu'ici comme la référence du secteur. La différence la plus marquante se situe toutefois du côté du prix : chaque tâche traitée par Sol coûte 1,04 dollar, soit environ un tiers du tarif facturé par Anthropic pour Fable 5. Sur les benchmarks de codage agentique, qui évaluent la capacité d'un modèle à exécuter des tâches complexes de façon autonome, Sol devance même l'ensemble de ses concurrents, Fable 5 y compris. Pour les entreprises et les développeurs qui choisissent quel modèle intégrer dans leurs produits, cet écart de prix change la donne : obtenir des performances quasiment équivalentes à celles du modèle le plus coté du marché, pour un tiers du coût, rend Sol particulièrement attractif pour les usages à grande échelle, où la facture de l'API pèse lourd. Le secteur du codage agentique, en pleine expansion avec la multiplication des assistants capables d'écrire et d'exécuter du code sans supervision constante, est particulièrement concerné. En prenant la tête sur ces benchmarks tout en restant nettement moins cher, OpenAI met une pression tarifaire directe sur Anthropic, qui devra soit baisser ses prix, soit justifier son positionnement premium par des gains de performance plus nets. Cette annonce s'inscrit dans une compétition de plus en plus serrée entre les grands laboratoires d'IA, où les écarts de performance entre modèles concurrents se resserrent d'une génération à l'autre, tandis que la guerre des prix s'intensifie. Anthropic, OpenAI et leurs rivaux misent de plus en plus sur les capacités agentiques, jugées déterminantes pour convaincre les entreprises d'automatiser des tâches de développement logiciel. L'Artificial Analysis Intelligence Index, devenu une référence pour comparer les modèles de façon indépendante, illustre à quel point les positions en tête de classement peuvent désormais basculer en quelques mois. Reste à voir comment Anthropic réagira à cette pression sur ses tarifs, et si d'autres acteurs suivront la stratégie d'OpenAI consistant à combiner performances de pointe et prix agressifs.

LLMsOpinion
1 source
Grok 4.5 est tellement moins cher que Fable 5 et GPT 5.5 que les écarts de benchmarks comptent peu
5The Decoder 

Grok 4.5 est tellement moins cher que Fable 5 et GPT 5.5 que les écarts de benchmarks comptent peu

xAI a dévoilé Grok 4.5, sa nouvelle génération de modèle entraînée sur des dizaines de milliers de GPU Nvidia GB300. Sur les benchmarks de codage, le modèle reste derrière Fable 5 et GPT-5.5 en termes de résultats bruts, mais il se distingue par son efficacité : il nécessite 4,2 fois moins de tokens qu'Opus 4.8 pour traiter une même tâche. Côté tarification, xAI affiche un prix de 2 dollars par million de tokens en entrée, très inférieur à celui de ses concurrents directs. La disponibilité du modèle en Europe est annoncée pour la mi-juillet. Cette différence de coût pourrait peser plus lourd que les écarts de performance mesurés sur les benchmarks. Pour les développeurs et les entreprises qui déploient des agents de codage à grande échelle, la facture liée aux tokens consommés peut rapidement dépasser l'importance du score obtenu sur un test isolé. Un modèle moins performant mais nettement moins gourmand en tokens et moins cher à l'usage peut donc s'avérer plus rentable en production, notamment pour des tâches répétitives ou du traitement en volume. Cela redistribue les cartes dans un marché où la course aux benchmarks ne garantit plus à elle seule l'adoption commerciale. Cette sortie s'inscrit dans la compétition intense que se livrent les grands laboratoires d'IA sur le terrain du codage, considéré comme l'un des usages les plus lucratifs des modèles de langage. xAI mise sur une infrastructure Nvidia GB300 dernier cri pour entraîner Grok 4.5, tout en cherchant à se démarquer par le rapport coût-efficacité plutôt que par la seule performance brute face à des rivaux comme Anthropic et OpenAI. L'arrivée prévue en Europe mi-juillet permettra de tester en conditions réelles si cette stratégie tarifaire agressive suffit à convaincre les entreprises européennes, dans un contexte où la question du coût d'exploitation des modèles devient centrale pour la rentabilité des produits basés sur l'IA générative.

UELa disponibilité annoncée de Grok 4.5 en Europe mi-juillet permettra aux entreprises françaises et européennes de tester ce modèle pour leurs usages de codage à grande échelle.

💬 Deux dollars le million de tokens et 4,2 fois moins de tokens consommés qu'Opus 4.8 pour la même tâche, ça pèse plus lourd que trois points d'écart sur un benchmark de code. En prod, sur des agents qui tournent en continu, c'est la facture qui tranche, pas le classement : le coût par tâche est en train de redistribuer les cartes du marché des modèles de langage. Reste à voir si xAI tient la promesse une fois le modèle dispo en Europe, mi-juillet.

LLMsOpinion
1 source
La solution d'Anthropic au coût élevé de Fable 5 : en faire un manager qui délègue à Sonnet 5
6The Decoder 

La solution d'Anthropic au coût élevé de Fable 5 : en faire un manager qui délègue à Sonnet 5

Anthropic recommande d'utiliser Claude Fable 5, son modèle le plus performant mais aussi le plus coûteux, non pas pour exécuter chaque tâche, mais comme chef d'orchestre chargé de planifier le travail confié à des modèles plus légers. Associé à Sonnet 5 dans une configuration baptisée "Advisor", ce dispositif permet d'atteindre 92 % des performances obtenues avec Fable 5 utilisé seul, pour seulement 63 % du coût total. L'information a été rapportée par le média spécialisé The Decoder, qui souligne que cette approche change la manière dont les équipes doivent penser le déploiement de leurs modèles. Cette recommandation change concrètement la donne pour les entreprises et développeurs qui construisent des agents ou des applications reposant sur l'IA générative. Plutôt que de payer le tarif premium de Fable 5 pour chaque requête, il devient possible de réserver ce modèle aux étapes de planification et de raisonnement complexe, tout en confiant l'exécution des tâches courantes à Sonnet 5, nettement moins cher. Pour les organisations qui traitent de gros volumes de requêtes, ce type d'architecture peut réduire significativement la facture d'API sans sacrifier la qualité des résultats de façon perceptible. Cette stratégie s'inscrit dans une tendance plus large du secteur : face à l'explosion des coûts de calcul liés aux modèles les plus avancés, les fournisseurs cherchent des moyens de répartir intelligemment les tâches entre plusieurs modèles selon leur complexité, une pratique parfois appelée "routing" de modèles. Pour Anthropic, promouvoir ce type d'architecture hybride répond aussi à la pression concurrentielle sur les prix de l'IA, tout en incitant les clients à rester dans son propre écosystème de modèles plutôt que de se tourner vers des solutions tierces moins chères.

LLMsOutil
1 source
Claude Fable 5 d'Anthropic domine les nouveaux benchmarks du secteur, à prix fort
7The Decoder 

Claude Fable 5 d'Anthropic domine les nouveaux benchmarks du secteur, à prix fort

Anthropic occupe la première place des six nouveaux indices sectoriels lancés par Artificial Analysis, qui évaluent les performances des modèles d'intelligence artificielle dans la finance, le droit et la médecine. Son modèle Claude Fable 5 devance tous ses concurrents sur ces nouveaux classements, mais cette suprématie a un prix élevé. Dans l'indice Strategy & Ops, une tâche unique coûte 3,48 dollars avec Fable 5, soit plus de cent fois le tarif pratiqué par DeepSeek V4 Pro, facturé à seulement 0,03 dollar pour la même opération. Or l'écart de score entre les deux modèles ne s'élève qu'à 12 points, un différentiel de performance jugé minime au regard du fossé tarifaire. Cette disparité relance le débat sur la rentabilité des modèles les plus puissants du marché face à des alternatives nettement moins coûteuses mais presque aussi performantes. Pour les entreprises qui déploient l'IA à grande échelle, notamment dans des secteurs sensibles comme la finance ou le droit, le choix du modèle ne se limite plus à la seule qualité des résultats : le rapport coût-performance devient un critère déterminant. Un gain marginal de précision ne justifie pas toujours une facture multipliée par cent, surtout lorsque les volumes de requêtes sont importants et que les marges d'erreur restent comparables entre les deux solutions. Ces nouveaux indices d'Artificial Analysis s'inscrivent dans une tendance plus large de benchmarking spécialisé par secteur, alors que les entreprises cherchent des repères fiables pour choisir leurs modèles d'IA en fonction de cas d'usage précis plutôt que de scores génériques. La concurrence entre laboratoires occidentaux comme Anthropic et des acteurs chinois comme DeepSeek illustre la diversification croissante du marché, où la course à la performance brute cède progressivement la place à des arbitrages économiques plus fins. Reste à savoir si Anthropic ajustera sa politique tarifaire pour Fable 5 face à cette pression concurrentielle, ou si l'entreprise misera sur un positionnement premium assumé pour les usages professionnels les plus critiques.

💬 Le prix affiché par Anthropic dit tout sur sa stratégie: viser les boîtes qui ne regardent pas à la dépense tant que l'erreur coûte plus cher que le modèle. Douze points d'écart pour cent fois le prix, en droit ou en finance, DeepSeek V4 Pro gagne ce match sur le papier. Reste que sur ces métiers-là, une réponse fausse peut coûter un contrat entier, donc le vrai calcul n'est pas dans le benchmark mais dans la sinistralité de chaque boîte.

LLMsPaper
1 source
Vous avez encore quelques jours pour tester Fable 5 : Anthropic prolonge son accès
8Le Big Data 

Vous avez encore quelques jours pour tester Fable 5 : Anthropic prolonge son accès

Anthropic a annoncé le 7 juillet 2026 la prolongation de l'accès promotionnel à Fable 5, son nouveau modèle Claude, initialement prévu pour s'achever ce même jour. La nouvelle échéance est fixée au 12 juillet 2026 à 23h59 (heure du Pacifique). Cette extension concerne les abonnés Pro, Max, Team et une partie des détenteurs de licences Entreprise Premium, qui peuvent tester le modèle sans frais supplémentaires dans la limite de leur forfait habituel. Les licences Entreprise Standard restent exclues du dispositif, sauf si l'organisation a explicitement activé des crédits d'utilisation. Pendant cette période, Fable 5 peut consommer jusqu'à 50% du quota hebdomadaire inclus dans l'abonnement de l'utilisateur. Le modèle est accessible sur le Web, l'application mobile, Claude Desktop, Claude Cowork, Claude Code, ainsi que dans Claude Design, Microsoft 365, Claude pour les équipes et Claude Tag, simplement en le sélectionnant dans le menu des modèles disponibles, sans activation particulière requise. Cette prolongation vise avant tout à laisser davantage de temps aux utilisateurs pour découvrir les capacités de Fable 5 avant son basculement vers un modèle entièrement payant. Pour les professionnels et développeurs qui exploitent Claude au quotidien, notamment via Claude Code où la version 2.1.170 ou une version plus récente est requise, ce délai supplémentaire permet de tester le modèle sur des cas d'usage réels sans engager de dépenses additionnelles. La disponibilité désormais confirmée sur mobile élargit aussi l'accès pour les utilisateurs en déplacement. Une fois la date du 12 juillet dépassée, Fable 5 sortira du quota hebdomadaire classique des abonnements concernés : toute utilisation continuera de nécessiter le recours aux crédits d'utilisation, facturés en supplément du forfait, ou le repli sur un autre modèle Claude déjà inclus. Cette stratégie s'inscrit dans une logique classique d'adoption progressive des nouveaux modèles d'IA générative, où l'accès gratuit ou inclus sert de levier commercial avant la monétisation complète. Anthropic teste ainsi l'appétit de sa base d'utilisateurs professionnels et entreprise pour Fable 5, tout en encadrant strictement la consommation via les quotas et les règles différenciées entre licences Entreprise Standard et Premium. L'annonce, relayée directement sur le compte X officiel de Claude, confirme aussi la volonté de l'entreprise de maintenir une communication transparente sur les conditions d'accès à mesure que ses modèles évoluent. Reste à voir si cette fenêtre supplémentaire suffira à convaincre davantage d'utilisateurs de basculer vers les crédits payants une fois l'offre promotionnelle définitivement close, ou si la question du coût freinera l'adoption à plus long terme du modèle.

LLMsActu
1 source
Le guide de terrain sur Fable
9Latent Space 

Le guide de terrain sur Fable

Thariq, connu pour sa série de blog "Field Guide to Fable", a bouleversé en une seule nuit le contenu de sa conférence prévue pile le jour du relancement de Fable, pour livrer les conseils les plus pertinents possibles avant la fin de la subvention d'abonnement, effective dès le lendemain. Diffusée le 6 juillet 2026, son intervention se décompose en quatre parties: une introduction, un segment sur le "unhobbling" de Claude, un autre sur la recherche des angles morts, puis une réflexion sur le deuil lié à la productivité en programmation et enfin un plaidoyer contre les compromis. Au même moment, Tencent a publié Hunyuan Hy3, un modèle ouvert sous licence Apache 2.0: une architecture MoE de 295 milliards de paramètres dont 21 milliards actifs, 192 experts avec routage top-8, de l'attention GQA, un contexte de 256 000 tokens et une couche MTP de 3,8 milliards de paramètres pour le décodage spéculatif. La newsletter AI News, qui a analysé 12 subreddits et 544 comptes Twitter sur la période du 4 au 6 juillet, a largement couvert ces deux actualités alors que la sortie de GPT-5.6 Sol Ultra reste attendue par l'ensemble du secteur. L'enjeu pour les développeurs est de comprendre que les limites d'un modèle viennent souvent moins de ses capacités réelles que du cadre d'usage qu'on lui impose: prompts et contraintes doivent être révisés à chaque nouvelle génération pour éviter de brider artificiellement le modèle, un phénomène que Thariq illustre par l'efficacité redoutée du HTML brut face à Claude. Pour Hy3, l'impact est immédiat et concret: le support natif dans vLLM était disponible dès le lancement, avec parseurs d'outils et de raisonnement, décodage spéculatif MTP, et compatibilité validée sur GPU Nvidia et AMD. Tencent a même intégré ses noyaux de production dans vLLM, avec des gains allant jusqu'à 2,95 fois en débit sur les séquences de longueur mixte, et des réductions de latence de 24% sur le temps avant premier token et 17% sur le temps par token. Cet engouement a poussé Teknium à rendre Hy3 gratuit pendant deux semaines sur Nous Portal. Ces annonces s'inscrivent dans une compétition de plus en plus vive entre laboratoires open source, Hy3 étant immédiatement comparé à GLM-5.2, certains estimant que Tencent rejoint désormais le tout premier rang des acteurs ouverts si les résultats de benchmarks se confirment, tandis que d'autres continuent de préférer GLM-5.2 en usage réel. Le contexte plus large reste marqué par une accélération générale, entre les nouveaux modèles de General Intuition et de Shunyu Yao, et l'attente de GPT-5.6 Sol Ultra, dans un secteur où AI News, désormais intégrée à Latent Space, continue de documenter ces mouvements semaine après semaine.

LLMsActu
1 source
Import AI 464 : Fables écrit des noyaux GPU, l'automatisation de l'IA et le calcul analogique
10Import AI 

Import AI 464 : Fables écrit des noyaux GPU, l'automatisation de l'IA et le calcul analogique

Fable, un modèle d'IA développé par Anthropic, vient d'écrire ce qu'un des mainteneurs du benchmark KernelBench-Mega qualifie de premier « véritable mégakernel » jamais soumis à ce test, et le plus rapide à ce jour. Sur un GPU RTX PRO 6000 Blackwell, le code CUDA généré par Fable atteint une accélération de 18,71 fois par rapport à une référence PyTorch optimisée, loin devant les autres tentatives : Claude Opus 4.8 avec du code Triton obtient 14,4 fois, GLM-5.2 atteint 11,14 fois et GPT-5.5 seulement 4,34 fois. Le point technique remarquable, souligné par l'analyste Elliot Arledge sur X, est que le profileur torch.profiler ne montre qu'un seul lancement de kernel coopératif par token décodé, alors que toutes les autres solutions bien classées décomposent le problème en 4 à 14 lancements séparés par token. Par ailleurs, des chercheurs du Center for AI Safety et de Scale Labs ont publié en juillet 2026 une mise à jour du Remote Labor Index, un test mesurant la capacité des IA à mener de bout en bout des projets freelance en ligne à valeur économique, dans des domaines comme la conception 3D, l'architecture, le graphisme, la vidéo, l'audio ou le développement web. Le taux de réussite des systèmes d'IA sur cet index est passé de 2,5% lors de son lancement en octobre 2025 à 16,1% en juillet 2026, avec Fable 5 en tête à 16,1%, suivi d'Opus 4.8 à 8,3% et GPT-5.5 à 6,3%. Ces deux résultats pointent vers un même phénomène : les IA progressent rapidement sur des tâches jugées jusqu'ici difficiles à automatiser de bout en bout. La capacité à concevoir des kernels performants est une brique fondamentale de la recherche en IA elle-même, ce qui signifie que des progrès sur ce front peuvent alimenter une boucle d'auto-amélioration des systèmes d'IA sur leur propre développement. Sur le plan économique, la progression du Remote Labor Index interroge directement l'avenir du travail freelance en ligne, avec des exemples concrets comme la modélisation 3D de bijoux, la création d'animations publicitaires ou la production de plans architecturaux photoréalistes. Les auteurs du Remote Labor Index notent que la frontière des capacités a plus que quadruplé en moins de huit mois, un signal de la vitesse d'avancée des agents IA économiquement viables. La question posée est celle du seuil critique : que se passera-t-il pour l'emploi en ligne lorsque ce taux de réussite atteindra 80%. De nouvelles tâches émergeront sans doute, créées par l'innovation humaine face à des IA de plus en plus compétentes, mais leur nombre suffira-t-il à compenser les emplois remplacés reste une question ouverte que ces benchmarks, comme KernelBench-Mega et le Remote Labor Index, permettront de suivre dans les mois à venir.

💬 Un seul lancement de kernel là où tout le monde en empile quatorze, ça montre que Fable ne "traduit" pas du code, il repense le problème. Le vrai signal n'est pas la perf GPU en soi, c'est que l'IA commence à optimiser les briques qui servent à construire l'IA suivante, une boucle qui s'auto-nourrit. Et pendant qu'on regarde ça, le Remote Labor Index a quadruplé en huit mois : le seuil qui va faire mal, c'est quand ce taux de réussite sur des missions freelance passera de 16% à 80%, pas avant.

LLMsPaper
1 source
L'outil open-source pxpipe cache du texte dans des PNG pour réduire jusqu'à 70% les coûts en tokens de Claude Code et Fable 5
11The Decoder 

L'outil open-source pxpipe cache du texte dans des PNG pour réduire jusqu'à 70% les coûts en tokens de Claude Code et Fable 5

Steven Chong, développeur indépendant, a mis en ligne un outil open source baptisé pxpipe qui convertit de longs prompts textuels destinés à Claude Code en fichiers PNG compacts. L'astuce repose sur un détail de la tarification d'Anthropic : les images sont facturées selon leur taille en pixels, et non selon le contenu textuel qu'elles encodent. Résultat, Chong annonce des économies de 59 à 70 pour cent sur les coûts de tokens, au prix toutefois d'une perte de précision et de vitesse dans les réponses générées. Cette découverte illustre à quel point les modèles de tarification des API d'intelligence artificielle peuvent être détournés dès qu'une faille de calcul apparaît entre différents types d'entrées, texte ou image. Pour les développeurs qui utilisent massivement des outils comme Claude Code au quotidien, la facture peut vite grimper, et une réduction de 70 pour cent des coûts représente un argument concret, surtout pour des usages intensifs ou automatisés. Mais le compromis sur la fiabilité des réponses limite l'intérêt de la méthode aux tâches où l'exactitude n'est pas critique. Cet épisode s'inscrit dans une tendance plus large de contournement des grilles tarifaires des fournisseurs de modèles de langage, où chaque nouvelle méthode de facturation, par token, par pixel ou par requête, finit par générer ses propres optimisations créatives côté utilisateurs. Anthropic, comme ses concurrents, devra probablement ajuster sa politique de prix pour combler cette faille, un exercice d'équilibriste récurrent entre simplicité de facturation et résistance aux détournements techniques.

💬 Cacher du texte dans une image pour payer moins cher, c'est malin, mais ça révèle surtout qu'Anthropic facture au pixel sans vraiment regarder ce qu'il y a dedans. Bon, sur le papier, 70% d'économie ça fait rêver, sauf que tu perds en précision, donc cette astuce, oublie-la dès que la réponse doit être fiable. Ce genre de bidouille dit une chose simple : dès qu'une API facture différemment texte et image, quelqu'un trouve la faille avant l'entreprise elle-même.

OutilsOutil
1 source
Un développeur d'Anthropic partage des conseils de prompting pour Fable 5, centrés sur ses propres angles morts
12The Decoder 

Un développeur d'Anthropic partage des conseils de prompting pour Fable 5, centrés sur ses propres angles morts

Voici le résumé en français : Thariq Shihipar, développeur chez Anthropic, a partagé une série de conseils pour tirer le meilleur parti de Fable 5, le nouveau modèle de l'entreprise, en s'appuyant sur son expérience de terrain. Sa thèse centrale renverse la perspective habituelle : selon lui, le principal frein à l'efficacité n'est plus la capacité du modèle, mais les angles morts de l'utilisateur lui-même, c'est-à-dire les connaissances implicites que le programmeur possède sans même s'en rendre compte et qu'il omet de transmettre à l'IA. Pour y remédier, Shihipar propose des méthodes concrètes, notamment des "passes de détection des angles morts" et des entretiens structurés, conçus pour aider les développeurs à identifier systématiquement ce qu'ils savent sans le formuler avant de déléguer une tâche d'implémentation à Claude. Cette approche marque un tournant dans la manière de penser l'usage professionnel des assistants de code IA. Plutôt que de chercher à améliorer le prompt par tâtonnement ou à multiplier les instructions techniques, elle invite les développeurs à interroger leur propre expertise tacite, celle qui guide intuitivement leurs décisions de conception mais reste rarement explicitée. Pour les équipes qui intègrent Claude dans leurs flux de travail quotidiens, cela signifie que la qualité des résultats dépend désormais moins des capacités brutes du modèle que de la capacité des humains à formaliser leur propre raisonnement, un enjeu de communication autant que de technique. Cette réflexion s'inscrit dans un mouvement plus large autour de l'ingénierie de prompt à mesure que les modèles gagnent en autonomie et en compétence sur des tâches complexes de programmation. À mesure que des modèles comme Fable 5 réduisent l'écart de performance brute, la valeur ajoutée se déplace vers la qualité de l'interaction humain-machine. Les praticiens chez Anthropic, en partageant ce type de retours d'expérience issus de leur propre usage interne des outils, cherchent à outiller la communauté des développeurs pour qu'elle exploite pleinement le potentiel de ces nouveaux modèles, plutôt que d'en rester à des pratiques de prompting héritées de générations d'IA moins capables.

💬 Ce qui bloque, c'est plus le modèle, c'est toi. Le vrai goulot d'étranglement avec Claude, c'est tout ce que tu sais sans le dire, ton contexte implicite que le modèle n'a jamais vu. Selon Le Fil IA, la prochaine bataille du prompting ne sera pas technique mais cognitive : apprendre à formaliser ce qu'on sait déjà.

OutilsTuto
1 source
Depuis son retour, Claude Fable 5 fait beaucoup moins rêver
13Next INpact 

Depuis son retour, Claude Fable 5 fait beaucoup moins rêver

Depuis son retour le 1ᵉʳ juillet 2026, Claude Fable 5 déçoit. Anthropic avait lancé ce modèle le 9 juin, le présentant comme le plus capable de son histoire, une version de Mythos 5 dotée de garde-fous supplémentaires. Trois jours plus tard, une directive de contrôle des exportations signée par la Maison-Blanche a contraint Anthropic à suspendre l'accès à Fable 5 et Mythos 5 pour tout ressortissant étranger, y compris ses propres employés non-américains, entraînant un arrêt mondial faute de pouvoir filtrer les utilisateurs par nationalité en temps réel. Le déclencheur : un rapport de chercheurs d'Amazon selon lequel Fable 5 pouvait être manipulé pour livrer des informations exploitables dans des cyberattaques, sur fond de soupçons qu'un groupe lié à la Chine ait pu accéder à Mythos et le rétro-ingénierer. Fin juin, le Department of Commerce a levé ces restrictions, et Fable 5 a retrouvé Claude Platform, Claude.ai, Claude Code et Claude Cowork le 1ᵉʳ juillet, tandis que Mythos 5 reste réservé aux partenaires vérifiés du programme Glasswing, comme Mozilla. Ce retour, après environ trois semaines d'interruption, s'accompagne d'une chute de performances qui inquiète les utilisateurs professionnels. Avant le blocage, Fable 5 affichait des scores impressionnants : 80,3 % sur SWE-Bench Pro contre 69,2 % pour Opus 4.8, et 64,5 % sur Humanity's Last Exam avec outils contre 57,9 % pour Opus 4.8 et 52,2 % pour GPT-5.5, des résultats relevés notamment par Datacamp. Every allait plus loin en le qualifiant de meilleur modèle de programmation du marché, avec 91 points sur 100 à son benchmark maison « Senior Engineer », contre 63 pour Opus 4.8 et 62 pour GPT-5.5, un constat partagé par BenchLM. Or depuis le 1ᵉʳ juillet, selon des données publiées le 2 juillet par la plateforme BridgeMind et relayées par Tech Times, les scores de débogage TypeScript de Fable 5 se sont effondrés de 70 %. Pour les développeurs qui avaient adopté le modèle pour ses capacités de programmation, cette dégradation change concrètement l'expérience d'usage et la confiance accordée à l'outil. L'explication ne tiendrait pas à une baisse réelle des capacités du modèle, mais à un nouveau classificateur de cybersécurité introduit avec le retour de Fable 5, qui redirige silencieusement une partie des requêtes de programmation vers Opus 4.8, sans en informer systématiquement les utilisateurs. Cet épisode illustre la tension entre impératifs de sécurité nationale et compétitivité commerciale : pendant les trois semaines de coupure et cette phase de restrictions renforcées, l'usage des modèles chinois a progressé rapidement, un contexte qui pourrait peser sur la position d'Anthropic face à une concurrence internationale de plus en plus pressante.

💬 La chute de perf de Fable 5, c'est pas le modèle qui a baissé, c'est un classificateur de sécurité qui redirige en douce une partie du trafic vers Opus 4.8 sans le dire aux utilisateurs. Sur le papier t'as toujours le meilleur codeur du marché, dans les faits tu causes parfois à un autre modèle sans le savoir. Et pendant les trois semaines de coupure, les modèles chinois ont grignoté du terrain, ça devrait inquiéter Anthropic bien plus qu'un benchmark TypeScript en berne.

LLMsOpinion
1 source
Claude Fable 5 indisponible plusieurs semaines : deux tiers des entreprises ont déjà un plan de secours
14VentureBeat AI 

Claude Fable 5 indisponible plusieurs semaines : deux tiers des entreprises ont déjà un plan de secours

Deux tiers des entreprises avaient déjà couvert leurs paris sur l'IA avant même la panne de Claude Fable 5, selon une nouvelle étude de VentureBeat Pulse Research menée auprès de 145 entreprises en juin 2026. Le 12 juin, un ordre de contrôle des exportations américain a mis hors ligne Claude Fable 5, le modèle le plus performant du marché, pour tous les clients, sans préavis ni calendrier de retour. Anthropic, incapable de vérifier la nationalité des utilisateurs en temps réel, a dû suspendre l'accès pour tout le monde. Le modèle est revenu cette semaine avec des garde-fous renforcés, mais entre-temps la société chinoise Z.ai avait profité du vide en publiant son modèle à poids ouverts GLM-5.2, suivi mercredi d'un environnement de codage agentique appelé Zcode. OpenAI a de son côté dévoilé un aperçu de sa gamme GPT-5.6 le 26 juin. L'étude révèle que 51% des entreprises combinent déjà modèles propriétaires fermés et modèles open-weight déployés sur leur propre infrastructure, et que 16% supplémentaires retirent carrément leurs flux de travail critiques des API fermées. Un tiers seulement misait tout sur les écosystèmes fermés au moment de la coupure. Cette panne a mis en lumière un problème plus profond que la simple dépendance à un fournisseur: le manque criant de supervision. Seulement une entreprise sur dix dispose d'une surveillance automatisée capable de détecter une dérive, un dysfonctionnement ou une panne d'un modèle d'IA en production. Environ un quart des entreprises ne découvriraient un problème qu'après un signalement par les utilisateurs, ou n'ont tout simplement aucune visibilité pour le détecter. Plus préoccupant encore, 79% des organisations ont déjà subi un impact financier ou opérationnel réel lié à des agents autonomes, le plus souvent via du "shadow AI": des employés lançant des agents non autorisés sur leurs propres cartes de crédit professionnelles, en dehors de tout contrôle. Les chercheurs baptisent cet écart entre l'agressivité du déploiement de l'IA et la capacité réelle à la superviser le "Control Gap", un fossé que la panne de juin a transformé en test de résistance grandeur nature. Ce épisode s'inscrit dans un printemps déjà marqué par la découverte du coût réel de la dépendance à l'IA. Uber avait épuisé tout son budget IA 2026 en quatre mois seulement, après que l'adoption de Claude Code a atteint 84% de ses quelque 5 000 ingénieurs, selon Forbes. Microsoft a de son côté annulé la majorité des licences internes Claude Code dans ses divisions Windows et Microsoft 365, réorientant ses équipes vers ses propres outils, rapporte The Verge. Fable 5 avait pourtant été lancé le 9 juin sous les acclamations, malgré un tarif élevé de 10 dollars par million de tokens en entrée et 50 dollars en sortie. La leçon de juin est plus dure: le modèle dont dépendent vos flux de travail peut disparaître du jour au lendemain, sur simple décision gouvernementale, sans que ni vous ni votre fournisseur n'y soyez pour quelque chose, pendant que des acteurs chinois comme DeepSeek continuent de proposer des modèles puissants et perturbateurs.

UELes entreprises françaises et européennes dépendant de l'API Claude via des flux de travail critiques sont exposées au même risque de coupure soudaine et doivent renforcer leur supervision et leurs plans de secours.

💬 Cette panne, c'est le crash test qu'on attendait sans le savoir. Selon Le Fil IA, le modèle le plus performant du marché peut disparaître du jour au lendemain sur simple décision d'un gouvernement, sans que toi ni ton fournisseur n'y puissiez quoi que ce soit. Deux tiers des boîtes avaient déjà un plan B, tant mieux, mais 79% qui se prennent des dégâts via du shadow AI que personne ne surveille, ça veut dire qu'on déploie l'IA en entreprise plus vite qu'on ne sait la contrôler.

BusinessActu
1 source
Anthropic dit avoir réduit de 80 % le prompt système de Claude Code, car Fable 5 préfère un prompt plus léger
15The Decoder 

Anthropic dit avoir réduit de 80 % le prompt système de Claude Code, car Fable 5 préfère un prompt plus léger

Anthropic a réduit de 80 % le prompt système de son outil Claude Code, son agent de codage en ligne de commande. L'annonce vient de Tariq Shihipar, ingénieur chez Anthropic, qui explique que les nouveaux modèles de la famille Fable 5 nécessitent beaucoup moins d'instructions et d'exemples que leurs prédécesseurs pour bien fonctionner. Selon lui, les consignes détaillées et les exemples multiples, qui servaient auparavant à cadrer le comportement des modèles, peuvent désormais freiner leurs performances plutôt que les améliorer. Les modèles Fable 5 seraient en effet plus créatifs et plus autonomes que les versions précédentes, rendant superflue une bonne partie des règles rigides accumulées dans le prompt système au fil du temps. Cette réduction change concrètement la manière dont Anthropic conçoit ses outils basés sur l'IA. Plutôt que d'imposer un cadre strict via des listes d'instructions, l'entreprise privilégie désormais un pilotage par le contexte, en laissant le modèle interpréter davantage la situation par lui-même. Pour les développeurs qui utilisent Claude Code au quotidien, cela pourrait se traduire par des réponses plus fluides et moins mécaniques, le modèle s'appuyant sur sa propre capacité de raisonnement plutôt que sur des règles prédéfinies. C'est aussi un signal pour l'ensemble de l'industrie : la course à l'ingénierie de prompts toujours plus longue et détaillée pourrait s'inverser à mesure que les modèles gagnent en autonomie. Cette évolution s'inscrit dans une tendance plus large observée avec les modèles de dernière génération, capables de mieux généraliser sans nécessiter d'instructions exhaustives. Les prompts système démesurés, devenus courants pour contraindre le comportement des premiers grands modèles de langage, posaient des problèmes de maintenance et pouvaient parfois entrer en conflit avec les capacités réelles des modèles. En misant sur des consignes plus légères, Anthropic parie sur une meilleure adéquation entre la puissance des modèles Fable 5 et la simplicité des outils qui les exploitent, une approche que d'autres acteurs du secteur pourraient être tentés de suivre.

💬 Le vrai signal, c'est pas la baisse de 80 %, c'est ce qu'elle dit sur la maturité des modèles : plus t'as besoin de béquilles dans le prompt système, plus le modèle raisonne tout seul. Ça fait des années qu'on empile des règles et des exemples pour corriger les modèles, et là Anthropic dit l'inverse : ça les bride. Reste à voir si les devs qui ont bâti leurs outils sur des prompts ultra-cadrés vont devoir tout réécrire, parce que cette course au prompt engineering XXL, elle est peut-être déjà finie.

OutilsOutil
1 source
Fable is back
16Ben's Bites 

Fable is back

Fable 5 est de nouveau accessible à tous les utilisateurs payants de Claude, quelques semaines après avoir été retiré. Anthropic évoque, dans un billet de blog, des garde-fous renforcés pour cette nouvelle version, même si l'auteur de la newsletter Ben's Bites affirme n'en avoir rencontré aucun pour l'instant. Le modèle reste toutefois disponible uniquement jusqu'au 7 juillet dans les formules d'abonnement, avec un quota d'usage limité à 50% du volume habituel. Un benchmark cité dans l'article affirme que Fable peut mener à bien 16% des tâches de travail à distance testées, soit le double d'Opus 4.8. Juste avant ce retour, Anthropic avait aussi lancé Claude Sonnet 5, dont les performances sur les tâches d'agents se rapprochent d'Opus 4.8 tout en coûtant moins cher au token. Il devient le modèle par défaut pour les offres gratuite et Pro, disponible dans Claude Code et via l'API, avec un tarif de lancement de 2 dollars par million de tokens en entrée et 10 dollars en sortie, valable jusqu'au 31 août. Côté Google, deux nouveaux modèles multimédias, Nano Banana 2 Lite et Gemini Omni Flash, sont désormais accessibles dans l'application Gemini et via l'API: le premier génère des images en moins de quatre secondes, à raison d'environ trente images en résolution 1K pour un dollar, tandis que le second permet de créer et modifier des vidéos pour 0,10 dollar la seconde. Par ailleurs, Bridgewater et Thinking Machines ont entraîné un modèle spécialisé atteignant 84,7% de précision sur des tâches de tri financier, pour un coût 13,8 fois inférieur au meilleur modèle généraliste testé. Enfin, Factory a affiné deux détecteurs dans son outil Droid Shield 2.0, capables de repérer des secrets exposés dans les sessions de code tout en réduisant les fausses alertes. Cette avalanche d'annonces illustre à quel point la course entre laboratoires d'IA se joue désormais autant sur le coût et l'usage pratique que sur les scores bruts de benchmarks. Si Sonnet 5 affiche de bons résultats sur le papier, plusieurs utilisateurs, dont l'auteur de la newsletter, le jugent en pratique cher et lent, ce qui relativise l'intérêt de l'adopter par rapport à d'autres modèles. À l'inverse, l'exemple du modèle spécialisé de Bridgewater et Thinking Machines montre qu'un entraînement ciblé sur une tâche précise, comme le tri de dossiers financiers, peut surpasser un modèle généraliste frontière pour une fraction du coût, une piste que de plus en plus d'entreprises explorent pour maîtriser leurs dépenses en IA. Les nouveaux outils de génération d'images et de vidéos à bas coût de Google, eux, abaissent la barrière d'entrée pour les créateurs de contenu, tandis que le renforcement de la détection de secrets exposés chez Factory répond à une préoccupation croissante à mesure que les agents de code gèrent une part grandissante du travail des développeurs. Ce mouvement s'inscrit dans une tendance plus large vers des agents capables d'agir de façon autonome, à condition de disposer du bon contexte et des bons outils. L'auteur illustre cela avec un exemple personnel: en vacances en Grèce, il a demandé à Codex de lui réserver un taxi pour rentrer de l'aéroport, et la tâche a été bouclée en un peu plus d'une minute et demie, l'agent ayant consulté son calendrier Google pour retrouver son vol, puis ses e-mails pour identifier son adresse et la compagnie de taxi utilisée à l'aller, avant de remplir le formulaire de réservation et de régler le trajet via un navigateur resté connecté. Cet exemple, bien que modeste, résume selon lui la logique qui sous-tend la plupart des usages efficaces des agents aujourd'hui: leur fournir la mémoire, les outils et le contexte nécessaires pour qu'ils puissent agir sans supervision constante, un principe qui devrait continuer à structurer le développement des futurs modèles et produits, qu'ils viennent d'Anthropic, de Google ou d'autres laboratoires concurrents.

💬 Le retour de Fable version bridée (50% de quota, embarqué jusqu'au 7 juillet) sent plus le patch de com' que la vraie sortie assumée. Ce qui m'intéresse plus, c'est Bridgewater et Thinking Machines: un modèle entraîné juste pour trier des dossiers financiers qui bat le généraliste frontière pour presque 14 fois moins cher. Selon Le Fil IA, la course à l'IA ne se gagne plus sur les benchmarks mais sur le prix au token, et les modèles spécialisés vont grignoter des pans entiers de marché aux généralistes.

LLMsActu
1 source
Anthropic relance Claude Fable 5 avec des garde-fous de sécurité renforcés
17Latent Space 

Anthropic relance Claude Fable 5 avec des garde-fous de sécurité renforcés

Anthropic a relancé Claude Fable 5 le 1er juillet 2026, après une journée d'indisponibilité qui avait provoqué une forte demande contenue chez les utilisateurs. L'entreprise a précisé que certaines requêtes, notamment liées à la cybersécurité, pourraient désormais être redirigées vers Opus 4.8 en raison de nouveaux garde-fous, et que les classificateurs de sécurité biologie/chimie restent pour l'instant trop larges dans leur détection. Les limites de débit (rate limits) ont été réinitialisées pour tous les utilisateurs une fois le modèle de nouveau disponible. L'écosystème d'outils a immédiatement intégré ce retour : Cursor indique que Fable 5 domine ses évaluations internes mais reste le modèle le plus coûteux par tâche, Devin l'a déployé sur ses versions Cloud, Desktop et CLI, et Perplexity l'a rétabli comme modèle d'orchestration. Sur le plan des benchmarks, Fable 5 obtient 16,10% sur le Remote Labor Index selon les données relayées par kimmonismus, tandis qu'Artificial Analysis situe Sonnet 5 en deuxième position sur AA-Briefcase, avec toutefois davantage de tours d'échange et un rapport coût-performance moins favorable aux niveaux d'effort les plus bas. Le fait marquant n'est pas tant le retour du modèle que la manière dont les développeurs s'adaptent aux contraintes des modèles de pointe. Plusieurs d'entre eux, dont l'utilisateur Theo, décrivent désormais une architecture multi-modèles plutôt qu'une dépendance à un seul système : Fable 5 est réservé au raisonnement et à la planification de haut niveau, tandis que l'implémentation, la vérification et les tâches d'usage d'ordinateur sont déléguées à d'autres modèles, ce qui améliorerait sensiblement le taux de succès des pull requests de bout en bout. Omar Sar et Mikhail Parakhin partagent une analyse proche : plutôt que de construire un pré-classificateur de tâches simples pour router les requêtes, mieux vaut concevoir directement des stratégies combinant plusieurs modèles, car un routage fiable exige souvent d'avoir déjà résolu la tâche elle-même. Cette évolution reflète une maturation du marché des agents de code, où la robustesse prime désormais sur la dépendance à un fournisseur unique. En parallèle, le laboratoire chinois Z.ai a lancé ZCode, un environnement de développement officiel dédié à son modèle ouvert GLM-5.2, avec prise en charge du BYOK (bring your own key), disponibilité multiplateforme et un quota de requêtes renforcé pour les abonnés à son offre de codage. LangChain a publié des guides d'intégration de GLM-5.2 dans des flux de code, et son fondateur Harrison Chase note que des développeurs en font déjà leur modèle quotidien. Sur le benchmark APEX-SWE, GLM-5.2 devient le premier modèle ouvert à dominer une catégorie, avec 55,3% de réussite au premier essai sur les tâches d'intégration, Kimi K2.7 le suivant de près ; des voix comme scaling01 tempèrent néanmoins l'idée que les modèles ouverts auraient dépassé les modèles occidentaux, tout en reconnaissant un écart de performance en code qui se réduit rapidement. Côté infrastructure, vLLM a intégré le décodage spéculatif DSpark pour les modèles DeepSeek, atteignant environ 250 tokens par seconde sur huit GPU B300, et des accélérations comparables ont été rapportées pour GLM-5.2 et Qwen3-32B, signe que la course à l'inférence rapide s'intensifie autant que celle des capacités.

💬 Le retour de Fable 5, je m'en fiche un peu, ce qui compte c'est ce que la panne a révélé : plus personne de sérieux ne mise tout sur un seul modèle. Fable 5 pour réfléchir, un autre pour coder, un troisième pour vérifier, c'est déjà la norme chez les devs qui livrent en prod, et ça fait grimper le taux de succès des pull requests. Le fantasme du routage automatique intelligent, lui, en prend un coup : comme le dit Omar Sar, pour router une tâche il faut déjà l'avoir résolue soi-même.

LLMsActu
1 source
Anthropic redéploie Claude Fable 5 après la levée des contrôles à l'exportation, ajoute un classificateur cybersécurité
18MarkTechPost 

Anthropic redéploie Claude Fable 5 après la levée des contrôles à l'exportation, ajoute un classificateur cybersécurité

Anthropic a redéployé Claude Fable 5, son modèle le plus performant en accès général, le mercredi 1er juillet, après la levée des contrôles à l'export imposés par le gouvernement américain. Ces restrictions, entrées en vigueur le 12 juin, visaient Fable 5 et son homologue Claude Mythos 5, deux modèles construits sur la même base mais dotés de garde-fous différents, Mythos 5 étant partiellement ouvert aux partenaires de cybersécurité défensive. Une directive gouvernementale limitant leur usage aux personnes non étrangères, qu'Anthropic ne pouvait vérifier en temps réel, avait poussé l'entreprise à suspendre les deux modèles pour tous les utilisateurs. L'élément déclencheur était un rapport de chercheurs d'Amazon ayant découvert une méthode de contournement des protections de Fable 5, permettant au modèle d'identifier plusieurs vulnérabilités logicielles et, dans un cas, de produire du code exploitant l'une d'elles. Le 26 juin, Washington a autorisé la restauration de Mythos 5 pour certaines organisations américaines, avant une levée complète des restrictions le 30 juin. Fable 5 est de nouveau disponible mondialement sur la Claude Platform, Claude.ai, Claude Code et Claude Cowork, au tarif de 10 dollars par million de tokens en entrée et 50 dollars par million en sortie. Anthropic affirme que la faille détectée n'avait rien d'unique à Fable 5 : des modèles moins puissants comme Claude Opus 4.8, GPT-5.5 ou Kimi K2.7 identifiaient les mêmes vulnérabilités, et l'exploit spécifique a pu être reproduit par pratiquement tous les modèles testés, dont Haiku 4.5, Sonnet 4.6, Opus 4.6, Opus 4.7, GPT-5.4 et GPT-5.5. L'entreprise qualifie l'incident de cas limite ne relevant pas de capacités cyber propres au niveau Mythos, mais bien de tâches de cybersécurité défensive courantes. Pour combler la brèche, elle a entraîné un nouveau classificateur de sécurité bloquant la technique signalée dans plus de 99 % des cas ; les requêtes interceptées ne sont pas rejetées mais redirigées vers Claude Opus 4.8, avec notification de l'utilisateur. Des chercheurs du CAISI, rattaché au Département du Commerce américain, ont testé les anciennes et nouvelles protections et les jugent extrêmement solides, au prix d'un peu plus de faux positifs lors de tâches de codage ou de débogage classiques, une conséquence assumée de la marge de sécurité volontairement élargie sur Fable 5. Cet épisode a mis en lumière l'absence de norme commune pour évaluer la gravité d'un jailbreak, une technique permettant de contourner les garde-fous d'un modèle. Anthropic élabore désormais un cadre de notation avec Amazon, Microsoft, Google et d'autres partenaires de l'initiative Glasswing, fondé sur quatre critères : le gain de capacité offert par rapport aux outils existants, l'étendue des tâches offensives débloquées, la facilité à transformer la technique en arme réellement exploitable, et sa facilité de découverte par un tiers. Pour les cas jugés les plus graves selon cette grille, Anthropic prévoit de déployer des mesures d'atténuation préliminaires dès leur détection, sans attendre une correction complète.

💬 Ce qui m'intéresse ici, c'est pas la faille en elle-même, tu remarqueras que presque tous les modèles testés savaient la reproduire, pas juste Fable 5. Le vrai trou, c'est qu'il n'existe aucune grille commune pour juger de la gravité d'un jailbreak, et ça a suffi à mettre le modèle le plus puissant d'Anthropic à l'arrêt pendant trois semaines. Le classificateur colmate l'urgence, mais tant que Google, Microsoft et les autres n'auront pas la même échelle de gravité, ce genre de coupure va se reproduire.

SécuritéActu
1 source
Anthropic pousse Trump à durcir les tests de sécurité, ses modèles IA déployés mondialement
19Ars Technica AI 

Anthropic pousse Trump à durcir les tests de sécurité, ses modèles IA déployés mondialement

Les autorités américaines ont levé les restrictions à l'exportation visant les derniers modèles d'intelligence artificielle d'Anthropic, Claude Fable 5 et Claude Mythos 5, environ trois semaines après que l'administration Trump les avait désignés comme des risques pour la sécurité nationale. Anthropic a confirmé la nouvelle dans un billet de blog. Fable 5 sera désormais accessible dans le monde entier, tandis que les organisations américaines ont retrouvé l'accès à Mythos 5 depuis le 26 juin. L'entreprise précise travailler avec le gouvernement pour élargir l'accès à Mythos à un ensemble plus large de partenaires nationaux et internationaux dans le cadre du programme Glasswing, qui permet à des chercheurs en cybersécurité issus d'entreprises de confiance d'utiliser le modèle à des fins défensives. Dans une lettre adressée à Anthropic et consultée par Reuters et le New York Times, le secrétaire au Commerce Howard Lutnick a indiqué que la société n'aurait "plus besoin de licence pour les exportations ou les transferts sur le territoire" de ses modèles Claude Mythos et Claude Fable. Cette levée d'obstacle est significative pour Anthropic, dont la diffusion internationale était freinée depuis près d'un mois par une décision politique inédite dans le secteur de l'IA générative. Pour les entreprises clientes hors des États Unis, cela signifie un accès retrouvé à des modèles de pointe sans les délais et incertitudes liés à un régime de licences d'exportation. Pour les chercheurs en cybersécurité partenaires du programme Glasswing, l'élargissement annoncé ouvre la voie à un usage défensif plus large de Mythos, notamment face à des menaces informatiques sophistiquées. Le geste envoie aussi un signal aux concurrents et aux régulateurs sur la manière dont Washington entend désormais arbitrer entre compétitivité technologique et contrôle des exportations d'IA avancée. L'épisode illustre les tensions croissantes entre innovation rapide en intelligence artificielle et impératifs de sécurité nationale. Le blocage initial, décrété fin mai, reflétait les craintes de l'administration quant aux capacités potentiellement dangereuses des modèles les plus avancés, notamment en matière de cybersécurité offensive. La lettre de Howard Lutnick reconnaît qu'Anthropic a travaillé en étroite coordination avec le gouvernement pour répondre à ces préoccupations, sans détailler publiquement les mesures prises. Ce précédent pourrait désormais servir de modèle pour d'autres laboratoires d'IA confrontés à des restrictions similaires, alors que les gouvernements cherchent encore à définir un cadre réglementaire cohérent pour l'exportation de systèmes d'intelligence artificielle jugés stratégiques.

UELes entreprises europeennes retrouvent un acces sans delai aux modeles Claude Fable 5 et Mythos 5, auparavant restreints par les controles a l'exportation americains.

💬 Trois semaines de blocage puis marche arrière complète : ça en dit long sur une politique IA américaine qui se fait au coup par coup, pas sur un cadre stable. Le point qui compte, c'est que le programme Glasswing devient le modèle du genre : la sécurité nationale se négocie désormais contre un accès élargi à des partenaires triés sur le volet. Bonne nouvelle pour les boîtes européennes qui carburaient à Fable 5 ou Mythos, mais l'embargo est revenu aussi vite qu'il est parti, alors faut pas compter sur une stabilité durable.

RégulationReglementation
1 source
Anthropic relance Claude Fable 5 dans le monde après la levée des restrictions américaines à l'export
20VentureBeat AI 

Anthropic relance Claude Fable 5 dans le monde après la levée des restrictions américaines à l'export

Anthropic a restauré aujourd'hui l'accès mondial à Claude Fable 5, son modèle grand public le plus puissant, après que le département du Commerce américain a levé la veille les contrôles d'exportation d'urgence qu'il avait imposés au modèle. Cet ordre, émis le 12 juin 2026, avait contraint Anthropic à suspendre l'accès mondial à la fois à Fable 5 et à son pendant orienté cybersécurité, Claude Mythos 5, quelques jours seulement après leur lancement. Fable 5 est désormais de nouveau disponible pour les utilisateurs du monde entier sur l'ensemble de l'écosystème Anthropic, incluant la Claude Platform, Claude.ai, Claude Code et Claude Cowork. Le média VentureBeat, qui a tenté d'y accéder via Claude Code en ligne de commande juste avant la publication de son article, a toutefois constaté que l'accès restait désactivé. Pour les entreprises passant par les grands fournisseurs cloud, Anthropic affirme œuvrer à rétablir l'accès sur Amazon Web Services, Google Cloud et Microsoft Foundry « aussi vite que possible », sans que VentureBeat ait pu confirmer, à ce stade, un retour effectif sur ces plateformes. Le cas de Mythos 5 reste différent : une lettre attribuée au secrétaire au Commerce Howard Lutnick, adressée au dirigeant d'Anthropic Tom Brown et publiée sur X, indique qu'aucune licence n'est plus requise pour l'exportation, la réexportation ou le transfert national de Fable et Mythos. Mais Anthropic, dans son propre communiqué, précise que l'accès à Mythos 5 n'a été rétabli que pour « un ensemble d'organisations américaines », à la suite d'une approbation gouvernementale obtenue le 26 juin, l'entreprise disant continuer de coordonner avec les autorités l'élargissement de l'accès via son programme de test de cybersécurité sur invitation, Project Glasswing. Cette décision a un impact direct sur les directions informatiques qui évaluent le retour de ces modèles, car elle s'accompagne de conditions structurelles distinctes et d'un coût élevé : Anthropic facture Fable 5 et Mythos 5 à 10 dollars par million de tokens en entrée et 50 dollars par million en sortie, ce qui en fait les modèles de pointe les plus chers du marché mondial, très loin devant des concurrents comme DeepSeek, MiniMax, LongCat, Gemini, Qwen ou Grok, dont les tarifs varient de 0,40 à environ 4 dollars par million de tokens combinés. Mythos 5 se retrouve ainsi dans une situation intermédiaire : juridiquement dégagé du contrôle d'exportation d'urgence, mais toujours pas disponible en accès général, Anthropic ayant choisi de le maintenir derrière un modèle d'accès vérifié où le gouvernement américain continue de peser sur les approbations et les standards. Sur X, Lutnick a expliqué qu'Anthropic et l'administration avaient « travaillé en étroite collaboration » pour « analyser et approuver Fable 5 », tandis que la cheffe de cabinet de la Maison-Blanche Susie Wiles a de son côté présenté cette décision comme un enjeu de leadership américain en IA, affirmant que les États-Unis restent le « vainqueur incontesté de la course à l'IA » et que la priorité partagée est de « déployer les meilleures technologies aussi rapidement et sûrement que possible ». Ce revirement fait suite aux critiques de responsables de la cybersécurité et d'experts en politique de l'IA, qui estimaient que cet ordre risquait de fragiliser l'industrie américaine tout en ouvrant un boulevard aux laboratoires chinois. L'ancien responsable de la sécurité de Facebook, Alex Stamos, avait qualifié la restriction sur Fable 5 de « énorme erreur stratégique pour les États-Unis », avertissant que les entreprises de cybersécurité pourraient se tourner vers des modèles chinois faute d'accès fiable aux modèles américains. D'autres critiques ont pointé le caractère improvisé de cette intervention réglementaire, qui donnait l'impression que dépendre des plateformes d'IA américaines constituait désormais un risque stratégique en soi. L'épisode illustre les tensions persistantes entre les impératifs de sécurité nationale, la compétition technologique avec la Chine et la volonté de Washington de préserver l'avance commerciale de ses champions de l'IA, un équilibre que les autorités américaines devront continuer d'ajuster à mesure que ces modèles se diffusent auprès de nouveaux partenaires domestiques et internationaux.

💬 Le vrai frein pour Fable 5, c'est pas Washington, c'est la facture : à 10 dollars l'entrée et 50 la sortie par million de tokens, c'est le modèle de pointe le plus cher du marché, loin devant Gemini, Qwen ou Grok. Bon, sur le papier la levée des restrictions règle le problème de dispo, mais VentureBeat n'arrivait toujours pas à s'en servir via Claude Code au moment de publier, alors si tu comptais y rebasculer demain matin, attends encore un peu. Et Mythos 5, le modèle cybersécurité, reste coincé en accès restreint, Washington continuant de décider qui a le droit de s'en servir.

RégulationReglementation
1 source
Dans l’ombre de Mythos et Fable ressuscités, la Chine progresse rapidement
21Next INpact 

Dans l’ombre de Mythos et Fable ressuscités, la Chine progresse rapidement

Anthropic a annoncé le 30 juin le retour de Mythos 5, suivi de Fable 5 dès le 1er juillet, mettant fin à un épisode de trois semaines qui a fragilisé l'entreprise face à la concurrence chinoise des modèles à poids ouvert. Les faits remontent au 9 juin 2026, date de lancement de Claude Fable 5, version publique et encadrée de l'architecture Mythos, tandis que Mythos 5, dépourvue de ces garde-fous, restait réservée aux organisations vérifiées via le programme Glasswing. Trois jours plus tard, le 12 juin, le secrétaire au Commerce Howard Lutnick a adressé à Anthropic une directive de contrôle des exportations exigeant la suspension immédiate de l'accès aux deux modèles pour tout ressortissant étranger dans le monde, y compris les propres employés étrangers de l'entreprise. Incapable de filtrer ses utilisateurs par nationalité en temps réel, Anthropic a coupé l'accès sur Claude.ai, son API, AWS Bedrock, Google Cloud et Microsoft Foundry. Le 26 juin, Washington a autorisé un retour partiel de Mythos 5 pour une centaine d'organisations liées aux infrastructures critiques et à la cyberdéfense, laissant Fable 5 hors service jusqu'à ce 1er juillet. Cet épisode illustre la fragilité des positions commerciales face à des décisions politiques soudaines : des centaines de millions d'utilisateurs à travers le monde se sont retrouvés privés d'accès du jour au lendemain, et les entreprises clientes de l'API ou des plateformes cloud partenaires ont dû composer avec plusieurs semaines d'incertitude. Pendant ce temps, les modèles chinois à poids ouvert ont continué de progresser, profitant du retrait temporaire d'un concurrent majeur. L'image d'Anthropic sort également écornée, des rumeurs de surveillance d'utilisateurs chinois étant venues s'ajouter à la confusion entourant cette affaire. Le fond du dossier reste flou. Selon Anthropic, la lettre reçue ne détaillait pas la menace précise pour la sécurité nationale, mais l'entreprise a compris que le gouvernement avait eu vent d'une méthode permettant de contourner les protections de Fable 5, en lui demandant par exemple d'analyser une base de code donnée pour en corriger les failles. Des rumeurs, invérifiables, ont même évoqué un modèle capable de mettre à mal les défenses de la NSA. Anthropic conteste la proportionnalité de la mesure, rappelant que des tests menés avec le gouvernement américain, l'AISI britannique et des tiers n'avaient révélé aucun jailbreak universel, et que le niveau de capacité en cause était comparable à celui de GPT-5.5 d'OpenAI. L'épisode relance ainsi le débat sur l'équilibre entre sécurité nationale et compétitivité de l'industrie américaine de l'IA face à la Chine.

UELes entreprises et developpeurs europeens utilisant l'API Claude via AWS Bedrock, Google Cloud ou Microsoft Foundry ont subi plusieurs semaines de coupure d'acces a Mythos 5 et Fable 5, sans qu'aucune decision reglementaire europeenne n'en soit la cause.

💬 Ce qui frappe, c'est la vitesse à laquelle une boîte peut se retrouver à genoux à cause d'une lettre de Washington, pas d'un bug ou d'un concurrent. Anthropic a coupé l'accès à Fable 5 dans le monde entier pendant trois semaines sur simple injonction, pendant que les modèles chinois à poids ouvert avançaient tranquillement. Le vrai enseignement de cet épisode : la sécurité nationale américaine est en train de devenir un facteur de compétitivité aussi déterminant que la puissance des modèles eux-mêmes, et ça peut jouer contre les boîtes américaines autant que pour elles.

RégulationReglementation
1 source
Anthropic déploie Claude Sonnet 5, restaure Fable et Mythos
22AI News 

Anthropic déploie Claude Sonnet 5, restaure Fable et Mythos

Anthropic a officiellement levé la suspension de ses modèles les plus avancés, Fable et Mythos, et lancé Claude Sonnet 5, mettant fin à dix-huit jours de blocage imposé par une directive fédérale américaine sur le contrôle des exportations entrée en vigueur le 12 juin. La suspension avait été déclenchée après que des chercheurs d'Amazon eurent documenté une méthode permettant de contourner les garde-fous de sécurité de Fable 5, la poussant à identifier des failles logicielles et à produire du code d'exploitation. Faute de système de vérification de nationalité en temps réel, les autorités avaient exigé un blocage total de l'accès pour l'ensemble des utilisateurs dans le monde. Des évaluations menées pendant l'interruption ont montré que ce comportement n'était pas propre à Fable 5 : des architectures plus anciennes et moins puissantes, dont Claude Opus 4.8, GPT-5.5 et Kimi K2.7, reproduisaient exactement les mêmes résultats. Pour répondre à l'exigence fédérale, les ingénieurs d'Anthropic ont entraîné un nouveau classificateur de sécurité ciblant précisément la faille signalée par Amazon, avec un taux de blocage supérieur à 99 % lors des tests internes. Ce correctif ouvre la voie à un déploiement commercial complet sur la plateforme, l'infrastructure cloud et les réseaux partenaires d'Anthropic, mais il introduit un compromis pour les équipes de développement. Le nouveau classificateur, volontairement large dans sa marge de sécurité, signale plus fréquemment des requêtes bénignes lors de tâches courantes de développement ou de débogage. Lorsqu'une invite déclenche ce filtre, la charge de travail est automatiquement redirigée vers l'ancienne architecture Opus 4.8 pour assurer la continuité du service. Le vrai enjeu commercial se concentre toutefois sur Claude Sonnet 5, que de nombreuses équipes techniques adoptent pour leurs agents autonomes afin de réduire les coûts tout en conservant une forte capacité d'exécution. Sur les benchmarks SWE-bench Pro et Terminal-Bench 2.1, Sonnet 5 atteint respectivement 63,2 % et 80,4 %, contre 58,1 % et 67 % pour Sonnet 4.6, pour un prix inchangé de 3 dollars par million de tokens en entrée et 15 dollars en sortie, avec un tarif de lancement réduit à 2 et 10 dollars jusqu'au 31 août 2026. Plusieurs entreprises ont déjà déployé le modèle en production. Chez Rakuten, les équipes techniques l'ont utilisé pour traiter des dizaines de pull requests parmi les plus complexes, le système exécutant et vérifiant lui-même les tests avant validation humaine finale. Zapier l'a intégré à ses flux de travail pour automatiser des tâches administratives à plusieurs étapes, comme la mise à jour de comptes Salesforce suivie de l'envoi d'annonces de lancement à des clients entreprise, une séquence que les versions précédentes du modèle peinaient souvent à mener à terme sans intervention humaine. L'éditeur d'outils de développement Zed a de son côté utilisé le modèle pour automatiser des procédures de débogage complexes. Cet épisode illustre la pression réglementaire croissante qui pèse sur les systèmes d'intelligence artificielle les plus avancés, à mesure que leurs capacités techniques se rapprochent de zones jugées sensibles par les gouvernements.

UELe blocage mondial ayant aussi affecté les utilisateurs europeens de la plateforme Anthropic, la levée de la suspension et le déploiement de Claude Sonnet 5 profitent indirectement aux entreprises et développeurs francais et europeens, sans qu'aucune entité francaise ou europeenne ne soit directement citée.

💬 Dix-huit jours de blocage total pour une faille qui touchait en fait tous les modèles du marché, Opus comme GPT-5.5, c'est le signe que la régulation avance plus vite que les garde-fous techniques. Le classificateur bricolé en urgence, qui balance les requêtes de dev vers l'ancien Opus dès qu'il a un doute, ça reste un pansement, pas une solution. Sur le papier Sonnet 5 est solide, 63% sur SWE-bench Pro c'est du concret, mais l'épisode Amazon prouve qu'un modèle capable de trouver des failles logicielles finira toujours par attirer l'œil des régulateurs avant celui des développeurs.

Fable 5 d'Anthropic de retour dans le monde après une interdiction gouvernementale de deux semaines liée à un jailbreak
23The Decoder 

Fable 5 d'Anthropic de retour dans le monde après une interdiction gouvernementale de deux semaines liée à un jailbreak

Je vais traduire et résumer cet article selon les consignes. Anthropic a de nouveau l'autorisation de déployer son modèle Fable 5 dans le monde entier, après une interdiction de deux semaines imposée par le gouvernement américain. Cette suspension faisait suite à la découverte, par des chercheurs d'Amazon, d'une méthode de contournement des protections de sécurité du modèle, permettant de le manipuler pour obtenir des réponses normalement bloquées. Anthropic a précisé que cette faille n'était pas propre à Fable 5: des modèles bien plus petits, comme Claude Haiku 4.5, pouvaient être exploités de la même manière. L'entreprise a depuis développé un nouveau classificateur de sécurité capable de bloquer cette technique de contournement dans plus de 99% des cas. Cet épisode illustre la tension croissante entre rapidité de déploiement des modèles d'intelligence artificielle et exigences de sécurité imposées par les autorités américaines. Une interdiction gouvernementale, même temporaire, représente un signal fort pour l'industrie de l'IA: elle montre que les régulateurs sont prêts à bloquer la distribution d'un modèle dès qu'une vulnérabilité significative est identifiée, y compris pour un acteur aussi établi qu'Anthropic. Pour les utilisateurs professionnels et les entreprises clientes, cela renforce l'idée que la fiabilité des garde-fous devient un critère aussi important que les performances brutes du modèle. Le correctif d'Anthropic n'est toutefois pas sans compromis: le nouveau classificateur, en devenant plus strict, tend aussi à signaler à tort davantage de requêtes parfaitement légitimes comme suspectes. Ce compromis entre sécurité et facilité d'usage reste un défi central pour l'ensemble des laboratoires d'IA, alors que les techniques de contournement se perfectionnent et que les régulateurs, notamment aux États-Unis, surveillent de plus près la manière dont les entreprises réagissent face à ce type d'incident. L'affaire pourrait influencer la façon dont les futures failles de sécurité seront traitées et divulguées dans le secteur.

SécuritéActu
1 source
Anthropic annonce le retour de Claude Fable 5 et Mythos 5, les États-Unis ont levé l’interdiction
2401net 

Anthropic annonce le retour de Claude Fable 5 et Mythos 5, les États-Unis ont levé l’interdiction

Après trois semaines de suspension mondiale, Anthropic peut de nouveau déployer ses deux modèles les plus avancés, Claude Fable 5 et Claude Mythos 5 : le département américain du Commerce a officiellement levé les contrôles à l'exportation qui les visaient. Les deux modèles avaient été bloqués mi-juin dans un contexte de sécurité nationale, notamment autour des capacités cyber de Mythos et de la crainte d'une fuite de ces capacités vers des acteurs étrangers. La levée met fin à l'interdiction, mais Anthropic n'a pas précisé le calendrier ni les conditions exactes du retour à une disponibilité générale.

UEPendant la suspension, des organisations européennes s'étaient retrouvées privées d'accès aux modèles Anthropic les plus avancés, sans préavis ni décision européenne. La levée des contrôles restaure cet accès, mais confirme la dépendance opérationnelle de l'Europe à des décisions réglementaires prises unilatéralement à Washington.

💬 Le vrai enseignement n'est pas qu'Anthropic récupère ses modèles, c'est la facilité avec laquelle Washington les a coupés puis rouverts : trois semaines d'indisponibilité décidées, puis levées, par une simple lettre administrative. Pour quiconque construit sur ces modèles, la disponibilité d'une API n'est plus une garantie technique, c'est devenu une variable politique. Et pour l'Europe, privée d'accès sans un mot pendant la coupure, la dépendance vient de passer du théorique à l'opérationnel.

Fable 5 et Mythos 5 sont de retour : Trump lève (enfin) ses restrictions
25Le Big Data 

Fable 5 et Mythos 5 sont de retour : Trump lève (enfin) ses restrictions

Voici le résumé en français, 3 paragraphes, sans titres : Anthropic a confirmé mardi 30 juin 2026 que le département du Commerce américain avait levé les restrictions à l'exportation visant ses modèles Claude Fable 5 et Mythos 5, imposées quelques semaines plus tôt au nom de la sécurité nationale. Le rétablissement de l'accès a commencé dès le mercredi 1er juillet. Mythos 5, le modèle le plus puissant de l'entreprise, reste toutefois en accès limité : depuis vendredi, seuls quelques spécialistes américains de la cybersécurité et des infrastructures critiques pouvaient l'utiliser, et les partenaires étrangers, dont plusieurs agences gouvernementales en Europe et en Asie, en restent pour l'instant exclus. Claude Fable 5, la version grand public, redevient accessible dans le monde entier à partir de jeudi, avec un nouveau jeu de classificateurs destiné à mieux repérer et bloquer les usages liés à la cybersécurité. En attendant, c'est Opus 4.8 qui continue d'assurer certaines tâches courantes comme le codage ou le débogage, et Fable 5 conserve des limitations sur les usages sensibles touchant à la cybersécurité ainsi qu'aux risques biologiques et chimiques. Cette annonce soulage de nombreux utilisateurs et entreprises privés d'accès aux modèles les plus avancés d'Anthropic pendant plusieurs semaines, mais elle relance surtout une question laissée sans réponse claire : qu'est-ce qui a réellement changé en moins de trois semaines pour justifier la levée de restrictions présentées initialement comme motivées par des inquiétudes sérieuses de sécurité nationale ? Le risque évoqué au départ était-il exagéré, ou de nouvelles mesures de protection ont-elles réellement été mises en place entretemps ? Anthropic n'a pour l'instant fourni aucune explication détaillée, se contentant d'assurer que ses équipes continueront d'affiner leurs systèmes de détection pour réduire les faux positifs et mieux distinguer un usage normal d'une tentative d'abus. L'épisode illustre la tension croissante entre rapidité de déploiement commercial et contrôle réglementaire des capacités d'IA jugées sensibles, notamment sur les plans offensifs en cybersécurité. Cette séquence s'inscrit dans un mouvement plus large de rapprochement entre les grands laboratoires d'IA et les autorités américaines sur les questions de sécurité. Anthropic affirme travailler, aux côtés d'Amazon, Microsoft, Google et d'autres partenaires du programme Glasswing, à un cadre commun pour évaluer la gravité des techniques de jailbreak visant les modèles d'IA et déterminer la réponse appropriée à chacune. L'entreprise dit également renforcer sa collaboration avec le gouvernement américain autour des tests et des mécanismes de protection de ses modèles, un partenariat qui prévoit un accès anticipé aux futurs modèles pour évaluation, un partage d'informations sur les tentatives de jailbreak et les usages abusifs constatés, ainsi que des ressources dédiées à des travaux de recherche communs sur la sécurité de l'IA.

UELes agences gouvernementales europeennes restent pour l'instant exclues de l'acces a Mythos 5, le modele le plus avance d'Anthropic, meme si Fable 5 redevient disponible mondialement.

Sonnet 5 aujourd'hui, Fable 5 demain
26Latent Space 

Sonnet 5 aujourd'hui, Fable 5 demain

Voici l'article traduit et résumé selon le format demandé : Anthropic a lancé le 29 juin 2026 Claude Sonnet 5, son nouveau modèle de milieu de gamme par défaut, avec un déploiement immédiat sur l'application Claude, Claude Code, l'API et chez ses partenaires écosystème. L'entreprise le présente comme « son Sonnet le plus agentique à ce jour », capable de planifier des tâches, d'utiliser un navigateur ou un terminal et d'exécuter des actions de façon autonome à un niveau qui nécessitait auparavant des modèles plus volumineux et plus coûteux. Le modèle dispose d'une fenêtre de contexte d'un million de tokens et devient le choix par défaut dans Claude Code pour les utilisateurs Pro. Côté tarifs, Anthropic maintient son prix catalogue à 3 dollars par million de tokens en entrée et 15 dollars en sortie, mais propose un tarif promotionnel à 2 dollars et 10 dollars jusqu'au 31 août ou 1er septembre selon les sources. Le lancement s'accompagne de l'arrivée de Claude Desktop sur Linux, en version bêta pour Ubuntu et Debian, incluant Claude Code, Cowork et le chat pour les comptes payants, mais sans la fonctionnalité Computer Use. Anthropic a aussi mis à jour ses Managed Agents avec des flux de données par session, des dérogations par session, des événements webhook, une pagination inversée, un contrôle plus fin de l'injection d'identifiants et un nouvel onglet d'observabilité pour suivre l'usage de tokens et d'outils. Cette mise à jour repositionne Sonnet comme une alternative crédible aux modèles haut de gamme pour les tâches de codage et d'automatisation, à un tarif nettement inférieur. Pour les développeurs et les entreprises utilisant Claude Code ou l'API, cela signifie un accès à des capacités agentiques avancées, comme l'exécution autonome de tâches complexes, sans payer le prix d'un modèle premium. L'arrivée sur Linux et les nouveaux outils de supervision des agents renforcent également l'attrait de la plateforme pour les équipes techniques qui déploient des agents IA en production. Ce lancement intervient après plusieurs semaines de rumeurs intenses autour d'une sortie conjointe de Sonnet 5 et de Fable 5, un modèle plus puissant que beaucoup attendaient depuis son interdiction survenue dix-huit jours plus tôt à la suite d'un différend avec les autorités. Des indices avaient suggéré qu'Anthropic préparait pour Fable 5 un système de crédits d'usage séparé, facturé hors des abonnements existants, avec des exigences de vérification d'identité, ce qui avait fait craindre un accès restreint, notamment en Europe. Sonnet 5 est finalement arrivé seul, laissant l'absence de Fable 5 comme le véritable sujet de discussion parmi les utilisateurs, alors que son retour, annoncé après un travail avec les pouvoirs publics, reste attendu.

UELe systeme de credits envisage pour Fable 5, avec verification d'identite, faisait craindre un acces restreint pour les utilisateurs europeens, meme si Sonnet 5 reste disponible normalement en France et dans l'UE.

💬 Sonnet 5 arrive seul et c'est peut-être le signal le plus intéressant de la semaine : Anthropic sort son modèle "agentique par défaut" à un tarif cassé, mais laisse Fable 5 dans les limbes après son interdiction. Un million de tokens de contexte et des capacités d'agent qui nécessitaient hier des modèles trois fois plus chers, ça change la donne pour tous ceux qui tournent sur Claude Code au quotidien. Reste que le vrai sujet, c'est l'absence de Fable 5 : si Anthropic prépare un système de crédits séparé avec vérification d'identité pour son modèle le plus puissant, l'accès en Europe risque d'être le premier à en payer le prix.

LLMsActu
1 source
Meituan publie LongCat-2.0 en open source, modèle de codage à agents leader sur OpenRouter, entraîné sur puces chinoises
27VentureBeat AI 

Meituan publie LongCat-2.0 en open source, modèle de codage à agents leader sur OpenRouter, entraîné sur puces chinoises

Meituan, l'un des plus grands conglomérats chinois de livraison à domicile, a dévoilé ce vendredi LongCat-2.0 sur GitHub et Hugging Face, révélant au passage que ce modèle se cachait depuis deux mois sous le nom de code "Owl Alpha" en tête des classements mondiaux de développeurs sur la plateforme OpenRouter. Ce système de type Mixture-of-Experts (MoE) cumule 1 600 milliards de paramètres et offre une fenêtre contextuelle native d'un million de tokens, publié sous licence MIT permettant un usage commercial sans restriction. La tarification est particulièrement agressive : les requêtes servant des données déjà en cache sont entièrement gratuites, tandis que les entrées non cachées sont facturées 0,30 dollar par million de tokens en promotion (0,75 dollar au tarif standard) et les sorties à 1,20 dollar (contre 2,95 dollars au tarif standard), positionnant LongCat-2.0 parmi les offres les plus compétitives du marché face à des références comme GPT-5.6 ou Claude Opus 4.8, dont les tarifs combinés dépassent respectivement 35 et 30 dollars par million de tokens. Ce qui distingue ce lancement d'une simple annonce technique est son indépendance matérielle totale : LongCat-2.0 a été entraîné sur un cluster de plus de 50 000 circuits intégrés spécifiques (ASICs) fabriqués en Chine, sans recourir aux GPU Nvidia qui ont jusqu'ici dominé l'entraînement des grands modèles à l'échelle mondiale. Cette démonstration prouve qu'il est désormais possible de produire des modèles de niveau quasi-frontalier sur du silicium domestique, remettant en cause la position de Nvidia dans l'industrie et la logique des contrôles à l'exportation américains. Pour les entreprises cherchant à intégrer des capacités de codage autonome à grande échelle, l'offre représente une alternative directe aux solutions fermées d'OpenAI ou d'Anthropic, à une fraction du coût. Ce lancement s'inscrit dans un contexte de tensions géopolitiques qui accélèrent précisément la dynamique que Washington cherchait à freiner. À la demande du gouvernement américain, OpenAI a dû restreindre l'accès à ses nouveaux modèles GPT-5.6, tandis qu'Anthropic a retiré entièrement ses modèles Claude Fable 5 et Mythos 5 de l'accès international. Ces restrictions ont laissé un vide que les acteurs chinois comme DeepSeek, Xiaomi avec MiMo, MiniMax, Moonshot AI et désormais Meituan s'empressent de combler avec des modèles ouverts, performants et bon marché. Pour de nombreux experts du secteur, ces mesures défensives ont produit l'effet inverse de celui escompté : en rendant les modèles occidentaux moins accessibles et plus coûteux, elles ont créé une ouverture structurelle pour l'écosystème open-source chinois, accélérant son adoption mondiale au moment même où Washington tente de préserver son avance technologique.

UELes entreprises françaises et européennes bénéficient d'un modèle de codage open-source (licence MIT) de niveau quasi-frontalier à coût marginal, au moment même où les restrictions géopolitiques américaines réduisent l'accès international aux modèles propriétaires occidentaux.

💬 Meituan livre des repas et sort le meilleur modèle de code du moment en open source, MIT, requêtes en cache gratuites. Ça, c'est la conséquence directe des restrictions américaines : en rendant GPT et Claude moins accessibles à l'international, Washington a construit le marché pour l'open source chinois. Et le modèle a été entraîné sans un seul GPU Nvidia, donc même les prochaines sanctions auront du mal à fermer ce robinet.

LLMsOpinion
1 source
Bonne nouvelle pour votre productivité : Claude Fable 5 pourrait revenir dès cette semaine
28Presse-citron 

Bonne nouvelle pour votre productivité : Claude Fable 5 pourrait revenir dès cette semaine

Anthropic s'apprête à redéployer Claude Fable 5 pour le grand public, possiblement dès cette semaine, selon des informations en circulation dans le secteur. Le modèle Claude Mythos 5, suspendu depuis le 12 juin, a quant à lui déjà été remis en ligne, mais uniquement auprès d'un nombre restreint d'organisations, toutes américaines. Cette réactivation partielle marque une première étape dans le retour progressif de ces modèles après plusieurs semaines d'interruption. L'enjeu est significatif pour les entreprises et développeurs qui dépendent de ces modèles dans leurs workflows quotidiens. La suspension de Mythos 5 et l'absence de Fable 5 ont contraint de nombreuses équipes à se rabattre sur des alternatives moins performantes, avec un impact direct sur la productivité. Le retour de Fable 5 en accès général représenterait un déblocage important pour les utilisateurs individuels et les petites structures qui n'ont pas accès aux programmes d'accès anticipé réservés aux grandes organisations. Ce redéploiement s'inscrit dans un contexte de négociations actives entre Anthropic et le gouvernement américain. Le laboratoire d'IA discuterait de l'élargissement de l'accès à Claude Mythos 5 à davantage d'organisations, au-delà du cercle initial. Ces échanges illustrent la position particulière d'Anthropic, dont certains modèles semblent désormais soumis à un cadre de validation gouvernementale avant diffusion, une dynamique qui pourrait redéfinir la façon dont les modèles frontier sont distribués aux États-Unis et, par extension, à l'international.

UELe retour de Claude Fable 5 en accès général bénéficierait aux développeurs et entreprises européens contraints depuis plusieurs semaines d'utiliser des modèles alternatifs moins performants, bien que Claude Mythos 5 demeure pour l'instant réservé aux seules organisations américaines.

LLMsActu
1 source
Construire un workflow stable avec les traces Fable 5 dans Colab : analyse d'appels d'outils, audit et entraînement
29MarkTechPost 

Construire un workflow stable avec les traces Fable 5 dans Colab : analyse d'appels d'outils, audit et entraînement

Le jeu de données "Fable-5-traces", publié par Glint Research sur Hugging Face sous l'identifiant Glint-Research/Fable-5-traces, rassemble des traces réelles d'agents de codage fonctionnant avec le modèle Fable 5. Un tutoriel technique détaille comment construire un pipeline d'analyse complet de ces données dans Google Colab, en contournant délibérément les bibliothèques instables comme datasets, scikit-learn ou scipy. Le workflow s'appuie sur le téléchargement manuel d'un fichier JSONL unique nommé fable5cotmerged.jsonl via huggingfacehub, puis enchaîne l'inspection des fichiers de dépôt, la normalisation des appels d'outils, un audit structurel du dataset, la détection de secrets potentiels via des expressions régulières couvrant des formats comme sk-, hf, AKIA ou githubpat, et la visualisation de distributions clés comme les types de sorties, les outils appelés ou la longueur des textes produits. Ces traces constituent des données d'entraînement précieuses pour affiner des modèles de langage sur des tâches de programmation réelles. Le tutoriel montre comment en extraire des exports "safe no-CoT" au format SFT, directement exploitables pour du fine-tuning supervisé sans exposer les raisonnements intermédiaires de l'agent. Un classificateur Naive Bayes écrit en Python pur, entraîné sur ces traces, sert de baseline quantitative pour tester si le contexte d'une conversation prédit le type de sortie produit et les outils sollicités, avant d'engager des ressources de fine-tuning plus coûteuses. L'attention portée à la détection de secrets intégrés dans les traces répond à un risque documenté : les datasets publics de traces d'agents contiennent parfois des credentials réels capturés par inadvertance lors des sessions d'enregistrement. Fable 5, le dernier modèle d'Anthropic, s'inscrit dans une génération de modèles dont les traces d'utilisation commencent à circuler publiquement, aux côtés de jeux de données comme SWE-bench ou les trajectoires OpenHands. La décision de construire un pipeline autonome sans dépendances lourdes répond aux contraintes concrètes des environnements Colab, où les incompatibilités de versions ont régulièrement brisé des notebooks complexes. En proposant un workflow stable reposant sur Python standard, pandas et matplotlib, ce tutoriel abaisse la barrière d'entrée pour les chercheurs et praticiens qui souhaitent analyser le comportement des agents de codage, repérer des biais dans leurs sorties ou assembler leurs propres jeux de données d'entraînement à partir de traces existantes. La disponibilité croissante de ce type de données soulève aussi des questions sur la gouvernance de leur publication, notamment autour de la confidentialité des sessions capturées et des risques de fuite d'informations sensibles.

💬 Des traces d'agents de codage réels sur HuggingFace, analysables sans dépendances lourdes, c'est le genre de ressource qui fait progresser vite le fine-tuning maison. Mais le vrai signal dans ce tutoriel, c'est la détection de credentials : des clés API et tokens GitHub capturés par inadvertance dans les sessions d'enregistrement, qui finissent publiés dans des datasets publics sans que personne n'ait nettoyé. Les équipes qui diffusent ce genre de traces vont devoir y penser avant de déposer, parce que le problème va s'aggraver à mesure que les données d'agents circulent.

LLMsTuto
1 source
Anthropic déploie de nouveau Mythos 5, Fable 5 attend son feu vert
30Next INpact 

Anthropic déploie de nouveau Mythos 5, Fable 5 attend son feu vert

Anthropic a reçu, le vendredi 26 juin, l'autorisation du gouvernement américain de redéployer Mythos 5 auprès d'organisations états-uniennes chargées d'opérer et de défendre des infrastructures critiques. Ce modèle, jumeau de Fable 5 mais dépourvu des garde-fous liés aux domaines sensibles comme la cybersécurité, la biologie, la chimie ou la distillation de modèles IA, avait été dévoilé le 10 juin aux côtés de Fable 5. Deux jours plus tard, le 12 juin, l'administration Trump imposait leur fermeture à tous les ressortissants étrangers. Incapable de vérifier la nationalité de ses utilisateurs, Anthropic avait dû bloquer l'accès à l'ensemble de sa base. Depuis, l'accès à Mythos 5 est en cours de rétablissement pour les membres du projet Glasswing. Quant à Fable 5, le modèle grand public, il pourrait obtenir son feu vert dans le courant de la semaine prochaine, selon Axios. Howard Lutnick, secrétaire au Commerce, a confirmé dans une lettre révélée par Semafor que des « avancées significatives » avaient été réalisées lors des négociations, et qu'Anthropic s'était engagée à travailler sur des protocoles et des normes de mise à disposition. Ce déblocage partiel est un soulagement pour Anthropic, dont les modèles les plus avancés étaient indisponibles depuis plus de deux semaines pour la quasi-totalité de ses clients commerciaux et développeurs. Mythos 5, conçu spécifiquement pour les usages en cybersécurité, représente un outil stratégique pour les opérateurs d'infrastructures critiques américaines. La remise en circulation de ces modèles réduit le manque à gagner commercial et restaure en partie la crédibilité d'Anthropic face à ses concurrents, notamment OpenAI, qui a lancé simultanément GPT-5.6 sous les modèles Sol, Terra et Luna, mais lui aussi en accès limité à quelques organisations sélectionnées par le gouvernement. L'épisode illustre la tension croissante entre la Maison-Blanche et les grands laboratoires d'IA autour du contrôle des exportations de modèles avancés. L'administration Trump, soucieuse d'éviter que ces technologies ne profitent à des puissances étrangères, a imposé un processus d'autorisation gouvernementale opaque que les acteurs du secteur jugent incompatible avec leurs modèles économiques. Dès le 12 juin, Anthropic réclamait publiquement un « processus statutaire transparent, équitable, clair et fondé sur des faits techniques ». OpenAI a exprimé hier une position identique, estimant que ce type de contrôle d'accès « ne doit pas devenir la norme à long terme ». La résolution du cas Mythos 5 ne règle donc pas le fond du problème : les deux géants de l'IA veulent des règles prévisibles, alors que Washington semble préférer traiter ces autorisations au cas par cas, modèle par modèle.

UELe blocage de Mythos 5 et Fable 5 a directement privé les entreprises et développeurs européens d'accès aux modèles Anthropic pendant plus de deux semaines ; le processus d'autorisation américain au cas par cas pourrait durablement compliquer l'accès des acteurs européens aux IA de pointe.

💬 Côté européen, on a passé deux semaines sans accès aux modèles les plus avancés d'Anthropic, juste parce que l'administration américaine n'a pas jugé utile de prévenir. Le signal est net : quand la géopolitique entre dans l'équation, les garanties de disponibilité d'une API ne valent plus grand-chose. Anthropic réclame des règles transparentes depuis le 12 juin, OpenAI a fait de même hier, mais Washington semble avoir découvert là un levier qu'il ne va pas lâcher facilement.

RégulationReglementation
1 source
OpenAI dévoile GPT-5.6 en plein débat réglementaire sur l'IA aux États-Unis
31The Verge AI 

OpenAI dévoile GPT-5.6 en plein débat réglementaire sur l'IA aux États-Unis

OpenAI a dévoilé vendredi une préversion limitée de sa nouvelle suite de modèles GPT-5.6, moins de 24 heures après que les médias américains ont révélé que la startup avait accepté d'en décaler la sortie à la demande de l'administration Trump. La suite comprend trois modèles : Sol, le modèle phare ; Terra, un modèle intermédiaire conçu pour les tâches à fort volume ; et Luna, une option rapide et économique pour un usage quotidien. Tarifé à 5 dollars l'entrée et 30 dollars la sortie par million de tokens, Sol représente environ la moitié du coût du concurrent direct Claude Fable 5 d'Anthropic. GPT-5.6 est présenté comme particulièrement performant en programmation, en cybersécurité et en biologie, avec une capacité améliorée à maintenir le cap lors de tâches agentiques longues et complexes. Cette dernière caractéristique est centrale dans la course aux agents IA autonomes, où les modèles doivent enchaîner des dizaines d'étapes sans perdre le fil de l'objectif initial. La compétitivité tarifaire de Sol face aux offres haut de gamme d'Anthropic constitue un argument de poids pour les entreprises qui déploient ces modèles à grande échelle. La révélation d'une intervention gouvernementale dans le calendrier de sortie illustre les tensions croissantes entre l'industrie de l'IA et les autorités américaines, alors que Washington cherche à influencer la dynamique de développement sans pour autant réguler formellement le secteur. OpenAI, qui maintient des liens étroits avec l'administration depuis le début de l'année 2025, navigue ainsi entre impératifs commerciaux et pressions politiques dans une course technologique où chaque semaine de retard peut faire la différence face à ses rivaux.

UELa tarification compétitive de Sol (moitié du coût de Claude Fable 5) pourrait orienter les décisions des entreprises européennes déployant des modèles IA à grande échelle vers les offres OpenAI.

LLMsActu
1 source
Washington voudrait embarquer l’UE dans une alliance IA face à la Chine
32Next INpact 

Washington voudrait embarquer l’UE dans une alliance IA face à la Chine

L'administration Trump a transmis cette semaine à plusieurs États membres de l'Union européenne un projet de déclaration commune sur l'intelligence artificielle, révélé par Bloomberg. Ce document d'une seule page propose un partenariat stratégique articulé autour de trois axes : le soutien à la recherche et au développement en IA, la promotion des exportations technologiques vers des pays partenaires, et l'établissement d'une « réglementation favorable à l'innovation ». L'objectif affiché est de constituer une alliance transatlantique capable de sécuriser la chaîne d'approvisionnement en composants critiques pour les centres de données IA, dans un contexte de compétition technologique croissante avec la Chine. Le texte emploie une formulation inhabituelle pour l'administration Trump : « nous partageons l'idée que l'avenir de l'IA doit reposer sur des bases de collaboration de confiance, de sécurité économique, d'innovation et de concurrence loyale ». L'initiative arrive dans un contexte transatlantique particulièrement tendu, ce qui explique l'accueil mitigé de plusieurs capitales européennes. Depuis le retour de Donald Trump à la Maison Blanche, les relations avec l'Europe ont été marquées par des différends commerciaux, des pressions sur la régulation numérique européenne et des restrictions d'accès à des technologies américaines. La récente interdiction d'accès aux modèles Fable 5 et Mythos 5 d'Anthropic pour les ressortissants étrangers a particulièrement inquiété les Européens, illustrant la possibilité pour Washington de couper l'accès à des outils devenus stratégiques du jour au lendemain. Plusieurs États membres estiment désormais que ce partenariat pourrait servir de cheval de Troie pour promouvoir l'écosystème IA américain au détriment des acteurs européens, d'autant que le point sur la « réglementation favorable à l'innovation » résonne directement avec les attaques américaines contre le DMA et le DSA européens. Sur le terrain diplomatique, Henna Virkkunen, vice-présidente de la Commission européenne chargée de la Souveraineté technologique, s'est rendue à Washington cette semaine pour aborder directement avec l'administration Trump le blocage des derniers modèles Anthropic, évoquant notamment la nécessité pour l'Europe d'y accéder à des fins de détection de vulnérabilités logicielles. En parallèle, le Congrès américain examine le MATCH Act, un texte visant à empêcher les fabricants chinois de puces d'accéder aux équipements occidentaux de production de semi-conducteurs, une mesure qui toucherait de plein fouet ASML, le géant néerlandais de la lithographie. L'Europe se retrouve ainsi prise en étau entre la dépendance technologique vis-à-vis des États-Unis et les risques de se voir instrumentalisée dans la rivalité sino-américaine, tandis que son propre « plan d'action pour le continent IA », présenté il y a un peu plus d'un an, peine à suivre le rythme d'une industrie qui évolue bien plus vite que les législateurs.

UEL'Europe est directement exposée : blocage d'accès aux modèles Anthropic pour les ressortissants européens, risque de sanctions sur ASML via le MATCH Act américain, et pressions explicites sur le DMA et le DSA au nom d'une 'réglementation favorable à l'innovation'.

💬 Rejoindre une alliance IA avec quelqu'un qui peut te couper l'accès aux outils stratégiques du jour au lendemain, c'est pas une alliance, c'est une dépendance avec un beau nom. La clause "réglementation favorable à l'innovation" dans le texte dit tout : c'est mot pour mot la formule qu'on retrouve dans les attaques américaines contre le DMA et le DSA. Bruxelles a bien raison d'hésiter.

RégulationReglementation
1 source
OpenAI : les tokens de sortie de Codex multipliés par 13 à 56 selon les services depuis novembre 2025
33Latent Space 

OpenAI : les tokens de sortie de Codex multipliés par 13 à 56 selon les services depuis novembre 2025

Les données internes d'OpenAI révèlent une accélération spectaculaire de l'utilisation de Codex au sein même de l'entreprise depuis novembre 2025. En six mois, la consommation de tokens de sortie a explosé dans tous les départements : les équipes de recherche ont multiplié leur usage par 56, le support client par 32, l'ingénierie par 27, et les équipes juridiques par 13. Ce que ces chiffres rendent visible est contre-intuitif : jusqu'en août 2025, un employé OpenAI moyen consacrait moins de 10 % de ses tokens à Codex, l'outil d'assistance au code. Autrement dit, même les salariés de la principale entreprise d'IA au monde, disposant d'un accès illimité à ces outils, sous-utilisaient massivement l'IA jusqu'à très récemment. Ce constat a une valeur de signal fort pour l'ensemble du secteur. Il suggère que l'adoption réelle de l'IA en entreprise suit une courbe beaucoup plus lente que les annonces marketing ne le laissent entendre, mais que le déverrouillage, une fois enclenché, peut être brutal. La croissance par 56 dans la recherche pointe vers un changement de nature du travail intellectuel : il ne s'agit plus d'utiliser l'IA pour des tâches ponctuelles, mais de lui déléguer des processus entiers. Pour les dirigeants qui mesurent encore leur adoption à la marge, ces données internes d'OpenAI constituent à la fois un avertissement et une référence chiffrée. Ce basculement s'inscrit dans un moment de turbulence compétitive intense. Alors qu'OpenAI documente sa propre adoption, d'autres acteurs bousculent le classement des modèles ouverts : GLM-5.2 de Z.ai a atteint 1 595 points sur Code Arena Frontend, devançant Claude Opus 4.8 et se rapprochant de Claude Fable 5, tout en atteignant 392 tokens par seconde sur les serveurs de Databricks grâce au décodage spéculatif et des optimisations de noyaux. Dans le même temps, Google a intégré le contrôle d'ordinateur directement dans Gemini 3.5 Flash, navigateur, bureau et mobile, avec des mécanismes de confirmation humaine pour les actions sensibles. La startup Sail, qui vient de lever 80 millions de dollars, parie sur des agents à longue durée de vie capables de travailler sur plusieurs jours ou semaines à moindre coût, revendiquant dix fois plus d'intelligence par dollar pour les tâches non urgentes. Ces développements convergent vers une même réalité : l'IA glisse du prototype vers l'infrastructure opérationnelle, et les courbes d'adoption interne d'OpenAI en offrent la première mesure chiffrée rendue publique.

UELes entreprises et dirigeants européens peuvent utiliser ces données internes chiffrées d'OpenAI comme référence pour calibrer et accélérer leur propre stratégie d'adoption de l'IA générative en entreprise.

BusinessOpinion
1 source
Fable 5 : un indice découvert dans le code de Claude relance l’espoir d’un retour
34Le Big Data 

Fable 5 : un indice découvert dans le code de Claude relance l’espoir d’un retour

Le 24 juin 2026, un utilisateur de X connu sous le pseudonyme @synthwavedd a mis au jour plusieurs chaînes de texte inédites enfouies dans le binaire de Claude Code v2.1.190. Ces fragments de code évoquent explicitement un quota hebdomadaire dédié à Fable 5, le dernier modèle phare d'Anthropic, ainsi que la possibilité pour les utilisateurs de continuer à l'utiliser via des crédits après avoir atteint cette limite. Plus significatif encore : l'ancienne mention d'un achat séparé de l'abonnement semble avoir disparu de la base de code. En parallèle, Fable 5 est réapparu dans le catalogue d'Amazon Bedrock avec une fiche toujours active, et le magazine Wired rapporte que les négociations entre Anthropic et l'administration américaine ont récemment évolué, Tom Brown, cofondateur de la société, ayant pris la main sur les discussions en lieu et place du PDG Dario Amodei. Ces indices prennent tout leur sens au regard de la situation actuelle. Depuis le 12 juin 2026, Fable 5 est inaccessible aux utilisateurs américains et internationaux, bloqué par une directive gouvernementale de l'administration Trump quelques jours seulement après son lancement, en même temps que Mythos. Anthropic conteste cette décision, estimant que les failles identifiées ne justifiaient pas un retrait total du modèle. Si les messages découverts dans le code ne constituent pas une preuve formelle de retour, ils décrivent une logique de distribution qui ne peut fonctionner que si le modèle redevient accessible. Les ingénieurs n'intègrent généralement pas ce type de mécanique dans une version de production sans raison opérationnelle concrète, ce qui confère à ces découvertes un poids que de simples rumeurs n'auraient pas. L'affaire Fable 5 illustre un phénomène inédit dans l'histoire de l'intelligence artificielle : un gouvernement bloquant l'accès à un modèle commercial développé par une entreprise de son propre territoire, dans un contexte de tensions croissantes autour de la sécurité des systèmes d'IA. Anthropic se retrouve ainsi coincé entre ses obligations réglementaires et la pression commerciale d'un marché mondial qui attendait Fable 5 comme un bond qualitatif majeur. La délégation des négociations à Tom Brown, figure moins exposée que Dario Amodei, suggère une stratégie d'apaisement plutôt que de confrontation. Si un accord venait à être trouvé, le retour du modèle s'accompagnerait vraisemblablement de nouvelles conditions d'accès, possiblement plus restrictives, dont la logique de quota hebdomadaire découverte dans le code pourrait être le premier signe.

UELe blocage de Fable 5 a privé les développeurs et entreprises européens d'accès à ce modèle ; un éventuel retour, potentiellement assorti d'un système de quotas restrictifs, concernerait directement les intégrateurs IA et startups françaises et européennes qui attendaient ce modèle pour leurs pipelines de production.

💬 Les ingénieurs ne codent pas des mécaniques de quota pour un modèle qu'ils n'ont pas l'intention de ressortir. Ce que @synthwavedd a trouvé dans le binaire de Claude Code, c'est pas une rumeur, c'est une spéc technique qui implique un plan de retour actif, et ça change tout. La vraie question maintenant, c'est à quelles conditions.

Comment Shopify a construit un stack IA indifférent à la survie des modèles
35VentureBeat AI 

Comment Shopify a construit un stack IA indifférent à la survie des modèles

Shopify a développé un proxy LLM maison qui connecte l'ensemble de ses ingénieurs à plusieurs fournisseurs d'IA en parallèle, avec basculement automatique en cas de panne ou de disparition d'un modèle. Quand Claude Fable 5 a été retiré du marché, aucun ingénieur de l'entreprise n'a été interrompu dans son travail : le système les a redirigés automatiquement vers Claude Opus ou GPT 5.5. Farhan Thawar, directeur de l'ingénierie chez Shopify, a détaillé cette architecture dans le podcast VentureBeat Beyond the Pilot. L'entreprise achète des tokens en volume auprès de plusieurs fournisseurs, et tous les utilisateurs passent par ce proxy unique qui centralise les rapports d'utilisation et gère la redondance. En cas d'indisponibilité d'un fournisseur, le transfert vers un autre est décrit comme "automatique et transparent". La plateforme interne Tangle permet à chacun de visualiser les pipelines d'IA en temps réel, et un tableau de bord de consommation suit les dépenses token par utilisateur, par discipline et par type de modèle. Ce choix architectural donne à Shopify une indépendance réelle vis-à-vis des fournisseurs, là où la plupart des entreprises restent exposées aux mises à jour non concertées ou aux arrêts de modèles. La stratégie de distillation pousse l'avantage plus loin encore : un modèle "enseignant" (par exemple Opus 4.8) transfère ses capacités vers un modèle "élève" plus petit et spécialisé (par exemple Qwen 3.5) en une journée de pipeline. Le résultat est évalué automatiquement sur la vitesse, le coût et la précision pour une tâche précise. Dans certains cas, les gains atteignent un facteur 2 en coût et en latence ; dans des cas extrêmes, jusqu'à 30 fois moins cher et plus rapide. Ces modèles distillés alimentent notamment Sidekick, l'assistant IA phare de Shopify destiné aux marchands, conçu pour automatiser les tâches répétitives du quotidien. Les ingénieurs peuvent déployer directement sans processus d'approbation, ce qui accélère considérablement les cycles d'itération. La démarche s'inscrit dans un contexte où le marché des modèles évolue à une vitesse difficile à anticiper : des modèles apparaissent, sont mis à jour silencieusement ou disparaissent en quelques mois. Shopify tire les conséquences pratiques de cette instabilité en construisant une infrastructure qui ne parie pas sur un seul acteur. Thawar évoque aussi une vision plus ambitieuse : à terme, le pipeline de distillation choisirait lui-même le meilleur modèle cible en fonction des données et des évaluations fournies, sans que l'ingénieur ait à le spécifier. "Peut-être que ça donnera un modèle si petit qu'il pourrait tourner sur un téléphone", dit-il. Des garde-fous existent également côté consommation : si un modèle tourne depuis plus de dix heures en accumulant des tokens, l'utilisateur reçoit une alerte lui demandant si la dépense est intentionnelle, une manière de concilier autonomie des équipes et maîtrise des coûts.

UELes équipes d'ingénierie européennes déployant des LLMs en production peuvent s'inspirer directement de cette architecture multi-fournisseurs pour réduire leur exposition aux changements non concertés de modèles et optimiser leurs coûts par distillation.

InfrastructureOpinion
1 source
Sans Claude Fable 5 : Sakana atteint les performances de pointe avec son système multi-modèles Fugu
36VentureBeat AI 

Sans Claude Fable 5 : Sakana atteint les performances de pointe avec son système multi-modèles Fugu

Sakana AI a lancé Fugu, un système d'orchestration multi-agents accessible via une API compatible OpenAI, conçu pour égaler les performances des modèles d'IA les plus avancés sans dépendre d'un fournisseur unique. Fondée par David Ha, ancien directeur de recherche chez Google Brain, la startup propose deux déclinaisons : Fugu, optimisé pour les tâches courantes à faible latence et intégrable directement dans des environnements de développement comme Codex, et Fugu Ultra, destiné aux travaux complexes tels que la recherche en IA, l'analyse en cybersécurité ou les investigations de brevets, facturé 5 dollars le million de tokens en entrée et 30 dollars en sortie. Le système fonctionne comme un chef d'orchestre : face à une requête, il la décompose en sous-tâches, les délègue à un ensemble de modèles spécialisés, vérifie leurs résultats, puis synthétise la réponse finale. Fugu est lui-même un LLM entraîné à appeler d'autres LLMs, y compris des instances de lui-même de façon récursive, selon les équipes de Sakana. Le lancement intervient dans un contexte précis : le 12 juin 2026, Anthropic a révoqué l'accès public à ses deux modèles les plus puissants, Claude Mythos 5 et Claude Fable 5, sous la pression d'un décret américain de contrôle des exportations. Pour Ha, cet événement illustre un risque systémique majeur pour les entreprises et les gouvernements qui s'appuient sur un seul fournisseur d'IA. "L'accès aux meilleurs modèles peut disparaître du jour au lendemain", a-t-il écrit sur X. Fugu répond à ce problème en s'appuyant sur un pool de modèles entièrement interchangeable, dont la composition exacte reste propriétaire, rendant le système résilient face aux restrictions géopolitiques ou commerciales soudaines. Ce projet s'inscrit dans une tendance plus large qui fait de l'orchestration intelligente de modèles la prochaine frontière de l'IA, au-delà de la seule course à la taille des paramètres. Fugu repose sur deux travaux de recherche publiés par Sakana en 2026, TRINITY et Conductor, qui formalisent des stratégies de coordination apprises plutôt que des workflows codés à la main. En affichant des performances comparables ou supérieures à Fable et Mythos sur des benchmarks d'agents tiers, Sakana cherche à convaincre entreprises et États que la résilience collective vaut mieux que la dépendance à un modèle monolithique. Dans un contexte géopolitique de plus en plus fragmenté, la startup, désormais clairement tournée vers le marché entreprise, pourrait s'imposer comme un acteur clé de l'infrastructure IA critique mondiale.

UELes entreprises et institutions européennes exposées aux restrictions d'exportation américaines sur les modèles IA disposent avec Fugu d'une alternative d'orchestration multi-modèles résiliente, réduisant leur dépendance à un fournisseur unique.

💬 La révocation de l'accès à Fable et Mythos sur décret américain le 12 juin dernier, c'est le genre d'événement qui transforme un argument de vente en argument de survie. Ne jamais dépendre d'un seul fournisseur d'IA pour des usages critiques, c'est désormais moins une recommandation qu'une évidence industrielle. Fugu arrive exactement au bon moment, reste à voir si les perfs en prod tiennent la promesse des benchmarks.

OutilsOpinion
1 source
☕️ Cybersécurité : les Five Eyes sonnent l’alerte sur les modèles IA les plus avancés
37Next INpact 

☕️ Cybersécurité : les Five Eyes sonnent l’alerte sur les modèles IA les plus avancés

Les agences de renseignement des cinq pays membres de l'alliance Five Eyes, États-Unis, Canada, Royaume-Uni, Australie et Nouvelle-Zélande, ont publié en juin 2026 une déclaration commune sur les risques posés par les modèles d'intelligence artificielle de frontière. Rompant avec leur discrétion habituelle, elles avertissent que les modèles les plus avancés devraient « transformer en profondeur les capacités offensives comme défensives dans le cyberespace » dans un horizon « de quelques mois, et non de plusieurs années ». Ces systèmes représentent désormais, selon elles, « un risque stratégique pour les entreprises et une responsabilité directe des dirigeants », appelant à une mobilisation de l'ensemble de la société plutôt qu'à une réponse purement technique. La déclaration intervient quelques jours après qu'Anthropic a dû couper l'accès à ses deux modèles les plus puissants, Fable 5 et Mythos 5, à l'ensemble de ses clients internationaux, après que Washington leur a interdit d'en autoriser l'usage à tout ressortissant étranger. L'alerte illustre un changement de nature du risque cyber : l'IA ne se contente plus d'automatiser des attaques existantes, elle abaisse le seuil d'entrée pour des acteurs malveillants peu qualifiés tout en augmentant la sophistication et la vitesse des offensives. Les capacités de Mythos en matière de détection de failles de sécurité ont déjà été démontrées concrètement via le projet Glasswing, notamment chez Firefox, ce qui donne une mesure tangible du potentiel de ces outils. Si ces mêmes capacités peuvent être exploitées à des fins défensives, leur disponibilité, ou leur indisponibilité, devient un enjeu géopolitique direct. Les restrictions imposées par les États-Unis à Anthropic signalent que Washington traite désormais ses modèles de frontière comme une ressource stratégique au même titre que les semi-conducteurs ou les technologies d'armement. Ce communiqué des Five Eyes s'inscrit dans un contexte où Anthropic multiplie depuis plusieurs mois les déclarations sur le potentiel disruptif de ses modèles, un discours qui mêle avertissement sincère et argument commercial. Il révèle aussi une tension au sein même de l'alliance occidentale : les États-Unis ont pris leurs décisions de restriction de manière unilatérale, sans concertation apparente avec leurs alliés les plus proches. La déclaration collective pourrait signaler une inflexion, un désir des partenaires de reprendre leur place dans une gouvernance coordonnée de ces technologies. Il reste à voir si Washington répondra à cet appel ou continuera de gérer seul l'accès à ses champions de l'IA, au risque de creuser des fractures au sein d'une alliance qui repose précisément sur la confiance et le partage du renseignement.

UELes entreprises et institutions françaises et européennes utilisant les modèles de frontière d'Anthropic en ont perdu l'accès suite à une décision unilatérale de Washington, exposant leur dépendance stratégique aux modèles IA américains et la nécessité de s'engager dans la gouvernance de ces technologies au sein de l'alliance occidentale.

💬 Les Five Eyes qui publient un communiqué commun sur l'IA, c'est rare. Moi ce qui m'interpelle, c'est pas le risque cyber en soi : c'est que Washington a décidé seul de couper l'accès à Fable et Mythos à tous ses partenaires, alliés compris, sans concertation préalable. Les modèles de frontière sont désormais traités comme des semi-conducteurs ou de l'armement, et si tu pensais que ton accès à ces outils allait de soi, t'as la réponse.

SécuritéReglementation
1 source
Claude Mythos a piraté la « quasi-totalité des systèmes classifiés » de la NSA en « quelques heures », mais c’était un test
3801net 

Claude Mythos a piraté la « quasi-totalité des systèmes classifiés » de la NSA en « quelques heures », mais c’était un test

Mythos, le modèle d'intelligence artificielle développé par Anthropic et spécialement conçu pour la détection de failles de sécurité, a réussi à compromettre la quasi-totalité des systèmes classifiés de la National Security Agency (NSA) en quelques heures seulement. L'exercice s'est déroulé dans un cadre strictement contrôlé, sous la supervision directe des agences fédérales américaines, qui avaient elles-mêmes organisé ce test de pénétration pour évaluer les capacités offensives des modèles d'IA de nouvelle génération. Les résultats ont immédiatement déclenché une onde de choc sur les réseaux sociaux, où l'information, sortie de son contexte opérationnel, a semé la confusion et alimenté une vague de panique. Pour la communauté de la cybersécurité, ces performances signalent un saut qualitatif majeur : jamais un système automatisé n'avait démontré une telle efficacité contre des infrastructures de renseignement aussi renforcées, soulevant des questions urgentes sur la vulnérabilité des systèmes d'information sensibles face à des agents IA autonomes. Cette démonstration relance un débat politique brûlant aux États-Unis. L'administration Trump a récemment décidé de suspendre le déploiement de Claude Fable 5 et de Mythos 5, deux modèles Anthropic de dernière génération, sans en expliquer pleinement les raisons. Les résultats du test NSA donnent désormais une lecture possible à cette décision, suggérant que Washington cherche à maîtriser la diffusion de capacités offensives jugées trop puissantes, alors que la frontière entre outil défensif et arme cyber devient de plus en plus poreuse.

UELes capacités offensives autonomes démontrées contre des infrastructures de renseignement renforcées relancent les débats sur la résilience des systèmes d'information sensibles européens face aux agents IA de nouvelle génération.

SécuritéActu
1 source
Emmanuel Macron appelle à un sursaut européen pour ne pas être « consommateurs d’une technologie faite par d’autres »
39Numerama 

Emmanuel Macron appelle à un sursaut européen pour ne pas être « consommateurs d’une technologie faite par d’autres »

Emmanuel Macron a clôturé la dixième édition de VivaTech avec un discours offensif sur la souveraineté technologique européenne, appelant la France et ses partenaires à ne pas se contenter d'être « consommateurs d'une technologie faite par d'autres ». Intervenant après une semaine particulièrement dense pour l'écosystème tech français, le président a évoqué plusieurs décisions concrètes : le déploiement d'un assistant IA au sein de la fonction publique française, un nouvel investissement dans le secteur numérique national, et la coupure du modèle Claude Fable d'Anthropic sur le territoire européen, illustrant la fragilité de la dépendance aux plateformes étrangères. L'enjeu est directement celui de la compétitivité industrielle du continent. En pointant le double risque d'une vassalité technologique vis-à-vis des États-Unis et de la Chine, Macron fixe un cap politique clair : investir dans des alternatives européennes, notamment en s'appuyant sur les modèles open source, pour ne pas abandonner aux acteurs étrangers la maîtrise des infrastructures numériques qui structureront l'économie et les services publics de demain. Ce discours intervient à quelques mois de la fin du second mandat de Macron, ce qui lui confère un caractère testamentaire. La France a multiplié les signaux volontaristes ces dernières années, soutien à Mistral AI, plan France 2030, accueil du Sommet pour l'action sur l'IA en février 2025, mais la course reste serrée face à des acteurs américains aux moyens sans commune mesure. Le choix de l'open source comme levier d'indépendance résume la tension entre ambition souveraine et réalisme économique qui traverse l'ensemble de la stratégie numérique européenne.

UEMacron annonce le déploiement d'un assistant IA dans la fonction publique française et oriente la stratégie numérique européenne vers les modèles open source pour réduire la dépendance aux plateformes américaines et chinoises.

💬 La coupure de Claude Fable en Europe cette semaine illustre mieux que n'importe quel discours ce que "dépendance technologique" veut dire en pratique. Macron a raison de miser sur l'open source, parce qu'on n'a clairement pas les milliards pour rivaliser sur la puissance de calcul. Le plan France 2030 et Mistral, c'est bien, mais on court encore après un train qui accélère.

RégulationReglementation
1 source
Trump est clair : pas de Fable 5 ni de Mythos 5, même pour les alliés du G7
40Le Big Data 

Trump est clair : pas de Fable 5 ni de Mythos 5, même pour les alliés du G7

Le département américain du Commerce a interdit l'accès aux modèles Fable 5 et Mythos 5 d'Anthropic à tous les ressortissants étrangers, forçant l'entreprise à couper complètement l'accès mondial à ces deux systèmes. L'interdiction, justifiée par des raisons de sécurité nationale, fait suite à la découverte d'une technique de « jailbreak » permettant de contourner les protections intégrées et de pousser les modèles à rechercher des vulnérabilités dans des logiciels, une capacité jugée dangereuse par Washington. Incapable de vérifier la nationalité de ses utilisateurs en temps réel, Anthropic n'a eu d'autre choix que de suspendre l'accès pour l'ensemble de ses utilisateurs non américains. La tentative du Premier ministre britannique Keir Starmer d'obtenir une exception pour le Royaume-Uni lors du sommet du G7, le 17 juin, a été rejetée par l'administration Trump, qui a estimé qu'accorder un traitement de faveur à certains alliés tout en l'interdisant aux autres n'aurait aucun sens. Dario Amodei, PDG d'Anthropic, présent au même déjeuner de dirigeants, a plaidé contre une fragmentation mondiale de l'IA. Donald Trump s'est contenté d'indiquer que les discussions avec l'entreprise se déroulaient bien. L'impact est immédiat et massif : des millions d'utilisateurs en Europe et dans le reste du monde se retrouvent du jour au lendemain privés de deux des modèles les plus avancés du marché, sans préavis et sans recours. Anthropic conteste la proportionnalité de la mesure, décrivant la faille en question comme mineure et rappelant que ses mécanismes de sécurité avaient été évalués avec plusieurs agences gouvernementales avant le lancement des modèles. Pour les professionnels et entreprises qui dépendent de ces outils, l'interruption illustre concrètement la fragilité de la souveraineté numérique européenne face aux décisions réglementaires américaines : un outil critique peut disparaître du jour au lendemain sans que les utilisateurs étrangers aient leur mot à dire. Cette affaire s'inscrit dans une tension plus ancienne entre Anthropic et Washington. Plus tôt cette année, la startup avait déjà été classée comme risque potentiel pour la sécurité nationale après avoir refusé de mettre ses modèles au service de projets liés à la surveillance et aux armes autonomes. L'alerte initiale sur la faille de jailbreak aurait par ailleurs été remontée par Amazon, principal investisseur d'Anthropic, un détail qui illustre la complexité des rapports de force à l'intérieur même de l'écosystème IA américain. Pour des responsables comme Emmanuel Macron, l'épisode relance le débat sur la dépendance stratégique de l'Europe aux infrastructures numériques américaines et sur les conséquences d'une éventuelle décision américaine de restreindre durablement l'accès aux modèles d'IA les plus performants.

UEDes millions d'utilisateurs européens ont perdu du jour au lendemain l'accès à deux modèles d'IA parmi les plus avancés, illustrant la vulnérabilité stratégique de l'Europe face aux décisions réglementaires américaines unilatérales sur les technologies numériques critiques.

💬 Ce que je décrivais comme un risque théorique, ça vient de se produire pour de vrai. Des millions d'utilisateurs européens ont perdu Fable 5 et Mythos 5 du jour au lendemain, sans préavis et sans recours, parce que Washington a décidé que le reste du monde n'était pas assez fiable, alliés du G7 inclus. Pense-y la prochaine fois qu'on te parle de souveraineté numérique européenne.

RégulationReglementation
1 source
GLM-5.2 rivalise avec GPT ; Z.ai prévoit la sortie d'Open Fable en décembre
41Latent Space 

GLM-5.2 rivalise avec GPT ; Z.ai prévoit la sortie d'Open Fable en décembre

GLM-5.2, le dernier modèle de langage de Zhipu AI, filiale de Z.ai, s'est imposé cette semaine comme l'événement open source majeur du moment. Plusieurs praticiens indépendants l'ont qualifié de premier modèle en accès libre réellement comparable aux meilleurs systèmes propriétaires. Jeremy Howard, chercheur réputé peu enclin aux effusions, a déclaré qu'il lui semblait « au moins aussi bon qu'Opus 4.8 et GPT-5.5 » pour ses usages quotidiens, soulignant néanmoins l'absence de support visuel comme principale lacune. Le cabinet Artificial Analysis l'a quant à lui classé entre GPT-5.5 et Opus 4.8 sur son nouveau benchmark de travail de connaissance agentique. Côté architecture, GLM-5.2 introduit une innovation appelée IndexShare, qui réutilise les indices d'attention sparse entre groupes de couches pour réduire considérablement le coût de l'inférence sur des contextes de un million de tokens. Sur les tâches internes de Zhipu, il passe de 21 à 48 tâches réussies sur 70 par rapport à son prédécesseur GLM-5.1. Le modèle est disponible gratuitement via les fournisseurs d'inférence Hugging Face pour une durée limitée, et en local via llama.cpp et Unsloth au format GGUF. Ce résultat est important parce qu'il marque un seuil symbolique : pour la première fois, un modèle open weight franchit ce que la communauté appelle le « vibe check frontier », c'est-à-dire la conviction, confirmée par des utilisateurs exigeants, qu'un modèle open source est utilisable en production comme alternative sérieuse aux systèmes fermés de premier rang. Cela change les calculs pour les entreprises, les développeurs et les chercheurs qui cherchent à s'affranchir des API commerciales et des contraintes de confidentialité qui les accompagnent. Z.ai, la société mère, se positionne désormais comme un laboratoire de recherche frontier à part entière, ce qui était encore contestable il y a quelques mois. La même semaine, Poolside AI a publié les poids de Laguna M.1 sous licence Apache 2.0 : un modèle sparse MoE de 225 milliards de paramètres en total et 23 milliards actifs, 256 experts avec top-k=16, 70 couches, contexte de 256 000 tokens, optimisé pour le codage agentique longue durée. L'ascension de Z.ai intervient dans un contexte de forte tension autour des modèles ouverts chinois. En février 2026, Anthropic avait publié un rapport dénonçant une « distillation à l'échelle industrielle » par plusieurs laboratoires chinois, mais Z.ai était notamment absent de cette liste, ce qui renforce sa crédibilité auprès de la communauté occidentale. La question qui domine désormais les discussions est celle du calendrier : Z.ai a laissé entendre qu'un modèle open source de classe Fable, soit l'équivalent du modèle le plus puissant d'Anthropic, pourrait être disponible d'ici décembre 2026. Pendant ce temps, l'incertitude plane sur la capacité des quatre grands laboratoires américains à maintenir leur avance, dans un contexte réglementaire tendu autour de ce que la newsletter appelle le « Mythos ban », qui pourrait freiner leurs prochaines publications majeures.

UELa disponibilité d'un modèle open weight de niveau frontier permet aux entreprises européennes d'auto-héberger une IA compétitive sans dépendre d'API commerciales américaines, facilitant la conformité RGPD.

💬 Ce que Jeremy Howard dit de GLM-5.2, ça m'intéresse plus que les benchmarks : c'est la première fois qu'un praticien exigeant dit qu'il l'utilise au quotidien à la place des modèles fermés. Le vibe check frontier, c'est ça, pas un score sur un leaderboard, la conviction que ça tient en prod. Si t'as des contraintes RGPD et que tu hésitais encore à auto-héberger, les calculs changent là.

LLMsOpinion
1 source
Après Anthropic, et si les États-Unis décidaient de couper les meilleures IA ? Macron s’inquiète
42Le Big Data 

Après Anthropic, et si les États-Unis décidaient de couper les meilleures IA ? Macron s’inquiète

Emmanuel Macron a profité du sommet du G7, le 17 juin 2026, pour exprimer publiquement ses inquiétudes face à la capacité des États-Unis à couper l'accès aux meilleurs modèles d'intelligence artificielle. Son intervention s'appuie directement sur une décision prise quelques jours plus tôt par Washington : l'administration Trump a interdit à Anthropic d'exporter ses modèles les plus avancés, Fable 5 et Mythos 5, invoquant des raisons de sécurité nationale après un signalement d'Amazon sur d'éventuelles failles. Sam Altman (OpenAI) et Dario Amodei (Anthropic) étaient présents au déjeuner de travail sur l'IA organisé en marge du G7, aux côtés de Donald Trump et de plusieurs dirigeants mondiaux. La décision de blocage reste en vigueur malgré les critiques de nombreux spécialistes en cybersécurité, qui soulignent que des capacités comparables à celles de Mythos 5 existent déjà dans d'autres modèles accessibles publiquement. Ce qui préoccupe Macron dépasse largement le cas Anthropic. Si un gouvernement peut suspendre l'accès à un modèle d'IA stratégique du jour au lendemain, aucune entreprise étrangère ne dispose d'une garantie durable. Les sociétés qui ont construit leurs services sur des IA américaines se retrouvent exposées à un risque systémique : celui de voir leurs outils essentiels disparaître sur décision unilatérale de Washington. Le Premier ministre indien Narendra Modi partage cette analyse et estime que les démocraties doivent pouvoir accéder aux meilleurs modèles pour protéger leurs infrastructures critiques. Pour les fournisseurs américains eux-mêmes, la situation n'est pas sans danger : leurs partenaires internationaux pourraient accélérer leur recherche d'alternatives, fragilisant ainsi leur position dominante sur le marché mondial. L'épisode relance le débat sur la souveraineté numérique, un sujet que l'Europe tente de traiter depuis plusieurs années sans avoir réussi à réduire significativement sa dépendance aux grandes plateformes américaines. Dans le domaine de l'IA, la réalité est particulièrement difficile à contourner : les modèles les plus performants proviennent encore majoritairement des États-Unis, ce qui rend les appels à diversifier les sources peu convaincants pour les entreprises en quête d'efficacité. Pour répondre à ces inquiétudes, les dirigeants du G7 ont évoqué la mise en place d'un programme de "partenaires de confiance", qui permettrait à certains pays et entreprises non américains de conserver un accès privilégié aux modèles avancés d'Anthropic ou d'OpenAI. Une piste encore floue, mais qui traduit l'urgence ressentie par les alliés des États-Unis face à un risque de dépendance technologique qui n'était jusqu'ici qu'hypothétique.

UEMacron a alerté au G7 sur le risque systémique pour les entreprises européennes dépendantes des IA américaines, après que Washington a bloqué l'export des modèles Anthropic, une décision qui accélère l'urgence d'une souveraineté numérique européenne.

RégulationReglementation
1 source
Les modèles d'IA "dangereux" vont émerger quoi qu'il arrive
43Ars Technica AI 

Les modèles d'IA "dangereux" vont émerger quoi qu'il arrive

Anthropic a retiré ses modèles Claude Fable 5 et Mythos 5 de la circulation fin juin 2026, à la suite d'une directive américaine de contrôle des exportations interdisant à "tout ressortissant étranger" d'accéder à ces services. La société est en négociation avec la Maison Blanche depuis vendredi, sans accord conclu à ce stade pour les remettre en ligne. Mythos 5 avait été lancé la semaine précédente auprès d'un cercle restreint, via le groupe de travail Project Glasswing, qui avait déjà reçu une version antérieure baptisée Mythos Preview en avril. Claude Fable 5, un modèle de niveau équivalent à Mythos, avait lui été rendu accessible au grand public, mais avec des restrictions explicites sur les réponses liées à la biologie et à la cybersécurité. Ces restrictions ne sont pas anodines : Anthropic reconnaît elle-même que Mythos est capable d'identifier des vulnérabilités logicielles pour aider les professionnels à les corriger, mais aussi de concevoir des méthodes d'exploitation qui pourraient servir à des acteurs malveillants. Dans un billet de blog accompagnant le lancement, la société formule ce paradoxe sans détour : les mêmes requêtes utiles entre les mains d'un chercheur en cybersécurité ou en biologie peuvent devenir dangereuses si elles sont accessibles sans contrôle. C'est précisément pour cela que Project Glasswing existe, comme mécanisme de diffusion controlée auprès d'experts habilités avant tout déploiement plus large. Cette crise illustre la tension croissante entre la vitesse de développement de l'IA de pointe et les impératifs de sécurité nationale américaine. Washington cherche à empêcher que des puissances étrangères, notamment étatiques, n'accèdent aux modèles les plus avancés avant que des garde-fous adéquats soient en place. Anthropic se retrouve au coeur de ce dilemme : l'entreprise a elle-même averti que des modèles aux capacités "dangereuses" arriveront inévitablement, quelles que soient les précautions. La question qui se pose désormais est de savoir si les mécanismes de contrôle existants, entre directives gouvernementales et consortiums d'accès restreint, sont réellement capables de contenir la diffusion de ces technologies, ou si la course est déjà trop avancée pour être régulée efficacement.

UELes contrôles américains d'exportation visant 'tout ressortissant étranger' privent directement les entreprises et développeurs européens d'accès aux modèles Fable 5 et Mythos 5, exposant la dépendance de l'UE aux modèles d'IA américains soumis à des décisions unilatérales de Washington.

La promesse d’une « IA pour tous » au service du bien commun a du plomb dans l’aile
44Next INpact 

La promesse d’une « IA pour tous » au service du bien commun a du plomb dans l’aile

La suspension soudaine, par Anthropic, de ses deux modèles les plus avancés, Mythos 5 et sa version grand public Fable 5, a provoqué une onde de choc bien au-delà du cercle des utilisateurs directement affectés. En quelques jours, le Conseil de l'IA et du Numérique a publié une note qualifiant l'événement de « point de bascule » et affirmant que « la menace sur l'autonomie numérique européenne n'est plus une hypothèse, elle est devenue une réalité tangible ». Le Conseil, co-présidé par Anne Bouverot (ex-Orange, présidente du conseil d'administration de l'ENS) et Guillaume Poupard (ex-directeur général de l'ANSSI, aujourd'hui CTO d'Orange), souligne que la coupure a touché l'ensemble des clients, partout dans le monde, sans distinction, comme l'avait déjà fait Adobe en octobre 2019, lorsque la société avait suspendu ses services au Venezuela sur ordre de l'administration Trump, empêchant même l'ouverture de documents PDF. Ce que cet épisode révèle, c'est la matérialisation d'un risque longtemps théorisé : le kill switch. La question se posait déjà autour de S3ns et Bleu, les deux offres de cloud souverain français adossées aux infrastructures de Google et Microsoft. S3ns, certifié SecNumCloud par l'ANSSI, estime pouvoir fonctionner quelques mois sans mises à jour depuis les États-Unis ; Bleu revendique une capacité d'autarcie d'environ un an, avec la possibilité de proposer des liaisons directes à ses clients pour fonctionner totalement isolé d'Internet. Mais la coupure d'Anthropic va plus loin : ce ne sont plus de simples outils logiciels qui disparaissent, ce sont des modèles de langage devenus centraux dans des workflows professionnels entiers. Le cas Nicolas Guillou, juge français à la Cour pénale internationale privé d'accès aux services numériques américains, illustre jusqu'où peut aller cette dépendance. Pour le Conseil de l'IA, cet événement s'inscrit dans une stratégie d'endiguement technologique américaine plus large, « jusqu'ici principalement incarnée par les restrictions à l'exportation des puces NVIDIA les plus performantes » vers la Chine. Washington entend éviter un nouveau « moment DeepSeek », soit l'émergence d'une alternative non américaine capable de rivaliser. Les LLM ne sont plus perçus comme de simples services en ligne mais comme des actifs stratégiques, au même titre que les semi-conducteurs ou les réseaux télécoms. L'Europe, encore largement dépourvue de modèles fondateurs de premier rang à l'échelle mondiale, se retrouve dans une position de dépendance structurelle que cette coupure a rendue impossible à ignorer, et que ni S3ns, ni Bleu, ni aucune certification nationale ne peuvent, seuls, résoudre.

UELe Conseil de l'IA et du Numérique français qualifie la suspension des modèles Anthropic de 'point de bascule', révélant la dépendance structurelle de l'Europe aux LLM américains et relançant en urgence le débat sur la souveraineté numérique des institutions et entreprises françaises et européennes.

RégulationReglementation
1 source
Fable 5 bloqué : la Chine lance GLM-5.2, une solution open source
45Le Big Data 

Fable 5 bloqué : la Chine lance GLM-5.2, une solution open source

Le 16 juin 2026, l'entreprise chinoise Zhipu a lancé GLM-5.2, un modèle d'intelligence artificielle en accès libre ciblant directement les tâches de programmation agentique et de raisonnement complexe. Disponible sur Ollama et Hugging Face sous licence MIT, le modèle embarque une fenêtre de contexte d'un million de jetons et propose deux niveaux de raisonnement : un mode "Max" orienté performances maximales et un mode "High" offrant un meilleur équilibre entre puissance et consommation. Sur les benchmarks publiés par Zhipu, GLM-5.2 affiche 81,0 % sur Terminal-Bench, 62,1 % sur SWE-bench Pro et 74,4 % sur Frontier SWE. Sur Design Arena, il décroche la première place avec un score Elo de 1360, devançant Claude Fable 5, et se classe deuxième sur Code Arena Frontend. Le lancement intervient au moment précis où Anthropic a suspendu l'accès à Claude Fable 5, offrant à GLM-5.2 une fenêtre de visibilité rare sur le marché. Pour les développeurs, l'enjeu est concret : la publication des poids sous licence MIT permet d'exécuter le modèle localement, de l'adapter à des cas d'usage spécifiques et de l'intégrer dans des pipelines sans dépendance à une API commerciale. Une fenêtre de contexte à un million de jetons combinée à de solides résultats sur les benchmarks de correction de bugs réels et de génération d'interfaces ouvre des perspectives directes pour l'automatisation du développement logiciel, la recherche assistée et les agents autonomes de longue durée. Il faut toutefois nuancer l'étiquette "open source" : si les poids du modèle sont bien publiés, les données d'entraînement, les pipelines de filtrage et le code complet ayant servi à l'entraîner restent privés. GLM-5.2 est donc plus précisément un modèle "open weight", une distinction qui compte pour les chercheurs et les équipes de sécurité souhaitant auditer ou reproduire le système. Par ailleurs, les chiffres de performance avancés par Zhipu n'ont pas encore été confirmés par des évaluations indépendantes. Ce lancement s'inscrit dans une tendance plus large : les laboratoires chinois, portés par des investissements massifs et l'urgence stratégique de contourner les restrictions américaines sur les semi-conducteurs, enchaînent les sorties de modèles compétitifs à un rythme soutenu. GLM-5.2 vient directement concurrencer les modèles de code occidentaux au moment où le leader de facto du secteur est temporairement indisponible.

UELes développeurs européens peuvent déployer GLM-5.2 localement via Ollama et Hugging Face sous licence MIT, offrant une alternative concrète aux modèles fermés pour les pipelines d'automatisation de code et les agents autonomes.

💬 Timing parfait pour Zhipu. Un modèle MIT avec 1M de contexte qui sort exactement quand Fable 5 est en pause forcée, c'est soit du hasard soit un calendrier très bien travaillé. Les benchmarks sont auto-publiés et "open weight" n'est pas "open source" (les données d'entraînement restent privées), mais pour faire tourner ça en local sans dépendance à une API commerciale, c'est du concret.

LLMsOpinion
1 source
GLM-5.2 à poids ouverts de Z.ai surpasse GPT-5.5 sur plusieurs benchmarks de codage long terme, pour un sixième du coût
46VentureBeat AI 

GLM-5.2 à poids ouverts de Z.ai surpasse GPT-5.5 sur plusieurs benchmarks de codage long terme, pour un sixième du coût

La startup chinoise Z.ai (anciennement Zhipu AI) a annoncé le 17 juin 2026 la disponibilité immédiate de GLM-5.2, un modèle de langage open-weights de 753 milliards de paramètres conçu spécifiquement pour les tâches de développement logiciel autonomes et de longue durée. Le modèle est accessible dès maintenant sur Hugging Face, via l'API Z.ai et dans plus de 20 environnements de développement tiers. Il dispose d'une fenêtre de contexte stable d'un million de tokens et des abonnements entreprise démarrent à 12,60 dollars par mois. Ses poids sont publiés sous licence MIT sans restriction, permettant à quiconque de le télécharger, de le personnaliser et de le déployer localement. Sur les benchmarks industriels, GLM-5.2 surpasse GPT-5.5 d'OpenAI sur plusieurs épreuves clés : SWE-bench Pro (62,1 contre 58,6), FrontierSWE (74,4 % contre 72,6 %), MCP-Atlas (77,0 contre 75,3) et PostTrainBench (34,3 % contre 25,0 %). Il talonne Claude Opus 4.8 d'Anthropic sur la quasi-totalité de ces tests. La sortie de GLM-5.2 arrive à un moment stratégiquement décisif pour les entreprises qui dépendent de modèles d'IA de pointe. La semaine précédente, l'administration Trump a publié une directive de contrôle des exportations interdisant aux ressortissants étrangers d'utiliser Claude Fable 5 d'Anthropic, ce qui a conduit Anthropic à retirer ce modèle de l'accès global pour tous les utilisateurs. Pour les responsables techniques en dehors des États-Unis, GLM-5.2 offre une alternative concrète : un modèle de niveau frontier hébergeable en interne, hors de portée des restrictions géographiques et des aléas réglementaires américains. Son coût d'exploitation réduit à un sixième de celui des modèles propriétaires équivalents renforce encore son attrait pour les organisations soucieuses de maîtriser leur infrastructure IA. Sur le plan architectural, GLM-5.2 introduit une optimisation appelée IndexShare, qui réutilise un même indexeur pour quatre couches d'attention sparse consécutives, réduisant de 2,9 fois le nombre de FLOPs par token à longueur de contexte maximale. Le modèle intègre également une couche Multi-Token Prediction améliorée, qui accroît de 20 % la longueur des tokens acceptés lors de l'inférence, ainsi que des modes de raisonnement sélectionnables, "Max" pour la puissance maximale, "High" pour un équilibre performance-latence. Z.ai s'inscrit ainsi dans une tendance de fond portée par des acteurs chinois comme DeepSeek, qui misent sur l'open-source et l'efficacité architecturale pour rivaliser avec les laboratoires occidentaux disposant de budgets bien supérieurs. Avec GLM-5.2, la compétition pour le leadership en IA agentic se déplace clairement au-delà des frontières américaines.

UELes entreprises et développeurs français et européens disposent désormais d'une alternative frontier auto-hébergeable sous licence MIT, hors de portée des restrictions d'exportation américaines qui ont récemment limité l'accès aux modèles de pointe d'Anthropic.

💬 Le moment est trop bien choisi pour être un hasard. Z.ai sort un 753 milliards de paramètres open-weights qui passe devant GPT-5.5 sur le code, MIT, hébergeable où tu veux, pile une semaine après qu'Anthropic a dû couper Fable 5 globalement sur pression de Washington. Pour les boîtes européennes qui cherchaient une sortie de la dépendance cloud américaine, bon, la voilà.

LLMsOpinion
1 source
Mythos 5 : Anthropic a tenté de faire plier Washington, mais Trump n’a pas changé d’avis
47Le Big Data 

Mythos 5 : Anthropic a tenté de faire plier Washington, mais Trump n’a pas changé d’avis

Lundi 16 juin 2026, des représentants d'Anthropic se sont rendus à Washington pour rencontrer plusieurs responsables de l'administration Trump dans l'espoir d'obtenir la levée des restrictions pesant sur leurs deux derniers modèles, Mythos 5 et Claude Fable 5. Accompagnés de spécialistes internes de la sécurité, ils ont tenté de démontrer que les vulnérabilités identifiées dans ces systèmes ne constituaient pas une menace suffisamment grave pour justifier leur blocage à l'échelle mondiale. Malgré plusieurs heures de discussions, l'administration n'a accordé aucune concession. Les deux modèles restent inaccessibles en dehors des États-Unis, victimes de contrôles à l'exportation imposés par la Maison-Blanche. Le blocage commence à produire des effets concrets dans l'industrie. Plusieurs développeurs se tournent déjà vers des alternatives concurrentes, et une lettre ouverte signée par des dizaines de chercheurs et de dirigeants du secteur réclame la levée rapide des restrictions. Ses signataires avancent que ces contrôles ralentissent avant tout les entreprises américaines, sans empêcher les concurrents étrangers de progresser. De son côté, l'administration estime que certaines failles pourraient permettre de contourner les garde-fous du modèle et faciliter des cyberattaques, ce qui justifie le maintien du principe de précaution. Une solution intermédiaire serait néanmoins à l'étude : limiter temporairement l'accès de Mythos 5 aux seuls utilisateurs situés aux États-Unis, le temps qu'Anthropic fournisse des garanties techniques supplémentaires. Aucune décision n'a toutefois été annoncée à l'issue des réunions. Ce bras de fer s'inscrit dans un mouvement plus large des autorités américaines visant à encadrer les modèles d'IA les plus puissants avant leur diffusion internationale. Le gouvernement cherche à éviter que ces systèmes ne soient détournés à des fins sensibles, qu'il s'agisse de cybersécurité ou d'autres usages à double tranchant. Anthropic conteste cette lecture, rappelant que d'autres modèles publiquement accessibles présentent des capacités comparables, et que les problèmes identifiés restent limités et corrigibles rapidement. Mais convaincre Washington lorsque la sécurité nationale entre dans l'équation s'avère une tâche autrement plus complexe que de présenter des arguments techniques. Le fossé entre les deux camps reste entier, et l'issue du dossier dépendra autant de considérations politiques que de démonstrations de sécurité.

UELes contrôles à l'exportation imposés par Washington bloquent l'accès à Mythos 5 et Claude Fable 5 hors des États-Unis, contraignant les développeurs et entreprises européens à se rabattre sur des modèles concurrents.

💬 Anthropic pensait convaincre Washington avec des arguments techniques. Raté. Quand la sécurité nationale entre dans l'équation, les slides sur les failles corrigeables ne font pas le poids face à des décideurs qui cherchent avant tout à couvrir leurs arrières. De notre côté, on se retourne déjà vers des alternatives, et Anthropic perd du terrain pendant que ses concurrents regardent le spectacle.

RégulationReglementation
1 source
Adieu Fable
48Ben's Bites 

Adieu Fable

Le 9 juin 2026, Anthropic lançait Claude Fable 5, son nouveau modèle grand public dérivé de Mythos, une architecture réservée à un cercle restreint d'entreprises en raison de son potentiel de risque en cybersécurité. Fable était conçu comme une version de Mythos dotée de garde-fous pour un usage général. Trois jours plus tard, le 12 juin, le modèle disparaissait de l'accès public. En cause : le gouvernement américain, alerté par une faille de jailbreak découverte via Fable, a ordonné la suspension immédiate de l'accès à Fable 5 et Mythos 5 pour tous les ressortissants étrangers, qu'ils soient à l'intérieur ou à l'extérieur des États-Unis, y compris les employés d'Anthropic eux-mêmes qui ne sont pas citoyens américains. Anthropic, incapable d'implémenter proprement un filtrage par nationalité, a préféré couper l'accès pour tout le monde. La situation illustre une tension inédite dans l'industrie de l'IA : un modèle de pointe, lancé avec fanfare, retiré en moins d'une semaine sur pression gouvernementale. Selon les benchmarks publiés dans la même période, Fable 5 surpassait GPT-5.5, ce qui en faisait l'un des modèles les plus capables du marché au moment de son retrait. La décision soulève une question fondamentale : si un modèle est jugé trop dangereux, pourquoi la nationalité de l'utilisateur constitue-t-elle la ligne de démarcation ? Anthropic perd ici non seulement des utilisateurs, mais aussi une partie de sa crédibilité et de sa légitimité à opérer globalement, ce que certains observateurs résument comme une perte du "mandat du ciel". Les équipes étrangères de l'entreprise, directement affectées, ne peuvent plus utiliser leurs propres outils. Cet épisode s'inscrit dans une dynamique plus large de militarisation progressive du discours autour des grands modèles de langage aux États-Unis, où la cybersécurité sert de prétexte à des restrictions d'accès géopolitiques. Anthropic avait déjà positionné Mythos comme une architecture à accès contrôlé, consciente des risques. La faille de jailbreak identifiée serait reproductible sur d'autres modèles comme GPT-5.5, ce qui relativise la singularité du danger, mais n'a pas suffi à convaincre Washington. En parallèle, la concurrence s'intensifie : DeepSeek vient de lever 7,4 milliards de dollars lors de son premier tour de table, valorisant la startup chinoise à plus de 50 milliards, avec son propre PDG comme principal investisseur à hauteur de 40 %. Dans cet environnement de plus en plus fragmenté entre puissances technologiques, la capacité d'Anthropic à maintenir un accès universel à ses modèles les plus avancés apparaît fragilisée.

UELes utilisateurs et entreprises européens sont directement privés d'accès à Claude Fable 5 et Mythos 5, les modèles les plus performants du marché au moment du retrait, suite à une restriction imposée par le gouvernement américain à tous les ressortissants étrangers, forçant une réévaluation urgente des dépendances à l'infrastructure IA américaine.

💬 Meilleur modèle du marché, retiré en 72 heures sur pression gouvernementale. Ce qui est nouveau ici, c'est pas qu'un modèle soit dangereux, c'est que la nationalité devienne le critère de sécurité, et qu'Anthropic, coincée, préfère couper tout accès plutôt que d'implémenter un filtrage bancal. Pour les boîtes européennes qui avaient misé dessus, c'est un rappel brutal que l'infrastructure qu'on utilise n'est pas la nôtre.

SécuritéOpinion
1 source
Google Cloud soutient l’ambition de superintelligence d’Ineffable Intelligence
49Le Big Data 

Google Cloud soutient l’ambition de superintelligence d’Ineffable Intelligence

Ineffable Intelligence, startup londonienne fondée par David Silver, le chercheur britannique à l'origine d'AlphaGo, a annoncé lors du Google Cloud Summit London 2026 un partenariat stratégique avec Google Cloud pour soutenir le développement de son projet de superintelligence. Cette alliance intervient dans la foulée d'une levée de fonds de 1,1 milliard de dollars, la plus importante jamais réalisée par une startup européenne spécialisée dans l'IA. Concrètement, Ineffable Intelligence déploiera sur l'infrastructure Google Cloud l'un des plus grands clusters A5X au monde, équipé de GPU NVIDIA Vera Rubin NVL72, pour entraîner ce qu'elle appelle un « super-apprenant » : une intelligence artificielle capable d'acquérir des connaissances par l'expérience directe, en continu, plutôt qu'à partir de vastes ensembles de données précompilées. L'enjeu dépasse largement le simple choix d'un prestataire cloud. Les systèmes fondés sur l'apprentissage par renforcement continu imposent des contraintes d'infrastructure radicalement différentes des modèles génératifs classiques : ils génèrent, évaluent et exploitent en temps réel des flux d'expériences, ce qui exige non seulement une puissance de calcul considérable, mais aussi une interconnexion ultra-performante entre GPU, réseau à haut débit et stockage optimisé. Google Cloud se positionne précisément sur cette architecture intégrée, présentée comme un avantage décisif pour les laboratoires les plus exigeants. Pour l'industrie, ce partenariat marque une étape dans la compétition entre hyperscalers pour capter les projets d'IA les plus ambitieux, où l'infrastructure devient un levier de différenciation aussi important que les algorithmes eux-mêmes. David Silver, figure emblématique du domaine depuis sa contribution décisive à AlphaGo chez DeepMind, a quitté Google pour fonder Ineffable Intelligence avec l'ambition explicite de développer des systèmes capables de dépasser les capacités humaines dans des domaines comme les sciences, les mathématiques ou la technologie. L'approche par apprentissage par renforcement qu'il défend s'inscrit dans une tradition de recherche distincte des grandes entreprises qui misent sur la mise à l'échelle de modèles de langage entraînés sur du texte. Le choix de Google Cloud comme partenaire est une décision stratégique pour les deux parties : Ineffable Intelligence bénéficie d'une infrastructure de premier rang à grande échelle, tandis que Google utilise ce partenariat comme vitrine pour démontrer la maturité de son offre IA à une période où la concurrence entre Azure, AWS et Google Cloud pour attirer les laboratoires de recherche de pointe n'a jamais été aussi intense. La levée de 1,1 milliard confirme que le projet est pris très au sérieux par les investisseurs, même si l'horizon d'une superintelligence opérationnelle reste indéfini.

UELa levée record d'1,1 milliard de dollars par Ineffable Intelligence, startup londonienne fondée par le chercheur britannique à l'origine d'AlphaGo, s'impose comme un signal fort pour l'écosystème européen de l'IA, confirmant sa capacité à générer des laboratoires de recherche de niveau mondial capables de rivaliser avec les géants américains.

💬 David Silver quitte Google pour lever 1,1 milliard et retourner entraîner ses modèles sur... l'infra Google. Le serpent qui se mord la queue, mais version superintelligence. Ce qui m'intéresse vraiment là-dedans, c'est l'approche : de l'apprentissage par renforcement continu plutôt que du scaling de LLM sur texte, c'est une vraie bifurcation par rapport à ce que font OpenAI ou Anthropic. Reste à voir si ça donne quelque chose en dehors des jeux de plateau.

BusinessOpinion
1 source
Satya sur Loopcraft : construire des écosystèmes frontier
50Latent Space 

Satya sur Loopcraft : construire des écosystèmes frontier

Satya Nadella a publié début juin 2026 son tout premier article sur X, et le résultat a dépassé toutes les attentes : plus de 60 millions de vues en quelques jours. Le PDG de Microsoft y formalisise un nouveau concept qu'il avait évoqué lors du Microsoft Build : le "Loopcraft", une théorie de l'entreprise à l'ère de l'IA fondée sur la notion de "boucles d'apprentissage". Selon lui, la vraie valeur ne réside pas dans le choix du meilleur modèle de langage, mais dans la construction d'une boucle cognitive entre humains et systèmes numériques, où le capital humain et le "capital en tokens" se renforcent mutuellement. En parallèle, Claude Fable 5 d'Anthropic a dominé l'actualité pour des raisons bien différentes : le gouvernement américain a frappé Anthropic d'une directive de contrôle à l'exportation visant ses modèles Fable et Mythos, forçant la startup à suspendre l'accès pour tous ses utilisateurs. Le modèle venait pourtant d'établir un nouveau record de 161 points sur l'Epoch Capabilities Index, devançant GPT-5.5 Pro. La déclaration de Nadella n'est pas qu'un exercice rhétorique : elle signale un pivot stratégique de Microsoft, huit mois après la rupture avec OpenAI. En affirmant que "l'opportunité réelle est de bâtir un écosystème frontier, pas seulement un modèle frontier", il repositionne son entreprise comme architecte de plateformes d'apprentissage institutionnel plutôt que comme course au modèle le plus puissant. Pour les entreprises clientes, cela change concrètement la manière d'évaluer leurs investissements IA : ce qui compte n'est plus la puissance brute du modèle, mais la capacité à encoder la connaissance organisationnelle dans des boucles autonomes et cumulatives. L'affaire Fable 5, elle, illustre un risque nouveau et concret : l'accès aux modèles frontier est désormais entrelacé avec les processus de sécurité nationale américaine, rendant la disponibilité des outils IA imprévisible pour les équipes techniques du monde entier. La crise Anthropic met en lumière une tension structurelle croissante entre innovation et gouvernance. Anthropic affirme avoir coordonné son lancement avec les agences gouvernementales avant d'être frappé par une directive large et soudaine, tandis que des sources proches de l'administration évoquent des défaillances de communication avec la Maison-Blanche. Des voix techniques influentes comme François Chollet ou Simon Willison critiquent l'opacité du régime réglementaire actuel, jugé trop dépendant d'interventions politiques ad hoc. La conséquence directe : une accélération de la tendance à la neutralité des modèles dans les architectures de production. Des figures comme Harrison Chase soutiennent que cette neutralité est désormais plus critique que la neutralité cloud, les modèles changeant trop vite et trop imprévisiblement pour justifier une dépendance exclusive à un seul fournisseur.

UELa suspension mondiale de l'accès à Fable 5 d'Anthropic par directive d'exportation américaine expose les entreprises et développeurs européens à un risque de dépendance critique envers des modèles soumis aux aléas de la politique de sécurité nationale américaine, accélérant la nécessité d'architectures neutrales vis-à-vis des fournisseurs de modèles.

💬 60 millions de vues pour un premier post X, Nadella sait encore ce qu'il fait. L'idée du Loopcraft, c'est pas révolutionnaire sur le papier, mais elle remet les priorités à l'endroit : ce qui compte c'est pas ton modèle, c'est ta boucle d'apprentissage organisationnelle. Et l'affaire Fable 5 tombe à pic, parce que quand le gouvernement US peut couper l'accès mondial à un modèle numéro 1 du jour au lendemain, la neutralité fournisseur n'est plus une option d'architecture, c'est une obligation.

RégulationReglementation
1 source

Suivre Claude Fable 5 en continu

Recevez chaque jour les articles essentiels du sujet. Pas de bruit, pas de spam.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic