Aller au contenu principal
Fable est de retour
LLMsBen's Bites · 3 min de lecture

Fable est de retour

Source originale ↗·

Fable 5 est de nouveau accessible à tous les utilisateurs payants de Claude, quelques semaines après avoir été retiré. Anthropic évoque, dans un billet de blog, des garde-fous renforcés pour cette nouvelle version, même si l'auteur de la newsletter Ben's Bites affirme n'en avoir rencontré aucun pour l'instant. Le modèle reste toutefois disponible uniquement jusqu'au 7 juillet dans les formules d'abonnement, avec un quota d'usage limité à 50% du volume habituel. Un benchmark cité dans l'article affirme que Fable peut mener à bien 16% des tâches de travail à distance testées, soit le double d'Opus 4.8. Juste avant ce retour, Anthropic avait aussi lancé Claude Sonnet 5, dont les performances sur les tâches d'agents se rapprochent d'Opus 4.8 tout en coûtant moins cher au token. Il devient le modèle par défaut pour les offres gratuite et Pro, disponible dans Claude Code et via l'API, avec un tarif de lancement de 2 dollars par million de tokens en entrée et 10 dollars en sortie, valable jusqu'au 31 août. Côté Google, deux nouveaux modèles multimédias, Nano Banana 2 Lite et Gemini Omni Flash, sont désormais accessibles dans l'application Gemini et via l'API: le premier génère des images en moins de quatre secondes, à raison d'environ trente images en résolution 1K pour un dollar, tandis que le second permet de créer et modifier des vidéos pour 0,10 dollar la seconde. Par ailleurs, Bridgewater et Thinking Machines ont entraîné un modèle spécialisé atteignant 84,7% de précision sur des tâches de tri financier, pour un coût 13,8 fois inférieur au meilleur modèle généraliste testé. Enfin, Factory a affiné deux détecteurs dans son outil Droid Shield 2.0, capables de repérer des secrets exposés dans les sessions de code tout en réduisant les fausses alertes.

Cette avalanche d'annonces illustre à quel point la course entre laboratoires d'IA se joue désormais autant sur le coût et l'usage pratique que sur les scores bruts de benchmarks. Si Sonnet 5 affiche de bons résultats sur le papier, plusieurs utilisateurs, dont l'auteur de la newsletter, le jugent en pratique cher et lent, ce qui relativise l'intérêt de l'adopter par rapport à d'autres modèles. À l'inverse, l'exemple du modèle spécialisé de Bridgewater et Thinking Machines montre qu'un entraînement ciblé sur une tâche précise, comme le tri de dossiers financiers, peut surpasser un modèle généraliste frontière pour une fraction du coût, une piste que de plus en plus d'entreprises explorent pour maîtriser leurs dépenses en IA. Les nouveaux outils de génération d'images et de vidéos à bas coût de Google, eux, abaissent la barrière d'entrée pour les créateurs de contenu, tandis que le renforcement de la détection de secrets exposés chez Factory répond à une préoccupation croissante à mesure que les agents de code gèrent une part grandissante du travail des développeurs.

Ce mouvement s'inscrit dans une tendance plus large vers des agents capables d'agir de façon autonome, à condition de disposer du bon contexte et des bons outils. L'auteur illustre cela avec un exemple personnel: en vacances en Grèce, il a demandé à Codex de lui réserver un taxi pour rentrer de l'aéroport, et la tâche a été bouclée en un peu plus d'une minute et demie, l'agent ayant consulté son calendrier Google pour retrouver son vol, puis ses e-mails pour identifier son adresse et la compagnie de taxi utilisée à l'aller, avant de remplir le formulaire de réservation et de régler le trajet via un navigateur resté connecté. Cet exemple, bien que modeste, résume selon lui la logique qui sous-tend la plupart des usages efficaces des agents aujourd'hui: leur fournir la mémoire, les outils et le contexte nécessaires pour qu'ils puissent agir sans supervision constante, un principe qui devrait continuer à structurer le développement des futurs modèles et produits, qu'ils viennent d'Anthropic, de Google ou d'autres laboratoires concurrents.

💬 L'analyse de Mathieu

Le retour de Fable version bridée (50% de quota, embarqué jusqu'au 7 juillet) sent plus le patch de com' que la vraie sortie assumée. Ce qui m'intéresse plus, c'est Bridgewater et Thinking Machines: un modèle entraîné juste pour trier des dossiers financiers qui bat le généraliste frontière pour presque 14 fois moins cher. Selon Le Fil IA, la course à l'IA ne se gagne plus sur les benchmarks mais sur le prix au token, et les modèles spécialisés vont grignoter des pans entiers de marché aux généralistes.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Le guide de terrain sur Fable
1Latent Space 

Le guide de terrain sur Fable

Thariq, connu pour sa série de blog "Field Guide to Fable", a bouleversé en une seule nuit le contenu de sa conférence prévue pile le jour du relancement de Fable, pour livrer les conseils les plus pertinents possibles avant la fin de la subvention d'abonnement, effective dès le lendemain. Diffusée le 6 juillet 2026, son intervention se décompose en quatre parties: une introduction, un segment sur le "unhobbling" de Claude, un autre sur la recherche des angles morts, puis une réflexion sur le deuil lié à la productivité en programmation et enfin un plaidoyer contre les compromis. Au même moment, Tencent a publié Hunyuan Hy3, un modèle ouvert sous licence Apache 2.0: une architecture MoE de 295 milliards de paramètres dont 21 milliards actifs, 192 experts avec routage top-8, de l'attention GQA, un contexte de 256 000 tokens et une couche MTP de 3,8 milliards de paramètres pour le décodage spéculatif. La newsletter AI News, qui a analysé 12 subreddits et 544 comptes Twitter sur la période du 4 au 6 juillet, a largement couvert ces deux actualités alors que la sortie de GPT-5.6 Sol Ultra reste attendue par l'ensemble du secteur. L'enjeu pour les développeurs est de comprendre que les limites d'un modèle viennent souvent moins de ses capacités réelles que du cadre d'usage qu'on lui impose: prompts et contraintes doivent être révisés à chaque nouvelle génération pour éviter de brider artificiellement le modèle, un phénomène que Thariq illustre par l'efficacité redoutée du HTML brut face à Claude. Pour Hy3, l'impact est immédiat et concret: le support natif dans vLLM était disponible dès le lancement, avec parseurs d'outils et de raisonnement, décodage spéculatif MTP, et compatibilité validée sur GPU Nvidia et AMD. Tencent a même intégré ses noyaux de production dans vLLM, avec des gains allant jusqu'à 2,95 fois en débit sur les séquences de longueur mixte, et des réductions de latence de 24% sur le temps avant premier token et 17% sur le temps par token. Cet engouement a poussé Teknium à rendre Hy3 gratuit pendant deux semaines sur Nous Portal. Ces annonces s'inscrivent dans une compétition de plus en plus vive entre laboratoires open source, Hy3 étant immédiatement comparé à GLM-5.2, certains estimant que Tencent rejoint désormais le tout premier rang des acteurs ouverts si les résultats de benchmarks se confirment, tandis que d'autres continuent de préférer GLM-5.2 en usage réel. Le contexte plus large reste marqué par une accélération générale, entre les nouveaux modèles de General Intuition et de Shunyu Yao, et l'attente de GPT-5.6 Sol Ultra, dans un secteur où AI News, désormais intégrée à Latent Space, continue de documenter ces mouvements semaine après semaine.

LLMsActu
1 source
Fable 5 : un indice découvert dans le code de Claude relance l’espoir d’un retour
2Le Big Data 

Fable 5 : un indice découvert dans le code de Claude relance l’espoir d’un retour

Le 24 juin 2026, un utilisateur de X connu sous le pseudonyme @synthwavedd a mis au jour plusieurs chaînes de texte inédites enfouies dans le binaire de Claude Code v2.1.190. Ces fragments de code évoquent explicitement un quota hebdomadaire dédié à Fable 5, le dernier modèle phare d'Anthropic, ainsi que la possibilité pour les utilisateurs de continuer à l'utiliser via des crédits après avoir atteint cette limite. Plus significatif encore : l'ancienne mention d'un achat séparé de l'abonnement semble avoir disparu de la base de code. En parallèle, Fable 5 est réapparu dans le catalogue d'Amazon Bedrock avec une fiche toujours active, et le magazine Wired rapporte que les négociations entre Anthropic et l'administration américaine ont récemment évolué, Tom Brown, cofondateur de la société, ayant pris la main sur les discussions en lieu et place du PDG Dario Amodei. Ces indices prennent tout leur sens au regard de la situation actuelle. Depuis le 12 juin 2026, Fable 5 est inaccessible aux utilisateurs américains et internationaux, bloqué par une directive gouvernementale de l'administration Trump quelques jours seulement après son lancement, en même temps que Mythos. Anthropic conteste cette décision, estimant que les failles identifiées ne justifiaient pas un retrait total du modèle. Si les messages découverts dans le code ne constituent pas une preuve formelle de retour, ils décrivent une logique de distribution qui ne peut fonctionner que si le modèle redevient accessible. Les ingénieurs n'intègrent généralement pas ce type de mécanique dans une version de production sans raison opérationnelle concrète, ce qui confère à ces découvertes un poids que de simples rumeurs n'auraient pas. L'affaire Fable 5 illustre un phénomène inédit dans l'histoire de l'intelligence artificielle : un gouvernement bloquant l'accès à un modèle commercial développé par une entreprise de son propre territoire, dans un contexte de tensions croissantes autour de la sécurité des systèmes d'IA. Anthropic se retrouve ainsi coincé entre ses obligations réglementaires et la pression commerciale d'un marché mondial qui attendait Fable 5 comme un bond qualitatif majeur. La délégation des négociations à Tom Brown, figure moins exposée que Dario Amodei, suggère une stratégie d'apaisement plutôt que de confrontation. Si un accord venait à être trouvé, le retour du modèle s'accompagnerait vraisemblablement de nouvelles conditions d'accès, possiblement plus restrictives, dont la logique de quota hebdomadaire découverte dans le code pourrait être le premier signe.

UELe blocage de Fable 5 a privé les développeurs et entreprises européens d'accès à ce modèle ; un éventuel retour, potentiellement assorti d'un système de quotas restrictifs, concernerait directement les intégrateurs IA et startups françaises et européennes qui attendaient ce modèle pour leurs pipelines de production.

💬 Les ingénieurs ne codent pas des mécaniques de quota pour un modèle qu'ils n'ont pas l'intention de ressortir. Ce que @synthwavedd a trouvé dans le binaire de Claude Code, c'est pas une rumeur, c'est une spéc technique qui implique un plan de retour actif, et ça change tout. La vraie question maintenant, c'est à quelles conditions.

LLMsOpinion
1 source
Depuis son retour, Claude Fable 5 fait beaucoup moins rêver
3Next INpact 

Depuis son retour, Claude Fable 5 fait beaucoup moins rêver

Depuis son retour le 1ᵉʳ juillet 2026, Claude Fable 5 déçoit. Anthropic avait lancé ce modèle le 9 juin, le présentant comme le plus capable de son histoire, une version de Mythos 5 dotée de garde-fous supplémentaires. Trois jours plus tard, une directive de contrôle des exportations signée par la Maison-Blanche a contraint Anthropic à suspendre l'accès à Fable 5 et Mythos 5 pour tout ressortissant étranger, y compris ses propres employés non-américains, entraînant un arrêt mondial faute de pouvoir filtrer les utilisateurs par nationalité en temps réel. Le déclencheur : un rapport de chercheurs d'Amazon selon lequel Fable 5 pouvait être manipulé pour livrer des informations exploitables dans des cyberattaques, sur fond de soupçons qu'un groupe lié à la Chine ait pu accéder à Mythos et le rétro-ingénierer. Fin juin, le Department of Commerce a levé ces restrictions, et Fable 5 a retrouvé Claude Platform, Claude.ai, Claude Code et Claude Cowork le 1ᵉʳ juillet, tandis que Mythos 5 reste réservé aux partenaires vérifiés du programme Glasswing, comme Mozilla. Ce retour, après environ trois semaines d'interruption, s'accompagne d'une chute de performances qui inquiète les utilisateurs professionnels. Avant le blocage, Fable 5 affichait des scores impressionnants : 80,3 % sur SWE-Bench Pro contre 69,2 % pour Opus 4.8, et 64,5 % sur Humanity's Last Exam avec outils contre 57,9 % pour Opus 4.8 et 52,2 % pour GPT-5.5, des résultats relevés notamment par Datacamp. Every allait plus loin en le qualifiant de meilleur modèle de programmation du marché, avec 91 points sur 100 à son benchmark maison « Senior Engineer », contre 63 pour Opus 4.8 et 62 pour GPT-5.5, un constat partagé par BenchLM. Or depuis le 1ᵉʳ juillet, selon des données publiées le 2 juillet par la plateforme BridgeMind et relayées par Tech Times, les scores de débogage TypeScript de Fable 5 se sont effondrés de 70 %. Pour les développeurs qui avaient adopté le modèle pour ses capacités de programmation, cette dégradation change concrètement l'expérience d'usage et la confiance accordée à l'outil. L'explication ne tiendrait pas à une baisse réelle des capacités du modèle, mais à un nouveau classificateur de cybersécurité introduit avec le retour de Fable 5, qui redirige silencieusement une partie des requêtes de programmation vers Opus 4.8, sans en informer systématiquement les utilisateurs. Cet épisode illustre la tension entre impératifs de sécurité nationale et compétitivité commerciale : pendant les trois semaines de coupure et cette phase de restrictions renforcées, l'usage des modèles chinois a progressé rapidement, un contexte qui pourrait peser sur la position d'Anthropic face à une concurrence internationale de plus en plus pressante.

💬 La chute de perf de Fable 5, c'est pas le modèle qui a baissé, c'est un classificateur de sécurité qui redirige en douce une partie du trafic vers Opus 4.8 sans le dire aux utilisateurs. Sur le papier t'as toujours le meilleur codeur du marché, dans les faits tu causes parfois à un autre modèle sans le savoir. Et pendant les trois semaines de coupure, les modèles chinois ont grignoté du terrain, ça devrait inquiéter Anthropic bien plus qu'un benchmark TypeScript en berne.

LLMsOpinion
1 source
Mes réflexions sur Fable
4Ben's Bites 

Mes réflexions sur Fable

Aujourd'hui marque le dernier jour où Fable est inclus gratuitement dans les abonnements Claude d'Anthropic : dès demain, son usage nécessitera l'achat de crédits séparés. Un utilisateur régulier raconte avoir passé la semaine à converser avec Fable dans une session unique et prolongée, exploitant sa gestion de la mémoire, la compaction des échanges et l'écriture de fichiers, qu'il juge impressionnante. Il a également fait appel à Codex et à Droid comme sous-agents, au point d'épuiser plus vite son quota Codex que celui de Claude Code. Anthropic a par ailleurs publié une nouvelle recherche en interprétabilité montrant que Claude mobilise un « espace de travail global » activant des concepts qui n'apparaissent ni dans la réponse finale ni dans la chaîne de raisonnement visible, mais qui influencent malgré tout son comportement, un mécanisme que les chercheurs comparent à une forme de pensée inconsciente. Du côté d'OpenAI, The Information rapporte que l'entreprise a trouvé un moyen de réduire de moitié le coût d'inférence de ses modèles, déjà testé sur les utilisateurs non connectés de ChatGPT, la dernière baisse de prix majeure remontant à un an avec la réduction de 80% du coût d'o3. Ces annonces comptent parce qu'elles redessinent la manière dont les professionnels choisissent et utilisent leurs outils d'IA au quotidien. La fin de la gratuité de Fable pousse les utilisateurs à repenser leur rapport à un outil qu'ils décrivent moins comme un assistant de développement que comme un véritable partenaire de réflexion, capable de connexions créatives que d'autres modèles peinent à reproduire. Cette bascule illustre aussi une tension plus large dans l'industrie entre agents conçus pour coder efficacement, comme Codex jugé plus rapide et plus abouti, et des harnais pensés pour le brainstorming, où la vitesse compte moins que la profondeur de pensée. Une éventuelle baisse des coûts d'inférence chez OpenAI pourrait, si elle s'étend aux API payantes, rendre l'usage intensif de ces modèles plus accessible aux développeurs et entreprises, un enjeu economique important dans un secteur ou les couts de calcul restent le principal frein a l'adoption a grande echelle. Le contexte plus large est celui d'une accélération attendue cette semaine avec l'arrivée annoncée de GPT-5.6, potentiellement dans sa variante Sol, censée rivaliser avec les capacités créatives et de raisonnement d'Anthropic. Parmi les autres sorties notables figure GPT-Realtime-2.1-mini, un nouveau modèle de l'API OpenAI capable de traiter de la vidéo en entrée et de produire de l'audio tout en effectuant du raisonnement et des appels d'outils. Un projet distinct, MIRA, a par ailleurs entraîné un modèle de monde jouable sur 10 000 heures de parties façon Rocket League, donnant une sensation de jeu réel malgré des graphismes sommaires. Sponsorisée par Adobe Firefly, cette actualité s'accompagne du déploiement de nouvelles capacités agentiques pour l'outil, incluant la création de chartes de marque, de vidéos produits courtes, un montage automatique baptisé Quick Cut et la génération de storyboards, signe que la course à l'intégration de l'IA générative dans les usages créatifs professionnels continue de s'intensifier sur tous les fronts.

UEUne éventuelle baisse du coût d'inférence des API OpenAI profiterait aussi aux développeurs et entreprises européens qui les utilisent.

💬 La fin de la gratuité de Fable, c'est le signal qu'on sort de l'ère où l'IA générative se distribuait comme un bonus marketing : à partir de maintenant, on paie pour ce que l'outil vaut vraiment, pas pour l'abonnement qui l'englobe gratuitement. La recherche d'Anthropic sur la "pensée inconsciente" de Claude est fascinante, mais ça reste du labo, pas du produit. Le vrai enjeu, il est chez OpenAI, qui coupe son coût d'inférence en deux : si ça arrive sur l'API payante, ça change la donne pour tous ceux qui tournent ces modèles en prod.

LLMsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic