Aller au contenu principal
LLMs · Opinion ·

Meta affirme que Muse Spark 1.3 atteint des performances de pointe, mais ses meilleurs résultats viennent d'un modèle pas encore largement accessible

Meta a dévoilé le 2 septembre 2026 son nouveau modèle Muse Spark 1.3, présenté par le PDG et cofondateur Mark Zuckerberg sur X comme la « plus grande avancée » de l'entreprise en code et en tâches agentiques, avec des performances qu'il juge « presque trop bon marché pour être facturées au compteur ». Le modèle progresse nettement par rapport à la version 1.2 sortie le mois précédent, notamment sur les tâches agentiques de longue durée. Mais les meilleurs résultats affichés par Meta proviennent d'une configuration dite « max », encore en phase de tests de sécurité et dont le déploiement est annoncé comme imminent sans date précise ; le cabinet d'analyse indépendant Artificial Analysis indique l'avoir évaluée uniquement lors d'un aperçu limité réservé à des partenaires, sans qu'aucun fournisseur d'API ne la propose actuellement. La version réellement disponible cette semaine, via le harnais Muse Code et l'API de modèles de Meta, utilise le réglage « xhigh » déjà existant. Sur GDPval-AA v2, max atteint 1 754 points Elo contre 1 709 pour xhigh ; sur OSWorld 2.0, 66,9 contre 57,2 ; sur JobBench, 64,9 contre 61,2. Sur l'indice d'intelligence d'Artificial Analysis, xhigh obtient 61 points contre 62 pour max, un score qui l'aligne sur GPT-5.6 Sol max d'OpenAI, Grok 4.6 high de xAI et Claude Opus 5 high d'Anthropic.

2 min de lecturePertinence 62

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →

Cette distinction entre modèle vitrine et modèle réellement livré change la question posée aux entreprises : il ne s'agit plus de savoir si Meta peut atteindre le niveau des meilleurs modèles du marché, mais de mesurer l'écart réel de performance et de coût de la version qu'elles peuvent effectivement déployer. Meta n'a pas dissimulé les deux jeux de résultats dans son rapport d'évaluation, mais ses documents de lancement mettent surtout en avant la configuration max, ce qui peut créer une impression trompeuse sur ce qu'obtiendront concrètement les développeurs. Meta assure toutefois que le modèle disponible est devenu plus efficace à l'usage : il recourrait à environ 20 % d'appels d'outils en moins et 25 % de tokens en moins que la version 1.2 pour des tâches de code, un gain qui compte davantage que quelques points de benchmark pour des entreprises exécutant des millions de boucles agentiques. Signe que Meta ne cherche pas à gagner sur le prix, la tarification standard reste inchangée par rapport à 1.2, à 1,25 dollar par million de tokens en entrée, 4,25 dollars en sortie et 0,15 dollar pour les tokens mis en cache.

Le lancement s'inscrit dans une compétition serrée entre grands laboratoires d'IA générative. Le mois dernier, Muse Spark 1.2 restait nettement derrière Claude Opus 5 d'Anthropic sur les tests de code, avec 82,9 % contre 86,7 % sur Terminal-Bench 2.1. Avec la version 1.3, Meta rivalise désormais directement avec OpenAI et Anthropic sur plusieurs évaluations de code et d'agents, même si Anthropic conserve la tête du classement d'Artificial Analysis grâce à Claude Fable 5.1, qui atteint 66 points en configuration max et 65 en xhigh, contre 63 pour Claude Opus 5 dans les deux configurations. La bataille se joue désormais autant sur l'efficacité opérationnelle et le rapport prix-performance réellement accessible aux développeurs que sur les records bruts de benchmarks.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Meta Superintelligence Labs lance Muse Spark 1.1, un modèle de raisonnement multimodal pour les tâches à base d'agents sur Meta Model API45MarkTechPostLLMs 02Meta Superintelligence Lab lance Muse Spark : modèle multimodal avec compression du raisonnement et agents parallèles49MarkTechPostLLMs 03Muse Spark 1.3 égale GPT-5.6-Sol, confirmant Meta Superintelligence comme nouveau labo de pointe, remise de plus de 90% sur l'entraînement59Latent SpaceLLMs 
Dossier · Meta IASuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.