Aller au contenu principal
LLMs · Actu ·

SpaceXAI dévoile Grok 4.6, dépasse Kimi K3 et rejoint GPT-5.6 Sol au 3e rang mondial sur Artificial Analysis

SpaceXAI, l'entreprise d'Elon Musk anciennement appelée xAI, a dévoilé Grok 4.6, son nouveau modèle d'IA de pointe conçu pour les agents de longue durée, le codage et les tâches de connaissance. Le modèle obtient un score de 61 sur l'Artificial Analysis Intelligence Index, dépassant le modèle chinois Kimi K3 de Moonshot AI, égalant GPT-5.6 Sol Max d'OpenAI, et progressant de cinq points par rapport à Grok 4.5 High, derrière Claude Opus 5 et Claude Fable 5 d'Anthropic, premier et deuxième du classement. Son API démarre à 2 dollars par million de tokens en entrée et 6 dollars en sortie sous 200 000 tokens de contexte (4 et 12 dollars au-delà), soit moins de la moitié du tarif standard de GPT-5.6 Sol. Le modèle est disponible dans Grok Build, via l'abonnement SuperGrok à 30 dollars par mois, ainsi que dans Cursor, la startup de codage récemment rachetée par SpaceX, et chez des partenaires comme OpenRouter, Vercel et Cloudflare, avec des quotas doublés durant la première semaine.

2 min de lecturePertinence 58
Source

Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →

Ce lancement marque un glissement du benchmark pur vers la fiabilité des agents en conditions réelles : pour les entreprises, l'enjeu est la capacité d'un modèle à rester concentré sur une tâche longue, qu'il s'agisse d'explorer un sujet inconnu, d'analyser des données, de naviguer dans une base de code ou de transformer une idée en application fonctionnelle. En associant des gains notables sur les benchmarks de codage, de terminal et d'agents à un prix resté inférieur à celui de plusieurs rivaux propriétaires, SpaceXAI cherche à rendre ces usages prolongés économiquement viables à grande échelle. Cela accentue aussi la pression tarifaire sur OpenAI et Anthropic, dont les modèles haut de gamme coûtent nettement plus cher à l'usage, tout en concurrençant des acteurs chinois comme DeepSeek ou Xiaomi, souvent moins onéreux.

Ce lancement s'inscrit dans une cadence très rapide chez SpaceXAI, qui a mis à jour son modèle phare presque mensuellement depuis Grok 4.5 en juillet, tout en élargissant son écosystème avec Grok Bot, lancé la veille pour assigner des agents IA à des tâches définies, en guise d'employés virtuels. SpaceXAI indique avoir soumis Grok 4.6 à un entraînement supplémentaire plus long, combinant données de raisonnement générées par IA et données d'ingénierie, puis utilisé Grok 4.5 pour régénérer des trajectoires d'affinage supervisé en codage, sciences et travail de connaissance, filtrées par des contrôles automatisés. Un entraînement par renforcement a ensuite ciblé des environnements agentiques variés, du codage général à la conception assistée par ordinateur, traduisant une bataille plus large entre laboratoires où la durée d'attention et le coût priment désormais sur le seul score brut.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Grok 4.5 : l’IA qui veut dépasser GPT-5.5 et Claude sur le code42Le Big DataLLMs 02Grok 4.5 de SpaceXAI, entraîné par Cursor pour le code et les tâches à base d'agents, arrive à 2$/M tokens22MarkTechPostLLMs 03Grok 4.5 de SpaceXAI, premier modèle de niveau Opus après le rachat de Cursor47Latent SpaceLLMs 
Dossier · xAI / GrokSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.