SpaceXAI dévoile Grok 4.6, dépasse Kimi K3 et rejoint GPT-5.6 Sol au 3e rang mondial sur Artificial Analysis
SpaceXAI, l'entreprise d'Elon Musk anciennement appelée xAI, a dévoilé Grok 4.6, son nouveau modèle d'IA de pointe conçu pour les agents de longue durée, le codage et les tâches de connaissance. Le modèle obtient un score de 61 sur l'Artificial Analysis Intelligence Index, dépassant le modèle chinois Kimi K3 de Moonshot AI, égalant GPT-5.6 Sol Max d'OpenAI, et progressant de cinq points par rapport à Grok 4.5 High, derrière Claude Opus 5 et Claude Fable 5 d'Anthropic, premier et deuxième du classement. Son API démarre à 2 dollars par million de tokens en entrée et 6 dollars en sortie sous 200 000 tokens de contexte (4 et 12 dollars au-delà), soit moins de la moitié du tarif standard de GPT-5.6 Sol. Le modèle est disponible dans Grok Build, via l'abonnement SuperGrok à 30 dollars par mois, ainsi que dans Cursor, la startup de codage récemment rachetée par SpaceX, et chez des partenaires comme OpenRouter, Vercel et Cloudflare, avec des quotas doublés durant la première semaine.
Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →
Ce lancement marque un glissement du benchmark pur vers la fiabilité des agents en conditions réelles : pour les entreprises, l'enjeu est la capacité d'un modèle à rester concentré sur une tâche longue, qu'il s'agisse d'explorer un sujet inconnu, d'analyser des données, de naviguer dans une base de code ou de transformer une idée en application fonctionnelle. En associant des gains notables sur les benchmarks de codage, de terminal et d'agents à un prix resté inférieur à celui de plusieurs rivaux propriétaires, SpaceXAI cherche à rendre ces usages prolongés économiquement viables à grande échelle. Cela accentue aussi la pression tarifaire sur OpenAI et Anthropic, dont les modèles haut de gamme coûtent nettement plus cher à l'usage, tout en concurrençant des acteurs chinois comme DeepSeek ou Xiaomi, souvent moins onéreux.
Ce lancement s'inscrit dans une cadence très rapide chez SpaceXAI, qui a mis à jour son modèle phare presque mensuellement depuis Grok 4.5 en juillet, tout en élargissant son écosystème avec Grok Bot, lancé la veille pour assigner des agents IA à des tâches définies, en guise d'employés virtuels. SpaceXAI indique avoir soumis Grok 4.6 à un entraînement supplémentaire plus long, combinant données de raisonnement générées par IA et données d'ingénierie, puis utilisé Grok 4.5 pour régénérer des trajectoires d'affinage supervisé en codage, sciences et travail de connaissance, filtrées par des contrôles automatisés. Un entraînement par renforcement a ensuite ciblé des environnements agentiques variés, du codage général à la conception assistée par ordinateur, traduisant une bataille plus large entre laboratoires où la durée d'attention et le coût priment désormais sur le seul score brut.
Pas d'impact direct sur la France/UE