SpaceX/xAI: Grok 4.6 est sorti et un bot Grok arrive
xAI a dévoilé Grok 4.6 le 11 août 2026, un modèle de 1,5 billion de paramètres présenté comme construit sur Grok 4.5, avec un accent particulier sur les agents à exécution longue et les tâches interactives ou visuelles complexes. Selon xAI, l'entraînement a combiné une phase supplémentaire plus longue que pour Grok 4.5, des données générées par modèle pour le raisonnement et des concepts techniques avancés, ainsi qu'un optimiseur amélioré ; les trajectoires de fine-tuning supervisé ont ensuite été régénérées via Grok 4.5 sur plusieurs domaines (STEM, ingénierie logicielle, travail de connaissance), avant un apprentissage par renforcement agentique portant sur le code général, le développement web, la conception assistée par ordinateur et l'optimisation de noyaux. Les évaluations indépendantes d'Artificial Analysis placent Grok 4.6 à 61 points sur leur Intelligence Index, un niveau proche de GPT-5.6 Sol Max mais derrière Claude Opus et Fable, avec de solides résultats agentiques : 88,4 % sur Terminal-Bench v2.1 et un score Elo de 1753 sur GDPval-AA v2. Sa tarification, 2 dollars par million de tokens en entrée et 6 dollars en sortie, reste nettement inférieure à celle des modèles concurrents de pointe, et le modèle est déjà disponible dans l'outil Devin de Cognition. Elon Musk a par ailleurs annoncé que Grok 4.7 est déjà en entraînement, avec une phase initiale achevée et un entraînement complémentaire prévu sur des données internes de SpaceX. Le même jour, Alibaba a publié en poids ouverts Qwen3.8-Max, un modèle MoE de 2,4 billions de paramètres au total dont 95 milliards actifs, immédiatement pris en charge par vLLM ainsi que par Together AI et Baseten, avec des versions quantifiées en 4 bits pour les puces Nvidia B300 et AMD MI355X.
Résumé et traduction réalisés par Le Fil IA à partir de Latent Space. Lire l'article original →
Également couvert par 01net.
Ce lancement s'inscrit dans une bataille de plus en plus vive autour du rapport qualité-prix des modèles destinés aux tâches professionnelles et au codage agentique. Des praticiens ont immédiatement désigné Grok 4.6 comme nouveau choix par défaut pour les charges de travail de codage et de détection de bugs, grâce à des performances proches des meilleurs modèles du marché pour une fraction de leur coût. Cette dynamique menace de comprimer les marges des offres concurrentes plus chères tout en accélérant l'adoption d'agents IA autonomes capables de gérer des tâches longues et complexes en entreprise.
Cette annonce s'inscrit dans une journée particulièrement dense pour l'industrie, marquée aussi par les sorties de DeepSeek V4 Pro et de MAI-Thinking-1 chez Microsoft, illustrant l'intensification de la course entre laboratoires. Elle confirme également une tendance observée tout au long de l'année 2026 : les agents de codage débordent progressivement du développement logiciel pur vers l'ensemble du travail de connaissance, un terrain que xAI, Anthropic avec sa fonctionnalité Tag et Block avec son outil Buzz se disputent désormais activement.
Pas d'impact direct sur la France/UE