SpaceXAI publie Grok 4.7, un modèle de base plus grand, au même prix que Grok 4.6 (2$/6$)
SpaceXAI a lancé le 22 septembre 2026 Grok 4.7, son nouveau modèle phare pour le code, les tâches agentiques et le travail de connaissance. Construit sur une base plus grande que Grok 4.6 et entraîné avec un cycle d'apprentissage par renforcement plus long, orienté vers des problèmes complexes nécessitant plusieurs heures de résolution, il conserve pourtant exactement le même tarif : 2 dollars par million de tokens en entrée et 6 dollars en sortie. Le modèle, disponible immédiatement via l'API xAI, Cursor, Grok Build, OpenRouter, Vercel et Cloudflare, offre une fenêtre de contexte de 500 000 tokens, une date de connaissance arrêtée à mai 2026, et quatre niveaux d'effort de raisonnement (low, medium, high par défaut, xhigh). Sur les benchmarks, Grok 4.7 progresse sur tous les indicateurs par rapport à Grok 4.6, avec un bond spectaculaire sur Terminal-Bench 4.0 (de 20,3 % à 38,0 %) et un score record de 64,0 % sur EEBench. Il devance nettement ses rivaux sur le benchmark juridique de Harvey (19,6 % contre 6,7 % pour Fable 5.1 Max), mais Fable 5.1 Max reste en tête sur quatre des sept benchmarks testés, et GPT-5.6 Sol Max conserve l'avantage sur DeepSWE v1.1 avec 72,7 %. Une version accélérée, Grok 4.7 Fast, double la vitesse de sortie pour le double du prix, mais reste réservée à Cursor et Grok Build.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de MarkTechPost. Lire l'article original →
Cette sortie illustre une bataille tarifaire et technique intense entre les grands fournisseurs de modèles. En maintenant ses prix inchangés tout en améliorant les performances, SpaceXAI cherche à occuper la position la plus avantageuse du marché en rapport qualité-prix, alors que Fable 5.1 Max coûte cinq fois plus cher à l'entrée et GPT-5.6 Sol Max environ deux fois plus. Pour les développeurs et les entreprises qui intègrent ces modèles dans des outils de codage ou des agents autonomes, cela signifie un accès à des capacités accrues sans surcoût, renforçant la pression concurrentielle sur les acteurs plus chers. Le renforcement de la sécurité est également notable : Grok 4.7 intègre une nouvelle pile de garde-fous, présentée comme la plus robuste testée par l'entreprise contre les tentatives de contournement, avec un score de 62,4 % sur le benchmark de biosécurité de LatchBio et seulement 3,3 % de requêtes risquées laissées passer sur HackerBench v0.3.
Cette annonce s'inscrit dans une course effrénée entre les grands laboratoires d'intelligence artificielle, où SpaceXAI, OpenAI et les développeurs de la famille Fable rivalisent sur les capacités agentiques, le codage et la sécurité des modèles. L'accès désormais accordé à certains partenaires en cybersécurité pour des recherches défensives sur les capacités de red-teaming du modèle traduit une volonté d'encadrer les usages sensibles tout en ouvrant la voie à des collaborations ciblées, dans un contexte où la vitesse d'itération des modèles s'accélère continuellement.
Pas d'impact direct sur la France/UE
Grok 4.7 au même prix que 4.6, c'est le vrai signal ici, pas le bond sur Terminal-Bench. Quand xAI double la perf sans toucher au tarif, c'est toute la grille de Fable et OpenAI qui devient dure à justifier, cinq fois le prix pour un avantage qui se limite à trois benchmarks sur sept. Bon, sur le papier, parce que reste à voir si ça tient en prod sur des tâches de plusieurs heures, c'est là que les scores de labo s'effondrent souvent.