xAI lance Grok 4.7 à bas prix, mais les benchmarks montrent un large retard face à Claude et GPT-6
xAI a dévoilé Grok 4.7, sa version la plus performante à ce jour, mais les premiers benchmarks révèlent un décrochage net face à la concurrence. Sur l'Artificial Analysis Intelligence Index, un indice de référence qui agrège plusieurs tests de raisonnement, Grok 4.7 obtient seulement 46 points, se classant en milieu de tableau. Claude Fable 5.1 et GPT-6 dominent tous deux avec 53 points chacun, soit un écart de 7 points sur cet indice. L'écart se creuse davantage encore sur les tâches de codage agentique, un domaine où les modèles doivent enchaîner des actions autonomes pour résoudre des problèmes complexes. Le principal argument commercial de xAI reste le prix, Grok 4.7 étant proposé à des tarifs nettement inférieurs à ceux de ses concurrents directs.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →
Ce positionnement tarifaire agressif change la donne pour les entreprises qui déploient des modèles à grande échelle, où le coût par requête pèse lourd dans les décisions d'infrastructure. Pour les développeurs et les équipes produit qui n'ont pas besoin des performances de pointe en raisonnement complexe, Grok 4.7 pourrait constituer une alternative économique viable pour des tâches courantes. Mais pour les usages exigeants, notamment le codage agentique où la fiabilité des enchaînements d'actions est critique, l'écart de performance risque de limiter l'adoption du modèle par les entreprises les plus pointues, qui continueront de privilégier Claude ou GPT-6 malgré leur coût plus élevé.
Cette sortie s'inscrit dans une course effrénée entre les grands laboratoires d'IA, où xAI, la société d'Elon Musk, cherche à se différencier par le prix plutôt que par la pure performance brute face à Anthropic et OpenAI. La stratégie rappelle une dynamique déjà observée dans le secteur du cloud et des semi-conducteurs, où des acteurs challengers misent sur l'accessibilité tarifaire pour gagner des parts de marché avant de rattraper leur retard technologique. Reste à savoir si xAI parviendra à combler cet écart de performance lors de ses prochaines itérations, alors qu'Anthropic et OpenAI continuent d'investir massivement pour maintenir leur avance sur les benchmarks de référence.
Les entreprises européennes déployant des modèles IA a grande échelle pourraient bénéficier de cette option tarifaire plus abordable, sans toutefois égaler les performances des modèles concurrents sur les taches complexes.