Claude Opus 5.5, GPT-6 Sol et Luna : Anthropic et OpenAI se battent sur les prix
Anthropic et OpenAI ont dévoilé, à quelques minutes d'intervalle, une nouvelle génération de modèles de langage. Anthropic a présenté Claude Opus 5.5, qui devient son modèle phare et surpasse son prédécesseur Opus 5 ainsi que Fable 5.1, lancé début septembre, sur les benchmarks internes de l'entreprise. Il dépasse aussi GPT-6 Astra d'OpenAI, sauf sur deux tests précis, Terminal-Bench-Science 0.1 pour la recherche agentique et AutomationBench pour les agents en conditions de travail réelles. Opus 5.5 se distingue en programmation, en agents autonomes, en analyse métier et en recherche, avec des gains marqués sur les tâches longues, les migrations de code et les workflows complexes. Son tarif baisse d'environ 40 % par rapport à Opus 5 : 4 dollars par million de tokens en entrée, 20 dollars en sortie, et 0,20 dollar pour les lectures de cache, pour une génération 30 % plus rapide. Presque simultanément, OpenAI a lancé GPT-6 Sol et GPT-6 Luna, deux modèles moins puissants qu'Astra mais bien moins chers, avec des prix divisés par deux par rapport à GPT-5.6 : 2 dollars en entrée et 10 dollars en sortie pour Sol, seulement 0,10 dollar en entrée et 0,50 dollar en sortie pour Luna, et 90 % de réduction sur les tokens déjà mis en cache dans les longs contextes.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de Next INpact. Lire l'article original →
Également couvert par Les Numériques IA.
Cette bataille tarifaire marque une nouvelle phase de la concurrence entre les deux laboratoires : après s'être longtemps affrontés sur la pure performance, ils rivalisent désormais sur l'efficacité économique. Sur AutomationBench, GPT-6 Sol obtient 33,2 % de réussite pour 0,27 dollar par tâche, contre 26,9 % pour Claude Opus 5, jugé environ onze fois plus coûteux à l'usage. Pour les entreprises qui déploient des agents IA à grande échelle, ce coût par tâche accomplie devient un critère aussi déterminant que le score brut. Anthropic reconnaît elle-même que l'écart entre Opus 5.5 et Fable 5.1 est « plus faible » en conditions réelles que ne le suggèrent les benchmarks, signe que la course aux scores atteint ses limites. Pour les professionnels et développeurs, ces baisses de prix ouvrent l'accès à des modèles plus performants ou plus rapides à moindre coût, ce qui pourrait accélérer l'adoption de workflows agentiques jusqu'ici jugés trop onéreux, chaque tâche multipliant les appels aux modèles.
Cette accélération tarifaire intervient alors que les deux entreprises multiplient les garde-fous face à des modèles toujours plus capables. Anthropic a doté Opus 5.5 des mêmes protections que Fable 5.1 en cybersécurité, biologie et distillation : les requêtes sensibles sont redirigées vers un autre modèle, Opus 4.8, qui traite la plupart des tâches liées à la cybersécurité à la place du modèle phare. Les organisations souhaitant des capacités élargies dans ce domaine doivent passer par le Cyber Verification Program de l'entreprise. Ces annonces s'inscrivent dans une compétition plus large, où Google et sa famille Gemini pèsent également, et où le rapport prix/performance devient un argument commercial central face à des clients professionnels de plus en plus attentifs aux coûts d'exploitation de leurs agents IA. OpenAI, de son côté, réserve son modèle le plus puissant, GPT-6 Astra, aux usages haut de gamme, avec des prompts pouvant coûter jusqu'à 33 dollars, illustrant une segmentation croissante entre modèles économiques pour les tâches courantes et modèles premium pour les tâches les plus exigeantes.
Les baisses de prix profitent aux entreprises et développeurs européens utilisant ces API, mais aucune entreprise ni régulation française ou européenne n'est directement concernée.