OpenAI lance GPT-6 Sol et Luna : prix API réduits de 50 % et benchmarks
OpenAI a lancé le 23 septembre 2026 deux nouveaux modèles, GPT-6 Sol et GPT-6 Luna, qui viennent compléter GPT-6 Astra, sorti plus tôt dans le mois et positionné comme le modèle haut de gamme de la famille. Sol cible le développement complexe et les tâches professionnelles à moindre coût, tandis que Luna vise les usages rapides et à fort volume. Les deux modèles sont disponibles immédiatement via l'API sous les identifiants gpt-6-sol et gpt-6-luna, sans poids téléchargeables puisqu'il s'agit de modèles accessibles uniquement en API. OpenAI en profite pour baisser les prix de 50 % par rapport au tarif promotionnel de GPT-5.6 : Sol passe à 2 dollars par million de tokens en entrée et 10 dollars en sortie (contre 4 et 20 dollars), tandis que Luna tombe à 0,10 dollar en entrée et 0,50 dollar en sortie, une baisse de près de 58 % sur la sortie. Astra reste à 10 dollars en entrée et 50 dollars en sortie. Sur les benchmarks internes, Sol en mode de raisonnement maximal atteint 33,2 % sur AutomationBench pour 0,27 dollar par tâche, contre 26,9 % pour Claude Opus 5 d'Anthropic à un coût onze fois supérieur, et 56,4 % sur Agents' Last Exam, dépassant Opus 5 pour 60 % de coût en moins. Luna, moins puissant mais nettement moins cher, obtient 66,6 % sur DeepSWE v1.1, un niveau comparable à Opus 5, pour 93 % de coût en moins.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de MarkTechPost. Lire l'article original →
Également couvert par OpenAI Blog.
Cette annonce illustre la stratégie d'OpenAI consistant à décliner ses avancées techniques en plusieurs niveaux de prix plutôt que de réserver la performance au modèle le plus cher. Pour les entreprises qui déploient des agents IA ou des outils de codage automatisé à grande échelle, la baisse de coût change concrètement l'équation économique : des tâches auparavant réservées aux modèles premium deviennent accessibles en volume. OpenAI met aussi en avant un système de mise en cache des prompts amélioré, avec des réductions allant jusqu'à 90 % sur les tokens réutilisés dans une fenêtre de trente minutes, ce qui profite directement aux agents conversationnels de longue durée. GitHub indique que ces changements ont réduit de plus de 50 % la part de tokens nécessitant un traitement complet, accélérant les réponses de Copilot.
Cette sortie s'inscrit dans une compétition tarifaire de plus en plus vive avec Anthropic, dont les modèles Claude Opus 5 et Claude Fable 5.1 servent systématiquement de référence dans les comparatifs publiés par OpenAI. Le déploiement dans ChatGPT reste progressif : les versions Work et Codex sont réservées aux abonnés Plus, Pro, Business, Enterprise et Edu, tandis que Luna arrive d'abord dans l'application de bureau pour les utilisateurs gratuits et Go, sans encore être disponible dans l'interface Chat classique.
Pas d'impact direct sur la France/UE