Aller au contenu principal
LLMs · Opinion ·

OpenAI baisse de 80% les prix de GPT-5.6 Luna, la concurrence se déplace désormais sur les coûts

OpenAI a annoncé une baisse spectaculaire des prix de deux modèles de sa gamme GPT-5.6 : GPT-5.6 Luna, le plus petit et le plus rapide de la série, voit son tarif chuter de 80%, tandis que GPT-5.6 Terra, le modèle intermédiaire, baisse de 20%. Luna passe désormais à 0,20 dollar par million de tokens en entrée et 1,20 dollar en sortie, soit un total combiné de 1,40 dollar par million de tokens, contre 7 dollars auparavant (1 dollar en entrée, 6 dollars en sortie). Terra coûte maintenant 2 dollars en entrée et 12 dollars en sortie, pour un total de 14 dollars. Le prix de GPT-5.6 Sol en mode Standard reste inchangé à 35 dollars au total, mais OpenAI introduit un nouveau mode Fast, facturé deux fois plus cher (10 dollars en entrée, 60 dollars en sortie, soit 70 dollars au total), qui promet jusqu'à 2,5 fois plus de débit sans changer l'intelligence sous-jacente du modèle. Sam Altman, cofondateur et PDG d'OpenAI, a annoncé ces changements sur X en évoquant de "importantes baisses de prix".

2 min de lecturePertinence 44

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de VentureBeat AI. Lire l'article original →

Cette annonce intervient seulement quelques jours après le lancement de Claude Opus 5 par Anthropic, au même prix que son prédécesseur Opus 4.8, et après l'introduction par Google de Gemini 3.6 Flash et Gemini 3.5 Flash-Lite, deux modèles pensés pour réduire les coûts d'inférence et accélérer l'exécution des tâches agentiques. Avec cette révision tarifaire, OpenAI positionne Luna sous Gemini 3.5 Flash-Lite (2,80 dollars au total) et très loin sous Gemini 3.6 Flash (9 dollars), tout en cherchant à séduire les utilisateurs d'Anthropic grâce à la vitesse plutôt qu'au prix. La stratégie illustre une bascule nette de la compétition entre grands modèles de langage : after des mois centrés sur les capacités brutes, la bataille se joue désormais sur le rapport performance-coût, un critère décisif pour les entreprises qui déploient ces modèles à grande échelle dans des applications agentiques ou des volumes massifs de requêtes.

Ce mouvement s'inscrit dans une guerre des prix plus large qui agite tout le secteur. Le marché reste dominé par des acteurs encore moins chers : le MiMo-V2.5 Flash de Xiaomi (0,40 dollar au total) et le DeepSeek-V4-Flash (0,42 dollar) restent sous la barre du dollar par million de tokens, loin devant Luna. Les modèles chinois, notamment ceux de Xiaomi, DeepSeek, Alibaba et MiniMax, tirent les prix vers le bas sur l'ensemble du marché, forçant les géants américains à réagir. À l'autre extrémité du spectre, les modèles les plus puissants comme GPT-5.6 Sol en mode Fast, Claude Fable 5 ou Claude Mythos 5 restent facturés entre 60 et 70 dollars par million de tokens, réservés aux usages les plus exigeants. Cette segmentation croissante entre modèles ultra-économiques et modèles premium à haute performance pourrait redéfinir la manière dont les entreprises choisissent leurs fournisseurs d'intelligence artificielle dans les mois à venir.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01OpenAI GPT-5.6 Sol, Terra et Luna sont désormais disponibles sur Amazon Bedrock47AWS ML BlogLLMs 02SpaceX lance Grok 4.5 a moitie prix de la concurrence, un defi pour Anthropic et OpenAI52VentureBeat AILLMs 03« GPT 5.6 fait baisser les prix de 20 à 80 % : le coût de l'intelligence de GPT 5.4 a chuté de 13x en 4 mois »46Latent SpaceLLMs 
Dossier · GPT-5Suivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.