Aller au contenu principal
GPT-5.5 coûte 49 à 92 % plus cher que son prédécesseur, selon la longueur des entrées
BusinessThe Decoder · 1 min de lecture

GPT-5.5 coûte 49 à 92 % plus cher que son prédécesseur, selon la longueur des entrées

Source originale ↗·

OpenAI a doublé le prix affiché de GPT-5.5 par rapport à GPT-5.4, justifiant cette hausse par la promesse que des réponses plus courtes compenseraient le surcoût pour les utilisateurs. Mais une analyse conduite par OpenRouter, plateforme d'agrégation de modèles de langage, révèle que la réalité est bien différente : en s'appuyant sur des données d'utilisation réelles, OpenRouter conclut que les coûts effectifs ont augmenté de 49 à 92 % selon la longueur des requêtes soumises au modèle.

Cette hausse tarifaire a des conséquences directes pour les développeurs et les entreprises qui intègrent GPT-5.5 dans leurs applications via l'API d'OpenAI. Une augmentation pouvant frôler les 100 % sur certains usages représente un choc budgétaire significatif, en particulier pour les startups et les équipes traitant de gros volumes de requêtes. Le fait que l'écart entre le tarif officiel et le coût réel soit si prononcé soulève également des questions sur la transparence des grilles tarifaires publiées par OpenAI.

Anthropic a, elle aussi, relevé le prix de son modèle haut de gamme Opus 4.7, confirmant une tendance de fond dans l'industrie. Les deux entreprises se préparent à une introduction en bourse, ce qui pourrait expliquer une stratégie visant à améliorer leur rentabilité à court terme. Alors que la concurrence entre les grands acteurs de l'IA reste intense, cette course à la hausse des prix suggère que la phase de conquête à prix coûtant laisse progressivement place à une logique de monétisation plus agressive.

Impact France/UE

Les startups et développeurs européens intégrant GPT-5.5 ou Opus 4.7 via API subissent une hausse effective de 49 à 92 % de leurs coûts opérationnels, les contraignant à revoir leurs budgets ou à évaluer des alternatives open-source.

💬 L'analyse de Mathieu

La "promesse de réponses plus courtes qui compensent", c'était du flan. OpenRouter a sorti les vraies données d'utilisation : +49 à +92% sur les coûts réels selon la longueur des requêtes, loin de ce qu'annonce le tarif officiel. Entre les deux boîtes en pré-IPO qui remontent leurs marges simultanément, le signal est assez lisible.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

DeepSeek propose son modèle V4 à 97 % moins cher que GPT-5.5 d'OpenAI
1SCMP Tech 

DeepSeek propose son modèle V4 à 97 % moins cher que GPT-5.5 d'OpenAI

DeepSeek a annoncé dimanche une baisse drastique des tarifs de ses modèles d'intelligence artificielle, dont son dernier modèle V4, désormais proposé à 97 % moins cher que les produits d'OpenAI. Concrètement, le coût minimum des entrées en cache pour les utilisateurs d'API tombe à environ 0,14 dollar par million de tokens, soit un dixième du prix précédent. Cette réduction s'applique aux "input cache hits", c'est-à-dire aux situations où un contexte déjà traité est réutilisé, ce qui concerne une grande partie des appels API en production. Cette annonce pourrait déclencher une nouvelle guerre des prix dans un secteur déjà sous pression. Pour les développeurs et les entreprises qui s'appuient sur des API de LLMs pour leurs applications, un écart de prix de 97 % par rapport à GPT-5.5 d'OpenAI représente un argument économique difficile à ignorer. Cela contraint directement les acteurs occidentaux à revoir leur stratégie tarifaire ou à justifier différemment la valeur de leurs modèles. DeepSeek s'est imposé début 2025 comme un compétiteur sérieux face aux géants américains, notamment avec son modèle R1 qui avait surpris l'industrie par ses performances à coût réduit. La startup chinoise capitalise sur des architectures optimisées et des coûts d'infrastructure inférieurs pour casser les prix. Cette dynamique s'inscrit dans une rivalité technologique plus large entre la Chine et les États-Unis sur le terrain de l'IA, où la course à la performance s'est progressivement doublée d'une course aux prix accessibles.

UELes développeurs et entreprises européennes utilisant des APIs LLM peuvent réduire drastiquement leurs coûts d'inférence, tout en bénéficiant d'une pression à la baisse sur les tarifs des autres fournisseurs présents sur le marché européen.

BusinessOpinion
1 source
☕️ Quand l’IA agentique coûte plus cher que de payer ses employés humains
2Next INpact 

☕️ Quand l’IA agentique coûte plus cher que de payer ses employés humains

Les grandes entreprises technologiques font face à une équation économique qui commence à gripper sérieusement leurs ambitions d'IA : la facturation à l'usage des agents IA, calculée en tokens et non plus en abonnements forfaitaires, rend ces systèmes plus onéreux que les employés humains qu'ils sont censés remplacer ou assister. Le CTO d'Uber, Praveen Neppalli Naga, a reconnu avoir épuisé la totalité de son budget IA 2026 en seulement quatre mois. Bryan Catanzaro, vice-président en charge de l'apprentissage profond appliqué chez Nvidia, est encore plus direct : pour son équipe, le coût de la puissance de calcul dépasse désormais celui des salaires. Microsoft, après avoir encouragé en décembre dernier des milliers de ses développeurs à utiliser Claude Code d'Anthropic, vient d'annuler ces licences et les contraint à migrer vers GitHub Copilot CLI. Ce même GitHub Copilot, qui avait limité fin avril les nouveaux abonnements individuels, basculera en juin vers une facturation indexée sur la consommation réelle de tokens. Cette pression économique a engendré un phénomène pervers baptisé « tokenmaxxing » : des employés génèrent artificiellement de l'activité IA pour gonfler leurs statistiques de consommation, moins pour produire du code utile que pour paraître surproductifs aux yeux de leur hiérarchie. Amazon a fixé comme objectif que 80 % de ses développeurs utilisent l'IA chaque semaine et suit leur consommation de tokens. Meta est allé plus loin encore, avec un tableau de bord interne attribuant le statut de « Token Legend » aux plus grands consommateurs. Ce que ces pratiques révèlent, c'est que les métriques de tokens sont devenues des indicateurs de performance managériale avant d'être des mesures de valeur créée. La question de fond est structurelle : les modèles agentiques consomment beaucoup plus de tokens par tâche que les modèles classiques, et cette intensité ne sera pas compensée par la baisse des coûts unitaires. Un rapport Gartner estime que le coût d'inférence sur un LLM sophistiqué pourrait chuter de 90 % d'ici 2030, mais prévoit néanmoins que le coût total de l'IA continuera d'augmenter si la consommation progresse plus vite que la déflation tarifaire. Jensen Huang, PDG de Nvidia, imaginait récemment un futur où 100 agents IA travailleraient aux côtés de chaque employé humain de son entreprise, une vision qui semble économiquement intenable dans le modèle de facturation actuel. L'industrie se retrouve donc devant un choix structurant : soit les prix s'effondrent suffisamment vite, soit les entreprises doivent revoir radicalement leur usage de l'IA agentique, sous peine de financer des dépenses dont le retour reste difficile à démontrer.

UELes entreprises européennes qui adoptent des agents IA à grande échelle sont exposées aux mêmes pressions économiques liées à la facturation à l'usage, remettant en question la viabilité budgétaire de leurs projets d'IA agentique.

💬 Uber qui épuise son budget IA en quatre mois, Nvidia qui dit que le compute dépasse les salaires : c'est pas un bug, c'est le modèle. Les agents consomment structurellement 10 à 100 fois plus de tokens qu'un chat classique, et aucune baisse de prix unitaire ne rattrapera ça avant 2-3 ans. Le tokenmaxxing chez Amazon et Meta, des gens qui gonflent leur conso pour paraître productifs sur un dashboard, c'est juste le signe qu'on a mis la mauvaise métrique au centre.

BusinessOpinion
1 source
OpenAI casse les prix à la chinoise avec une baisse de 80 % sur son GPT-5.6 le plus abordable
3The Decoder 

OpenAI casse les prix à la chinoise avec une baisse de 80 % sur son GPT-5.6 le plus abordable

À partir du 30 juillet, OpenAI réduit de 80 % le prix de son modèle GPT-5.6 Luna, l'offre la plus abordable de sa gamme, et de 20 % celui de Terra, un modèle de milieu de gamme. L'entreprise explique que ces baisses ont été rendues possibles par son modèle haut de gamme Sol, qui a permis d'optimiser l'efficacité de sa propre infrastructure de calcul. Cette annonce s'inscrit dans une stratégie tarifaire de plus en plus agressive pour OpenAI, qui aligne désormais ses prix d'entrée de gamme sur ceux pratiqués par certains fournisseurs chinois. Cette décision a des conséquences directes pour les développeurs et les entreprises qui bâtissent leurs produits sur l'API d'OpenAI, puisqu'un modèle nettement moins cher élargit l'accès à l'intelligence artificielle générative pour des usages à fort volume ou à budget limité. Pour les acteurs du secteur, ce mouvement confirme que la compétition sur les coûts d'inférence devient un axe stratégique aussi important que la performance brute des modèles, forçant l'ensemble du marché à revoir ses grilles tarifaires. Cette baisse intervient dans un contexte de pression concurrentielle croissante. Les fournisseurs chinois proposent depuis plusieurs mois des modèles à des tarifs très inférieurs à ceux du marché occidental, tandis que Microsoft, pourtant partenaire historique et investisseur majeur d'OpenAI, développe en parallèle ses propres modèles MAI, ce qui accentue la pression sur les prix même au sein de l'écosystème. Cette dynamique laisse entrevoir de nouvelles baisses tarifaires à venir chez les principaux fournisseurs d'IA générative, à mesure que la course à l'efficacité des infrastructures s'intensifie.

UELes entreprises et développeurs européens utilisant l'API d'OpenAI bénéficient de coûts d'inférence réduits, mais aucune entreprise ou réglementation française/européenne n'est directement concernée.

💬 Bon, OpenAI joue enfin la carte qu'on attendait depuis que DeepSeek a mis tout le monde mal à l'aise. Une baisse de 80% sur Luna, c'est pas du marketing, c'est une réponse directe à la pression chinoise, et ça confirme un truc simple : le vrai champ de bataille en 2026, c'est plus qui a le meilleur modèle, c'est qui fait tourner l'inférence le moins cher. Pour les devs qui bâtissent dessus, tant mieux. Mais faut pas se leurrer, cette guerre des prix va finir par rogner les marges de tout le monde, OpenAI compris.

BusinessActu
1 source
☕️ Google baisse le prix de son offre AI Plus d’entrée de gamme
4Next INpact 

☕️ Google baisse le prix de son offre AI Plus d’entrée de gamme

Google a revu à la baisse le tarif de son abonnement AI Plus d'entrée de gamme : le prix passe de 7,99 à 4,99 euros par mois, soit une réduction de près de 38 %. En parallèle, le stockage inclus dans cette formule double, passant de 200 à 400 Go partagés entre Drive, Photos et Gmail. La formule 2 To change quant à elle de nom, elle s'appelle désormais « AI Plus » en remplacement de « Premium », mais reste facturée 9,99 euros par mois. Les offres supérieures évoluent également : AI Pro (21,99 euros/mois) voit son stockage passer de 2 à 5 To, tandis qu'AI Ultra reste disponible à partir de 99,99 euros pour 20 To de stockage. Cette baisse de prix positionne Google de façon plus agressive face à ses concurrents directs. L'offre AI Plus devient ainsi trois euros moins chère que ChatGPT Go d'OpenAI, rendant l'entrée dans l'écosystème Google AI nettement plus accessible. Pour les utilisateurs, c'est davantage de stockage pour moins cher, un argument concret au-delà du seul accès à l'IA. Toutefois, Google introduit en contrepartie de nouvelles limites d'utilisation dans l'application Gemini, calculées selon la complexité des requêtes, les fonctionnalités utilisées et la longueur des conversations. Ces plafonds se réinitialisent toutes les cinq heures, dans la limite d'un plafond hebdomadaire. Les abonnés AI Plus bénéficient de limites deux fois plus élevées que les utilisateurs non-abonnés, mais le forfait ne comprend plus les 200 crédits mensuels qui étaient auparavant inclus. Lancée en septembre 2025 en Indonésie avant d'être déployée dans la quasi-totalité du monde, l'offre AI Plus s'inscrit dans la stratégie de Google pour élargir sa base d'abonnés payants à l'ère de l'IA. La guerre des prix entre les grandes plateformes, Google, OpenAI, Microsoft, s'intensifie alors que chacune cherche à fidéliser les utilisateurs dans son écosystème. En abaissant le ticket d'entrée tout en ajustant les limites d'usage, Google tente de trouver l'équilibre entre adoption de masse et rentabilité de ses modèles, dont l'inférence reste coûteuse à grande échelle.

UEL'offre AI Plus de Google passe à 4,99 €/mois en France, soit 3 € moins chère que l'offre équivalente d'OpenAI, ce qui rend l'accès à l'IA grand public plus accessible pour les consommateurs français et européens.

BusinessActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic