Aller au contenu principal
OpenAI lance officiellement GPT-5.6 : meilleur que Mythos 5 ?
LLMsLe Big Data1sem· 2 min de lecture

OpenAI lance officiellement GPT-5.6 : meilleur que Mythos 5 ?

Source originale ↗·

OpenAI a lancé vendredi 26 juin sa famille de modèles GPT-5.6, composée de trois variantes aux noms inspirés du système solaire : Sol, Terra et Luna. Sol est présenté comme le modèle frontier le plus puissant jamais développé par la société, optimisé pour les tâches dites agentiques comme le développement logiciel, les workflows complexes, la biologie quantitative et la cybersécurité. Terra vise l'équilibre performances-coût, divisant par deux le prix de GPT-5.5 pour un niveau comparable, tandis que Luna mise sur la rapidité et le faible coût pour les traitements à haut volume. OpenAI introduit également un mode "Ultra" permettant de distribuer les tâches entre plusieurs sous-agents pour les missions les plus exigeantes. Pour l'heure, l'accès reste limité à quelques partenaires validés par le gouvernement américain.

Sur le plan des performances, les résultats publiés par OpenAI positionnent Sol en tête de plusieurs benchmarks clés. Sur TerminalBench 2.1, qui évalue les tâches complexes en ligne de commande, Sol atteint 88,8 % et Sol Ultra grimpe à 91,9 %, dépassant Claude Mythos 5 d'Anthropic, crédité de 88 % sur le même test. Sur ExploitBench dédié à la cybersécurité, Sol rivalise avec Mythos Preview tout en générant environ trois fois moins de tokens, ce qui se traduit directement par des économies d'usage. Sur GeneBench v1, consacré à la génomique, Sol atteint environ 31 % pour 1,9 dollar via l'API, contre 23 % et 1,2 dollar pour GPT-5.5. Ces gains d'efficacité énergétique et économique constituent un argument commercial fort, notamment pour les entreprises qui déploient des modèles à grande échelle. La sécurité du modèle a également été renforcée via plus de 700 000 heures de tests automatisés et des exercices de piratage menés par des équipes spécialisées.

Ce lancement s'inscrit dans une course à l'armement entre les grands laboratoires d'IA qui s'est nettement accélérée en 2025 et 2026. Anthropic a sorti Mythos 5 comme référence du secteur, Google pousse ses modèles Gemini, et la pression concurrentielle force chaque acteur à livrer des sauts de génération de plus en plus rapprochés. OpenAI mise ici sur une stratégie de gamme claire : un modèle souverain ultra-performant réservé aux partenaires institutionnels, un modèle grand public accessible et un modèle économique pour les déploiements massifs. L'ouverture progressive à d'autres utilisateurs, au-delà des partenaires gouvernementaux actuels, devrait intervenir dans les semaines à venir et constituera le vrai test d'adoption de GPT-5.6.

Impact France/UE

L'accès à GPT-5.6 reste pour l'instant limité aux partenaires validés par le gouvernement américain, excluant de facto les entreprises et institutions européennes dans l'immédiat.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

OpenAI met à jour GPT-5.5 Instant : voici qu’est-ce que ça change
1Le Big Data 

OpenAI met à jour GPT-5.5 Instant : voici qu’est-ce que ça change

OpenAI a déployé le 24 juin 2026 une nouvelle mise à jour de GPT-5.5 Instant, le modèle par défaut de ChatGPT. Il s'agit de la troisième évolution majeure depuis le lancement du modèle le 5 mai 2026, après des versions précédentes axées sur la réduction des erreurs et la clarté des réponses. Cette fois, l'entreprise vise explicitement à rendre les échanges "plus fun" et plus naturels. La mise à jour est d'abord accessible aux abonnés payants, avant un déploiement progressif vers les utilisateurs de la version gratuite. Concrètement, le modèle améliore sa capacité à identifier l'intention derrière une question, à maintenir la continuité d'une conversation sur plusieurs échanges, à gérer des requêtes contenant plusieurs contraintes simultanées, et à intégrer les corrections apportées par l'utilisateur sans simplement répéter la même réponse. Ces ajustements ciblent les usages les plus fréquents de ChatGPT, qui ne sont pas les démonstrations techniques mais les besoins du quotidien : planifier un voyage, comparer des produits, rédiger un message délicat ou clarifier ses idées. Pour des dizaines de millions d'utilisateurs qui interagissent avec ChatGPT plusieurs fois par semaine, une meilleure compréhension du contexte et des contraintes change directement la qualité de l'expérience. Le fait que le modèle réagisse mieux aux corrections est particulièrement significatif : cela réduit les allers-retours frustrants où l'IA ignore les précisions apportées et répète son raisonnement initial, un défaut régulièrement reproché aux assistants conversationnels. Derrière ces améliorations se profile une architecture nouvelle baptisée "Dreaming", qui permettrait au modèle de construire progressivement un profil de l'utilisateur au fil des conversations pour mieux adapter ses réponses. OpenAI s'engage depuis le début 2026 dans une cadence de mises à jour soutenue sur GPT-5.5 Instant, son modèle le plus utilisé, ce qui reflète une stratégie claire : maintenir ChatGPT comme standard de référence face à la concurrence directe de Google Gemini, Anthropic Claude et des assistants intégrés dans les systèmes d'exploitation comme Copilot de Microsoft. La bataille ne se joue plus uniquement sur les benchmarks de raisonnement, mais sur la fluidité perçue au quotidien, un terrain où la différence entre modèles devient de plus en plus difficile à mesurer objectivement pour l'utilisateur final.

LLMsOpinion
1 source
OpenAI GPT-5.6 Sol / Terra / Luna : réservé aux partenaires de confiance
2Latent Space 

OpenAI GPT-5.6 Sol / Terra / Luna : réservé aux partenaires de confiance

OpenAI a lancé le 25 juin 2026 une nouvelle famille de modèles baptisée GPT-5.6, composée de trois variantes : Sol (flagship), Terra (milieu de gamme) et Luna (rapide et économique). Le déploiement est volontairement restreint : seul un groupe d'environ vingt entreprises considérées comme "partenaires de confiance" y a accès via Codex et l'API, avec un élargissement prévu "dans les prochaines semaines". Sam Altman a confirmé qu'OpenAI avait initialement prévu un lancement grand public, mais a modifié ses plans à la demande explicite du gouvernement américain. La tarification est structurée : Sol coûte 5 dollars pour un million de tokens en entrée et 30 dollars en sortie, Terra 2,50 et 15 dollars, Luna 1 et 6 dollars. Sur le plan des performances, OpenAI revendique que Sol Ultra atteint 91,9 % sur le benchmark Terminal-Bench 2.1, dépassant selon certains observateurs Claude Mythos 5, tandis que Terra serait le premier modèle de taille intermédiaire à franchir les 80 % sur ce même test. Deux nouvelles fonctionnalités ont également été introduites : le "max reasoning" pour des raisonnements prolongés et un "ultra mode" mobilisant des sous-agents pour des tâches complexes. Ce lancement marque un tournant dans la manière dont les grands modèles de langage atteignent le marché : pour la première fois, un déploiement frontier est ouvertement conditionné par une décision gouvernementale, transformant ce qui était jusqu'ici un processus commercial en un mécanisme de contrôle public. Pour les développeurs et entreprises qui comptaient sur un accès immédiat, cela signifie des semaines d'attente supplémentaires. Pour l'écosystème plus large, cela établit un précédent : les gouvernements peuvent désormais influencer directement le calendrier de mise à disposition des modèles les plus puissants. Sur le plan tarifaire, la famille GPT-5.6 challenge directement Anthropic : Sol se positionne en dessous de Claude Mythos 5 (10/50 dollars) tout en revendiquant des performances supérieures sur certains benchmarks, ce qui pourrait accélérer une guerre des prix sur le segment haut de gamme. Ce lancement s'inscrit dans un contexte de tensions croissantes autour de la sécurité des IA frontier. OpenAI a pris soin de préciser que Sol ne franchit pas le seuil "Cyber Critical" de son cadre de préparation aux risques : dans des évaluations sur Chromium et Firefox, le modèle a identifié des failles et des primitives d'exploitation, mais n'a pas produit de chaîne d'exploit fonctionnelle de manière autonome. Ce soin dans la communication signale que la pression réglementaire s'intensifie autour des capacités offensives des modèles. En parallèle, la négociation en cours entre Anthropic et ses investisseurs autour de Fable, et l'assouplissement des contrôles Mythos, suggèrent que tous les grands laboratoires naviguent simultanément entre course aux performances et contraintes institutionnelles grandissantes.

UELe déploiement restreint aux partenaires de confiance retarde l'accès des développeurs et entreprises européens, et le précédent d'une intervention gouvernementale américaine sur le calendrier de lancement pourrait influencer les approches réglementaires de l'UE en matière de diffusion des modèles frontier.

💬 Ce qui compte ici, c'est pas les trois variantes Sol/Terra/Luna. C'est qu'OpenAI a officiellement acquiescé à une demande du gouvernement américain pour retarder son lancement, et l'a dit publiquement, ce qui établit un précédent réel : les gouvernements ont désormais une prise directe sur le calendrier des modèles frontier. Sur les prix, Sol à 5/30 dollars face à Mythos à 10/50, c'est agressif, reste à voir si ça tient hors benchmarks maison.

LLMsOpinion
1 source
3MarkTechPost 

OpenAI lance GPT-5.6 (Sol, Terra, Luna), une famille de trois modèles avec appel d'outils programmatique dans l'API Responses

OpenAI a fait passer sa famille GPT-5.6 en disponibilité générale après une période de test limitée, avec trois modèles distincts plutôt qu'un seul. Sol est le modèle phare, Terra la version équilibrée pour un usage quotidien, et Luna la variante la plus économique. Les prix par million de tokens s'échelonnent de 1 dollar en entrée et 6 dollars en sortie pour Luna, à 2,50 et 15 dollars pour Terra, jusqu'à 5 et 30 dollars pour Sol. L'accès varie selon les plateformes : dans ChatGPT, les abonnés Plus, Pro, Business et Enterprise obtiennent Sol en effort moyen ou supérieur, les comptes Pro et Enterprise pouvant aussi choisir une version Sol Pro. Sur Codex et ChatGPT Work, les utilisateurs gratuits accèdent à Terra tandis que les payants choisissent librement entre les trois modèles. Les trois tiers sont également disponibles via l'API, qui introduit une fonctionnalité baptisée Programmatic Tool Calling permettant au modèle d'exécuter du code JavaScript qu'il a lui-même écrit, dans un environnement V8 isolé sans accès réseau. La mise en cache des prompts évolue aussi, avec une durée de vie minimale de 30 minutes, une facturation des écritures en cache à 1,25 fois le tarif standard, et une remise de 90% conservée pour les lectures. Sur le plan des performances, Sol s'impose avec un score de 80 sur l'indice de codage agentique d'Artificial Analysis, soit 2,8 points de plus que Claude Fable 5, tout en consommant moins de la moitié des tokens de sortie et du temps nécessaires. En activant un mode appelé ultra, qui fait tourner quatre agents en parallèle, Sol grimpe à 91,9% sur Terminal-Bench 2.1, contre 88,8% en configuration standard. Le modèle atteint aussi 92,2% sur BrowseComp et dépasse Claude Opus 4.8 sur OSWorld 2.0 avec 85% de tokens en moins. Ces gains concrets touchent directement les développeurs et les équipes qui automatisent des tâches complexes via des agents, en réduisant coûts et temps d'exécution. Mais Sol accuse un retard net sur SWE-Bench Pro, où il plafonne à 64,6% contre 80,3% pour Claude Mythos 5, un écart de quinze points sur un benchmark de codage très suivi. Claude Fable 5 garde aussi l'avantage sur l'indice d'intelligence générale d'Artificial Analysis et sur l'usage d'outils via Toolathlon. Cette sortie s'inscrit dans une compétition serrée entre OpenAI, Anthropic et Google autour des agents autonomes capables de mener des tâches professionnelles longues et complexes, mesurées notamment par le test Agents' Last Exam couvrant 55 métiers, où Sol revendique un score de 53,6, largement devant Fable 5. La stratégie de tarification par paliers et la diversification des surfaces d'accès traduisent une volonté de capter aussi bien les usages grand public que les déploiements d'agents en entreprise, un terrain où la bataille des benchmarks continue de s'intensifier.

LLMsActu
1 source
OpenAI annonce (enfin) la sortie publique de GPT 5.6, rendez-vous ce jeudi
4Le Big Data 

OpenAI annonce (enfin) la sortie publique de GPT 5.6, rendez-vous ce jeudi

OpenAI a mis fin au suspense le 8 juillet 2026 en annonçant, via un message publié sur X, que sa nouvelle génération de modèles GPT-5.6 serait disponible pour le grand public dès ce jeudi 9 juillet. Cette famille comprend trois modèles distincts : Sol, le modèle principal, taillé pour la programmation, les sciences et la cybersécurité ; Terra, qui affiche des performances comparables à GPT-5.5 pour un coût deux fois moindre ; et Luna, pensé avant tout pour la rapidité d'exécution. L'accès à ces modèles avait débuté de façon très restreinte le 26 juin, limité à quelques partenaires aux États-Unis, sans qu'OpenAI ne communique alors de date précise pour un déploiement plus large. L'entreprise s'était contentée d'indiquer travailler avec le gouvernement américain pour organiser cette ouverture. Des sources proches du dossier évoquaient déjà des vitesses pouvant grimper jusqu'à 750 jetons par seconde sur les infrastructures de Cerebras pour certains clients privilégiés. Cette sortie marque une étape importante pour OpenAI, qui doit régulièrement démontrer sa capacité à transformer ses avancées techniques en produits réellement accessibles, face à une concurrence toujours plus dense. En segmentant son offre entre trois modèles aux usages différenciés, l'entreprise cherche à répondre à des besoins très variés : les développeurs et chercheurs en sécurité pourront s'appuyer sur Sol, les entreprises soucieuses de maîtriser leurs coûts d'infrastructure IA se tourneront vers Terra, tandis que les applications nécessitant une réactivité immédiate profiteront de Luna. Pour les utilisateurs de ChatGPT comme pour les développeurs exploitant l'API, cette diversification signifie surtout plus de choix, avec la possibilité d'arbitrer entre puissance, prix et vitesse selon leurs contraintes réelles, plutôt que de composer avec un modèle unique taillé pour un usage générique. Le contexte entourant cette annonce illustre aussi la tension propre au secteur entre attentes du marché et prudence des laboratoires. Sur la plateforme de paris en ligne Polymarket, les probabilités données à une sortie de GPT-5.6 les 7 ou 8 juillet restaient faibles, alimentant les spéculations dans les jours précédant l'annonce officielle. Ce silence prolongé d'OpenAI, entre l'ouverture limitée du 26 juin et la confirmation du 8 juillet, s'explique en partie par la nécessité de coordonner ce lancement avec les autorités américaines, dans un climat où la régulation de l'intelligence artificielle reste un sujet sensible. Reste à voir si les performances promises, notamment en matière de vitesse sur les infrastructures Cerebras, se confirmeront à grande échelle une fois l'accès réellement généralisé à l'ensemble des utilisateurs dès jeudi.

LLMsActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic