Aller au contenu principal
Outils · Outil ·

OpenAI lance le mode Ultrafast avec Cerebras, GPT-5.6 Sol 14 fois plus rapide

OpenAI a lancé "Ultrafast", un nouveau mode d'inférence pour son modèle GPT-5.6 Sol, capable de générer jusqu'à 750 tokens de sortie par seconde, soit une vitesse 14 fois supérieure au mode standard. Cette performance repose sur du matériel Cerebras, issu du partenariat de 10 milliards de dollars conclu entre les deux entreprises. Ultrafast vient s'ajouter aux modes "Standard" et "Fast" déjà proposés par OpenAI, formant désormais une structure tarifaire à trois niveaux dans laquelle la vitesse d'exécution devient un produit à part entière, facturé et choisi indépendamment des capacités du modèle lui-même.

1 min de lecturePertinence 52
Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Cette évolution change la donne pour les développeurs et les entreprises qui construisent des applications reposant sur l'IA générative. Jusqu'ici, le choix se limitait souvent à un compromis entre coût et qualité des réponses. Avec Ultrafast, la latence devient un paramètre ajustable à part, ce qui profite particulièrement aux usages exigeant des réponses quasi instantanées : assistants vocaux, agents de codage autonomes, outils de trading ou applications interactives où chaque milliseconde compte. Pour les entreprises clientes, cela ouvre la possibilité de payer plus cher uniquement pour les tâches critiques en temps réel, tout en gardant des modes plus économiques pour le reste de leurs usages.

Ce lancement s'inscrit dans une compétition croissante autour de la vitesse d'inférence, un terrain où des fabricants de puces spécialisées comme Cerebras ou Groq se distinguent face aux GPU traditionnels de Nvidia. Le partenariat massif entre OpenAI et Cerebras illustre l'importance stratégique que prend désormais la rapidité d'exécution, à mesure que les modèles sont de plus en plus utilisés dans des flux de travail agentiques nécessitant de nombreux appels successifs, où chaque gain de vitesse se traduit directement en gain de productivité.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01OpenAI lance ChatGPT Pro à 100 dollars avec des limites d'utilisation de Codex 5 fois supérieures à celles de Plus50VentureBeat AIOutils 02OpenAI lance un plugin Codex compatible avec Claude Code d'Anthropic47The DecoderOutils 03ChatGPT : OpenAI prépare sa plus grande transformation depuis son lancement46Le Big DataOutils 
Dossier · OpenAISuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.