OpenAI dévoile Jalapeño, sa première puce maison, plus rapide que les Blackwell de Nvidia en inférence
OpenAI a dévoilé lors de la conférence Hot Chips son premier processeur d'inférence conçu en interne, baptisé "Jalapeño". Des essais publiés par OpenAI sur InferenceX, le banc d'essai de la société d'analyse SemiAnalysis, placent cette puce devant les GB200 et GB300 de Nvidia en débit de calcul et en efficacité énergétique. SemiAnalysis, qui indique avoir relu ces exécutions avec les ingénieurs d'OpenAI sans conduire elle-même la suite complète, juge la comparaison incomplète : Jalapeño embarque de la mémoire HBM4 quand les GB200 et GB300 sont en HBM3E. Dylan Patel, patron de SemiAnalysis, a résumé la performance en soulignant que les puces de première génération sont habituellement peu compétitives, alors que celle d'OpenAI devance déjà les Blackwell de Nvidia. Le dépassement de la génération suivante, Vera Rubin, ne repose pas sur un face-à-face mais sur un recoupement avec des chiffres publiés séparément. Ces résultats ont été présentés publiquement lors de la conférence, un rendez-vous suivi de près par l'industrie des semi-conducteurs.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →
Également couvert par TechCrunch AI, Le Big Data, ZDNET FR.
Cette annonce marque un tournant potentiel dans la dépendance d'OpenAI envers Nvidia, qui fournit aujourd'hui l'essentiel de la puissance de calcul utilisée pour faire tourner ses modèles comme ChatGPT. Si Jalapeño tient ses promesses à grande échelle, OpenAI pourrait réduire ses coûts d'inférence, qui représentent une part croissante de ses dépenses à mesure que l'usage de ses produits explose, tout en gagnant en indépendance stratégique face à un fournisseur unique dont les prix et les délais de livraison pèsent sur l'ensemble du secteur.
Cette démarche s'inscrit dans une tendance plus large où les grands acteurs de l'intelligence artificielle développent leurs propres puces pour limiter leur dépendance à Nvidia, à l'image de Google avec ses TPU, Amazon avec Trainium ou Microsoft avec Maia. OpenAI travaillerait notamment avec Broadcom sur la conception de ces circuits. Reste à voir si Jalapeño passera du stade des bancs d'essai à un déploiement massif dans les centres de données d'OpenAI.
Pas d'impact direct sur la France/UE
Jalapeño change la donne : pour la première fois, une puce maison bat Blackwell dès sa première génération, alors que d'habitude un round 1 se fait laminer. Ça veut dire qu'OpenAI peut viser une inférence moins chère sans dépendre entièrement de Nvidia, et vu que l'inférence bouffe une part croissante de leurs coûts, c'est stratégique, pas cosmétique. Reste à voir si ça tient la charge en datacenter réel, les bancs d'essai chez SemiAnalysis c'est une chose, un déploiement massif chez OpenAI c'en est une autre.