Aller au contenu principal
L'accord OpenAI-Broadcom sur les puces IA bute sur 18 milliards de financement
InfrastructureThe Information AI · 1 min de lecture

L'accord OpenAI-Broadcom sur les puces IA bute sur 18 milliards de financement

Source originale ↗·

OpenAI et le fabricant de semi-conducteurs Broadcom avaient annoncé l'automne dernier un accord pour développer ensemble des puces d'intelligence artificielle sur mesure. L'ambition affichée était de taille : mettre en ligne suffisamment de composants avant 2030 pour consommer 10 gigawatts d'électricité, soit l'équivalent de cinq fois la production du barrage Hoover. L'objectif déclaré était de réduire la dépendance coûteuse d'OpenAI à l'égard des processeurs Nvidia. Ce que les deux entreprises n'avaient pas précisé, c'est qu'elles n'avaient pas encore trouvé comment financer le projet, dont le montant atteint 18 milliards de dollars.

Ce blocage financier expose une contradiction au coeur de la stratégie d'OpenAI : l'entreprise affiche des ambitions d'infrastructure colossales tout en restant tributaire d'un partenaire unique, Nvidia, dont les GPU sont à la fois indispensables et extrêmement onéreux. Sans financement sécurisé, le calendrier du projet risque de glisser, laissant OpenAI dans une position de dépendance prolongée qui pèse directement sur ses marges et sa capacité à scaler ses modèles.

Cette situation s'inscrit dans une course plus large à l'indépendance chipière. Google, Meta et Amazon ont chacun développé leurs propres accélérateurs maison pour s'affranchir de Nvidia. OpenAI, longtemps focalisé sur la recherche et les produits, arrive plus tardivement dans cette logique d'intégration verticale. L'accord avec Broadcom est une tentative de rattrapage, mais sa concrétisation dépend désormais de la capacité d'OpenAI à lever des fonds dans un contexte où ses dépenses opérationnelles restent très élevées.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

OpenAI et Broadcom annoncent une puce dédiée à l'inférence de grands modèles de langage
1Ars Technica AI 

OpenAI et Broadcom annoncent une puce dédiée à l'inférence de grands modèles de langage

OpenAI et Broadcom ont annoncé conjointement une nouvelle puce baptisée Jalapeño, conçue spécifiquement pour l'inférence de grands modèles de langage (LLM) dans les centres de données à grande échelle. Les deux entreprises présentent ce composant comme la première génération d'un partenariat à long terme, avec l'ambition d'affiner et d'améliorer le design des puces au fil des générations successives. Cette annonce marque une étape significative dans la stratégie d'OpenAI pour maîtriser sa propre chaîne d'approvisionnement en silicium. L'inférence, soit le processus par lequel un modèle génère des réponses en temps réel, représente la charge computationnelle la plus coûteuse et la plus constante pour une entreprise comme OpenAI, qui sert des centaines de millions d'utilisateurs via ChatGPT et ses API. Disposer d'une puce dédiée, optimisée pour ce cas d'usage précis, pourrait réduire drastiquement les coûts opérationnels et diminuer la dépendance d'OpenAI envers Nvidia, dont les GPU dominent aujourd'hui le marché de l'IA. Cette démarche s'inscrit dans une tendance de fond : les géants du numérique cherchent tous à s'affranchir de Nvidia en développant leurs propres accélérateurs. Google a ses TPU, Amazon son Trainium, Microsoft son Maia, Apple son Neural Engine. Broadcom, qui fabrique déjà des puces personnalisées pour Google et Meta, s'affirme comme le partenaire industriel privilégié de cette nouvelle vague. Le fait qu'OpenAI rejoigne ce mouvement avec un chip nominalement dédié à l'inférence signale que la société considère désormais le contrôle du matériel comme un avantage concurrentiel structurel, et non plus une simple option.

InfrastructureOpinion
1 source
Broadcom refuserait de fabriquer la puce personnalisée d'OpenAI si Microsoft n'en achète pas 40 %
2The Decoder 

Broadcom refuserait de fabriquer la puce personnalisée d'OpenAI si Microsoft n'en achète pas 40 %

Le projet de puce IA sur mesure développé par OpenAI en collaboration avec Broadcom se heurte à un obstacle financier majeur. Selon des informations rapportées par The Decoder, Broadcom refuse de financer la production de ces processeurs à moins que Microsoft ne s'engage à en acheter 40 % du volume total. Or, Microsoft n'a toujours pas donné son accord. La première phase du projet représente à elle seule un coût estimé à 18 milliards de dollars. Sachin Katti, un dirigeant d'OpenAI, a qualifié cette dépendance de "financièrement peu attractive" dans un message interne. Cette impasse met en lumière la fragilité de la stratégie d'indépendance technologique d'OpenAI. La start-up cherche depuis plusieurs mois à réduire sa dépendance à Nvidia pour ses besoins en calcul, mais cette ambition se retrouve bloquée faute de garanties commerciales suffisantes. Pour Broadcom, assumer seul le risque industriel d'un projet de cette envergure sans acheteur garanti est tout simplement hors de question. La décision de Microsoft conditionne donc directement la viabilité du programme. Ce projet s'inscrit dans une tendance plus large où les grandes plateformes d'IA cherchent à concevoir leurs propres puces spécialisées, à l'image de Google avec ses TPU ou d'Amazon avec ses Trainium. OpenAI avait annoncé des ambitions dans ce sens dans le cadre de l'initiative Stargate, le mégaprojet d'infrastructure à 500 milliards de dollars soutenu par l'administration Trump. La relation complexe entre OpenAI et Microsoft, à la fois partenaire stratégique et investisseur dominant, continue de peser sur chaque grande décision opérationnelle de la société.

💬 OpenAI veut son indépendance vis-à-vis de Nvidia, mais pour financer la puce qui lui donnera cette indépendance, il faut que Microsoft signe. La dépendance a juste changé d'adresse. Broadcom ne prend pas 18 milliards de risque sans acheteur garanti, c'est du bon sens, et ça dit beaucoup sur l'état de la stratégie Stargate en ce moment.

InfrastructureActu
1 source
OLIX, FRACTILE, ETCHED : les milliards affluent vers les futurs moteurs de l’IA
3FrenchWeb 

OLIX, FRACTILE, ETCHED : les milliards affluent vers les futurs moteurs de l’IA

Trois start-up spécialisées dans les puces d'inférence pour l'intelligence artificielle, OLIX, FRACTILE et ETCHED, ont levé ensemble plus de 1,5 milliard de dollars pour développer une nouvelle génération de moteurs de calcul dédiés à l'exécution des modèles de raisonnement. Ce mouvement de financement traduit un déplacement du centre de gravité de l'industrie : longtemps concentré sur l'entraînement des grands modèles de langage, l'essentiel des investissements se tourne désormais vers l'inférence, c'est-à-dire la phase où les modèles produisent effectivement leurs réponses, token après token. Les trois entreprises visent un objectif commun, accélérer la production de tokens tout en réduisant la facture énergétique, un enjeu devenu central à mesure que les modèles de raisonnement multiplient les étapes de calcul pour chaque requête. Cette bascule financière est stratégique pour toute l'industrie de l'IA. Les modèles de raisonnement récents, plus lents et plus gourmands en calcul que les générations précédentes, rendent le coût de l'inférence critique pour la rentabilité des services d'IA grand public et professionnels. Réduire ce coût, ou en changer l'architecture matérielle sous-jacente, peut directement déterminer quelles entreprises pourront proposer des modèles avancés à grande échelle sans que la facture énergétique et financière ne devienne prohibitive. Le point commun de ces trois levées est la volonté de contester la position dominante de NVIDIA, dont les puces GPU équipent aujourd'hui la quasi-totalité des centres de données d'IA. En misant sur des architectures alternatives conçues spécifiquement pour l'inférence plutôt que pour l'entraînement, OLIX, FRACTILE et ETCHED cherchent à ouvrir une brèche dans un marché des semi-conducteurs d'IA jusqu'ici verrouillé par un seul acteur dominant, dans un contexte où la demande de calcul pour l'IA continue de croître fortement.

💬 Sur le papier, OLIX, FRACTILE et ETCHED font le même pari : sortir du duopole GPU/NVIDIA en construisant des puces pensées pour l'inférence, pas pour l'entraînement. C'est le vrai signal derrière les 1,5 milliard : l'IA de raisonnement coûte cher token par token, et c'est cette facture-là qui va trier les entreprises capables de la proposer à grande échelle. Reste à voir si ces architectures tiennent en prod à la vitesse où NVIDIA sort ses nouvelles puces, parce que sur ce marché, l'avance technique se périme vite.

InfrastructureActu
1 source
Google négocierait le financement d'un data center de plusieurs milliards pour Anthropic
4The Information AI 

Google négocierait le financement d'un data center de plusieurs milliards pour Anthropic

Google serait en négociation pour financer partiellement la construction d'un datacenter de plusieurs milliards de dollars au Texas, destiné à être loué par Anthropic, selon des informations du Financial Times. Le montage financier envisagé passerait par des prêts à la construction accordés à Nexus Data Centers, l'opérateur du site qui détient le bail avec Anthropic. Le montant exact n'a pas été divulgué, mais l'expression « multibillion-dollar » laisse entrevoir une infrastructure d'envergure. Ce projet illustre la dépendance croissante des laboratoires d'IA aux investissements massifs en infrastructure de calcul. Pour Anthropic, accéder à une capacité de calcul dédiée et à grande échelle est indispensable pour entraîner et déployer ses modèles Claude à un niveau compétitif face à OpenAI et Google DeepMind. Pour Google, financer l'infrastructure de son partenaire stratégique, dans lequel il a déjà investi plus de 2 milliards de dollars, renforce un écosystème dans lequel ses propres intérêts sont engagés. Ce mouvement s'inscrit dans une course mondiale aux datacenters alimentée par l'explosion de la demande en IA générative. Microsoft construit des infrastructures pour OpenAI, Amazon pour ses propres services et Anthropic via AWS. Le fait que Google joue désormais aussi le rôle de bailleur de fonds pour Anthropic, en plus de partenaire cloud, témoigne de l'intrication croissante entre financement, infrastructure et développement des modèles dans l'industrie de l'IA.

InfrastructureOpinion
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic