NVIDIA rachète HuggingFace pour 13 milliards de dollars, OpenAI publie son rapport d'incident sur HF
Nvidia va racheter HuggingFace pour 13 milliards de dollars, confirmant les informations initialement révélées par The Information. Ce montant représente environ 80 fois les revenus annuels récurrents de la plateforme, estimés à 150 millions de dollars, après que HuggingFace a doublé sa base de clients en 2026. Il s'agit d'une hausse spectaculaire par rapport à l'offre initiale de Nvidia, qui s'élevait à 7 milliards de dollars en janvier 2026. Cette annonce survient alors que le modèle chinois GLM-5.3-Flash, développé par Z.ai, vient d'être officiellement lancé, révélant au passage que le mystérieux modèle surnommé "Ox Alpha" n'était autre que sa version de prévisualisation. GLM-5.3-Flash est un modèle nativement multimodal doté d'une fenêtre de contexte d'un million de tokens, comptant 320 milliards de paramètres au total dont 18 milliards actifs, distribué sous licence MIT et fonctionnant entièrement sur des puces d'intelligence artificielle chinoises. Le modèle est disponible via les poids sur Hugging Face, une API, un chat, un plan de codage et l'outil AutoClaw. Z.ai affirme, sur son propre benchmark interne Code Bench, que ce modèle surpasse son prédécesseur GLM-5.2 à tous les niveaux d'effort et rivalise avec Claude Opus 4.8 en matière de codage. Qwen a de son côté également lancé un modèle Flash performant tournant sur des puces chinoises.
Résumé et traduction réalisés par Le Fil IA à partir de Latent Space. Lire l'article original →
Cette double actualité illustre un basculement de rapport de force dans l'écosystème de l'intelligence artificielle ouverte. Le rachat de HuggingFace par Nvidia, à un prix presque doublé en huit mois, montre à quel point les infrastructures de partage de modèles sont devenues stratégiques, y compris pour les géants du matériel. Simultanément, la montée en puissance de modèles chinois open source performants et peu coûteux, capables de rivaliser avec les meilleurs modèles fermés américains tout en fonctionnant sur du silicium domestique, questionne la position dominante des laboratoires occidentaux sur l'IA ouverte. Pour les développeurs et les entreprises, cela signifie un accès à des modèles toujours plus performants à moindre coût, avec un rapport intelligence/prix jugé par certains analystes comme le meilleur du marché actuellement.
Ce contexte s'inscrit dans les suites de la conférence Hot Chips, où les discussions ont porté sur l'avenir de l'IA ouverte occidentale face à la concurrence chinoise. Le soutien technique autour de GLM-5.3-Flash s'est mis en place presque instantanément, avec une prise en charge par CoreWeave, Baseten et l'intégration gratuite de Cline dans VS Code, JetBrains et en ligne de commande. Des ajustements mineurs ont suivi le lancement, notamment une mise à jour du template de conversation signalée par l'ingénieur de Z.ai Zixuan Li, et une correction d'Artificial Analysis concernant la taille de la fenêtre de contexte, initialement mal évaluée à 400 000 tokens avant d'être rectifiée à un million.
De nombreux développeurs et entreprises européens dépendent de Hugging Face pour héberger et partager leurs modèles, rendant son rachat par un acteur du matériel comme Nvidia sensible pour la neutralité de cette infrastructure clé en Europe.