Wafer, fournisseur d'inférence utilisant des puces non-Nvidia, reçoit des offres de rachat et est valorisé à plus de 200 millions de dollars
Wafer, une start-up d'inférence IA basée à San Francisco et fondée en mai 2025 par Emilio Andere et son meilleur ami d'université Steven Arellano, vient de boucler une levée de série A de 40 millions de dollars, co-menée par Marathon Management Partners et Chemistry VC. Selon une personne proche du dossier, la valorisation de l'entreprise dépasse désormais les 200 millions de dollars, un chiffre qu'Andere, le PDG, a refusé de commenter directement auprès de The Information. La start-up a également reçu des offres de rachat, sans que les montants ou les acquéreurs potentiels ne soient précisés. Le cœur de l'activité de Wafer repose sur des agents IA baptisés "AI inférence engineers", capables d'optimiser des modèles open-source en fonction de la charge de travail spécifique d'une entreprise, et ce sur une variété de puces qui ne se limite pas aux processeurs Nvidia.
Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie
Résumé et traduction réalisés par Le Fil IA à partir de The Information AI. Lire l'article original →
Cette approche répond à un enjeu concret pour les entreprises qui déploient des modèles d'IA en production : un agent vocal, qui doit traiter rapidement des requêtes répétées et des pics de trafic soudains, n'a pas les mêmes besoins d'optimisation qu'un agent de codage, qui doit au contraire conserver un contexte important sur de longues périodes. En automatisant ce travail d'optimisation fin, Wafer promet aux entreprises de réduire les coûts et d'améliorer les performances de leurs modèles, tout en leur donnant accès à un éventail plus large de puces que le seul écosystème Nvidia, aujourd'hui dominant mais coûteux et parfois difficile d'accès.
Cette levée s'inscrit dans une tendance plus large observée dans l'industrie des semi-conducteurs et de l'IA : de plus en plus de développeurs et de concepteurs de puces misent sur l'IA elle-même pour accélérer et perfectionner la conception et l'optimisation des puces destinées à l'IA. Wafer applique cette logique côté inférence plutôt que côté conception matérielle. Dans un marché où la demande de calcul explose et où la dépendance à Nvidia inquiète de nombreux acteurs, ce type de solution logicielle capable de tirer parti de puces alternatives pourrait peser sur les rapports de force entre fournisseurs de puces et fournisseurs de services d'inférence, avec des suites attendues autour des offres de rachat évoquées.
Pas d'impact direct sur la France/UE.