L’envers du décor des agents IA : comment IBM et Together AI préparent l’infrastructure cloud de 2027
IBM et Together AI ont annoncé le 11 août 2026 un partenariat pluriannuel de 240 millions de dollars pour déployer, dès le premier trimestre 2027, un cluster d'inférence de nouvelle génération sur IBM Cloud, reposant sur les systèmes NVIDIA HGX B300 et le réseau Ethernet NVIDIA Spectrum-X. Il s'agirait du premier déploiement à grande échelle spécifiquement conçu pour l'inférence plutôt que pour l'entraînement de modèles. Together AI, spécialiste de l'hébergement de modèles open source, traite déjà plus de 400 000 milliards de tokens par mois pour plus d'un million de développeurs. La start-up, valorisée à 8,3 milliards de dollars après une levée de fonds de 800 millions de dollars, veut utiliser cette infrastructure pour absorber la charge des agents IA autonomes, qui enchaînent appels d'API et raisonnements séquentiels, contrairement aux chatbots classiques sollicités ponctuellement. Selon les deux entreprises, l'association des puces B300 et du réseau Spectrum-X doit multiplier par trente le rendement des centres de calcul par rapport aux générations précédentes.
Résumé et traduction réalisés par Le Fil IA à partir de Le Big Data. Lire l'article original →
Ce partenariat traduit un changement d'échelle économique pour l'industrie de l'IA. Le passage des chatbots aux agents autonomes multiplie la consommation de tokens, donc les coûts de calcul, ce qui menace la rentabilité des déploiements si l'infrastructure ne suit pas. Pour les directions informatiques, la promesse d'un débit plus élevé et d'une latence réduite, grâce à un réseau qui limite les engorgements entre puces GPU, revient à rendre prévisible un poste de dépense jusque là volatile. L'accès à des modèles open source performants, hébergés sur une infrastructure dédiée plutôt que via des API propriétaires facturées à l'usage, pourrait réduire le coût par token pour les grands groupes, tout en limitant leur dépendance envers des fournisseurs de modèles fermés.
Le partenariat s'inscrit dans la stratégie d'IBM de se positionner comme fournisseur d'infrastructure cloud pour l'IA d'entreprise, en misant sur ses atouts en matière de sécurité, de conformité réglementaire et de cloud hybride, recherchés dans des secteurs sensibles comme la finance ou la santé. Together AI poursuit de son côté une expansion rapide, portée par la demande pour des alternatives ouvertes aux modèles propriétaires, alors que de nombreuses entreprises refusent de confier leurs données à des API fermées ou de subir des tarifs imprévisibles. Cette course aux capacités d'inférence, alimentée par NVIDIA qui fournit à la fois les puces B300 et la technologie réseau Spectrum-X, illustre la bascule de l'industrie vers une phase où l'exécution des modèles pèse désormais plus lourd que leur entraînement. La réussite de ce pari dépendra de la capacité du secteur à livrer, d'ici 2027, une infrastructure capable de soutenir des millions d'agents IA opérant en continu sans faire exploser les coûts d'exploitation.
Ce partenariat concerne l'infrastructure cloud americaine d'IBM et pourrait a terme interesser des entreprises europeennes en quete de solutions hybrides conformes aux reglementations sectorielles, mais aucun impact direct sur la France ou l'UE n'est annonce.