OLIX, FRACTILE, ETCHED : les milliards affluent vers les futurs moteurs de l’IA
Trois start-up spécialisées dans les puces d'inférence pour l'intelligence artificielle, OLIX, FRACTILE et ETCHED, ont levé ensemble plus de 1,5 milliard de dollars pour développer une nouvelle génération de moteurs de calcul dédiés à l'exécution des modèles de raisonnement. Ce mouvement de financement traduit un déplacement du centre de gravité de l'industrie : longtemps concentré sur l'entraînement des grands modèles de langage, l'essentiel des investissements se tourne désormais vers l'inférence, c'est-à-dire la phase où les modèles produisent effectivement leurs réponses, token après token. Les trois entreprises visent un objectif commun, accélérer la production de tokens tout en réduisant la facture énergétique, un enjeu devenu central à mesure que les modèles de raisonnement multiplient les étapes de calcul pour chaque requête.
Résumé et traduction réalisés par Le Fil IA à partir de FrenchWeb. Lire l'article original →
Cette bascule financière est stratégique pour toute l'industrie de l'IA. Les modèles de raisonnement récents, plus lents et plus gourmands en calcul que les générations précédentes, rendent le coût de l'inférence critique pour la rentabilité des services d'IA grand public et professionnels. Réduire ce coût, ou en changer l'architecture matérielle sous-jacente, peut directement déterminer quelles entreprises pourront proposer des modèles avancés à grande échelle sans que la facture énergétique et financière ne devienne prohibitive.
Le point commun de ces trois levées est la volonté de contester la position dominante de NVIDIA, dont les puces GPU équipent aujourd'hui la quasi-totalité des centres de données d'IA. En misant sur des architectures alternatives conçues spécifiquement pour l'inférence plutôt que pour l'entraînement, OLIX, FRACTILE et ETCHED cherchent à ouvrir une brèche dans un marché des semi-conducteurs d'IA jusqu'ici verrouillé par un seul acteur dominant, dans un contexte où la demande de calcul pour l'IA continue de croître fortement.
Pas d'impact direct sur la France/UE
Sur le papier, OLIX, FRACTILE et ETCHED font le même pari : sortir du duopole GPU/NVIDIA en construisant des puces pensées pour l'inférence, pas pour l'entraînement. C'est le vrai signal derrière les 1,5 milliard : l'IA de raisonnement coûte cher token par token, et c'est cette facture-là qui va trier les entreprises capables de la proposer à grande échelle. Reste à voir si ces architectures tiennent en prod à la vitesse où NVIDIA sort ses nouvelles puces, parce que sur ce marché, l'avance technique se périme vite.