Aller au contenu principal
LLMs · Opinion ·

Le Fil Factory dans les coulisses : Eiso Kant, Poolside AI

Poolside AI, la start-up cofondée par Eiso Kant, vient de dévoiler son nouveau modèle Laguna S 2.1, qui surpasse le récent modèle de Thinking Machines alors qu'il est près de dix fois plus petit. Laguna S compte 118 milliards de paramètres au total, dont 8 milliards actifs, et a été développé grâce au Model Factory de Poolside, un système capable de faire passer un modèle du pré-entraînement au lancement en seulement huit semaines. Moins de 70 chercheurs y font tourner entre 10 000 et 20 000 expériences par mois. Eiso Kant a démarré cette aventure en 2015, inspiré par les travaux d'Andrej Karpathy sur les réseaux de neurones récurrents, en misant sur l'idée que le code est la voie vers l'AGI. Il a dépensé 12 millions de dollars sur quatre ans avant que le marché ne s'intéresse au sujet, et la sortie de ChatGPT a représenté pour lui une véritable vindication, poussant Poolside à revenir vers les poids ouverts et la recherche ouverte. L'entreprise a depuis levé 500 millions de dollars.

2 min de lecturePertinence 43
Source

Résumé et traduction réalisés par Le Fil IA à partir de Latent Space. Lire l'article original →

Cette annonce intervient alors que le débat entre IA ouverte et fermée, et entre souveraineté américaine et chinoise sur les modèles, atteint un point critique. Eiso Kant défend une position singulière: il préférerait un marché avec 100 entreprises de modèles fondamentaux plutôt qu'un oligopole de cinq acteurs, même si Poolside comptait parmi ces cinq. Il distingue aussi clairement le fait de publier des poids ouverts de celui de publier une recherche réellement ouverte, une nuance qui compte pour l'industrie et les développeurs cherchant à comprendre comment ces modèles sont réellement construits, et pas seulement à les utiliser.

Le Model Factory repose sur des données diffusées en flux continu directement dans l'entraînement, des expériences reproductibles grâce à des données immuables et du code versionné, ainsi qu'un calcul en basse précision. Des agents interviennent de plus en plus pour écrire du code, lancer des tâches, évaluer les résultats et modifier les pipelines d'entraînement des futurs modèles. Eiso Kant estime que la persistance, la vérification et le retour en arrière comptent parfois plus que l'intelligence brute, que l'apprentissage par renforcement va migrer plus tôt dans le pré-entraînement, et que le prédiction du prochain mot exploite encore trop peu les connaissances du web. Il critique par ailleurs certains protocoles d'agents comme MCP, qu'il juge mal conçus, et évoque l'influence de NVIDIA et TSMC sur l'économie réelle de l'entraînement des modèles frontières.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01Contrôler l'effort de raisonnement dans les LLM41Ahead of AILLMs 02Poolside AI présente Laguna XS.2 et M.1, des modèles de codage à base d'agents atteignant 68,2 % et 72,5 % sur SWE-bench Verified44MarkTechPostLLMs 03Qwen3.8-Max : Alibaba revient dans la course pour rivaliser avec Fable 5 et Kimi K349Next INpactLLMs 
Dossier · Open weight & Open sourceSuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.