Aller au contenu principal
Recherche · Paper ·

Ces startups en quête de la prochaine avancée majeure des LLM

Une nouvelle génération de startups s'attaque aux limites des transformeurs, l'architecture qui sous-tend la quasi-totalité des grands modèles de langage actuels. Ce mécanisme a été décrit pour la première fois en 2017 par des chercheurs de Google dans l'article fondateur "Attention Is All You Need". Neuf ans plus tard, selon Justin Dangel, cofondateur et PDG de la startup Subquadratic, "l'ensemble de l'industrie de l'IA repose sur les transformeurs" qui ont "changé le monde". Mais leur mécanisme central, l'attention dense, qui compare chaque mot d'un texte à tous les autres pour en capturer le sens, devient très coûteux à mesure que les documents s'allongent : un texte de 10 000 mots peut nécessiter environ 50 millions de multiplications. Cette explosion des calculs explique en grande partie la consommation énergétique massive des modèles actuels. OpenAI prévoit ainsi de dépenser 50 milliards de dollars en puissance de calcul cette année, selon son président Greg Brockman, et l'Agence internationale de l'énergie anticipe un doublement de la consommation électrique des centres de données d'ici 2030.

2 min de lecturePertinence 40

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de MIT Technology Review. Lire l'article original →

Cette limite technique a des conséquences concrètes pour toute l'industrie. Les modèles les plus récents, notamment les modèles dits "de raisonnement" qui rédigent des notes intermédiaires (une "chaîne de pensée") avant de répondre, ou les agents qui doivent ingérer d'immenses quantités de données comme des bibliothèques de documents entières ou des bases de code, ont besoin de fenêtres de contexte toujours plus larges. Or les transformeurs, en traitant le texte mot par mot, peinent justement à conserver en mémoire de très grands volumes d'informations. Ce qui faisait la force du transformeur, sa capacité à analyser finement chaque relation entre les mots, devient donc un frein à la progression des modèles vers des tâches plus complexes, plus rapides et moins coûteuses à exécuter.

Face à ce constat, plusieurs jeunes entreprises, dont Subquadratic, cherchent à repenser les fondations de l'IA générative plutôt que de se contenter de correctifs temporaires. Une des pistes explorées consiste à remplacer l'attention dense par une attention dite "sparse" (éparse), qui ne calcule les relations que pour certaines paires de mots plutôt que pour l'ensemble d'un texte, réduisant ainsi drastiquement la charge de calcul. Cette approche n'est pas nouvelle en soi, plusieurs chercheurs ayant déjà proposé des variantes d'attention éparse par le passé sans obtenir de résultats aussi convaincants que l'attention dense classique. Ces startups, moins exposées que les géants déjà installés du secteur, misent sur le fait qu'elles ont peu à perdre et beaucoup à gagner si l'une de leurs innovations parvient à surpasser l'architecture dominante actuelle.

Impact France / UEChamp produit par Le Fil IA

Aucune entreprise française ou européenne n'est citée, mais la hausse de la consommation énergétique des data centers évoquée concerne aussi les infrastructures européennes.

À lire ensuite

01L'IA aide les scientifiques à concevoir la prochaine génération de médicaments40MIT Technology ReviewRecherche 02OpenAI promeut son prochain modèle Astra avec la résolution de 10 problèmes de maths45Next INpactRecherche 03OpenAI repousse les limites du raisonnement automatisé avec ce qu'il appelle une avancée majeure en mathématiques49The DecoderRecherche 
Dossier · OpenAISuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.