Aller au contenu principal
LLMs · Actu ·

Nvidia mise sur la vitesse avec Nemotron 3.5 Lightning, son modele ouvert

Nvidia a présenté Nemotron 3.5 Lightning, un nouveau modèle de langage à poids ouverts qui ne compte que 3,6 milliards de paramètres actifs. Malgré cette taille réduite, environ quatre fois inférieure à celle de gpt-oss-120b d'OpenAI, il obtient un score équivalent à celui de ce dernier sur l'Intelligence Index, un indice de référence mesurant les capacités de raisonnement des modèles de langage. Autre atout mis en avant par Nvidia : sa vitesse de génération, qui atteint près de 670 tokens par seconde, ce qui en fait le modèle le plus rapide parmi ceux comparés dans cette évaluation.

1 min de lecturePertinence 60
Source

Résumé et traduction réalisés par Le Fil IA à partir de The Decoder. Lire l'article original →

Cette performance illustre un choix stratégique clair de la part de Nvidia : privilégier l'efficacité computationnelle plutôt que la course à la taille des modèles. Pour les entreprises et les développeurs, un modèle capable d'égaler les performances de systèmes bien plus volumineux tout en consommant moins de ressources et en répondant plus vite représente un avantage économique et pratique significatif, notamment pour les applications nécessitant des réponses en temps réel ou un déploiement à grande échelle avec des coûts d'inférence maîtrisés. Cela pourrait aussi faciliter l'exécution de modèles performants sur du matériel moins puissant.

Cette annonce s'inscrit dans une tendance plus large de l'industrie de l'IA, où la course au nombre de paramètres cède progressivement du terrain à une recherche d'efficacité et d'optimisation des architectures, notamment via des approches à faible nombre de paramètres actifs. En publiant ce modèle en poids ouverts, Nvidia renforce sa présence dans l'écosystème des modèles accessibles librement, un terrain où elle affronte des acteurs comme Meta, Mistral ou la communauté open source associée à OpenAI avec gpt-oss. Reste à voir comment ce compromis entre vitesse et intelligence maximale sera perçu par les développeurs selon leurs cas d'usage spécifiques.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01NVIDIA lance Nemotron 3 Embed, une collection d'embeddings ouverts dont le modèle 8B se classe premier sur RTEB37MarkTechPostLLMs 02NVIDIA Nemotron 3.5 Lightning et NeMo Switchyard rendent l'IA à base d'agents plus rapide et efficace56NVIDIA AI BlogLLMs 03NVIDIA Nemotron 3 Nano Omni intègre le raisonnement d'agents multimodaux dans un modèle ouvert et efficace52NVIDIA Developer BlogLLMs 
Dossier · NVIDIASuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.