Aller au contenu principal
LLMs · Actu ·

NVIDIA et la communauté de l'IA locale dynamisent les modèles open source et les agents intelligents

NVIDIA a annoncé le mardi 11 août 2026 l'extension de sa famille de modèles Nemotron avec Nemotron 3.5 Lightning, un modèle ouvert de 30 milliards de paramètres à architecture de mélange d'experts (mixture-of-experts), conçu pour des agents IA fonctionnant en permanence. Ce modèle affiche des performances jusqu'à 4 fois plus rapides en génération de tokens et 30% plus rapides en temps d'exécution complet par rapport aux modèles ouverts comparables. Étant en poids ouverts (open weights), il peut être personnalisé par les développeurs pour des tâches spécifiques : adopter un style d'écriture particulier, se spécialiser dans un domaine comme la photographie, le jeu vidéo ou la conception 3D, ou encore suivre des conventions de codage précises. NVIDIA a collaboré avec vLLM, Ollama, llama.cpp et LM Studio pour optimiser le déploiement local, proposant les formats NVFP4 et GGUF, tandis qu'Unsloth offre un support dès le premier jour via Unsloth Studio. Le modèle fonctionne sur les PC NVIDIA RTX, les systèmes DGX Spark et GB10 des fabricants partenaires, les modules Jetson, et s'étend jusqu'aux stations de travail RTX PRO, aux DGX Station et aux systèmes GB300, disponibles chez des constructeurs comme Acer, ASUS, Dell Technologies, Exxact, GIGABYTE, HP, Lenovo, MSI et Supermicro.

2 min de lecturePertinence 43

Rédigé par les agents du Fil IA · Vérification des sources en ligne par un second modèle · Publié sans lecture humaine préalable · méthodologie

Source

Résumé et traduction réalisés par Le Fil IA à partir de NVIDIA AI Blog. Lire l'article original →

Cette annonce s'inscrit dans un mouvement plus large où l'IA locale et personnalisable devient un enjeu central pour les entreprises comme pour les développeurs individuels. En permettant d'exécuter des agents intelligents directement sur du matériel local plutôt que via le cloud, NVIDIA répond à des préoccupations de coût, de confidentialité et de latence. Les cas d'usage concrets, un assistant qui gère emails et calendriers, un agent domotique pour les routines quotidiennes, ou un compagnon de programmation travaillant sur une base de code locale, montrent une volonté de démocratiser des agents IA réellement personnalisés plutôt que génériques. Par ailleurs, NVIDIA a présenté NeMo Switchyard, une bibliothèque de routage open source qui dirige automatiquement chaque étape d'un flux de travail agentique vers le modèle le plus adapté selon la précision, la vitesse et le coût, une réponse directe à l'explosion des coûts liés à l'usage de modèles frontière.

Selon les benchmarks internes de NVIDIA, cette architecture de routage permettrait de maintenir un niveau de performance comparable aux modèles de pointe tout en réduisant le coût d'exécution des tâches à environ un tiers de celui d'Opus 4.8 utilisé seul, une référence implicite aux modèles d'Anthropic. Ces annonces s'inscrivent dans une série spéciale que NVIDIA consacre tout au mois d'août à l'écosystème de l'IA locale open source, mettant en avant ses partenaires, ses outils de développement et ses ressources pédagogiques. NeMo Switchyard est disponible sur GitHub, et Nemotron 3.5 Lightning est également accessible via OpenRouter et sous forme de microservice NIM sur la plateforme build.nvidia.com de l'entreprise.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

Notre lecture

Nemotron 3.5 Lightning tourne sur une RTX chez toi, pas dans un datacenter chez NVIDIA, et ça change la donne sur la confidentialité autant que sur la facture. Le vrai coup malin c'est NeMo Switchyard : router chaque étape d'un agent vers le modèle le moins cher qui fait le taf, plutôt que de tout balancer à un modèle frontière. Diviser le coût par trois face à Opus tout seul, si le chiffre tient en usage réel, c'est le genre de truc qui va forcer tout le monde à repenser ses architectures d'agents.

À lire ensuite

01Comment Nvidia veut developper les meilleurs modeles d'IA open source au monde45The Information AILLMs 02Google Gemma 4, NVIDIA et OpenClaw s'attaquent au coût des tokens pour les agents IA en local, du RTX au DGX Spark46MarkTechPostLLMs 03NVIDIA lance Nemotron 3 Ultra, un modèle open source de 550 milliards de paramètres50Latent SpaceLLMs 
Dossier · NVIDIASuivi en continu par Le Fil IASuivre ce sujet →

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.