Aller au contenu principal
De DeepSeek à DeepRoute : pourquoi un chercheur en IA de premier plan a misé sur le monde physique
RobotiquePandaily · 2 min de lecture

De DeepSeek à DeepRoute : pourquoi un chercheur en IA de premier plan a misé sur le monde physique

Source originale ↗·

Le 25 avril 2026, lors du Salon de l'automobile de Pékin, la startup chinoise d'autonomie véhiculaire DeepRoute.ai a tenu une conférence de presse inhabituelle dans le hall A4 du China International Exhibition Center : aucun véhicule en exposition, aucun prototype sur scène. Son PDG, Maxwell Zhou, a choisi ce vide comme manifeste. En une après-midi, il a dévoilé la nouvelle architecture stratégique de l'entreprise autour du concept de "Physical AI", son modèle fondateur (Foundation Model), une ébauche d'agent intégrant conduite et habitacle, et un chiffre clé : un véhicule sur trois équipé d'un système NOA urbain en Chine tourne aujourd'hui sur la technologie DeepRoute, soit plus de 300 000 voitures en circulation. L'événement a également marqué la première apparition publique de Ruan Chong, ancien directeur R&D de DeepSeek et chercheur central en IA multimodale, depuis son arrivée chez DeepRoute en tant que Chief Scientist.

Ce repositionnement marque une rupture nette avec la logique dominante du secteur. Là où les acteurs de la conduite autonome se sont longtemps concurrencés sur des benchmarks techniques, quelle pluie, quel angle mort, quel cas limite, DeepRoute revendique désormais un rôle d'infrastructure, comparable selon Zhou à "l'électricité ou les télécommunications". L'objectif affiché est d'atteindre 1 000 miles ou plus entre deux interventions critiques (MPCI) d'ici fin 2026. "Quatre-vingt-dix pour cent de ce qui compte, c'est la sécurité", a déclaré Zhou, ajoutant que Tesla a déjà atteint ce seuil et que les petits modèles ne permettront jamais d'y parvenir : "Quoi que vous fassiez dans le monde des petits modèles, vous ne pouvez pas obtenir dix fois mieux en travaillant plus fort." Le virage vers les grands modèles de fondation est donc présenté comme une nécessité structurelle, pas une option.

Le recrutement de Ruan Chong illustre une dynamique plus large que Zhou a explicitement nommée : les responsables de la recherche multimodale des grands groupes internet chinois migrent vers la conduite autonome. Ruan lui-même a expliqué ce choix avec franchise : "Les modèles de langage sont très matures, presque n'importe quelle tâche peut être traitée par un seul modèle. Mais dans l'intelligence multimodale et incarnée, on en est loin. Je préfère être à la frontière." Cette migration de talents, si elle se confirme, signale que le centre de gravité de l'IA appliquée se déplace du texte vers le monde physique. DeepRoute entend capitaliser sur cette fenêtre, avant que le secteur n'atteigne lui-même la maturité qu'a connue le NLP.

Impact France/UE

La montée en puissance de DeepRoute et la migration de talents IA vers l'autonomie véhiculaire en Chine renforcent la pression compétitive sur les constructeurs automobiles européens dans la course au véhicule autonome.

Dans nos dossiers

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

Pénurie de main-d'œuvre : le Japon mise sur l'IA physique pour rester compétitif
1La Tribune 

Pénurie de main-d'œuvre : le Japon mise sur l'IA physique pour rester compétitif

Face à une pénurie de main-d'œuvre structurelle, le ministère de l'Économie japonais a annoncé un plan de transition vers l'intelligence artificielle physique pour maintenir la compétitivité industrielle du pays. Le Japon, qui contrôlait déjà 70 % du marché mondial de la robotique industrielle en 2022, franchit une nouvelle étape en intégrant des systèmes d'IA directement dans ses chaînes de production et ses infrastructures critiques. Cette initiative s'inscrit dans une politique nationale coordonnée entre le gouvernement, les grands groupes industriels et les fabricants de robots. L'enjeu est considérable pour une économie de la taille du Japon : automatiser les tâches physiques répétitives permet de compenser le recul de la population active sans recourir massivement à l'immigration, une option politiquement sensible. Les secteurs ciblés incluent la logistique, la construction, l'agriculture et les soins aux personnes âgées, autant de domaines où le manque de travailleurs se fait déjà sentir de manière aiguë. Pour les entreprises japonaises, cela représente aussi une opportunité d'exporter ces solutions vers d'autres pays vieillissants. Le Japon n'est pas seul dans cette course : la Corée du Sud et l'Allemagne poursuivent des stratégies similaires, tandis que les États-Unis et la Chine investissent massivement dans la robotique humanoïde. Mais Tokyo dispose d'un avantage historique dans la fabrication de robots industriels, avec des acteurs comme Fanuc, Yaskawa et Kawasaki. La prochaine étape sera d'y greffer des modèles d'IA capables d'apprentissage autonome, transformant des automates programmés en systèmes réellement adaptatifs.

UEL'Allemagne, explicitement citée comme poursuivant une stratégie similaire, risque d'intensifier la compétition avec le Japon sur les marchés de la robotique industrielle, ce qui concerne directement les industriels européens du secteur.

RobotiqueOpinion
1 source
Nvidia mise sur l'IA physique au GTC Taipei : nouveau modèle de monde, cerveau de conduite et robot humanoïde open source
2The Decoder 

Nvidia mise sur l'IA physique au GTC Taipei : nouveau modèle de monde, cerveau de conduite et robot humanoïde open source

Lors du GTC Taipei, Nvidia a dévoilé plusieurs modèles destinés à accélérer son offensive dans l'IA physique. La conférence a été marquée par trois annonces majeures : Cosmos 3, un nouveau modèle de monde (world model) de dernière génération, Alpamayo 2 Super, une version considérablement élargie du modèle de conduite autonome, et une plateforme de référence ouverte pour robots humanoïdes. Ces annonces s'inscrivent dans la stratégie de Jensen Huang de faire de Nvidia le fournisseur incontournable de l'infrastructure pour les systèmes physiques intelligents. Ces outils visent des marchés en pleine explosion : la robotique industrielle, les véhicules autonomes et les systèmes de surveillance vidéo intelligents. Un world model comme Cosmos 3 permet à des robots ou des voitures autonomes de simuler leur environnement et d'anticiper les conséquences de leurs actions, une brique fondamentale pour passer de la démonstration laboratoire au déploiement à grande échelle. La plateforme humanoïde ouverte, quant à elle, vise à standardiser le développement matériel et logiciel pour les constructeurs de robots à deux jambes, réduisant les coûts d'entrée pour les startups du secteur. Nvidia capitalise ici sur sa domination dans les GPU d'entraînement pour étendre son empreinte vers l'inférence embarquée et les systèmes temps-réel. La concurrence s'intensifie avec des acteurs comme Qualcomm et Intel sur les puces pour véhicules autonomes, tandis que des entreprises comme Figure, Boston Dynamics ou 1X Technologies attendent des plateformes logicielles communes pour accélérer leurs développements. GTC Taipei confirme que Nvidia ne veut pas seulement alimenter les data centers de l'IA, il veut aussi être le cerveau des machines qui bougent.

UELes constructeurs automobiles européens (Renault, Stellantis, BMW, Volkswagen) et les startups robotiques européennes pourraient bénéficier de la plateforme humanoïde ouverte pour réduire leurs coûts d'entrée et accélérer leurs développements en robotique industrielle et véhicules autonomes.

RobotiqueOpinion
1 source
Les 10 meilleurs modèles d'IA physique pour robots en 2026
3MarkTechPost 

Les 10 meilleurs modèles d'IA physique pour robots en 2026

En 2026, une nouvelle génération de modèles d'IA dits "physiques" s'impose comme la colonne vertébrale de la robotique industrielle et de recherche. Ces systèmes ne génèrent pas du texte, mais des commandes motrices : ils permettent à des robots réels d'exécuter des tâches complexes dans des usines, entrepôts et laboratoires. Dix modèles dominent ce paysage. NVIDIA a lancé sa série GR00T N dès mars 2025 au GTC, avec une première version ouverte et personnalisable. La version N1.7, publiée le 17 avril 2026 en accès anticipé, est un modèle de 3 milliards de paramètres, sous licence Apache 2.0, entraîné sur 20 854 heures de vidéo égocentrique humaine couvrant plus de 20 catégories de tâches. NVIDIA a également identifié la première loi d'échelle pour la dextérité robotique : passer de 1 000 à 20 000 heures de données humaines double les performances. Google DeepMind, de son côté, a dévoilé Gemini Robotics 1.5 en septembre 2025, un modèle vision-langage-action bâti sur Gemini 2.0, et a publié le 14 avril 2026 une version Gemini Robotics-ER 1.6 améliorant le raisonnement spatial, développée en collaboration avec Boston Dynamics. Ces avancées marquent un tournant concret pour l'industrie robotique. Des partenaires comme Agile Robots, Agility Robotics, Foxlink, NEURA Robotics et Lightwheel testent ou déploient déjà ces systèmes sur du matériel réel. Les modèles permettent désormais à des robots bimanuels d'accomplir des tâches en plusieurs étapes, de lire des instruments complexes, ou d'apprendre à partir de simples vidéos d'humains au travail, sans nécessiter des mois de génération de données synthétiques. NVIDIA a réduit ce délai à environ 36 heures grâce à son architecture GR00T-Dreams. Pour les opérateurs industriels, cela signifie des cycles de déploiement raccourcis et une polyvalence accrue des robots sans reprogrammation manuelle lourde. Ce bond technologique s'inscrit dans une convergence entre les grands modèles de langage et la robotique physique, amorcée depuis 18 mois environ. Des acteurs comme Physical Intelligence, avec ses modèles pi0 et pi0.5 basés sur le flow matching, Figure AI avec Helix, ou encore OpenVLA et le SmolVLA open-source d'HuggingFace LeRobot, enrichissent un écosystème désormais très dense. NVIDIA s'appuie également sur ses Cosmos World Foundation Models pour simuler des environnements d'entraînement réalistes. La compétition s'intensifie entre approches ouvertes, comme GR00T N1.7, et systèmes propriétaires à accès restreint comme Gemini Robotics 1.5, dont la disponibilité reste limitée à des partenaires sélectionnés. Les prochains mois verront probablement les premières mises en production à grande échelle dans les lignes d'assemblage et la logistique automatisée.

UEL'entreprise allemande NEURA Robotics figure parmi les partenaires industriels testant ces systèmes, et les opérateurs européens de la logistique et de l'assemblage pourraient bénéficier de cycles de déploiement robotique significativement raccourcis.

RobotiqueActu
1 source
Nvidia mise sur l'IA physique pour résoudre le problème de données de la robotique médicale
4AI News 

Nvidia mise sur l'IA physique pour résoudre le problème de données de la robotique médicale

Nvidia a dévoilé Medical Physics Simulation, un nouveau framework open source intégré à sa plateforme Isaac for Healthcare, conçu pour entraîner des robots médicaux par simulation plutôt que par expérience clinique réelle. L'outil combine deux approches : une simulation physique classique qui modélise les règles mécaniques connues, comment un cathéter se courbe, quelle résistance oppose une paroi vasculaire, comment les forces de contact évoluent quand un instrument traverse un tissu, et un composant d'IA générative baptisé Cosmos H Dreams, qui apprend la dynamique visuelle des scènes à partir de données procédurales. Exécuté à grande échelle sur GPU grâce aux bibliothèques Warp et Newton de Nvidia, le système peut faire tourner des milliers d'environnements d'entraînement en parallèle. Nvidia annonce qu'un test portant sur 8 192 environnements parallèles a fait chuter le temps d'entraînement de plus de cinq heures à moins de deux minutes. CMR Surgical et Cambridge Consultants, filiale de Capgemini, figurent parmi les premiers partenaires : CMR a versé près de 500 heures de données cliniques anonymisées issues de son robot chirurgical Versius au jeu de données Open H Embodiment, couvrant des interventions comme la cholécystectomie, la prostatectomie, la réparation de hernie et l'hystérectomie. L'enjeu tient au fait que les robots médicaux, à la différence des modèles de langage qui apprennent à partir de texte, doivent acquérir une forme d'intuition physique par le contact et la conséquence, par exemple ce qui se passe quand un guide-fil rencontre une paroi vasculaire calcifiée ou quand un bras robotisé exerce une pression excessive sur un tissu mou. Or ces situations réelles sont rares, fortement encadrées par la réglementation et lentes à accumuler en nombre suffisant pour couvrir toute la diversité des cas cliniques. En générant ces scénarios à la demande, la simulation pourrait accélérer considérablement le développement de robots chirurgicaux et diagnostiques capables de généraliser au-delà des cas standards, un enjeu direct pour les fabricants comme CMR Surgical qui cherchent à fiabiliser leurs systèmes avant un déploiement plus large en salle d'opération. Le vrai test reste cependant la fiabilité clinique plutôt que la seule vitesse de calcul. Nvidia reconnaît lui-même que la performance en simulation ne dit rien de la manière dont un modèle entraîné ainsi réagirait face à une imagerie incomplète, des données de capteurs retardées, voire une anatomie totalement inédite. Un modèle de langage qui se trompe produit une mauvaise réponse ; un système d'IA physique qui se trompe agit à l'intérieur d'un patient. La question de fond, pour l'ensemble du secteur de la robotique médicale, est donc de savoir si les échecs simulés reproduisent fidèlement ceux qui surviennent réellement au bloc opératoire, et cela ne pourra être tranché que par des validations cliniques successives à mesure que des acteurs comme CMR Surgical et Cambridge Consultants approfondissent leur usage de la plateforme.

UECambridge Consultants, l'un des premiers partenaires du projet, est une filiale du groupe français Capgemini, ce qui relie indirectement cette avancée technologique à un acteur industriel français.

RobotiqueActu
1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic