RobotiquearXiv cs.RO · 23 avr. 2026, 07:00· 1 min de lecture

Navigation autonome d'un robot par apprentissage structurel en ligne et planification par inférence active

Résumé IASource uniqueImpact UE Take éditorial

Des chercheurs de l'université de Gand ont publié sur arXiv un système de navigation robotique autonome baptisé AIMAPP (Active Inference MAPping and Planning), capable d'explorer des environnements inconnus sans carte préalable ni phase d'entraînement. Le robot construit en temps réel une carte topologique sparse, apprend dynamiquement les transitions d'états et planifie ses actions en minimisant ce que les auteurs appellent l'Énergie Libre Attendue (Expected Free Energy), un principe emprunté à la théorie de l'inférence active. Le système est compatible avec ROS, indépendant du type de capteurs utilisés et fonctionne en mode entièrement auto-supervisé, sans aucune intervention humaine préalable.

L'intérêt principal d'AIMAPP réside dans sa robustesse face aux conditions réelles d'opération : il continue de fonctionner même en cas de défaillance partielle des capteurs ou de dérive odométrique cumulative, deux problèmes qui paralysent souvent les systèmes classiques de navigation SLAM. Contrairement aux approches par apprentissage profond qui nécessitent d'importants volumes de données annotées, AIMAPP s'adapte en ligne à des environnements changeants et à des observations ambiguës. Dans des évaluations conduites à grande échelle, en environnements réels et simulés, le système surpasse ou égale les planificateurs de référence actuels, ouvrant la voie à des robots déployables dans des contextes non structurés comme des entrepôts, des zones sinistrées ou des espaces extérieurs.

L'inférence active est un cadre théorique issu des neurosciences computationnelles, initialement développé pour modéliser la perception et l'action chez les êtres vivants. Son application à la robotique est encore émergente, mais AIMAPP représente une des implémentations les plus complètes à ce jour, combinant cartographie, localisation et prise de décision dans un modèle génératif unifié. Le code est disponible publiquement sur GitHub (decide-ugent/aimapp), ce qui pourrait accélérer son adoption dans la communauté robotique. La prochaine étape naturelle sera de tester le système sur des flottes de robots opérant en parallèle, ainsi que dans des environnements dynamiques peuplés d'humains.

Impact France/UE

Recherche conduite par l'Université de Gand (Belgique), le code open-source publié sur GitHub est directement exploitable par les laboratoires et industriels européens actifs en robotique autonome.

💬 L'analyse de Mathieu

Pas de données annotées, pas de carte préalable, et ça tient quand les capteurs flanchent, là où SLAM se plante souvent. C'est le problème qu'on n'arrivait pas à régler proprement depuis des années en robotique mobile. Le code est sur GitHub et compatible ROS, donc les labos n'ont pas besoin de repartir de zéro.

Cet article vous a été utile ?

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.

À lire aussi

1arXiv cs.RO

Stratégie de planification par apprentissage coopératif autonome intégrant l'incertitude

Des chercheurs ont publié sur arXiv un nouveau cadre algorithmique baptisé DRLACP (Deep Reinforcement Learning-based Autonomous Cooperative Planning), conçu pour améliorer la coordination entre véhicules autonomes dans des environnements de circulation complexes. Le système s'appuie sur une combinaison de deux techniques d'apprentissage automatique : le Soft Actor-Critic (SAC), un algorithme d'apprentissage par renforcement réputé pour sa robustesse, et les Gate Recurrent Units (GRU), un type de réseau de neurones récurrents capable de traiter des séquences temporelles. Les performances du système ont été évaluées sur CARLA, une plateforme de simulation open-source largement utilisée dans la recherche sur la conduite autonome. L'enjeu central est de traiter simultanément trois catégories d'incertitudes qui affectent les systèmes de planification coopérative actuels : les incertitudes de perception (données sensorielles imprécises ou manquantes), de planification (décisions sous information incomplète) et de communication (latences ou pertes de données entre véhicules). Les approches existantes ne parviennent généralement à gérer qu'une ou deux de ces sources d'erreur. Selon les auteurs, DRLACP surpasse les méthodes de référence testées dans plusieurs scénarios de simulation avec des informations d'état imparfaites, ce qui représente une avancée concrète pour la fiabilité des systèmes multi-véhicules. La planification coopérative autonome est considérée comme une brique fondamentale des systèmes de transport intelligents de demain, où des flottes de véhicules doivent coordonner leurs trajectoires en temps réel pour maximiser fluidité et sécurité. La difficulté réside dans la nature distribuée de ces systèmes : chaque véhicule perçoit partiellement son environnement et communique avec ses voisins dans des conditions réseau variables. Les travaux sur DRLACP s'inscrivent dans une tendance plus large qui cherche à rendre ces algorithmes opérationnels hors des conditions idéales des laboratoires. La prochaine étape naturelle sera de valider ces résultats sur des données réelles et dans des scénarios urbains plus denses que ceux testés en simulation.

UEContribution académique indirectement pertinente pour l'industrie automobile européenne (Stellantis, Renault, Volkswagen) engagée dans la conduite coopérative, mais les résultats restent cantonnés à la simulation CARLA et sont loin d'un déploiement industriel.

RobotiquePaper

1 source

2arXiv cs.RO

L'apprentissage par démonstration avec détection d'échecs pour la navigation sécurisée des robots

Des chercheurs ont publié un article de recherche présentant un nouveau cadre d'apprentissage pour la navigation robotique, intitulé "Learning from Demonstration with Failure Awareness for Safe Robot Navigation" (arXiv:2604.23360). Leur approche s'attaque à un problème fondamental des systèmes d'apprentissage par démonstration : les robots apprennent principalement à partir de comportements réussis, ce qui les rend vulnérables dès qu'ils rencontrent des situations inédites ou dangereuses. Pour y remédier, l'équipe propose un cadre qui exploite explicitement les expériences d'échec, comme les collisions, jusqu'ici largement ignorées car elles n'offrent pas de comportement directement imitable. Le coeur de l'innovation réside dans une séparation stricte des rôles des deux types de données. Les expériences d'échec servent exclusivement à calibrer l'estimation de la valeur dans les zones à risque, signalant au robot les régions à éviter, tandis que l'apprentissage de la politique de navigation reste cantonné aux démonstrations réussies. Cette dissociation permet d'intégrer les données d'échec sans dégrader les performances globales, un écueil habituel des approches naïves qui mélangent les deux. Le tout est implémenté dans un cadre d'apprentissage par renforcement hors ligne, ce qui signifie que le robot apprend à partir d'un jeu de données fixe, sans nécessiter d'interactions supplémentaires avec l'environnement pendant l'entraînement. Les évaluations menées à la fois en simulation et en environnements réels montrent une réduction significative des taux de collision, tout en maintenant un taux de succès des tâches équivalent, avec une bonne généralisation sur différentes plateformes robotiques. Cette recherche s'inscrit dans un effort plus large pour rendre les robots autonomes fiables dans des contextes ouverts et imprévisibles, un enjeu critique pour leur déploiement dans des entrepôts logistiques, des hôpitaux ou des espaces publics. L'apprentissage par démonstration reste l'une des approches les plus pratiques pour programmer des robots sans expertise en RL, mais sa fragilité face aux situations hors distribution freine son adoption industrielle. En valorisant les données d'échec autrement que comme du bruit à écarter, ce travail ouvre une voie prometteuse pour construire des politiques de navigation plus robustes, sans coût de collecte de données supplémentaire.

RobotiqueActu

1 source

3arXiv cs.RO

Système ouvert de bout en bout pour la navigation autonome de robots en conditions réelles

Des chercheurs ont présenté un système embarqué léger et à architecture ouverte permettant à un robot quadrupède de naviguer de manière autonome dans des environnements réels, inconnus et dynamiques, sans apprentissage préalable spécifique à ces lieux. Déployé sur un robot Unitree Go2 à quatre pattes, le système atteint un taux de réussite supérieur à 88 % dans plusieurs environnements intérieurs testés. Il repose sur ROS2 comme middleware de communication entre les différents composants embarqués, et accepte des instructions de navigation formulées en langage naturel. Les capteurs du robot alimentent en continu un système de localisation et de cartographie, qui construit des graphes de scènes hiérarchiques enrichis de sémantique ouverte, c'est-à-dire capables d'identifier des objets sans liste prédéfinie. Un planificateur basé sur un grand modèle de langage (LLM) exploite ces graphes pour générer et adapter des plans d'action en temps réel, au fur et à mesure que la scène évolue. Ce résultat est significatif car la navigation autonome en environnement réel reste un problème difficile que la majorité des systèmes actuels ne résolvent qu'en simulation, là où les conditions sont contrôlées et les incertitudes absentes. Le fait qu'un robot puisse interpréter une consigne en langue naturelle, construire une représentation sémantique de son environnement à la volée et s'y adapter dynamiquement ouvre la voie à des déploiements pratiques dans des bâtiments industriels, des entrepôts, des hôpitaux ou des espaces publics, sans configuration manuelle préalable. La robotique autonome bute depuis des années sur quatre obstacles fondamentaux : la perception imparfaite, l'observabilité partielle, l'incertitude de localisation et les contraintes de sécurité. L'intégration des LLM comme couche de planification symbolique, combinée à une cartographie sémantique continue, représente une approche émergente qui capitalise sur les progrès récents en traitement du langage naturel et en vision par ordinateur. Ce travail s'inscrit dans une tendance plus large visant à doter les robots de capacités de raisonnement général plutôt que de comportements pré-programmés, un chantier sur lequel rivalisent des équipes académiques et des acteurs industriels comme Boston Dynamics, Figure AI ou Agility Robotics.

RobotiqueActu

1 source

4arXiv cs.RO

GS-Playground : un simulateur photoréaliste haute cadence pour l'apprentissage robotique par vision

Des chercheurs ont publié sur arXiv un article présentant GS-Playground, un simulateur haute performance conçu pour entraîner des robots à partir de données visuelles. Le système repose sur une combinaison inédite : un moteur physique parallèle développé spécifiquement pour fonctionner avec le rendu 3D Gaussian Splatting (3DGS), une technique de reconstruction visuelle photorréaliste. Le résultat est un débit de 10 000 images par seconde à une résolution de 640x480 pixels, ce qui représente une rupture significative par rapport aux simulateurs existants. GS-Playground intègre également un pipeline automatisé baptisé Real2Sim, capable de reconstruire des environnements simulés fidèles à la réalité physique à partir de scènes du monde réel, sans modélisation manuelle fastidieuse. L'enjeu est majeur pour la robotique et l'IA incarnée : entraîner un robot à agir dans le monde réel requiert des millions de simulations, mais les simulateurs visuellement réalistes sont jusqu'ici trop lents pour fonctionner à grande échelle. GS-Playground réduit drastiquement ce goulot d'étranglement computationnel, rendant possible l'apprentissage par renforcement visuel à grande échelle. Les expériences présentées couvrent trois catégories de tâches : la locomotion, la navigation et la manipulation d'objets au contact, trois domaines où la précision visuelle est déterminante pour transférer les comportements appris en simulation vers des robots réels. Le problème du "sim-to-real gap", c'est-à-dire l'écart entre ce qu'un robot apprend en simulation et ce qu'il peut réellement faire dans le monde physique, est l'un des verrous centraux de la robotique moderne. Les simulateurs massivement parallèles comme Isaac Gym d'NVIDIA ont déjà transformé l'apprentissage moteur basé sur la proprioception, mais ils restent aveugles sur le plan visuel. GS-Playground s'attaque à cette limite en combinant physique et rendu réaliste dans un seul pipeline cohérent. Si les résultats se confirment hors du cadre académique, ce type d'infrastructure pourrait accélérer sensiblement le développement de robots capables d'opérer dans des environnements non structurés.

RobotiqueOpinion

1 source

Recevez l'essentiel de l'IA chaque jour

Une sélection éditoriale quotidienne, sans bruit. Directement dans votre boîte mail.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic