Aller au contenu principal
Robotique · Paper ·

MoMo : le "mode mouvement" pour la manipulation robotique via tokenisation spatio-temporelle des actions

Une équipe de recherche en robotique présente MoMo, un nouveau système d'apprentissage par imitation permettant aux robots manipulateurs de faire varier la façon dont ils exécutent leurs gestes, et pas seulement les gestes eux-mêmes. Concrètement, MoMo repose sur deux étages: un tokeniseur d'actions spatio-temporel qui encode les mouvements dans le temps et l'espace, puis un transformeur de clonage comportemental qui prend en entrée la tâche à accomplir ainsi qu'un paramètre continu appelé mode de mouvement. Les chercheurs ont testé leur approche sur six tâches de manipulation réalisées par un robot réel, et ont montré qu'en faisant varier ce paramètre de mode de mouvement, le comportement du bras robotique évolue de façon régulière et contrôlable, sans nécessiter de réentraînement pour chaque style d'exécution.

2 min de lecturePertinence 35
Source

Résumé et traduction réalisés par Le Fil IA à partir de Apple Machine Learning. Lire l'article original →

Cette capacité répond à un besoin concret de l'industrie robotique: un même robot doit souvent adapter la vitesse, la fluidité ou la prudence de ses gestes selon le contexte, par exemple manipuler un objet fragile plus lentement qu'un objet robuste, ou ajuster son comportement selon la présence d'un humain à proximité. Jusqu'ici, la plupart des systèmes de clonage comportemental apprenaient une seule façon d'exécuter chaque tâche, ce qui limitait leur flexibilité en usage réel. En traitant le style d'exécution comme un facteur réutilisable et partagé entre les tâches, MoMo ouvre la voie à des robots capables de moduler leur comportement à la demande, un atout pour les applications industrielles et domestiques où les conditions varient constamment.

Ce travail s'inscrit dans une tendance plus large de la recherche en robotique, qui cherche à rendre l'apprentissage par imitation plus général et plus adaptable, au-delà de la simple reproduction de démonstrations humaines. La tokenisation spatio-temporelle des actions, en particulier, s'impose progressivement comme un outil clé pour représenter des mouvements complexes de manière compacte et manipulable par des modèles de type transformeur. Les prochaines étapes pour cette ligne de recherche incluront probablement l'extension à un plus grand nombre de tâches et de robots, ainsi que l'intégration de ce contrôle du style de mouvement dans des systèmes robotiques déployés en conditions réelles.

Impact France / UEChamp produit par Le Fil IA

Pas d'impact direct sur la France/UE

À lire ensuite

01SARM : une modélisation des récompenses adaptée aux étapes pour la manipulation robotique à long terme38arXiv cs.RORobotique 02Apprentissage des intentions humaines à partir de démonstrations massives pour la manipulation robotique38arXiv cs.RORobotique 03STARRY : modélisation du monde centrée sur l'action spatio-temporelle pour la manipulation robotique42arXiv cs.ROAutre 

Le brief du matin

L'essentiel de l'IA chaque jour. Gratuit, désinscription en un clic.

Recevez l'essentiel de l'IA chaque jour

Gratuit · 1 email le matin, l'essentiel de l'IA · désinscription en un clic

Vu une erreur factuelle dans cet article ? Signalez-la. Toutes les corrections valides sont publiées sur /corrections.