Interaction-Aware : contrôle du corps entier pour un transport d'objets compliant
Le transport coopératif d'objets en environnement non structuré reste un défi majeur pour les robots humanoïdes assistants, car les forces d'interaction fortes et variables dans le temps rendent peu fiable le contrôle corps entier classique axé sur le suivi de trajectoire, notamment lors de tâches de soutien en contact rapproché. Une équipe de recherche propose IO-WBC (Interaction-Oriented Whole-Body Control), un contrôle bio-inspiré fonctionnant comme un "cervelet artificiel" : un agent moteur adaptatif qui traduit des commandes de haut niveau en comportements corps entier stables et physiquement cohérents sous contact. L'architecture sépare structurellement l'exécution des interactions du haut du corps du contrôle de soutien du bas du corps, permettant au robot de garder l'équilibre tout en modulant les échanges de force avec l'objet transporté. Un générateur de référence optimisé par trajectoire fournit un a priori cinématique, tandis qu'une politique d'apprentissage par renforcement gère les réponses du corps sous charges lourdes et perturbations. Cette politique est entraînée en simulation avec masse et inertie de charge randomisées, puis déployée via une distillation asymétrique enseignant-élève, l'élève ne s'appuyant à l'exécution que sur l'historique proprioceptif. L'article, republié en version révisée sur arXiv (2603.03751v2), rapporte des expériences montrant un comportement corps entier stable même quand le suivi précis de vitesse devient impossible.
Ce travail s'attaque à un point de friction connu de la robotique humanoïde assistive : les contrôleurs classiques, optimisés pour suivre une trajectoire, décrochent dès que les forces de contact deviennent imprévisibles, ce qui limite les cas d'usage réels de transport ou de manipulation coopérative. En démontrant qu'une politique RL entraînée sur charge et perturbations randomisées peut maintenir la stabilité sans suivi de vitesse parfait, l'étude apporte un argument concret dans le débat sur l'écart entre démonstrations en simulation et robustesse en conditions réelles, un sujet sensible pour tout intégrateur évaluant des humanoïdes pour la logistique ou l'assistance physique.
Il s'agit d'une publication académique, sans lien annoncé avec un produit commercial ou une plateforme robotique spécifique ; l'article ne mentionne ni partenaire industriel ni calendrier de déploiement. La distillation enseignant-élève et l'entraînement par domain randomization s'inscrivent dans une lignée de méthodes désormais courantes en contrôle locomoteur par apprentissage, appliquées ici à un problème encore peu traité : la manipulation coopérative sous forte charge de contact.
Dans nos dossiers



