
Projection-rétraction MPPI : contrôle exact sur variété de contraintes pour manipulateurs
Des chercheurs du RCI Lab publient sur arXiv (référence 2608.07573v1) une nouvelle méthode de commande pour bras manipulateurs baptisée Projection-Retraction MPPI (PR-MPPI). Le système a été validé sur des plateformes bimanuelles à 14 degrés de liberté (DOF) : en simulation, via un test de stress sur les limites articulaires et un test d'évitement d'obstacles randomisé, puis sur matériel réel avec un humanoïde Unitree H1-2 dont les deux bras évitent de façon réactive un obstacle mobile. Le code source et les vidéos d'expérience sont publiés sur rcilab.github.io/prmppi. Il s'agit d'une publication de recherche académique, sans annonce de produit commercial ni de déploiement industriel.
Le Model Predictive Path Integral (MPPI) est une technique de commande prédictive très utilisée en manipulation robotique car elle gère des coûts non convexes sans calcul de gradient, en échantillonnant en parallèle de nombreuses trajectoires candidates, une approche qui tire parti du calcul GPU massivement parallèle. Sa limite connue est que les contraintes strictes, comme une chaîne cinématique fermée que deux bras doivent maintenir exactement pour porter ensemble un objet rigide, ou les limites articulaires et distances de sécurité aux obstacles, ne sont traitées que comme des pénalités douces dans le coût, susceptibles d'être violées dès que le coût de tâche devient dominant. PR-MPPI corrige ce point en projetant, à chaque étape de simulation, la vitesse échantillonnée sur le sous-espace de la contrainte d'égalité puis sur le demi-espace de chaque contrainte d'inégalité, avant de ramener la commande finale sur la contrainte à une tolérance numérique près, indépendamment du poids attribué à la tâche. Pour la manipulation bimanuelle et les humanoïdes évoluant près d'humains ou d'obstacles mobiles, cette garantie de respect exact, et non plus seulement approximatif, des contraintes de sécurité répond à une faiblesse pratique connue des architectures de commande par échantillonnage.
Le MPPI est hérité des méthodes de commande prédictive par échantillonnage développées initialement pour les véhicules autonomes, avant d'être largement repris ces dernières années dans la commande corps-complet des bras manipulateurs et des humanoïdes, portée par les gains de calcul parallèle sur GPU. L'article positionne PR-MPPI comme une réponse directe à la principale faiblesse de cette famille de méthodes, la gestion uniquement molle des contraintes strictes, un problème qui concerne potentiellement des architectures de commande similaires chez d'autres constructeurs d'humanoïdes et de bras bimanuels, alors même que le H1-2 d'Unitree a servi ici de plateforme de test réel. Aucun partenariat industriel, pilote commercial ni calendrier de déploiement n'est mentionné : la publication reste, à ce stade, une validation académique en simulation et sur un seul robot en laboratoire, code et vidéos mis à disposition de la communauté recherche.
Dans nos dossiers




