Aller au contenu principal
Course d'un quadrupède à roues : atténuation active du transfert de charge par commande prédictive
RecherchearXiv cs.RO 

Course d'un quadrupède à roues : atténuation active du transfert de charge par commande prédictive

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs de l'UC Berkeley ont publié fin juin 2026 (arXiv:2606.26313) un cadre de contrôle hiérarchique combinant commande prédictive par modèle (MPC) et apprentissage par renforcement (RL) pour piloter en autonome le Unitree Go2-W, un quadrupède à roues équipé de 16 actionneurs. L'objectif : gérer activement le transfert de charge latéral pendant une course sur circuit physique, un régime d'accélération où les robots à pattes perdent typiquement de la stabilité. Le système repose sur trois couches : une génération hors ligne de trajectoire temps-optimal, un planificateur MPC en ligne qui minimise le Lateral Load Transfer Ratio (LTR) en temps réel, et une politique RL bas niveau déployée directement sur les 16 actionneurs du robot. Résultats mesurés sur piste réelle : réduction du LTR moyen de 44 %, amélioration du meilleur tour de 8,7 %, et accélération latérale maximale portée à 1,98 m/s², soit +21,3 % par rapport au contrôleur de référence sans inclinaison active.

Ce qui est techniquement notable, c'est l'utilisation des genoux du robot comme suspension active : les actionneurs de jambes génèrent un couple anti-roulis pour que le châssis s'incline dans les virages, à la manière d'une moto. C'est un usage détourné de la morphologie quadrupède qui n'est pas possible sur un AMR classique à roues fixes. La politique RL, entraînée en simulation et déployée directement sur le matériel sans couche intermédiaire, tient le transfert réel, ce qui constitue un exemple concret de sim-to-real fonctionnel sur un système dynamique rapide. Pour les intégrateurs ou chercheurs qui travaillent sur la navigation haute vitesse en environnement non structuré, cette architecture montre qu'on peut extraire des performances supplémentaires d'un châssis existant par du contrôle, sans modifier le hardware.

Le Unitree Go2-W est la variante à roues du Go2, le quadrupède à 2 700 USD lancé par Unitree Robotics (Hangzhou) en 2023, devenu plateforme de recherche très répandue dans les labos nord-américains et européens grâce à son prix. Sur le segment wheeled quadruped, il fait face au Spot de Boston Dynamics et au Jueying X20 de Deep Robotics, mais reste la référence académique en termes de volume de publications. L'équipe de Berkeley publie le code et la vidéo sur GitHub ; il n'y a pas d'annonce de commercialisation ni de partenariat industriel associé à ce travail, qui reste pour l'instant de la recherche fondamentale orientée course autonome. Les prochaines étapes naturelles seraient l'extension à des surfaces variables et des vitesses plus élevées, ou l'adaptation du framework MPC+RL à des plateformes à charge utile plus importante.

Impact France/UE

Les laboratoires européens équipés du Unitree Go2-W (plateforme académique très répandue en Europe) pourront directement tester et adapter ce framework MPC+RL open-source pour leurs propres recherches en navigation haute vitesse.

À lire aussi

Vers une prédictibilité fiable du transfert simulation-réel pour la locomotion quadrupède robuste à base de MoE
1arXiv cs.RO 

Vers une prédictibilité fiable du transfert simulation-réel pour la locomotion quadrupède robuste à base de MoE

Des chercheurs ont présenté dans un preprint arXiv (2602.00678, version 4) un cadre unifié combinant une politique de locomotion Mixture-of-Experts (MoE) et RoboGauge, une suite d'évaluation prédictive du transfert simulation-réel, appliquée à la locomotion quadrupède. L'architecture MoE déploie un ensemble d'experts spécialisés activés par un mécanisme de gating, chacun modélisant un sous-espace distinct de représentation du terrain et des commandes moteur, en s'appuyant uniquement sur la proprioception (encodeurs articulaires, centrale inertielle), sans caméra ni LiDAR. Les expériences sur un Unitree Go2 ont validé une locomotion robuste sur des terrains non vus à l'entraînement: neige, sable, escaliers, pentes et obstacles de 30 cm. En tests haute vitesse, le robot a atteint 4 m/s, avec apparition spontanée d'une allure à faible écartement latéral que les auteurs associent à une meilleure stabilité dynamique à grande vitesse. L'apport central est RoboGauge, qui génère des métriques proprioceptives multi-dimensionnelles via des tests sim-to-sim couvrant plusieurs terrains, niveaux de difficulté et randomisations de domaine, permettant de sélectionner le meilleur checkpoint de politique MoE sans validation physique répétée. Pour les équipes de R&D et les intégrateurs industriels, cela adresse directement le principal goulot d'étranglement du déploiement de robots marcheurs: le coût et le risque des essais terrain. La robustesse obtenue avec proprioception seule est également significative, car elle conteste l'hypothèse fréquente selon laquelle la vision ou le LiDAR seraient indispensables hors d'environnements contrôlés, élargissant l'espace d'application en milieux non structurés (entrepôts, chantiers, extérieurs). Il convient cependant de noter que les métriques de vitesse et d'obstacle sont issues de tests en conditions choisies, sans données de taux d'échec agrégées sur des déploiements prolongés. Ce travail s'inscrit dans une filière de recherche initiée par ETH Zurich avec ANYmal (commercialisé par ANYbotics) et les équipes de Berkeley sur l'apprentissage agile en locomotion. Le Unitree Go2, vendu autour de 1 600 dollars, est devenu la plateforme de référence académique en raison de son accessibilité. Les concurrents industriels comme Boston Dynamics (Spot) ou les acteurs AMR européens comme Exotec développent des approches similaires de robustesse multi-terrain, bien que leurs validations restent largement propriétaires. Les suites naturelles de ce travail incluent la publication de RoboGauge comme outil de benchmark open-source inter-plateformes et son extension potentielle à d'autres morphologies, notamment les humanoïdes dont le transfert sim-to-real reste un défi ouvert.

UESi RoboGauge est publié en open source, les équipes européennes (ANYbotics, intégrateurs industriels UE) bénéficieraient d'un outil de benchmark standardisé réduisant les coûts de validation physique pour la locomotion quadrupède.

RecherchePaper
1 source
CacheMPC : commande prédictive par modèle certifiée avec cache pour la locomotion quadrupède
2arXiv cs.RO 

CacheMPC : commande prédictive par modèle certifiée avec cache pour la locomotion quadrupède

Une équipe de recherche propose CacheMPC, un mécanisme de mise en cache certifiée pour le Model Predictive Control (MPC) appliqué à la locomotion de robots quadrupèdes, publié sur arXiv (2606.28300). Le MPC constitue la couche prédictive standard dans les contrôleurs hiérarchiques de quadrupèdes, mais son solveur QP (programmation quadratique) recalculé à chaque cycle constitue un goulot d'étranglement sur processeur embarqué. Certified CacheMPC adresse ce problème via un cache indexé par Locality-Sensitive Hashing (LSH) de trajectoires de forces de contact, partitionné par mode de contact. Chaque entrée récupérée est acceptée uniquement si un certificat a posteriori confirme la faisabilité primale et une borne supérieure sur la sous-optimalité via le dual gap lagrangien. Le contrôleur combine récupération certifiée top-K, solveur QP à deadline bornée, et fallback sur la dernière solution certifiée. Validé sur un Unitree Go2, le système a été évalué sur 2 038 essais MuJoCo en froid contrôleur, dont une campagne de 600 essais à n=50 sur trois cellules à la frontière d'échec, puis déployé physiquement sur le NVIDIA Orin NX embarqué du robot. Le cache sans filtrage atteint un gain médian de 25x en temps de calcul en simulation, et 18,7x sur hardware réel. L'enjeu industriel est direct : MPC haute fréquence sur SoC embarqué standard (Orin NX, environ 10-15W) sans recourir à un ASIC dédié ou à une approximation neuronale. Un facteur 18,7x de réduction du temps de solve ouvre la porte à des boucles de contrôle plus rapides sur des plateformes commerciales comme le Go2, utilisé massivement dans la recherche académique et les pilotes industriels légers. La certification formelle distingue cette approche des méthodes d'apprentissage du MPC (neural MPC, learning-based warm-starting) qui offrent des speedups similaires mais sans garantie exploitable. Nuance importante : la contribution du certificat à la stabilité en boucle fermée n'est pas statistiquement résolvable à la taille d'échantillon actuelle (n=50). Aucune différence significative n'a été détectée entre les variantes avec et sans cache, ce qui est honnête scientifiquement mais laisse la question de sécurité formelle ouverte. Le MPC pour locomotion quadrupède s'est imposé depuis les travaux d'ETH Zurich (ANYmal) et du MIT (Cheetah), avec des implémentations ouvertes comme ACADOS ou OSQP qui restent les références en solve embarqué. CacheMPC s'inscrit dans un courant distinct : plutôt qu'accélérer le solveur ou substituer le MPC par un réseau de neurones, il exploite la répétabilité des gaits locomoteurs pour réutiliser des solutions passées. Les concurrents directs incluent les approches de warm-starting par apprentissage (DeepMPC, L4DC 2024) et les approximateurs explicites de MPC. Le Unitree Go2 est devenu le benchmark de facto à petit budget pour ce type de validation hardware. Les prochaines étapes naturelles seraient une campagne avec n significativement plus grand pour trancher sur la sécurité certifiée, et une extension aux bipèdes ou aux transitions de mode de contact plus complexes.

RecherchePaper
1 source
Détection de contact active pour un transfert d'objet robuste de robot à humain
3arXiv cs.RO 

Détection de contact active pour un transfert d'objet robuste de robot à humain

Une équipe de chercheurs propose une méthode de détection de contact active pour fiabiliser les transferts d'objets de robot à humain, publiée en prépublication sur arXiv (2605.04610, mai 2026). Au lieu d'attendre passivement un signal de saisie, le robot génère des micro-mouvements exploratoires et mesure les forces appliquées en retour par l'humain : une saisie ferme produit des forces dans plusieurs directions, un contact accidentel non. Le système repose sur un modèle bayésien linéaire par morceaux qui estime la probabilité de chaque état de contact à partir de ces réponses en force. Testé avec 12 participants sur 30 objets rigides variés, il atteint un taux de succès de 97,5 %, soit plus de 30 points au-dessus des deux approches passives utilisées comme référence. Les applications visées vont du robot d'assistance à domicile (servir un verre) au bloc opératoire (passer un instrument chirurgical). Ce résultat est significatif car la généralisation inter-objets est précisément le point dur des approches passives (tactile, force/couple) : elles peinent à distinguer saisie ferme et contact fortuit face à la diversité des formes, des masses et des comportements humains. L'active sensing force une perturbation contrôlée qui rend les états ambigus séparables. Pour les intégrateurs et les décideurs industriels, l'enjeu est directement lié à la sécurité : dans un environnement collaboratif ou chirurgical, un relâchement prématuré peut causer un incident grave. Un taux de 97,5 % commence à entrer dans la plage exploitable pour des assistants robotiques en conditions réelles, même si le périmètre du test reste limité (objets rigides, 12 sujets, conditions de laboratoire). La question du handover robot-humain est active en recherche depuis plusieurs années, portée notamment par les domaines de l'assistance à la personne et de la chirurgie robotique. Ce papier est une prépublication non encore évaluée par les pairs, et l'abstract ne mentionne ni institution ni partenaire industriel, ce qui rend difficile l'évaluation de sa trajectoire vers un déploiement réel. Aucune intégration commerciale n'est annoncée. Les suites logiques incluent des tests sur objets déformables ou non rigides, une validation en conditions cliniques contrôlées, et une intégration dans des plateformes à retour d'effort comme les cobots ou les mains de robots humanoïdes qui commencent à offrir les interfaces mécaniques nécessaires à ce type de dialogue haptique.

RecherchePaper
1 source
Le facteur de charge prédit une locomotion quadrupède robuste sous contraintes, quel que soit le type d'allure
4arXiv cs.RO 

Le facteur de charge prédit une locomotion quadrupède robuste sous contraintes, quel que soit le type d'allure

Une équipe de recherche publie sur arXiv (article 2609.22073v1, soumis le 21 septembre 2026) une étude intitulée "Duty Factor Predicts Robust Constrained Quadrupedal Locomotion Across Gait Types". Les auteurs comparent trois architectures de contrôle pour robots quadrupèdes : une optimisation de trajectoire corps entier couplée à un retour LQR (régulateur linéaire quadratique), un contrôleur de marche appris par apprentissage, et un contrôle prédictif de modèle centroidal (MPC). Résultat central : le duty factor, soit la fraction du cycle de marche pendant laquelle chaque patte reste au sol, prédit mieux la convergence de l'erreur et la robustesse locale que le type de démarche nominal, marche ou trot. Ces tendances sont confirmées par des essais sur un quadrupède physique évoluant sur un terrain étroit et contraint. Pour les ingénieurs et intégrateurs qui conçoivent des plateformes à pattes destinées à des environnements contraints, usine, chantier, terrain accidenté, ce résultat propose un paramètre de réglage simple et unidimensionnel pour ajuster la robustesse sans changer de démarche. Plutôt que de choisir entre marche et trot selon la vitesse ou le terrain, régler le duty factor suffirait à gagner en stabilité, quel que soit l'algorithme utilisé, optimisation classique, apprentissage, ou MPC. Le fait que la tendance se vérifie sur trois architectures de contrôle distinctes suggère une propriété générale de la dynamique quadrupède plutôt qu'un artefact propre à une méthode, ce qui pourrait simplifier la conception de futurs contrôleurs robustes destinés à opérer hors laboratoire. Ce travail s'inscrit dans une recherche visant à dépasser la classification traditionnelle des démarches en isolant les paramètres continus, duty factor, vitesse, largeur d'appui, qui varient à l'intérieur d'un même type de démarche et conditionnent la robustesse aux perturbations. Il s'agit d'un preprint arXiv non encore évalué par les pairs, avec une validation expérimentale limitée à un seul robot physique sur un scénario de terrain étroit, sans précision sur le fabricant de la plateforme ni de calendrier de déploiement industriel. Aucun acteur commercial, français ou international, n'est cité dans l'étude, qui reste à ce stade un travail académique orienté conception plutôt qu'un produit ou un déploiement réel.

RecherchePaper
1 source