Aller au contenu principal
RecherchearXiv cs.RO 

Odométrie proprioceptive à modèles multiples interactifs pour robots à pattes

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Voici le résumé en français :

Une équipe de recherche propose une méthode d'odométrie proprioceptive basée sur un modèle multiple interactif (IMM, interacting multiple model) pour l'estimation d'état des robots à pattes. Le problème adressé : l'odométrie de jambe souffre habituellement d'une observabilité limitée et dépend fortement de contraintes de mesure pour limiter la dérive de position. Lorsque les capteurs extéroceptifs (caméras, LiDAR) sont peu fiables ou dégradés, ces contraintes reposent essentiellement sur les données proprioceptives, en particulier la cinématique des jambes au contact du sol. Or la plupart des méthodes existantes supposent un contact ponctuel idéalisé entre le pied et le sol, une hypothèse souvent violée en conditions réelles de marche. Les chercheurs ont donc conçu un cadre probabiliste unifié intégrant plusieurs hypothèses de contact simultanément, permettant une commutation de mode en ligne et une fusion probabiliste adaptée aux conditions de contact variables. Des simulations poussées et des expériences sur robot réel valident l'approche, montrant une précision d'estimation de pose supérieure aux méthodes de référence actuelles, pour un coût de calcul comparable.

Cette avancée compte pour les intégrateurs et ingénieurs en robotique de locomotion car l'estimation d'état fiable est un prérequis critique à l'autonomie des robots à pattes, notamment en environnements où le GPS ou la vision échouent (intérieurs encombrés, terrains accidentés, conditions de faible luminosité). L'hypothèse de contact ponctuel, largement utilisée par commodité mathématique, ne correspond pas à la réalité physique des pieds robotiques, qui peuvent glisser, rouler ou entrer en contact par une surface plutôt qu'un point unique. En modélisant explicitement plusieurs types de contact possibles et en les fusionnant de façon probabiliste, cette méthode comble un écart entre modèles théoriques et comportement réel, un enjeu direct pour la fiabilité des robots quadrupèdes et bipèdes déployés en conditions industrielles ou d'inspection.

Ce travail s'inscrit dans une lignée de recherche sur l'estimation d'état des robots à pattes, domaine où les approches à filtre de Kalman étendu ou à optimisation par fenêtre glissante dominent traditionnellement, souvent couplées à l'IMU et aux encodeurs de jambe. L'utilisation de modèles à interaction multiple, technique empruntée au suivi de cibles en robotique et en aérospatiale, représente une adaptation méthodologique notable à ce domaine. Cette version republiée (v2) sur arXiv suggère une révision après un premier dépôt, sans détails sur un déploiement matériel commercial ni sur les acteurs impliqués dans l'expérimentation.

Dans nos dossiers

À lire aussi

Odométrie proprioceptive à ancrage de contact pour robots à pattes et roues-pattes
1arXiv cs.RO 

Odométrie proprioceptive à ancrage de contact pour robots à pattes et roues-pattes

Des chercheurs présentent dans un preprint arXiv (2602.17393, v3) un estimateur d'état proprioceptif pour robots à pattes qui n'utilise ni caméra, ni LiDAR, uniquement IMU et encodeurs moteurs. Le système calcule la pose et la vitesse du corps avec une formulation unifiée couvrant quadrupèdes et robots roue-patte (wheel-legged), validée sur quatre plateformes quadrupèdes distinctes. Le principe central est l'ancrage cinématique par contact : l'estimation des forces d'appui via le couple articulaire sélectionne les pieds en stance, dont les empreintes au sol fournissent des contraintes intermittentes dans le repère monde qui limitent la dérive cumulative de l'IMU. Un algorithme de clustering de hauteur avec décroissance temporelle corrige la dérive en élévation lors de longues traversées en recalant les nouvelles empreintes sur les plans d'appui précédemment observés. Pour les plateformes roue-patte, le contact enregistré est propagé par déplacement de roulement effectif avec compensation du mouvement de jambe et correction de direction sur pente. Cette approche répond à un verrou concret de la robotique mobile : les robots à pattes déployés en environnements visuellement dégradés (poussière, fumée, obscurité, souterrains) ne peuvent pas se fier à la vision ou au LiDAR. Les méthodes purement inertielles accumulent une dérive de cap et de position incompatible avec une navigation autonome prolongée. En ancrant l'estimation sur des contacts validés par couple, la méthode s'affranchit partiellement de la qualité des encodeurs de vitesse, sujets à quantification. Un filtre de Kalman cubature (UKF) par cinématique inverse est proposé en module optionnel pour améliorer les observations de vitesse pied sans alourdir l'architecture principale. La cohérence géométrique multi-contacts est injectée comme prior souple de cap plutôt que comme reset brutal de l'attitude, préservant la continuité de l'état estimé. L'odométrie proprioceptive pour robots à pattes est un terrain actif depuis les travaux Contact-Aided Invariant EKF (Hartley, University of Michigan) et les plateformes ANYmal développées à l'ETH Zurich. Les grandes solutions commerciales actuelles comme Boston Dynamics Spot ou Unitree B2 combinent odométrie visuelle et inertielle en production, ce qui signale l'intérêt industriel pour des alternatives sans capteurs exogènes dans des conditions adverses. La méthode est présentée comme extensible aux bipèdes, morphologie centrale dans la course aux humanoïdes industriels. À sa troisième révision sur arXiv, le papier cible probablement une conférence de robotique de premier rang (IROS, ICRA), sans calendrier de soumission annoncé.

RecherchePaper
1 source
Quatre estimateurs proprioceptifs simples pour robots à pattes
2arXiv cs.RO 

Quatre estimateurs proprioceptifs simples pour robots à pattes

Des chercheurs ont publié sur arXiv (réf. 2605.23100) un rapport technique présentant quatre estimateurs d'état proprioceptifs pour robots à pattes, conçus pour corriger la dérive des centrales inertielles (IMU) de grade consommateur embarquées sur ces plateformes. Le problème central est connu : une IMU seule accumule des erreurs de position et d'orientation au fil du temps en raison du bruit de mesure. L'approche proposée exploite les contacts intermittents des pieds avec le sol comme événements de recalage, sans recourir à des capteurs extéroceptifs (caméras, lidar). L'état estimé comprend l'attitude, la position, la vitesse et les biais IMU. Les quatre variantes progressent en complexité : un filtre de Kalman étendu invariant assisté par contacts (EKF invariant, d'après les travaux de Hartley et al.) à taux de mise à jour réduit, puis ce même filtre augmenté d'une mise à jour par graphe de facteurs, puis un lisseur à décalage fixe intégrant des points d'appui par épisode de contact, avec et sans modélisation d'un biais IMU évolutif. Les quatre implémentations sont disponibles dans la bibliothèque GTSAM (Dellaert et al.) et accompagnées d'une interface compatible ROS2. L'intérêt pratique de cette contribution est double : elle fournit une baseline reproductible permettant de comparer rigoureusement des architectures d'estimation proprioceptive, et elle abaisse le seuil d'entrée pour les équipes d'intégration qui déploient des robots à pattes en environnements sans GPS ni infrastructure de localisation. Disposer d'un odométre fiable à partir des seuls capteurs embarqués est une condition préalable à toute navigation autonome robuste, avant même d'envisager des couches de cartographie ou de planification. Le fait que les quatre variantes soient directement disponibles dans GTSAM, outil standard en robotique académique et industrielle, facilite l'adoption et la comparaison objective des compromis vitesse-précision. Ce travail s'inscrit dans une longue tradition de recherche sur l'estimation d'état pour robots à pattes, où l'EKF invariant de Hartley (Michigan) fait figure de référence depuis 2019. GTSAM, développé par Frank Dellaert à Georgia Tech, est le socle sur lequel reposent de nombreux systèmes de SLAM et d'odométrie dans le domaine. L'article n'est pas associé à un déploiement industriel annoncé : il s'agit d'un preprint académique, pas d'un produit commercialisé. Dans un contexte où Boston Dynamics, ANYbotics, Unitree et des startups comme Figure ou Agility Robotics intensifient leurs efforts sur la fiabilité en milieu réel, la disponibilité d'estimateurs ouverts et testables représente une ressource utile pour accélérer la recherche comparative.

RecherchePaper
1 source
OCELOT : odométrie et estimation du contact pour robots à pattes
3arXiv cs.RO 

OCELOT : odométrie et estimation du contact pour robots à pattes

Une équipe de chercheurs a publié OCELOT (Odometry and Contact Estimation for Legged rObots), un pipeline complet d'odométrie pour robots à pattes reposant exclusivement sur des capteurs proprioceptifs embarqués : une centrale inertielle (IMU) solidaire du corps, des encodeurs articulaires et des capteurs de force. Le système s'appuie sur un filtre de Kalman à état d'erreur (ESEKF) dont l'état est corrigé par les pieds détectés en appui stationnaire. Sa contribution centrale est un module de détection de contact fusionnée et de quantification d'incertitude : deux détecteurs tournent en parallèle pour chaque pied, le premier combinant un modèle de mélange gaussien (GMM) avec une machine à états finis (FSM) à déclenchement anti-rebond sur les données de force, le second appliquant un test de rapport de vraisemblance généralisé (GLRT) sur la vélocité cinématique estimée du pied. Les scores continus issus des deux détecteurs sont fusionnés pour identifier les glissements. Pour valider l'approche, les auteurs ont constitué un dataset de 29 séquences couvrant 2,4 km sur des terrains variés (béton, herbe, graviers, rochers) et ont comparé OCELOT à des méthodes proprioceptives et extéroceptives. Le code et un package ROS2 temps réel sont publiés en open source. L'intérêt principal de OCELOT réside dans sa robustesse aux terrains glissants sans recourir à des capteurs extéroceptifs (caméra, lidar), qui restent coûteux, fragiles et sensibles aux conditions d'éclairage ou de poussière. Pour un intégrateur déployant un robot quadrupède en environnement industriel ou outdoor, disposer d'une odométrie fiable avec uniquement l'équipement embarqué de série réduit significativement la complexité système. La disponibilité d'un package ROS2 prêt à l'emploi abaisse la barrière d'adoption. Le benchmark face à des méthodes extéroceptives constitue un signal fort : il suggère que l'estimation de contact bien conçue peut rivaliser avec des approches visuelles sur des trajectoires courtes à moyennes. Les robots à pattes de type Spot (Boston Dynamics), ANYmal (ANYbotics) ou Unitree B2 sont les cibles naturelles de tels pipelines. L'odométrie proprioceptive pour quadrupèdes est un problème ouvert depuis des années, avec des travaux antérieurs comme Pronto (IIT) ou les pipelines d'ETH Zurich sur ANYmal. OCELOT se distingue par la combinaison explicite GMM+GLRT pour la détection de glissement, un point sensible dans les déploiements extérieurs. Les prochaines étapes probables incluent la validation sur des trajectoires longue distance et l'intégration dans des architectures SLAM proprioceptif complet.

UELa publication en open source d'un package ROS2 directement intégrable peut bénéficier aux intégrateurs et labos européens (ANYbotics/Suisse, IIT/Italie) déployant des quadrupèdes en environnements industriels ou extérieurs difficiles.

RecherchePaper
1 source
OSCAR : modèle d'action du monde conditionné par squelette pour robots à morphologies multiples
4arXiv cs.RO 

OSCAR : modèle d'action du monde conditionné par squelette pour robots à morphologies multiples

Des chercheurs ont publié OSCAR (Omni-Embodiment Skeleton-Conditioned World Action Model), un modèle de monde vidéo conditionné par les actions, capable de généraliser à travers différentes morphologies de robots. Décrit dans un preprint arXiv (2606.04463), le système s'appuie sur deux éléments centraux : un pipeline de données à grande échelle qui agrège, filtre et déduplique des jeux de données robotiques et des séquences vidéo égocentrées humaines pour couvrir des tâches, scénarios et morphologies variés ; et un conditionnement par rendu de squelette cinématique 2D, représentation unifiée fonctionnant aussi bien pour des bras robotiques de morphologies différentes que pour des mains humaines. Le modèle de base Cosmos-Predict2.5-2B de NVIDIA a été fine-tuné sur un seul GPU GH200. OSCAR a ensuite été déployé pour évaluer des politiques de contrôle issues de RoboArena, plateforme de benchmark communautaire, et démontre une corrélation significative entre évaluations virtuelles et tests en conditions réelles. L'enjeu central est le sim-to-real gap dans l'évaluation des policies : les environnements de simulation classiques reproduisent mal la physique réelle, rendant les benchmarks peu prédictifs du comportement sur robot physique. OSCAR propose une alternative directe, générer des vidéos conditionnées par les trajectoires d'actions pour simuler l'exécution d'une politique sans déploiement matériel. Si la corrélation annoncée se confirme à plus grande échelle, cela réduirait significativement les coûts et les cycles d'itération pour les équipes développant des VLA (Vision-Language-Action models). La représentation par squelette 2D est également notable : en évitant une spécialisation par embodiment, elle adresse un blocage récurrent de la généralisation multi-robot. Le fine-tuning sur GPU unique, contre des baselines nécessitant des modèles plus grands ou davantage de ressources de calcul, améliore l'accessibilité de l'approche. Les video world models appliqués à la robotique constituent un domaine en forte compétition : UniSim, RoboDreamer et le World Model de 1X Technologies ont chacun tenté d'adresser la simulation vidéo pour l'entraînement ou l'évaluation de robots, avec des résultats limités en diversité de scénarios ou en généralisation inter-embodiment. Le recours au modèle Cosmos de NVIDIA comme base pré-entraînée positionne OSCAR dans l'écosystème robotique croissant de NVIDIA, qui comprend Isaac Lab et GR00T. Les auteurs ouvrent explicitement la perspective d'une évaluation purement virtuelle des politiques robots, une proposition qui intéresse directement les intégrateurs cherchant à réduire les cycles de test hardware. Les étapes naturelles seraient la validation sur des morphologies plus variées, des tâches de manipulation complexes, et un passage à l'échelle vers des configurations multi-GPU.

RechercheOpinion
1 source