Exploration sémantique consciente de la posture par un robot à pattes à perception omnidirectionnelle en environnements confinés inconnus
Une équipe de chercheurs présente POSE, un système d'exploration sémantique conscient de la posture pour robots à pattes, décrit dans un preprint arXiv publié le 19 septembre 2026 (arXiv:2609.19460v1). Le système exploite la capacité intrinsèque d'un robot à pattes à incliner son corps en tangage et en roulis, combinée à une perception omnidirectionnelle caméra-LiDAR, pour observer les surfaces supérieures d'objets normalement invisibles depuis un point de vue plan au sol. Un module d'échantillonnage de points de vue sélectionne les postures corporelles selon le gain de couverture attendu à partir de cartes partielles d'objets, tandis qu'une exécution alignée sur la cible limite les réorientations inutiles du corps. Une stratégie d'élagage des points de vue, assistée par un modèle vision-langage (VLM) et des cartes en vue aérienne (bird's-eye-view), réduit les visites d'inspection redondantes en s'appuyant sur l'historique d'observation. En simulation, POSE améliore la couverture finale des surfaces cibles de 8 à 10 points de pourcentage par rapport à une planification planaire classique, tout en réduisant le temps d'exploration de 17 à 32 %, et obtient le meilleur score moyen de couverture d'objets (AUC) parmi les méthodes comparées. Une validation réelle a été menée avec un robot à pattes équipé de la suite caméra-LiDAR omnidirectionnelle dans un atelier d'usinage.
Le résultat cible un problème concret pour les intégrateurs de robots à pattes en inspection industrielle : les capteurs montés au niveau du sol ont un champ de vue vertical limité et une distance de recul contrainte, ce qui laisse des zones d'objets non inspectées si le robot reste dans une posture fixe. En montrant qu'exploiter la mobilité corporelle native du robot, plutôt que d'ajouter des capteurs ou des arrêts d'inspection supplémentaires, améliore simultanément couverture et rapidité, les auteurs apportent un argument méthodologique en faveur d'une planification adaptative de posture pour l'exploration sémantique, plutôt que la seule addition de capteurs ou de temps de mission.
Le travail se positionne comme une alternative à l'exploration planaire classique utilisée en robotique mobile terrestre, en s'appuyant sur les capacités récentes des VLM pour le raisonnement sémantique embarqué. Il reste toutefois au stade de preprint non revu par les pairs, avec des résultats chiffrés majoritairement issus de simulation et une seule démonstration réelle limitée à un atelier d'usinage. Les auteurs indiquent prévoir de publier le code en open source, sans calendrier précis.
Dans nos dossiers




