Aller au contenu principal
Arbres de croyance gaussiens en temps continu pour la planification de mouvement
RecherchearXiv cs.RO 

Arbres de croyance gaussiens en temps continu pour la planification de mouvement

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Un article de recherche publié sur arXiv (2607.02884) propose une nouvelle méthode de planification de trajectoire pour robots évoluant sous incertitude, en temps continu plutôt qu'en temps discret. Les auteurs modélisent la dynamique du robot comme une équation différentielle stochastique linéaire à temps continu, tandis que les mesures des capteurs n'arrivent qu'à des instants discrets. Ils construisent un modèle de propagation de croyance ("belief") hybride : entre deux mesures, la croyance évolue selon des équations différentielles ordinaires, puis subit une mise à jour brusque par filtre de Kalman à chaque nouvelle mesure. Pour garantir la sécurité, l'équipe introduit un vérificateur basé sur des fonctions barrières de croyance, capable de certifier la sécurité sur des segments entiers de trajectoire plutôt que seulement aux points d'échantillonnage. La méthode a été intégrée aux planificateurs RRT et SST et testée sur plusieurs environnements de référence, avec des taux de réussite élevés et un respect robuste des contraintes probabilistes, notamment dans des passages étroits.

L'enjeu concret est la fiabilité des robots mobiles et manipulateurs en environnement incertain, un point critique pour les intégrateurs qui déploient des AMR ou des bras robotiques en usine. Les approches classiques de planification, qui ne vérifient la sécurité qu'à des nœuds discrets du chemin, peuvent laisser passer des violations de contraintes entre deux points d'échantillonnage, un angle mort particulièrement dangereux dans les couloirs étroits ou les zones à forte densité d'obstacles. En traitant l'incertitude et la vérification de sécurité en temps continu, cette approche comble une lacune connue des méthodes de planification sous incertitude, sans changer la nature probabiliste du problème.

Ce travail s'inscrit dans la lignée des méthodes de planification sous incertitude basées sur des arbres de croyance, où les mises à jour par filtre de Kalman servent depuis longtemps à estimer l'état d'un robot à partir de mesures bruitées. En combinant cette estimation continue avec les planificateurs RRT et SST, largement utilisés en robotique mobile, les auteurs proposent une extension directement compatible avec les pipelines de planification existants, plutôt qu'un cadre entièrement nouveau à réimplémenter.

Dans nos dossiers

À lire aussi

Planification de mouvement en corps entier et contrôle à sécurité critique pour la manipulation aérienne
1arXiv cs.RO 

Planification de mouvement en corps entier et contrôle à sécurité critique pour la manipulation aérienne

Une équipe de chercheurs propose sur arXiv (2511.02342v3) un cadre de planification de mouvement corps entier pour manipulateurs aériens : des drones multirotors équipés de bras robotiques conçus pour opérer dans des espaces encombrés. Le système repose sur une représentation par superquadriques (SQ), surfaces paramétriques différentiables qui modélisent avec précision la géométrie du véhicule, du bras embarqué et des obstacles environnants. Un planificateur à clairance maximale fusionne diagrammes de Voronoï et formulation de variété d'équilibre pour générer des trajectoires lisses, tandis qu'un contrôleur de sécurité applique simultanément les limites de poussée et l'évitement de collision via des fonctions de barrière d'ordre supérieur (high-order CBFs). En simulation, l'approche surpasse les planificateurs par échantillonnage en vitesse, sécurité et fluidité ; des expériences sur une plateforme physique réelle confirment la cohérence des performances sim-to-real. La manipulation aérienne bute depuis longtemps sur le conservatisme des abstractions géométriques classiques : boîtes englobantes et ellipsoïdes surestiment l'encombrement du système, imposent des déviations inutiles et ferment des passages pourtant praticables. Les superquadriques résolvent ce problème en modélisant les surfaces réelles avec une fidélité géométrique fine, sans le coût computationnel des maillages. Pour les intégrateurs et équipes R&D, cela se traduit par des cycles plus courts et la capacité d'opérer dans des espaces confinés, directement pertinents pour l'inspection de structures, la maintenance en hauteur ou l'intervention en zone difficile d'accès. La validation hardware distingue ce travail de nombreuses publications restées cantonnées à la simulation, et les garanties formelles des CBF d'ordre supérieur constituent un argument de poids pour des déploiements en environnements réels. La manipulation aérienne est un champ de recherche actif depuis une décennie, motivé par l'inspection d'éoliennes, de pylônes et d'infrastructures inaccessibles aux robots terrestres. La représentation par superquadriques, issue des travaux de Barr dans les années 1980 et revisitée par la robotique de manipulation terrestre, gagne en traction pour les contextes où la précision géométrique est critique. Parmi les équipes actives sur des problèmes voisins figurent l'ETH Zurich (ASL), le LAAS-CNRS côté français, ainsi que plusieurs groupes nord-américains et asiatiques. Ce preprint ne mentionne aucun partenaire industriel ni horizon de déploiement commercial, ce qui le positionne comme une contribution académique fondamentale avec validation expérimentale.

UELe LAAS-CNRS est explicitement cité parmi les équipes actives sur des problèmes voisins ; cette contribution pourrait alimenter les travaux européens sur la manipulation aérienne pour l'inspection d'infrastructures.

RecherchePaper
1 source
Planification en temps constant pour enchaîner mouvement sans collision et comportements de manipulation
2arXiv cs.RO 

Planification en temps constant pour enchaîner mouvement sans collision et comportements de manipulation

Des chercheurs publient, dans la version 3 d'un preprint arXiv (2512.00939), le Behavioral Constant-Time Motion Planner (B-CTMP), un planificateur de mouvement qui étend la planification à temps constant (CTMP) aux tâches de manipulation en deux étapes. Le robot exécute d'abord un mouvement sans collision vers un état d'initiation du comportement, puis déroule un comportement tel qu'une saisie ou une insertion. Le CTMP classique répond à toute requête dans un budget de temps fixé par l'utilisateur (par exemple 10 millisecondes) grâce à une phase de précalcul, dans un environnement connu à l'avance. B-CTMP change deux choses : les voisinages sont construits dans l'espace des poses d'objet plutôt que dans l'espace des configurations du robot, et la couverture est établie par certification statistique plutôt que par un simple test d'atteignabilité. Un plan n'est mis en cache que si des rollouts répétés établissent une borne inférieure de son taux de succès au-dessus d'un seuil choisi, et les auteurs démontrent que ces bornes tiennent simultanément sur tout le cache, à un niveau de confiance donné. Pour un comportement déterministe, un seul rollout suffit, ce qui redonne le test binaire du CTMP. L'évaluation porte sur trois tâches (prélèvement en rayonnage, insertion de prise, remplacement de roue), en simulation et sur robots réels. Le résumé ne donne aucun chiffre de taux de succès ni de nombre d'essais. L'enjeu est de combler un écart entre la planification de mouvement vérifiable et les comportements appris. Les compétences de manipulation riches en contacts progressent vite, mais restent cantonnées à des routines simples et scriptées, faute de garanties de sécurité, d'efficacité et de fiabilité. Le CTMP ne certifie que l'atteignabilité, un prédicat binaire, et ignore le comportement qui accomplit la tâche. Or ce comportement est de plus en plus stochastique, par exemple une politique apprise de type VLA, et aucun rollout hors ligne ne suffit à en prouver le succès. B-CTMP propose une réponse : borner statistiquement le taux de succès du comportement et garder un temps de réponse constant, y compris pour rejeter des poses d'objet infaisables. Pour un intégrateur ou un responsable de ligne, c'est le type de garantie auditable qui manque pour déployer des politiques apprises en production. Les auteurs affirment que les plans certifiés réussissent de façon constante là où les références échouent pendant l'exécution du comportement. Cette affirmation reste à vérifier sur les détails expérimentaux, notamment la diversité des poses testées et les budgets de rollouts. Ce travail prolonge la lignée du CTMP, conçu pour offrir des temps de requête bornés dans des environnements semi-structurés, typiques des cellules industrielles où les objets varient peu. Il se rapproche aussi des efforts de vérification des politiques apprises, face à la tendance dominante qui consiste à évaluer les modèles de manipulation sur des essais limités. La limite principale tient à l'hypothèse d'un environnement connu a priori et d'un monde semi-structuré : la garantie ne s'étend pas à des scènes ouvertes. Il s'agit d'une publication académique, sans produit ni déploiement annoncé. La suite logique serait de tester la méthode avec des politiques apprises plus complexes et sur des tâches plus longues, avec un cache dont la taille et le coût de précalcul restent à documenter.

UEPas d\'impact direct sur la France/UE

RecherchePaper
1 source
Optimisation des arbres de trajectoires dans l'espace des croyances : de la commande prédictive à la planification de tâches et de mouvements
3arXiv cs.RO 

Optimisation des arbres de trajectoires dans l'espace des croyances : de la commande prédictive à la planification de tâches et de mouvements

Des chercheurs proposent, dans un preprint arXiv soumis début mai 2026 (arXiv:2605.01860), de planifier des trajectoires arborescentes (trajectory-trees) dans l'espace des croyances (belief space) plutôt que les trajectoires séquentielles classiques. Quand un robot évolue en environnement partiellement observable, la trajectoire optimale dépend d'observations futures encore inconnues: les trajectory-trees branchent à chaque point où l'état de croyance est susceptible de diverger en scénarios distincts. Le papier présente deux contributions: un contrôleur prédictif partiellement observable (PO-MPC) à branchement unique, optimisé par un algorithme parallélisé baptisé D-AuLa (Distributed Augmented Lagrangian) conçu pour satisfaire les contraintes temps-réel du MPC; et un planificateur tâche-et-mouvement (PO-LGP) combinant arbres de décision symboliques et trajectory-trees cinématiques, en étendant le cadre Logic-Geometric-Programming (LGP) aux problèmes partiellement observables. Les validations expérimentales portent sur la conduite autonome pour le MPC et des scénarios de manipulation robotique pour le TAMP. L'enjeu industriel est direct: les environnements réels sont rarement entièrement observables. Un bras triant des pièces dont l'orientation n'est connue qu'après préhension, ou un AGV naviguant en zone d'incertitude sensorielle, nécessitent précisément ce type de planification contingente. Les trajectoires séquentielles obligent le robot à choisir un plan unique à l'avance, ce qui se traduit par des comportements sous-optimaux ou des replanifications coûteuses. L'approche PO-MPC réduit les coûts de contrôle en anticipant les branches d'observation possibles; PO-LGP génère des politiques d'exploration utilisables comme macro-actions dans un plan global. D-AuLa répond à l'objection classique contre la planification en espace de croyance: sa complexité computationnelle prohibitive pour le temps-réel, en exploitant la décomposabilité du problème pour paralléliser l'optimisation. Le cadre LGP étendu par ces travaux a été développé par le groupe de Marc Toussaint (TU Berlin), et constitue l'une des approches TAMP les plus rigoureuses pour la manipulation multi-étapes. La planification en POMDP (Partially Observable Markov Decision Processes) est un domaine actif depuis les années 1990, mais son couplage avec le contrôle continu et la planification symbolique reste un défi ouvert. Des approches concurrentes basées sur l'apprentissage par renforcement (notamment les méthodes VLA et politiques diffusion) ou sur des planificateurs sampling-based adressent des problèmes voisins avec des compromis différents en matière de généralisation et de garanties formelles. Les auteurs reconnaissent eux-mêmes que la méthode est validée sur des belief states de taille restreinte et exclusivement en simulation; la prochaine étape naturelle est une validation hardware sur robots réels avec perception embarquée et latences de capteurs.

UELes travaux étendent le cadre LGP développé par le groupe de Marc Toussaint à TU Berlin, consolidant le leadership académique européen en planification tâche-et-mouvement rigoureuse pour la manipulation robotique multi-étapes.

RecherchePaper
1 source
PccDiffuser : planification de mouvement multi-solutions pour robots à corps continu
4arXiv cs.RO 

PccDiffuser : planification de mouvement multi-solutions pour robots à corps continu

Une équipe de recherche présente PccDiffuser, un cadre de diffusion conditionnelle pour la planification de mouvement des robots continuum, dans un preprint arXiv publié en septembre 2026 (2609.09745v1). Le système apprend une distribution multimodale de trajectoires dans l'espace des configurations et génère plusieurs solutions candidates en parallèle, converties en trajectoire exécutable par allocation temporelle respectant les contraintes des actionneurs. Sa cinématique, modélisée par courbure constante par morceaux avec des coordonnées exponentielles, s'appuie sur un réseau de neurones sur graphe pour encoder un nombre variable d'obstacles et sur une cinématique différentielle analytique intégrée au débruitage pour améliorer précision et dégagement du corps entier. Sur un jeu de test allant de zéro à quatre obstacles, le taux de réussite atteint 91 %, supérieur aux méthodes par échantillonnage ou optimisation, avec un gain d'efficacité de calcul. Des essais sur un robot continuum à trois sections actionné par câbles confirment la planification multi-solutions et l'évitement d'obstacle du corps entier. Les robots continuum, structures souples et hyper-redondantes utilisées en chirurgie mini-invasive, en inspection de zones confinées et en recherche-sauvetage, restent difficiles à piloter automatiquement en raison d'un espace de configuration quasi infini et d'une cinématique non linéaire. Les méthodes classiques par échantillonnage ou optimisation peinent à capturer la multimodalité du problème, c'est-à-dire l'existence de plusieurs chemins valides distincts, et deviennent lentes quand l'environnement se complexifie. En atteignant 91 % de réussite tout en restant plus rapide que ces références, PccDiffuser démontre que les modèles de diffusion, déjà répandus pour les bras robotiques rigides, se transposent aux robots mous. Il s'agit toutefois d'un résultat de recherche en preprint, validé sur un seul robot de laboratoire et un environnement limité à quatre obstacles, et non d'un produit commercial ni d'un déploiement industriel. La planification des robots continuum s'appuyait jusqu'ici sur des solveurs de cinématique inverse et des planificateurs par échantillonnage adaptés au modèle de courbure constante par morceaux, une représentation standard depuis le milieu des années 2000. Les modèles de diffusion, popularisés pour les bras rigides, avaient jusqu'à présent peu été appliqués aux structures continues, faute d'encodage adapté à une cinématique non linéaire et à un nombre variable d'obstacles. Sans acteur industriel ni calendrier annoncé, ce travail de recherche ouvre la voie à des validations sur des robots continuum plus complexes et des environnements encombrés, avant tout transfert éventuel vers des applications comme la chirurgie robotisée ou l'inspection industrielle.

RecherchePaper
1 source