Aller au contenu principal
Commande prédictive adaptative d'un robot continu souple par réseau neuronal informé par la physique (tiges de Cosserat)
RecherchearXiv cs.RO 

Commande prédictive adaptative d'un robot continu souple par réseau neuronal informé par la physique (tiges de Cosserat)

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs ont publié sur arXiv (2508.12681) un framework de contrôle prédictif par modèle (MPC) non linéaire pour robots continus souples, capables de se déformer en flexion continue plutôt que par articulations rigides. Le coeur du système est un réseau de neurones physiquement informé à découplage de domaine (DD-PINN), entraîné comme substitut du modèle dynamique de tige de Cosserat, la référence mathématique pour la mécanique des structures élancées déformables. Ce substitut atteint un facteur d'accélération de 44 000 par rapport au modèle complet, ce qui permet de faire tourner le MPC en temps réel à 70 Hz sur GPU. En parallèle, un filtre de Kalman non parfumé (UKF) exploite le DD-PINN pour estimer en ligne les états internes du robot et la compliance en flexion, à partir des seules mesures de position de l'effecteur terminal. En simulation, les erreurs de position restent inférieures à 3 mm, soit 2,3 % de la longueur de l'actionneur. Sur le robot physique, le contrôleur atteint des accélérations jusqu'à 3,55 m/s², avec une précision comparable.

Ce résultat est notable parce qu'il démontre un contrôle dynamique (et non quasi-statique) d'un robot souple en conditions réelles, à une fréquence compatible avec les exigences industrielles. La majorité des approches antérieures, dont les méthodes basées sur l'opérateur de Koopman, sacrifient soit la précision de forme globale, soit l'adaptabilité aux variations de rigidité. Ici, le DD-PINN reconstruit la forme complète du robot et adapte en ligne la compliance, ce qui ouvre la voie à des manipulateurs souples capables de compenser vieillissement matériau ou déformations sous charge variable. Pour un intégrateur ou un décideur industriel, c'est la convergence entre modèle physique et inférence rapide qui est structurante : on cesse de choisir entre fidélité du modèle et temps réel.

Les robots continus souples sont étudiés depuis une quinzaine d'années, principalement pour des applications médicales (endoscopes actifs, outils chirurgicaux), l'inspection en espace confiné, et la manipulation de pièces fragiles. Le modèle de Cosserat est le standard théorique du domaine, mais son coût computationnel avait jusqu'ici limité son usage au contrôle quasi-statique ou offline. Les PINN, réseaux intégrant des équations différentielles comme contraintes de loss, constituent depuis 2019 une piste active pour contourner ce verrou. Ce preprint ne mentionne pas de partenaires industriels ni de calendrier de déploiement ; il s'agit à ce stade d'un résultat de recherche académique, sans produit ni pilote terrain annoncé. Les prochaines étapes naturelles concernent la robustesse aux perturbations externes, l'extension à des structures à plusieurs segments, et une validation sur des cas d'usage médicaux ou d'assemblage délicat.

Dans nos dossiers

À lire aussi

Prédire la conformité de préhension des mains robotiques via des réseaux de neurones informés par modèle analytique
1arXiv cs.RO 

Prédire la conformité de préhension des mains robotiques via des réseaux de neurones informés par modèle analytique

La recherche, publiée sur arXiv sous la référence 2607.17541v1, s'attaque à un problème précis de la manipulation robotique : la plupart des études traitent la prise d'un objet comme un problème binaire, réussite ou échec, jugé simplement par le fait que l'objet reste dans la main. Cette approche devient insuffisante dès qu'il s'agit d'usage forcé d'un outil, où la compliance de la prise, c'est-à-dire sa capacité à se déformer sous charge, devient déterminante pour prédire le comportement conjoint de la main et de l'outil. Les auteurs introduisent l'AMINN (Analytical Model Informed Neural Network), un modèle hybride qui combine une couche de mécanique analytique avec un réseau de neurones entraîné sur données, afin d'estimer la stabilité de la prise et le déplacement de l'outil dans la main sous charge externe. Le modèle a été évalué sur une main robotique sous-actionnée à trois doigts et montre une bonne capacité prédictive, avec des sorties mécaniquement cohérentes sur des conditions de charge variées. L'enjeu dépasse la simple précision prédictive. Les mains sous-actionnées, appréciées pour leur faible coût et leur capacité d'adaptation passive à la forme des objets, sont notoirement difficiles à modéliser car leur comportement de compliance dépend d'une combinaison non linéaire de cinématique couplée, de mécanique passive et de conditions de contact. Pour les intégrateurs et concepteurs de systèmes robotiques destinés à un usage forcé d'outils, un tel modèle physiquement interprétable ouvre la voie à des systèmes plus fiables et plus sûrs, notamment dans les contextes critiques où une défaillance de prise sous charge peut avoir des conséquences directes. Comparé à un modèle boîte noire de type perceptron multicouche pris comme référence, l'AMINN affiche une meilleure cohérence physique fondée sur l'énergie, ce qui distingue clairement son approche des méthodes purement data-driven aujourd'hui dominantes dans l'apprentissage pour la manipulation. Ce travail s'inscrit dans une tendance de fond en robotique : réintroduire des contraintes physiques explicites dans des architectures d'apprentissage profond pour gagner en interprétabilité et en robustesse, plutôt que de s'en remettre uniquement à des réseaux entraînés de bout en bout. Les auteurs présentent leur cadre comme une base pour des travaux futurs sur l'usage autonome et fiable d'outils par des mains robotiques compliantes.

RecherchePaper
1 source
Commande prédictive par intégrale de chemin informée par objets pour la manipulation robotique sans préhension
2arXiv cs.RO 

Commande prédictive par intégrale de chemin informée par objets pour la manipulation robotique sans préhension

Des chercheurs ont présenté une formulation hiérarchique du contrôle MPPI (Model Predictive Path Integral) appliquée à la manipulation non-préhensile, c'est-à-dire au déplacement d'objets par poussée sans saisie physique. Publiée sur arXiv (référence 2605.30778), la méthode décompose le problème en deux niveaux : un premier plan est calculé en supposant que l'objet peut être actionné directement, puis cette trajectoire sert de référence pour résoudre le problème couplé robot-objet. Les expériences ont été conduites sur un bras xArm6 à 6 degrés de liberté de UFactory, avec pour tâche de pousser un objet vers une cible tout en contournant des obstacles statiques. En simulation, la méthode augmente le taux de succès de 40 % et accélère la fréquence de contrôle de 26 % par rapport à un MPPI standard. Sur matériel réel, le gain de succès atteint 20 % pour un coût de calcul comparable. Cette décomposition hiérarchique répond à un problème fondamental de la planification à long horizon : l'espace de recherche conjoint robot-objet est trop vaste pour être exploré efficacement dans des délais temps-réel. En résolvant d'abord un sous-problème centré sur l'objet, l'algorithme oriente l'échantillonnage stochastique vers des régions prometteuses, réduisant le gaspillage computationnel sans nécessiter de hardware spécialisé. Pour un intégrateur industriel, cela signifie que des tâches impliquant poussées ou réorientations sans préhension deviennent planifiables en temps réel sur des cellules robotiques standard, un verrou qui limitait jusqu'ici l'automatisation de nombreuses opérations de manutention. Le MPPI est une méthode de contrôle prédictif par échantillonnage stochastique introduite par Theodorou et Williams à Georgia Tech, et popularisée en robotique par NVIDIA via ses environnements de simulation. La manipulation non-préhensile reste un domaine actif, avec des contributions récentes de MIT CSAIL, ETH Zurich et Stanford sur la gestion des contacts discontinus. Ce travail reste à ce stade un preprint non évalué par les pairs, et les benchmarks se limitent à des scénarios de poussée en espace plan avec obstacles statiques : des configurations plus complexes, obstacles dynamiques ou objets déformables, n'ont pas été testés.

RecherchePaper
1 source
Commande quasi-statique d'une tige de Cosserat discrète
3arXiv cs.RO 

Commande quasi-statique d'une tige de Cosserat discrète

Des chercheurs ont publié sur arXiv (arXiv:2605.01395) une étude proposant des lois de commande par rétroaction pour robots souples modélisés selon le formalisme de la tige de Cosserat. L'approche repose sur une discrétisation spatiale dite PCS (Piecewise Constant Strain), qui transforme les équations aux dérivées partielles non linéaires décrivant la déformation continue du robot en un système d'équations différentielles ordinaires non linéaires. Ce passage PDE vers ODE est central : il ramène la dynamique quasi-statique d'un corps déformable continu à une structure formellement proche des manipulateurs rigides sériels à chaîne articulée. Les lois de commande sont conçues avec le torseur d'effort externe appliqué à l'effecteur comme entrée de commande, et deux stratégies de linéarisation par retour d'état sont développées : l'une dans l'espace des déformations (strain space), l'autre dans l'espace tâche. Les résultats sont validés par simulation numérique sur des scénarios de suivi de trajectoire d'effecteur et de contrôle de forme globale du robot. L'intérêt principal de ce travail pour la communauté robotique est de fournir un pont formel entre le contrôle des robots souples et les outils analytiques bien établis pour les manipulateurs rigides. En reformulant le modèle continu en système ODE via PCS, les auteurs rendent accessibles des méthodes de commande à base de modèle développées pour les bras industriels classiques, sans recourir à des approches d'apprentissage ou à des régulateurs heuristiques. Cela représente une contribution théorique solide pour les laboratoires et intégrateurs qui cherchent des garanties formelles de stabilité et de performance pour les robots à corps déformables. La restriction au régime quasi-statique constitue toutefois une limite applicative notable : elle exclut les tâches à dynamique rapide et réduit la portée immédiate aux manipulations lentes ou à faible fréquence. La modélisation de robots souples par tige de Cosserat est une approche développée depuis une vingtaine d'années, notamment par les groupes de recherche de Webster, Jones, et Rucker aux États-Unis, ainsi que par plusieurs équipes européennes. La discrétisation PCS a été introduite pour contourner la complexité de résolution numérique des PDEs de Cosserat et est aujourd'hui un standard dans plusieurs simulateurs open source comme Sofa. Sur le plan concurrentiel, ce travail se distingue des approches par réseaux de neurones physiques (Neural ODEs, physics-informed control) et des méthodes éléments finis en privilégiant une formulation analytique close. La prochaine étape naturelle serait une validation expérimentale sur des plateformes matérielles réelles ainsi qu'une extension au régime dynamique pour élargir le domaine d'application.

RecherchePaper
1 source
Contrôle de Koopman différentiable et adaptatif, guidé par la physique, pour un vol stable sous perturbations inconnues
4arXiv cs.RO 

Contrôle de Koopman différentiable et adaptatif, guidé par la physique, pour un vol stable sous perturbations inconnues

Des chercheurs ont publié sur arXiv (arXiv:2506.08319) un cadre de commande hybride baptisé DEKC (Differentiable data-Enabled Koopman Control), conçu pour permettre à des systèmes robotiques de voler ou de se déplacer de manière précise dans des environnements non structurés, malgré des perturbations extérieures non modélisées. L'approche combine un modèle physique nominal du système avec un réseau de neurones profond chargé de paramétrer la "lifting function" de l'opérateur de Koopman, un outil mathématique qui projette des dynamiques non linéaires dans un espace linéaire global, simplifiant ainsi la conception du contrôleur. Point central de la contribution : les perturbations (forces aérodynamiques, charges suspendues) sont modélisées non pas comme du bruit aléatoire, mais comme un système dynamique à part entière dont l'évolution temporelle est apprise et anticipée. Un mécanisme de mise à jour par gradient rétropropagé en ligne permet une adaptation en temps réel aux incertitudes variables. Les validations expérimentales couvrent des simulations sur un robot spatial amarré (tethered space robot) et des essais réels sur quadrirotor soumis à des perturbations aérodynamiques et à des charges utiles suspendues lors de trajectoires agiles. L'intérêt industriel tient à la dualité que DEKC résout : les méthodes d'apprentissage pur offrent une bonne capacité d'approximation mais exigent un entraînement hors ligne massif et ne fournissent aucune garantie théorique de stabilité, tandis que les contrôleurs robustes classiques restent purement réactifs, corrigeant les erreurs au lieu de les anticiper. DEKC adopte une posture proactive en intégrant la trajectoire future estimée des perturbations directement dans la loi de commande, ce qui réduit les erreurs de suivi sur des manoeuvres rapides. La validation sur quadrirotor physique constitue un argument concret de passage du simulateur au réel, un défi fréquemment sous-estimé dans les publications de contrôle. L'opérateur de Koopman est un formalisme de contrôle établi depuis plusieurs décennies, mais son application combinée à des réseaux différentiables et à une prédiction explicite des perturbations représente une direction de recherche active depuis 2020 environ. Les approches concurrentes incluent les contrôleurs adaptatifs à base de Gaussian Process (GP-MPC), les réseaux neuronaux résiduels couplés à un MPC classique, et les méthodes d-Learning entièrement sans modèle. DEKC se distingue en conservant la structure physique tout en apprenant uniquement la dynamique résiduelle, ce qui réduit la charge de données. L'article reste un preprint non encore évalué par les pairs ; aucune timeline de déploiement industriel ni partenariat avec un intégrateur n'est mentionné.

RecherchePaper
1 source