Aller au contenu principal
Contrôle en boucle fermée sans modèle des manipulateurs continus spatiaux par optimisation de la tension de l'épine dorsale
RecherchearXiv cs.RO 

Contrôle en boucle fermée sans modèle des manipulateurs continus spatiaux par optimisation de la tension de l'épine dorsale

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs présentent un nouveau cadre de contrôle pour les manipulateurs continus, ces bras robotiques flexibles à tendons capables de se faufiler dans des environnements confinés et encombrés, notamment à bord d'engins spatiaux. Le papier, publié sur arXiv sous la référence 2512.06754 (version 2, une révision d'une publication antérieure), part d'un constat : la déformation de leur structure porteuse est de dimension infinie, la friction interne reste largement non modélisée et leur rigidité varie selon la configuration, ce qui rend les modèles cinématiques classiques peu fiables, avec des jacobiennes erronées, des singularités artificielles et un actionnement instable. La solution proposée abandonne la modélisation physique au profit d'une jacobienne empirique, initialisée grossièrement puis raffinée en continu par des mises à jour convexes différentielles. Le mouvement de la pointe du bras est ensuite généré par un programme quadratique résolu en temps réel, qui calcule les incréments d'actionneurs tout en évitant le relâchement des tendons et en respectant les limites géométriques ; les auteurs ajoutent un terme d'optimisation de la tension de la structure pour réguler la charge axiale et supprimer la compression liée à la co-activation des tendons. Testé sur trois trajectoires (cercle, pentagone, carré), le système converge de façon stable, avec une précision inférieure au millimètre, sans calibration de modèle ni identification de paramètres.

Cette approche s'attaque à un verrou connu en robotique spatiale et en robotique molle : les bras continus séduisent pour leur compliance géométrique et leur sécurité intrinsèque, mais leur commande a toujours souffert de modèles cinématiques fragiles, difficiles à recalibrer à chaque changement de configuration, un problème d'autant plus critique en orbite où une recalibration in situ est coûteuse, voire impossible. En s'affranchissant du modèle physique au profit d'un apprentissage en ligne de la jacobienne, ce travail suggère qu'une commande fiable peut être obtenue sans caractérisation préalable du matériau ni identification exhaustive des frottements, ce qui faciliterait le déploiement de ces bras pour l'inspection en espace confiné, la maintenance en orbite ou la capture de débris. Il faut toutefois noter que la validation reste, à ce stade, limitée à des trajectoires de test simples en environnement contrôlé, et non à une mission spatiale réelle : la précision sous-millimétrique annoncée concerne ces essais, pas des conditions opérationnelles en orbite.

Le document est une prépublication arXiv, sans laboratoire ni entreprise nommément identifiés dans le résumé, ce qui la situe du côté de la recherche méthodologique plutôt que du produit commercial. Elle s'inscrit dans une tendance plus large de la robotique continue, qui cherche depuis plusieurs années des alternatives au contrôle par jacobienne analytique, jugé trop rigide face à des structures déformables et à frottement variable, au profit de méthodes empiriques pilotées par les données. Aucun essai matériel réel, partenariat industriel ni calendrier de déploiement n'est mentionné ; les suites logiques, non annoncées dans le texte, seraient une validation sur bras physique puis dans des conditions représentatives d'un environnement spatial confiné.

Dans nos dossiers

À lire aussi

Commande en boucle fermée de bras continus en spirale logarithmique par compensation du Jacobien, adaptée à la morphologie
1arXiv cs.RO 

Commande en boucle fermée de bras continus en spirale logarithmique par compensation du Jacobien, adaptée à la morphologie

Des chercheurs ont publié en juin 2026 sur arXiv (arXiv:2606.26188) le premier cadre de contrôle en boucle fermée spécifique à la morphologie pour bras continus à spirale logarithmique. Ces manipulateurs souples, à actionnement tendineux segmenté, s'appuient sur un squelette central avec routage équilatéral des tendons et ont été modélisés dans le simulateur MuJoCo pour capturer la compliance conique et les dynamiques de contact. La contribution centrale est la dérivation d'un Jacobien analytique en espace des tâches, directement extrait de la cinématique spirale, couplé à une compensation d'erreur Jacobienne en ligne combinant une mise à jour sécante de Broyden et un filtre de Kalman. Le contrôleur est validé en simulation planaire et spatiale sur des tâches de suivi de trajectoire, de régulation d'attitude, de rejet de perturbations, de suivi de position 3D et de contrôle simultané position-orientation. Par rapport à la baseline piecewise-constant-curvature (PCC), la méthode réduit systématiquement les erreurs de suivi, supprime la dérive d'attitude et maintient une erreur d'estimation Jacobienne bornée. L'apport principal est de combler un vide critique : les robots à spirale logarithmique précédemment décrits disposaient d'une fabrication scalable et d'une préhension polyvalente, mais n'avaient ni cinématique inverse ni contrôle en boucle fermée, ce qui les cantonnait à des démonstrations en boucle ouverte. La combinaison Broyden-Kalman permet de corriger en continu les erreurs de modélisation dues aux déformations non linéaires, aux contacts et aux désaccords géométriques, problèmes structurels des robots souples sous-actionnés. Il faut cependant noter que la validation reste entièrement simulée : aucun prototype physique n'est rapporté, ce qui laisse entier le défi du sim-to-real, particulièrement sensible sur des structures souples à compliance variable. La spirale logarithmique est une morphologie omniprésente dans le vivant (vrilles, tentacules, coquilles) et explorée depuis plusieurs années en robotique des continuum comme alternative aux bras rigides pour opérer en espaces confinés ou autour d'objets fragiles. Les travaux antérieurs avaient démontré la fabricabilité de ces structures mais butaient sur le contrôle précis. Dans le paysage des robots continus, les concurrents directs incluent les approches à modèle PCC classique (largement étudié depuis les années 2000) et les bras pneumatiques de type Festo ou les structures hydrogel. En Europe, Pollen Robotics (France) travaille sur des architectures souples bien qu'avec une philosophie différente. La suite logique annoncée par les auteurs est l'implémentation sur hardware réel et l'intégration de méthodes d'apprentissage pour augmenter le contrôle analytique.

RecherchePaper
1 source
Optimisation par données des configurations de capteurs tactiles pour la manipulation dextérique
2arXiv cs.RO 

Optimisation par données des configurations de capteurs tactiles pour la manipulation dextérique

Des chercheurs ont publié sur arXiv (arXiv:2409.20473v3) un cadre méthodologique permettant, pour la première fois, de quantifier la contribution individuelle de chaque capteur tactile à la performance d'une politique d'apprentissage par renforcement profond (DRL) appliquée à la manipulation dextère. L'étude cible la Shadow Hand, une main robotique à 24 degrés de liberté équipée de 92 capteurs tactiles. En deux étapes, les auteurs réduisent ce réseau dense à 14 capteurs tout en conservant plus de 90 % de la performance initiale sur trois tâches de manipulation standardisées (bloc, oeuf, stylo). La première phase, empirique, écrête le nombre de capteurs de 92 à 21 en maintenant 93 % des performances. La seconde phase, plus fine, combine une régression par processus gaussiens (GPR) et une régression Lasso pour classer l'importance fonctionnelle de chaque capteur restant. Le résultat le plus saillant contredit l'intuition habituelle en robotique : les capteurs du doigt médius contribuent négativement à l'apprentissage, dégradant activement la politique DRL plutôt que de l'améliorer. À l'inverse, le pouce, l'annulaire et l'auriculaire concentrent l'essentiel de l'information utile au contrôle de contact. Pour les intégrateurs et les équipes de R&D en manipulation robotique, cela signifie qu'une réduction drastique du nombre de capteurs n'est pas seulement possible sans sacrifier les performances, elle peut même les améliorer en éliminant des signaux redondants ou antagonistes. Des expériences de transfert zéro-shot sur deux nouveaux objets et une validation croisée sur l'Allegro Hand et la Leap Hand confirment que ces classements d'importance se généralisent au-delà de la plateforme d'entraînement. La problématique de placement de capteurs tactiles reste largement non résolue dans la littérature, en l'absence de méthodes systématiques comparables à celles développées pour la vision. Ce travail s'inscrit dans un contexte où plusieurs laboratoires et entreprises, dont Sanctuary AI, Agility Robotics ou encore OpenAI avec Dexterous Manipulation, investissent massivement dans la manipulation fine comme prochain verrou de la robotique humanoïde. Les concurrents directs sur la Shadow Hand incluent des frameworks basés sur le sim-to-real (IsaacGym, MuJoCo), qui peinent encore à modéliser fidèlement le retour tactile dense. Les auteurs proposent leurs critères de déploiement comme des guidelines quantitatifs applicables à d'autres morphologies robotiques, ouvrant la voie à des configurations capteurs optimisées dès la phase de conception mécanique plutôt qu'a posteriori.

RecherchePaper
1 source
GE-Sim 2.0 : une feuille de route vers des simulateurs vidéo en boucle fermée pour la manipulation robotique
3arXiv cs.RO 

GE-Sim 2.0 : une feuille de route vers des simulateurs vidéo en boucle fermée pour la manipulation robotique

Une équipe de recherche a publié sur arXiv (arXiv:2605.27491) GE-Sim 2.0, un simulateur vidéo en boucle fermée conçu pour l'entraînement et l'évaluation de politiques de manipulation robotique. Le système, Genie Envisioner World Simulator 2.0, prolonge l'architecture de génération vidéo conditionnée par l'action de son prédécesseur et a été ré-entraîné sur des milliers d'heures de données robotiques réelles couvrant la télé-opération, les interactions contact-rich et le déploiement de politiques embarquées. Trois nouveaux modules ferment la boucle simulation-apprentissage : un "state expert" qui décode l'état proprioceptif depuis les latents vidéo pour alimenter les politiques VLA (Vision-Language-Action) en prédiction de trajectoire ; un "world judge" qui évalue automatiquement les rollouts générés face aux instructions de tâche, produisant des signaux de réussite vérifiables sans inspection manuelle ; et un framework d'accélération capable de générer un rollout de 25 frames en 2,3 secondes sur un seul GPU H100, avec jusqu'à 4x de frame skipping à l'inférence pour les scénarios longue-portée. Avec seulement 2 milliards de paramètres, le modèle domine le classement public WorldArena, devançant à la fois des world models robotiques dédiés et des générateurs vidéo généralistes en source fermée. L'enjeu central est le sim-to-real gap, la difficulté chronique à transférer des politiques entraînées en simulation vers des robots réels. GE-Sim 2.0 tente d'y répondre sur deux fronts : en générant des données synthétiques crédibles sur lesquelles entraîner des politiques VLA, avec des gains mesurables en conditions réelles selon les auteurs, et en automatisant l'évaluation des rollouts via le world judge, un goulot d'étranglement qui nécessitait jusqu'ici infrastructure physique ou inspection humaine. Pour les équipes travaillant à l'échelle sur des politiques de manipulation, l'équation coût-délai d'itération pourrait évoluer sensiblement. La performance au benchmark WorldArena avec 2B paramètres seulement suggère une efficacité paramétrique notable, même si les benchmarks de simulation ne garantissent pas directement des performances terrain. GE-Sim 2.0 s'inscrit dans la continuité directe de Genie Envisioner, framework de génération vidéo conditionné par l'action publié par la même équipe. Le marché des world models pour la robotique s'est densifié rapidement, avec notamment UniSim et des travaux issus de Google DeepMind, IRASim, ainsi que les simulateurs développés par Physical Intelligence autour de pi_zero. Dans l'espace VLA, Lerobot (Hugging Face) et plusieurs groupes académiques de MIT et Stanford investissent des directions parallèles. Ce résultat reste une pré-publication arXiv sans révision par les pairs ; les "gains mesurables en conditions réelles" annoncés ne sont pas quantifiés précisément dans l'abstract, ce qui limite l'interprétation des performances de transfert. La prochaine étape logique serait une validation externe sur des benchmarks physiques standardisés.

RechercheOpinion
1 source
Opérateurs neuronaux pour la modélisation par substitution de l'espace de conception des robots continus à actionnement par tendons
4arXiv cs.RO 

Opérateurs neuronaux pour la modélisation par substitution de l'espace de conception des robots continus à actionnement par tendons

Des chercheurs ont soumis sur arXiv (identifiant 2605.19104, mai 2026) un cadre de modélisation par apprentissage d'opérateurs pour les robots continus actionnés par tendons. Le problème adressé est fondamental : les modèles physiques classiques issus de la mécanique des poutres de Cosserat sont trop coûteux en calcul pour le contrôle temps réel, tandis que les approches d'apprentissage automatique existantes se spécialisent sur un design de robot précis et ne transfèrent pas. La contribution propose de reformuler le problème comme un apprentissage d'opérateurs, une famille de méthodes qui apprend des mappings entre espaces fonctionnels plutôt qu'entre vecteurs fixes. Un modèle unique ingère conjointement les paramètres de conception du robot (géométrie des segments, propriétés mécaniques) et les entrées d'actionnement par tendons, et prédit la configuration résultante. Quatre architectures sont présentées : deux variantes de Deep Operator Networks (DeepONets) et deux variantes de Fourier Neural Operators (FNOs), toutes entraînées sur des données de simulation. L'enjeu industriel est la généralisation inter-designs en espace de conception. Pour un OEM ou un intégrateur en robotique chirurgicale, évaluer des milliers de variantes mécaniques sans relancer de simulations physiques complètes représente un gain de cycle de design considérable. Les auteurs décrivent une "bonne précision" et des temps d'inférence compatibles avec le contrôle embarqué, sans donner d'erreurs quantitatives dans l'abstract. Point de vigilance éditorial : l'entraînement est réalisé exclusivement sur données simulées, et aucune validation hardware n'est rapportée. Les robots continus à tendons sont particulièrement exposés au sim-to-real gap, notamment les frottements de câbles, l'hystérésis, et les déformations non modélisées sous charge. Les robots continus occupent une niche stratégique en endoscopie robotisée et inspection en espace confiné, avec des acteurs commerciaux comme Intuitive Surgical (Da Vinci), Auris Health (Monarch, racheté par J\&J) et Medtronic. Côté recherche académique, les groupes travaillant sur la modélisation apprise pour robots déformables incluent Imperial College London, ETH Zürich et plusieurs labos nord-américains. Ce preprint reste une contribution théorique et computationnelle : aucun déploiement, aucun partenariat industriel ni timeline de validation physique ne sont mentionnés. La prochaine étape naturelle, et le vrai test de la méthode, sera la validation sur banc d'essai avec des prototypes réels aux designs variés.

UEImpact indirect et lointain : des groupes européens comme Imperial College London et ETH Zürich travaillent sur des problématiques voisines, mais ce preprint sans validation hardware ni partenariat industriel n'a pas d'effet immédiat sur la France ou l'industrie robotique de l'UE.

RecherchePaper
1 source