Aller au contenu principal
RecherchearXiv cs.RO 

AM-Bench : une suite de simulation modulaire et un benchmark pour l'apprentissage de politiques de manipulation aérienne

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs présentent AM-Bench, une suite de simulation modulaire et un benchmark dédiés à l'apprentissage de politiques de contrôle pour la manipulation aérienne, c'est-à-dire des drones multirotors équipés de bras manipulateurs. Décrit dans un article arXiv publié début septembre 2026, l'outil couvre des architectures robotiques représentatives allant des systèmes sous-actionnés aux systèmes pleinement ou sur-actionnés, avec 12 tâches réparties en trois catégories : contact, transport d'objets et interaction sous contrainte. AM-Bench intègre des perturbations aérodynamiques configurables, une modélisation de la saturation des actionneurs, des contrôleurs bas niveau standardisés ainsi que des algorithmes de référence pour l'apprentissage de politiques. Les auteurs valident l'outil via trois études en simulation portant respectivement sur les politiques de haut niveau, les interfaces entre politique et contrôle, et les différentes architectures robotiques, complétées par une validation partielle sur banc matériel réel.

Pour l'industrie robotique, cet outil comble un vide méthodologique réel : la quasi-totalité des benchmarks de manipulation existants suppose une base fixe ou terrestre, alors que la manipulation aérienne ajoute un couplage dynamique complexe entre le bras et la plateforme volante, plus sensible aux perturbations environnementales et aux degrés de liberté restreints. En permettant une évaluation systémique, et non plus seulement une mesure de performance de bout en bout, AM-Bench donne aux équipes de recherche et aux intégrateurs un cadre commun pour comparer objectivement embodiment, contrôle et choix algorithmiques, un enjeu direct pour les applications d'inspection, de maintenance en hauteur ou de logistique aérienne où le drone manipulateur reste largement au stade expérimental.

Le projet s'inscrit dans la continuité des travaux sur les benchmarks standardisés qui ont structuré les progrès de l'apprentissage de la manipulation robotique au sol ces dernières années, un mouvement qu'AM-Bench cherche explicitement à étendre au domaine aérien, resté à la traîne faute d'outils communs. L'article ne mentionne ni partenaire industriel ni acteur français ou européen impliqué, et reste à ce stade une contribution académique en open source plutôt qu'un produit commercial : les auteurs annoncent une validation matérielle réelle mais limitée, laissant ouverte la question de l'adoption par la communauté et d'un éventuel élargissement des tâches et des plateformes couvertes dans de futures versions.

À lire aussi

Apprentissage de politiques par simulation pour la loco-manipulation des robots humanoïdes
1arXiv cs.RO 

Apprentissage de politiques par simulation pour la loco-manipulation des robots humanoïdes

Une équipe de chercheurs a publié le 9 juin 2026 sur arXiv (2606.08278) SIMPLE, un banc de test de simulation unifié pour l'apprentissage et l'évaluation de politiques de contrôle de robots humanoïdes. La plateforme couple la simulation de dynamique de contact de MuJoCo avec le rendu photoréaliste d'IsaacSim, et propose 60 tâches de loco-manipulation plein corps, 50 scènes d'intérieur et plus de 1 000 assets d'objets. Pour la collecte de données, deux pipelines sont intégrés : génération automatisée de trajectoires par planification de mouvement, et interface de téléopération VR à faible latence. Les auteurs y benchmarkent plusieurs familles de politiques humanoïdes : réseaux d'imitation légers, grands modèles vision-langage-action (VLA) et les récents modèles d'action du monde (WAM, World Action Models). Les expériences démontrent, selon les auteurs, un transfert zero-shot vers des robots humanoïdes physiques dans des configurations similaires. L'enjeu central est un goulot d'étranglement d'évaluation : les modèles fondationnels humanoïdes progressent plus vite que les protocoles pour les tester. Les benchmarks existants se concentrent sur la robotique de table ou les robots à roues, sans couvrir la loco-manipulation plein corps, compétence clé pour les humanoïdes déployés en environnement industriel ou domestique. Si la corrélation sim-to-real revendiquée dans l'article se confirme à plus grande échelle, elle légitime le recours massif à la simulation pour entraîner des politiques de contrôle, réduisant drastiquement les coûts de collecte de données en conditions réelles. C'est précisément le pari industriel de Physical Intelligence avec pi-0, et de Figure AI avec Figure 02 : remplacer les démos téléopérées coûteuses par des pipelines simulés reproductibles. La fragmentation des benchmarks est un problème structurel en robotique humanoïde : chaque laboratoire publie sur ses propres protocoles, rendant toute comparaison inter-équipes difficile. Des initiatives comme HumanoidBench, RoboVerse ou Isaac Lab ont tenté d'y répondre, mais sans couvrir la chaîne complète loco-manipulation avec rendu photoréaliste et pipelines de données intégrés. SIMPLE se positionne à cette intersection. Les équipes de Google DeepMind (GR00T N2, Helix), Agility Robotics (Digit) et Boston Dynamics sont directement concernées. Ce preprint arXiv n'est pas encore évalué par les pairs ; l'adoption par la communauté dépendra de la disponibilité publique du code et des assets, non encore confirmée.

RecherchePaper
1 source
SimFoundry : génération modulaire et automatisée de scènes pour l'apprentissage et l'évaluation de politiques
2arXiv cs.RO 

SimFoundry : génération modulaire et automatisée de scènes pour l'apprentissage et l'évaluation de politiques

Des chercheurs du laboratoire GEAR de NVIDIA ont publié SimFoundry sur arXiv (identifiant 2606.28276), un pipeline modulaire et automatisé permettant de reconstruire des scènes de simulation directement depuis une vidéo du monde réel, sans annotation manuelle. Le système génère des jumeaux numériques sim-ready, puis en dérive automatiquement des "cousins numériques": des variantes de la scène originale qui préservent les affordances manipulatoires tout en modifiant objets, arrangements ou tâches. Testé sur sept tâches de manipulation (multi-étapes, objets articulés, bimane) et cinq architectures de policies distinctes, SimFoundry atteint une corrélation de Pearson de 0,911 entre évaluation en simulation et performance réelle, avec un mean maximum ranking violation de 0,018. En transfert zéro-shot vers le monde réel, les cousins d'objets apportent +17% de taux de succès, les cousins de scènes +21%, et les cousins de tâches +40%. Ces résultats s'attaquent directement au sim-to-real gap, l'écart structurel qui rend les benchmarks de simulation peu fiables pour prédire les performances physiques. Avec une corrélation de 0,911, les équipes R&D peuvent comparer des architectures de policies en simulation sans mobiliser de temps robot, ce qui réduit significativement le coût d'évaluation. Le concept de cousins numériques va plus loin que l'augmentation de données classique: en préservant les affordances, les variantes restent exploitables pour l'apprentissage sans dériver vers des distributions hors domaine. Pour un intégrateur de cellules robotiques ou un décideur industriel, le gain concret est une accélération du cycle développement-évaluation, à condition que la reconstruction vidéo reste robuste hors des environnements contrôlés présentés dans le papier. SimFoundry s'inscrit dans la stratégie robotique large de NVIDIA, qui développe en parallèle la plateforme Isaac Sim et le modèle de fondation humanoïde GR00T N2. Le laboratoire GEAR, dédié à la généralisation des policies d'agents incarnés, positionne cette approche sim-centric face aux alternatives data-centric: Physical Intelligence (Pi-0, issu des travaux de Sergey Levine) mise sur des volumes massifs de démonstrations réelles, tandis que Google DeepMind avance avec ses propres pipelines de simulation. Dans l'écosystème des simulateurs robotiques (Sapien, RoboSuite, Genesis), SimFoundry se distingue par son entrée vidéo sans annotation. Le papier, disponible en prépublication sur arXiv, ne précise pas de calendrier de mise à disposition du code ni d'intégration dans un produit commercial.

UELes laboratoires de robotique européens (CEA-List, INRIA) pourraient bénéficier de cette infrastructure de simulation pour évaluer leurs policies sans mobiliser de temps robot, mais aucun acteur FR/EU n'est impliqué et le code n'est pas encore disponible.

RecherchePaper
1 source
Modélisation de représentations volumétriques pour l'apprentissage de politiques de manipulation : VolumeDP
3arXiv cs.RO 

Modélisation de représentations volumétriques pour l'apprentissage de politiques de manipulation : VolumeDP

Une équipe de recherche présente VolumeDP, une nouvelle architecture pour l'apprentissage par imitation en robotique manipulatrice, décrite dans une version révisée d'un article arXiv (2603.17720v2). Le problème visé est concret : la plupart des méthodes actuelles font correspondre directement des observations d'images 2D à des sorties d'action 3D, un décalage géométrique qui nuit au raisonnement spatial et fragilise la robustesse des politiques apprises. VolumeDP corrige ce défaut en raisonnant explicitement en trois dimensions : les features issues des images sont d'abord projetées dans une représentation volumétrique via un mécanisme d'attention croisée, puis un module apprenable sélectionne les voxels pertinents pour la tâche et les convertit en un ensemble compact de tokens spatiaux, ce qui réduit fortement le calcul sans perdre la géométrie utile à l'action. Un décodeur multi-tokens exploite ensuite l'ensemble de ces tokens pour prédire les actions, évitant l'agrégation destructrice qui réduit plusieurs indices spatiaux à un seul descripteur. Résultat chiffré : 88,8% de taux de réussite moyen sur le benchmark de simulation LIBERO, soit 14,8 points de mieux que la meilleure méthode concurrente, avec des gains également marqués sur ManiSkill et LIBERO-Plus. Des essais en conditions réelles confirment la généralisation à de nouvelles dispositions spatiales, de nouveaux points de vue caméra et de nouveaux environnements. Pour les équipes qui développent des politiques de manipulation robotique, ce travail illustre une limite structurelle des architectures VLA qui traitent la 3D comme un simple sous-produit d'un flux d'images : sans représentation spatiale explicite, la robustesse aux changements de caméra ou de décor s'effondre, un problème récurrent dès qu'on sort du laboratoire. VolumeDP montre qu'ajouter un raisonnement volumétrique explicite, plutôt que de compter uniquement sur l'échelle des données ou du modèle, améliore sensiblement la généralisation, ce qui nuance l'idée reçue selon laquelle scaler les VLA suffirait à résoudre le problème spatial. Le travail s'inscrit dans la lignée des méthodes d'apprentissage par imitation ayant précédemment tenté d'intégrer une composante 3D, comme les approches de type Diffusion Policy en 3D, mais en visant une représentation volumétrique plus efficiente en calcul. Il s'agit à ce stade d'une contribution académique, publiée sur arXiv avec code et vidéos disponibles sur une page projet dédiée, et non d'un produit ou d'un système déployé commercialement. Les benchmarks utilisés (LIBERO, ManiSkill) restent des environnements de recherche standard, ce qui laissera aux prochaines étapes le soin de confirmer la tenue de ces résultats sur des tâches industrielles plus complexes.

RecherchePaper
1 source
EquiBim : apprentissage d'une politique équivariante par symétrie pour la manipulation bimanuelle
4arXiv cs.RO 

EquiBim : apprentissage d'une politique équivariante par symétrie pour la manipulation bimanuelle

Des chercheurs présentent EquiBim, un cadre d'apprentissage par imitation qui impose une contrainte de symétrie bilatérale aux politiques de manipulation bimanuelle. Publié sur arXiv (2603.08541, version 3, une révision d'un article déjà soumis), le travail part d'un constat simple: les bras robotiques à deux membres partagent souvent une symétrie morphologique gauche-droite, tout comme de nombreuses tâches qu'ils exécutent, mais les politiques entraînées par imitation classique ne l'exploitent pas et produisent des comportements incohérents face à des observations pourtant symétriques. EquiBim formalise cette symétrie physique comme une action de groupe sur les espaces d'observation et d'action, puis impose une contrainte d'équivariance aux prédictions du modèle pendant l'entraînement. Le framework se veut agnostique au modèle sous-jacent: il s'intègre à des pipelines variés, qu'ils reposent sur des nuages de points ou des images, et que les actions soient paramétrées dans l'espace cartésien de l'effecteur ou dans l'espace articulaire. Les auteurs valident l'approche sur RoboTwin, une plateforme de simulation à cinématique bimanuelle symétrique, avant de la tester sur un système bras double réel. L'intérêt pour l'industrie tient à la nature du gain rapporté: une amélioration constante des performances et de la robustesse face aux changements de distribution, en simulation comme en conditions réelles. C'est un signal utile dans un secteur où l'écart entre démonstrations impressionnantes et fiabilité en déploiement reste un point de friction majeur pour les intégrateurs de robots bimanuels et humanoïdes. Injecter un biais inductif structurel, plutôt que de compter uniquement sur le volume de données de démonstration, est une piste que plusieurs laboratoires explorent pour réduire le besoin en données coûteuses tout en stabilisant le comportement des politiques VLA. Le contexte est celui d'une littérature déjà riche sur l'équivariance en apprentissage robotique, jusqu'ici surtout appliquée aux bras uniques. EquiBim l'étend au cas bimanuel, dans un paysage où des architectures comme GR00T N2, Pi-0 ou Helix cherchent aussi à généraliser au-delà des données d'entraînement. À ce stade, il s'agit d'un résultat académique reproductible sur banc d'essai et sur un prototype réel, pas d'un produit commercial: la suite logique serait son adoption ou son adaptation par des équipes développant des piles de contrôle bimanuelles en conditions industrielles.

RecherchePaper
1 source