Aller au contenu principal
InfrastructurearXiv cs.RO 

ERUPT : une boîte à outils ouverte pour piloter les planificateurs de mouvement en réalité étendue

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs du Parasol Lab publient ERUPT (Extended Reality Universal Planning Toolkit), un système de réalité étendue (XR) open source pour la planification interactive de mouvements robotiques, décrit dans un article arXiv mis à jour en version 2 (arXiv:2510.02464). L'outil s'interface avec MoveIt, le framework de planification de manipulation largement utilisé dans l'écosystème ROS, pour permettre à un opérateur de composer une requête de planification et de visualiser le chemin résultant directement en réalité virtuelle ou augmentée. Plutôt que de manipuler une scène 2D projetée sur un écran avec souris et clavier, l'utilisateur saisit et repositionne les objets de l'environnement à la main, dans l'espace, avant de lancer le calcul de trajectoire, puis de déployer le plan validé sur un robot physique. Le code source complet est disponible sur GitHub (parasollab/erupt), en libre accès pour quiconque souhaite construire une application d'interaction homme-robot immersive à partir de cette base.

Pour l'industrie robotique, l'apport n'est pas un robot ni un chiffre de performance mais un outil d'infrastructure: un moyen de tester et valider un plan de mouvement en réalité virtuelle, sans risque de collision, avant tout déploiement sur un robot physique. Cela répond à un besoin concret des intégrateurs et des équipes de R&D, qui doivent aujourd'hui itérer sur des scènes de manipulation via des interfaces 2D peu intuitives, un goulot d'étranglement connu dans la mise au point de cellules robotisées. En s'appuyant sur MoveIt plutôt qu'en réinventant un moteur de planification propriétaire, ERUPT vise l'adoption par une communauté déjà familière de cet outil, et illustre une tendance plus large: l'usage de la XR comme couche d'interaction pour la robotique manipulatrice, en complément du travail classique de simulation plutôt qu'en remplacement.

L'article se positionne explicitement comme une contribution académique ouverte plutôt qu'un produit commercial: aucun prix ni chiffre de déploiement industriel n'est communiqué, et l'objectif affiché par les auteurs est que d'autres équipes réutilisent ce socle logiciel pour leurs propres applications. ERUPT s'inscrit dans une lignée d'outils de visualisation et de téléopération en réalité virtuelle pour la robotique, mais se distingue en ciblant l'intégration native avec MoveIt et la reconfiguration dynamique de l'environnement pendant la planification elle-même. Aucune feuille de route de pilote industriel ou de partenariat n'est mentionnée dans le papier; sa diffusion dépendra désormais de l'adoption par la communauté ROS et robotique open source via le dépôt GitHub public.

Dans nos dossiers

À lire aussi

Planification à base d'agents en lots pour le service de politiques robotiques
1arXiv cs.RO 

Planification à base d'agents en lots pour le service de politiques robotiques

Des chercheurs du Georgia Tech (laboratoire RL2) publient un article intitulé "Action Chunk Scheduling for Batched Robot Policy Serving" (arXiv:2608.00337v1), qui pose un problème encore peu formalisé dans la robotique : comment servir un même modèle de politique robotique, hébergé sur un GPU distant, à plusieurs robots simultanément. Les auteurs présentent Armory, un système de service ("serving") conçu pour cet usage et validé à la fois sur des flottes de robots simulés et sur des robots réels. Leurs expériences montrent que les heuristiques de scheduling classiques (les méthodes de batching habituelles en inférence LLM) fonctionnent correctement tant que tous les robots de la flotte sont identiques et consomment les actions au même rythme. Mais dès que les robots consomment leurs "action chunks" (blocs d'actions produits par les modèles Vision-Language-Action) à des vitesses différentes, ces heuristiques échouent : elles ne tiennent pas compte des contraintes en boucle fermée ("closed-loop") propres à l'exécution de politiques robotiques. Pour corriger ce défaut, l'équipe propose un nouvel algorithme de scheduling qui intègre cette hétérogénéité de rythme entre robots, avec un gain de débit système mesuré jusqu'à 18 % lors d'essais réels. Le code et les détails sont disponibles sur gatech-rl2.github.io/actionchunkscheduling. Le résultat touche un point aveugle du déploiement à grande échelle des modèles fondation pour la robotique (VLA type Pi-0, GR00T N2, Helix ou autres) : le calcul embarqué est limité en puissance et en encombrement, ce qui pousse naturellement vers une inférence déportée sur GPU distant, mutualisée entre plusieurs robots pour amortir les coûts. Or les architectures de batching héritées du monde LLM, pensées pour du texte asynchrone, ignorent la contrainte physique du temps réel robotique : un robot qui épuise son buffer d'actions avant d'être resservi s'arrête ou dégrade sa trajectoire. Ce papier démontre empiriquement que cette mécanique de service compte autant que la qualité du modèle lui-même pour faire fonctionner une flotte hétérogène en production, un enjeu direct pour les intégrateurs qui veulent mutualiser l'inférence entre robots de générations ou de tâches différentes plutôt que de multiplier les cartes embarquées. Ce travail s'inscrit dans la vague récente de modèles VLA génériques (Pi-0 de Physical Intelligence, GR00T N2 de NVIDIA, Helix de Figure) qui cherchent à démontrer un contrôle robotique à l'échelle d'une flotte plutôt qu'à l'unité, un terrain où l'infrastructure de service devient aussi critique que l'entraînement. En formalisant le problème comme un scheduling explicite et en le testant sur du matériel réel plutôt que seulement en simulation, les auteurs positionnent Armory comme une brique d'infrastructure réutilisable, potentiellement comparable aux serveurs d'inférence LLM (type vLLM) mais adaptée aux contraintes temps réel de la robotique. L'article ne précise pas de partenariat industriel ni de déploiement commercial annoncé ; il s'agit pour l'instant d'un résultat de recherche académique, avec du code ouvert, plutôt que d'un produit prêt à l'emploi.

InfrastructureActu
1 source
XPolicyLab : une norme unifiée et un écosystème ouvert pour l'évaluation et le déploiement de politiques robotiques
2arXiv cs.RO 

XPolicyLab : une norme unifiée et un écosystème ouvert pour l'évaluation et le déploiement de politiques robotiques

Un article publié sur arXiv (2608.09892v1) présente XPolicyLab, un standard unifié et un écosystème ouvert pour l'évaluation et le déploiement de politiques robotiques. Il ramène le coût d'intégration entre N modèles de politique et M environnements, jusqu'ici de O(N×M), à O(N+M), grâce à des schémas communs d'observation, d'action et de trajectoire et à une architecture client/serveur séparant l'inférence de la politique de l'exécution de l'environnement. L'écosystème intègre 42 politiques robotiques et normalise leur installation, leur débogage et leur évaluation ; le respect du standard fait passer l'effort d'intégration d'une politique type de plus de cinq heures à deux heures, puis à trente minutes avec des modules d'agent prêts à l'emploi. Les mêmes adaptateurs font tourner les simulateurs RoboTwin et RoboDojo ainsi que des protocoles d'évaluation sur robot réel via une seule interface, le tout publié sur xpolicylab.github.io. Cette fragmentation logicielle freine depuis longtemps la comparaison reproductible des politiques robotiques, notamment des modèles vision-langage-action (VLA) qui se multiplient sans convention commune de dépendances. Pour les intégrateurs et laboratoires qui testent plusieurs politiques sur plusieurs plateformes, ce coût quadratique explique pourquoi tant de comparatifs publiés restent partiels ou difficiles à reproduire. Les auteurs montrent que le code propre à chaque politique varie d'un ordre de grandeur alors que la boucle côté environnement reste quasi identique à une référence fixe, preuve que la complexité peut être confinée au seul modèle. Le fait que les mêmes adaptateurs couvrent simulation et robot physique constitue un argument concret, mais limité à l'ingénierie logicielle, pour atténuer l'écart entre démonstration et déploiement réel. Ce travail s'inscrit dans la multiplication récente des modèles de politique généralistes pour la robotique, chacun livré avec sa propre pile logicielle et ses propres simulateurs, ce qui rendait les comparaisons indépendantes coûteuses et rares. XPolicyLab se positionne comme une couche d'infrastructure neutre plutôt qu'un produit commercial, un rôle comparable à celui des formats d'échange communs adoptés ailleurs en machine learning. L'article ne mentionne aucun déploiement industriel ni partenariat avec un fabricant de robots : il s'agit d'une publication de recherche, pas d'une annonce produit, présentée comme une infrastructure partagée destinée à être étendue par la communauté avec de nouvelles politiques et de nouveaux environnements.

InfrastructureActu
1 source
NVIDIA publie de nouveaux outils et des mises à jour pour les développeurs d'IA physique
3The Robot Report 

NVIDIA publie de nouveaux outils et des mises à jour pour les développeurs d'IA physique

Lors du GTC Taipei et du Computex, NVIDIA a dévoilé un ensemble de nouveaux outils open-source rassemblés sous le nom NVIDIA Agent Toolkit, destinés aux développeurs de systèmes d'IA physique : robotique, véhicules autonomes, vision industrielle et jumeaux numériques. L'objectif affiché est de réduire le coût et la complexité des pipelines de développement en rendant l'ensemble de la pile logicielle de NVIDIA directement orchestrable par des agents IA. Les outils concernés incluent Cosmos 3, le modèle de fondation pour la compréhension du monde physique (vidéo, texte, prédiction d'états futurs), les bibliothèques Omniverse pour la simulation et les jumeaux numériques, Isaac pour la robotique, Metropolis pour la vision IA, Alpamayo pour la conduite autonome, et la plateforme Jetson pour le déploiement embarqué. Le déploiement sécurisé de ces agents est encadré par le blueprint NemoClaw et le runtime OpenShell, qui appliquent des politiques de sécurité et de confidentialité en local comme dans le cloud. L'approche "agent-ready" de NVIDIA marque un changement de paradigme dans le développement de l'IA physique : plutôt que des bibliothèques que les ingénieurs assemblent manuellement, les outils deviennent des briques directement appelables par des agents de codage, capables d'enchaîner automatiquement génération de données, simulation, entraînement et évaluation. Pour les développeurs de véhicules autonomes, cela signifie qu'un agent peut reconstruire des scènes à partir de données de flotte, générer des scénarios de conduite photoréalistes et lancer des boucles de renforcement sans intervention manuelle à chaque étape. Pour les intégrateurs robotiques, des tâches comme l'automatisation de l'entraînement à la navigation ou le tuning de systèmes Jetson deviennent théoriquement scriptables. Rev Lebaredian, vice-président pour la simulation d'IA physique chez NVIDIA, a qualifié Cosmos 3 de "modèle de fondation frontier pour l'IA physique", capable de comprendre vidéo et texte, de prédire les états futurs et de générer des actions, positionnant ce world model comme un candidat généraliste opérationnel, même si aucune métrique de benchmark indépendante n'a été communiquée à ce stade. NVIDIA consolide avec cette annonce sa position d'infrastructure de référence pour l'IA physique, un rôle qu'elle occupe via ses GPU d'entraînement et ses plateformes Isaac Sim et Jetson. La compétition dans ce segment s'intensifie : Google DeepMind pousse MuJoCo et ses dérivés, Boston Dynamics, Figure, Agility Robotics et Physical Intelligence développent leurs propres stacks de simulation et d'apprentissage, tandis que des acteurs industriels comme Siemens ou ANSYS occupent le terrain des jumeaux numériques. En Europe, des entreprises comme Wandercraft ou Enchanted Tools pourraient bénéficier de ces outils si la promesse de réduction de complexité se confirme en pratique. NVIDIA joue ici la carte de la plateforme unifiée plutôt que du modèle de fondation isolé, un positionnement cohérent avec son modèle d'affaires mais qui reste à valider au-delà des démonstrations internes. Les suites annoncées incluent des applications en santé, dont le détail n'a pas été entièrement communiqué lors de l'événement.

UELes entreprises françaises comme Wandercraft et Enchanted Tools pourraient bénéficier de la réduction de complexité annoncée, mais aucun déploiement européen concret n'est confirmé à ce stade.

InfrastructureOpinion
1 source
Robotics Summit : le discours d'ouverture présente une fondation ouverte pour les robots à base d'IA
4Robotics Business Review 

Robotics Summit : le discours d'ouverture présente une fondation ouverte pour les robots à base d'IA

Brian Gerkey, co-fondateur d'Open Robotics et actuel directeur technique d'Intrinsic, filiale d'Alphabet dédiée aux logiciels robotiques, prendra la parole le mercredi 28 mai 2026 à 9h00 ET lors du Robotics Summit & Expo de Boston, au Thomas M. Menino Convention & Exhibition Center (salle 253 ABC). Sa conférence, intitulée "An Open Foundation for the Age of AI-Powered Robots", présentera la stratégie de l'Open Source Robotics Alliance (OSRA) en matière d'accessibilité, d'outillage moderne et de sécurité fonctionnelle. Open Robotics, organisation qui maintient le Robot Operating System (ROS) et le simulateur Gazebo, y défendra la thèse que l'open source devient une infrastructure critique à mesure que l'IA physique accélère. La session remplace une conférence initialement prévue avec Russ Tedrake, professeur au MIT et ex-vice-président senior pour les large behavior models au Toyota Research Institute. L'événement rassemble cette année plus de 70 intervenants confirmés issus d'Amazon Robotics, AWS, Tesla, Universal Robots, Brain Corp, PickNik Robotics et Robust AI, avec plus de 50 sessions réparties sur des tracks IA, design, healthcare et logistique. Le signal est moins technique qu'institutionnel. L'émergence des architectures Vision-Language-Action (VLA), des pipelines sim-to-real et des foundation models pour la robotique physique rend la standardisation des middlewares plus stratégique que jamais. ROS 2, qui reste la référence pour la communication inter-processus sur les plateformes industrielles et humanoïdes, est maintenu collectivement via l'OSRA. Pour les intégrateurs et les équipes R&D, le fait que Gerkey articule une roadmap publique au principal salon technique commercial américain de robotique signale que l'OSRA entend jouer un rôle normatif, pas seulement communautaire. La question non résolue est celle de la performance : les pipelines d'inférence GPU modernes imposent des contraintes de latence que les architectures ROS classiques gèrent mal, et c'est précisément là que se jouera la crédibilité du discours. Open Robotics a été fondée en 2012 autour de ROS, né à Willow Garage, l'un des premiers labs à industrialiser la recherche robotique aux États-Unis. Gerkey y a travaillé avant de co-fonder l'organisation, et son rattachement actuel à Intrinsic place cette prise de parole à l'intersection de la stratégie Google/Alphabet et de la gouvernance open source. Sur le plan concurrentiel, l'écosystème ROS fait face à des alternatives propriétaires croissantes : Isaac ROS de NVIDIA, les middlewares maison de Boston Dynamics ou de Figure AI, et des frameworks applicatifs comme LeRobot de HuggingFace. La prochaine étape pour l'OSRA sera de démontrer comment ROS 2 s'intègre nativement avec des architectures de foundation models en production, un point que Gerkey devrait adresser lors de sa session du 28 mai.

UEROS 2 étant la référence middleware adoptée par la majorité des équipes robotiques européennes, la roadmap OSRA articulée par Gerkey influencera les choix d'architecture pour les intégrateurs et startups FR/EU développant des robots à base de foundation models.

InfrastructureOpinion
1 source