Aller au contenu principal

Dossier Boston Dynamics — page 3

669 articles · page 3 sur 14

Boston Dynamics, pionnier de la locomotion : Atlas électrique, Spot patrouille industrielle et inspection, partenariats Hyundai et Toyota Research Institute.

101Robotics Business Review InfrastructureActu

Clé du progrès des humanoïdes : gérer l'énergie derrière les robots

Murata Power Solutions présente, dans cet épisode du podcast Designing the Future animé par Jim Anderton, les défis d'ingénierie liés à l'alimentation électrique des robots humanoïdes. John Quinlan, Senior Engineering Manager chez Murata Power Solutions (Boston), y détaille pourquoi la gestion de l'énergie embarquée devient le facteur limitant des performances robotiques. Alors que la vitesse, la mobilité, la dextérité, la vision et les interfaces utilisateur des humanoïdes progressent à un rythme soutenu, avec des annonces quasi hebdomadaires dans le secteur, la conversion de l'énergie stockée en batteries ou en piles à combustible embarquées vers les formes utilisables par la mécatronique et l'électronique de contrôle reste un point de blocage physique incontournable. Murata y présente sa gamme de convertisseurs de puissance compacts et à haut rendement, couvrant un large spectre de besoins, des applications de faible puissance jusqu'aux systèmes de forte puissance, destinés aux marchés industriels, médicaux, des télécommunications et de l'information. Ce constat rappelle une réalité souvent éclipsée par les vitrines spectaculaires des démonstrations d'humanoïdes: la performance perçue d'un robot, qu'il s'agisse de sa vitesse de déplacement ou de la fluidité de ses gestes, dépend directement de l'efficacité de sa chaîne d'alimentation électrique. Pour les intégrateurs et décideurs industriels, ce rappel a une portée concrète: l'autonomie, le poids embarqué et la fiabilité thermique d'un humanoïde ne se jouent pas uniquement dans les algorithmes de contrôle moteur ou les modèles vision-langage-action, mais aussi dans des composants moins visibles comme les convertisseurs DC-DC et la gestion thermique de l'électronique de puissance. C'est un angle mort fréquent des comparatifs entre plateformes comme Figure 03, Optimus ou Atlas, qui se concentrent sur le payload, les degrés de liberté ou le temps de cycle sans détailler l'architecture énergétique sous-jacente. Ce format podcast s'inscrit dans une série éditoriale de The Robot Report consacrée aux coulisses techniques de la robotique, où des fournisseurs de composants critiques mais peu médiatisés, capteurs, actionneurs, systèmes d'alimentation, prennent la parole aux côtés des géants de l'humanoïde. Murata Power Solutions, filiale du groupe japonais Murata Manufacturing, est un acteur établi de longue date dans l'électronique de puissance pour environnements contraints, bien avant l'essor actuel des humanoïdes commerciaux. Aucune annonce de produit spécifique aux humanoïdes n'est faite ici: il s'agit d'un contenu de positionnement technique et commercial, destiné à installer Murata comme fournisseur de référence auprès des concepteurs de robots à mesure que la demande en solutions d'alimentation embarquée haute densité s'intensifie.

1 source
102IEEE Spectrum Robotics 

Video Friday : une Coupe du Monde pour robots

Pour la première fois, deux équipes complètes de robots humanoïdes se sont affrontées dans un match de football à 11 contre 11 sur du matériel réel, lors de RoboCup 2026 à Incheon, en Corée du Sud, une avancée que les organisateurs présentent comme une étape vers un objectif à long terme de la robotique : battre une équipe humaine championne du monde d'ici 2050. Toujours à Incheon, l'équipe néerlandaise Tech United a affronté IRIS en ligue « mid-size ». Dans un autre registre, des ingénieurs du MIT et de l'EPFL à Lausanne ont présenté un robot capable de nager sous l'eau puis de jaillir hors de l'eau pour poursuivre son vol, en s'inspirant de la mécanique des oiseaux plongeurs, dans l'optique de développer une nouvelle classe de drones aériens-aquatiques. La startup 1X a dévolié pour sa plateforme humanoïde NEO une main à 25 degrés de liberté entièrement actionnés, à commande par tendons, dotée d'un retour tactile riche et présentée comme apte à la manipulation fine et à l'usage d'outils de précision, une annonce à prendre avec prudence tant qu'aucune démonstration indépendante n'a été montrée. Boston Dynamics a fait intervenir son robot Atlas devant 80 000 spectateurs au stade NYNJ, lors du match Brésil-Norvège, pour livrer le ballon du coup d'envoi de la seconde mi-temps. Agility Robotics a de son côté mis en scène Digit à la tenue d'un barbecue pour la fête nationale américaine, argument marketing autour du contrôle de force précis de son bras. Enfin, le laboratoire Generalist a annoncé GEN-1, un modèle d'apprentissage robotique affichant un taux de réussite moyen de 99 % contre 64 % pour les modèles précédents sur des tâches physiques simples, une exécution dite trois fois plus rapide, et un entraînement ne nécessitant qu'une heure de données robotiques par tâche. Ces annonces illustrent la bascule en cours dans le secteur, où le spectacle événementiel (Atlas au coup d'envoi, Digit au grill) coexiste avec des progrès techniques plus substantiels sur la manipulation fine et l'apprentissage généraliste. Le chiffre avancé par Generalist, s'il se confirme sur des tâches diversifiées et hors laboratoire, toucherait directement la question du sim-to-real et de la donnée nécessaire au déploiement commercial des VLA, un point de friction majeur pour les intégrateurs industriels. La main à 25 DoF de 1X s'inscrit dans la course à la dextérité, condition jugée indispensable pour sortir les humanoïdes des tâches de manutention basique vers des usages en logistique fine ou en assemblage. Cette semaine s'inscrit dans une accélération plus large du secteur en 2026, entre compétitions sportives comme vitrines technologiques (RoboCup, dont l'ambition affichée reste un horizon 2050) et rivalité entre acteurs américains (Boston Dynamics, Agility, 1X, Figure, Generalist) sur le terrain de l'humanoïde généraliste. Aucun acteur français ou européen n'apparaît dans cette sélection, un signe de la concentration actuelle de l'innovation humanoïde aux États-Unis et en Asie. Les prochains rendez-vous à suivre incluent IROS 2026 à Pittsburgh fin septembre et le Humanoids Summit de Séoul, où ces annonces devraient être confrontées à des démonstrations en conditions réelles.

HumanoïdesActu
1 source
Recherche technique d'ABot-C0 sur les comportements fondamentaux pour robots quadrupèdes
103arXiv cs.RO 

Recherche technique d'ABot-C0 sur les comportements fondamentaux pour robots quadrupèdes

ABot-C0, présenté dans un rapport technique publié sur arXiv (2607.07370), est un système généraliste de contrôle de mouvement pour robots quadrupèdes reposant sur trois piliers complémentaires. Les chercheurs ont d'abord construit une pyramide de données combinant génération vidéo conditionnelle, capture de mouvement annotée, téléopération et conception manuelle, pour produire 16 074 séquences de mouvement physiquement réalisables. Sur cette base, ils ont entraîné une politique généraliste par flow-matching qui, selon les auteurs, démontre pour la première fois une loi d'échelle pour le suivi de mouvement chez les quadrupèdes: les performances s'améliorent de façon constante avec l'augmentation des données d'entraînement, avec une capacité à suivre des mouvements inédits sans exemples spécifiques (zero-shot). Pour la locomotion sur tout-terrain, l'équipe a développé un cadre en trois étapes passant d'un contrôle privilégié à un contrôle perceptif, appuyé sur une mémoire temporelle LiDAR et une supervision prédictive du terrain. Le système a été testé en navigation autonome sur terrain urbain et en interaction multimodale de type compagnon. L'enjeu dépasse la simple démonstration technique. Contrairement aux robots humanoïdes, qui bénéficient de vastes corpus de capture de mouvement humain et d'un paradigme de motion-tracking déjà mature, les quadrupèdes souffrent d'un manque criant de données animales exploitables, et le transfert d'un squelette à un autre reste fragile. En traitant ce problème par la synthèse vidéo et une politique d'apprentissage unifiée, ce travail cherche à combler l'écart entre les deux familles de robots. La revendication centrale, faire passer les quadrupèdes de démonstrations mono-fonction à une intelligence comportementale de niveau produit, doit toutefois être lue comme une affirmation d'auteurs de papier de recherche, non comme un déploiement commercial vérifié: les expériences relatées restent des tests en conditions contrôlées ou semi-contrôlées, pas des mises en service industrielles à grande échelle. Ce travail s'inscrit dans une dynamique plus large où l'apprentissage de bout en bout par grands modèles de mouvement, déjà éprouvé sur les humanoïdes commerciaux, cherche à s'étendre aux plateformes quadrupèdes utilisées en inspection, sécurité ou logistique, un segment où des acteurs comme Unitree, ANYbotics ou Boston Dynamics dominent aujourd'hui avec des commandes plus classiques. En s'appuyant sur des données synthétiques plutôt que sur la capture animale, coûteuse et rare, les auteurs ouvrent une piste pour industrialiser l'entraînement de ces robots. Aucune date de déploiement commercial ni partenaire industriel n'est mentionnée dans ce rapport, qui reste à ce stade une contribution académique destinée à être suivie par d'autres itérations.

RecherchePaper
1 source
Boston Dynamics amène ses robots à pattes à la Coupe du monde de la FIFA
104Robotics Business Review 

Boston Dynamics amène ses robots à pattes à la Coupe du monde de la FIFA

Boston Dynamics a présenté lors de la Coupe du monde de la FIFA une démonstration de son humanoïde Atlas exécutant un "Ghost Rabona", un tir de football complexe mêlant feinte et frappe enchaînée, tandis que des robots quadrupèdes Spot assurent des missions de sécurité sur les sites du tournoi. Cette initiative s'inscrit dans la campagne "School of Football" et prolonge un partenariat vieux de 27 ans entre Hyundai Motor, propriétaire de Boston Dynamics depuis 2021, et la FIFA. Alberto Rodriguez, directeur du comportement robotique, et Merry Frayne, directrice produit senior pour Spot, ont détaillé au Robot Report la méthode employée: capture de mouvement (mocap) d'un joueur expérimenté, injection des données dans un moteur de simulation, puis génération d'une politique de contrôle en quelques heures à une journée grâce à l'apprentissage par renforcement (RL). Contrairement à la RoboCup, où d'autres humanoïdes s'affrontent directement, Hyundai laisse ici la compétition sportive aux humains et se concentre sur une vitrine technologique. L'enjeu dépasse le simple coup marketing. Boston Dynamics explique avoir abandonné, il y a environ un an, son contrôle prédictif basé modèle, pourtant considéré comme la référence mondiale pour l'équilibre humanoïde, au profit du RL appris en simulation. Ce choix technique permet des comportements que la démonstration humaine ne pourrait pas transmettre directement, comme le déplacement d'un réfrigérateur, et les mêmes techniques serviraient déjà à la manipulation mobile en entrepôt, par exemple le transport de cartons. Pour les intégrateurs et décideurs industriels, ce signal est significatif: il suggère que l'apprentissage par renforcement en simulation devient la voie privilégiée pour généraliser des comportements dynamiques au delà de ce qui a été démontré, plutôt qu'un exercice isolé de motion capture. Reste que la démonstration filmée pour un événement sportif grand public relève avant tout d'une vitrine soignée, et non d'un déploiement opérationnel comparable aux usages en entrepôt. Cette communication s'inscrit dans la longue série de démonstrations spectaculaires de Boston Dynamics, danse, parkour, sauts et sauts périlleux, qui ont construit sa réputation avant même l'acquisition par Hyundai en 2021. Elle intervient aussi dans un contexte de concurrence croissante sur les humanoïdes, où d'autres acteurs mettent en avant des compétitions comme la RoboCup plutôt que des vitrines chorégraphiées. Rodriguez évoque déjà des pistes d'amélioration futures, notamment l'ajustement des recettes de simulation pour renforcer la fiabilité des comportements appris, sans toutefois fixer de calendrier précis pour d'éventuels prochains déploiements ou nouvelles démonstrations.

HumanoïdesActu
1 source
MACHINA 2026 : Paris veut devenir la capitale européenne de la Physical AI
105Robot Magazine FR 

MACHINA 2026 : Paris veut devenir la capitale européenne de la Physical AI

Paris accueille le 7 juillet 2026 la première édition de MACHINA, sommet dédié à la Physical AI organisé à Station F, la veille du RAISE Summit. Les organisateurs annoncent une liste d'intervenants dense pour un événement européen sur la robotique : Jim Fan (directeur recherche Physical AI chez NVIDIA), Marc Raibert (fondateur de Boston Dynamics, aujourd'hui directeur exécutif du RAI Institute), Carolina Parada (robotique chez Google DeepMind), Jeff Cardenas (CEO d'Apptronik), Bernt Børnich (fondateur de 1X), Jonathan Hurst (cofondateur d'Agility Robotics), David Reger (fondateur de NEURA Robotics), Abhinav Gupta (président de Skild AI), Thomas Wolf (Chief Science Officer de Hugging Face), Laura Modiano (OpenAI) et Péter Fankhauser (CEO d'ANYbotics). Le sommet ne se limite pas à des vitrines de machines : il couvre modèles de fondation, simulation, infrastructure de calcul et déploiement industriel, soit l'ensemble de la chaîne qui va du modèle VLA au robot physique. Cette concentration de dirigeants issus de NVIDIA, Google DeepMind, OpenAI, Boston Dynamics et des principaux acteurs humanoïdes américains (Apptronik, Agility Robotics, 1X) sur un événement parisien signale un repositionnement : la Physical AI cherche désormais des relais de visibilité en dehors des États-Unis et de l'Asie. Pour les intégrateurs et décideurs industriels européens, MACHINA offre un accès rare à des interlocuteurs habituellement présents sur les scènes de la Silicon Valley. L'angle retenu, la convergence entre IA générative, simulation et robotique plutôt que la seule performance mécanique, reflète un basculement du secteur où le logiciel et les modèles de fondation pèsent désormais autant que le hardware dans la course humanoïde. Cet événement s'inscrit dans la suite logique de trois années centrées sur les assistants conversationnels et les modèles génératifs, dont les avancées en vision par ordinateur et en simulation commencent à irriguer la robotique. Sur le plan concurrentiel, les États-Unis alignent Apptronik, Agility Robotics et Boston Dynamics, tandis que l'Asie conserve son avance industrielle historique ; l'Europe mise sur des acteurs comme l'allemand NEURA Robotics ou le suisse ANYbotics pour exister dans cette nouvelle vague. La proximité immédiate avec le RAISE Summit, organisé le lendemain, dessine une séquence parisienne pensée pour capter à la fois investisseurs et chercheurs sur une même semaine, un pari sur la capacité de la France à s'imposer comme point de passage européen de la Physical AI plutôt que comme simple spectatrice d'une course menée depuis San Francisco et Shenzhen.

UEL'événement se tient à Paris (Station F) et vise à positionner la France comme plaque tournante européenne de la Physical AI, offrant aux intégrateurs et décideurs industriels français et européens un accès direct à des dirigeants majeurs du secteur (NVIDIA, Google DeepMind, OpenAI, Boston Dynamics) ainsi qu'à des acteurs européens comme NEURA Robotics et ANYbotics.

FR/EU ecosystemeOpinion
1 source
Jaiveer Singh aide les robots et les développeurs à progresser plus rapidement
106NVIDIA Blog Robotics 

Jaiveer Singh aide les robots et les développeurs à progresser plus rapidement

Jaiveer Singh, ingénieur logiciel chez NVIDIA, dirige l'équipe responsable d'Isaac ROS (Robot Operating System), une pile logicielle open source construite sur le framework ROS 2 et accélérée par les bibliothèques CUDA de NVIDIA. Isaac ROS fournit aux développeurs un ensemble de modules pour la perception, la détection d'objets, la cartographie (SLAM), la détection de collision et la planification de mouvements. La plateforme est compatible avec les robots mobiles autonomes (AMR), les systèmes de manipulation et les humanoïdes, et peut s'exécuter sur des postes de travail, sur le DGX Spark (le supercalculateur IA personnel de NVIDIA) ainsi que sur les systèmes embarqués Jetson. Le projet a débuté comme un projet de stage de Singh, alors étudiant en génie électrique, informatique et gestion à l'Université de Californie Berkeley, avec une question simple : publier des bibliothèques GPU open source pour la robotique aurait-il de la valeur ? La réponse s'est avérée positive, et Isaac ROS est depuis devenu un composant central de l'écosystème robotique NVIDIA. L'importance d'Isaac ROS pour l'industrie tient à sa modularité et à son positionnement comme couche d'intégration entre l'IA générative et le déploiement physique. Contrairement à l'ancien Isaac SDK, la version ROS se présente, selon Singh lui-même, comme "un ensemble de briques LEGO" : les développeurs assemblent les modules selon leurs besoins et les combinent avec du code ROS communautaire existant. Pour un intégrateur ou un OEM qui cherche à passer de la démonstration au déploiement série, cette approche réduit la friction d'adoption. Elle répond aussi à une préoccupation structurelle du secteur : la pérennité de la pile logicielle. Un startup qui construit sur un système fermé doit faire confiance au fait que ce système correspondra toujours à ses besoins dans deux ou trois ans, une promesse difficile à tenir dans un marché qui se recompose chaque trimestre. L'open source apporte ici une garantie d'auditabilité et de continuité que les systèmes propriétaires peinent à offrir. NVIDIA s'est positionné sur la robotique bien avant que le secteur devienne un sujet grand public, et Isaac ROS s'inscrit dans cette continuité stratégique. La plateforme évolue aujourd'hui pour répondre aux exigences des humanoïdes, qui requièrent une stack logicielle de bout en bout capable de gérer des agents IA, de la simulation (Isaac Sim) au déploiement edge sur Jetson. Les concurrents directs sur la couche middleware incluent ROS 2 non-accéléré utilisé seul, mais aussi les environnements propriétaires de Boston Dynamics, Agility Robotics ou Figure AI, qui développent leurs propres stacks internes. NVIDIA joue ici un rôle transversal d'infrastructure partagée, moins visible qu'un robot humanoïde en vidéo, mais potentiellement plus déterminant pour la cadence industrielle du secteur. Les prochaines étapes annoncées portent sur le renforcement du support aux agents IA et aux systèmes humanoïdes, deux segments en forte croissance depuis 2024.

UELes intégrateurs et startups robotiques français et européens peuvent bénéficier d'Isaac ROS comme couche middleware open source pour accélérer leurs déploiements, mais l'impact reste indirect et dépendant de l'adoption de l'écosystème NVIDIA.

InfrastructureOpinion
1 source
Event-VLA : fusion d'événements conditionnée par l'action pour un modèle VLA robuste
107arXiv cs.RO 

Event-VLA : fusion d'événements conditionnée par l'action pour un modèle VLA robuste

Des chercheurs ont publié sur arXiv (référence 2606.29384) Event-VLA, un framework combinant des caméras événementielles avec des modèles Vision-Language-Action (VLA) pour rendre la manipulation robotique robuste dans des conditions d'éclairage dégradées. L'approche repose sur l'intégration de flux d'événements, une modalité de capteur neuromorphique qui encode les variations de luminosité pixel par pixel avec une résolution temporelle de l'ordre de la microseconde, contrairement aux caméras RGB classiques qui acquièrent des images complètes à fréquence fixe. L'architecture introduit un mécanisme de routage par requêtes d'action : des requêtes apprenantes extraient la sémantique pertinente à la tâche depuis le raisonnement VLA, puis agrègent sélectivement les tokens événementiels via une cross-attention à portes (gated cross-attention), produisant des représentations d'action sensibles aux conditions lumineuses. Les expériences couvrent des scénarios de simulation et de déploiement réel en faible luminosité, voire en quasi-obscurité. Ce travail s'attaque à une faille structurelle des VLA actuels, Pi-0, OpenVLA, GR00T N2 ou Helix inclus, qui sont entraînés et évalués quasi-exclusivement dans des environnements d'intérieur bien éclairés et stables. Le sim-to-real gap se double ici d'un lighting-to-real gap rarement quantifié dans les benchmarks publiés. Event-VLA démontre qu'on peut greffer une modalité événementielle sans détruire les priors sémantiques RGB-langage préentraînés, ce qui est non trivial : la plupart des fusions multimodales naïves dégradent la performance en conditions normales pour gagner en robustesse marginale. Le fait que le gain soit mesuré sans régression sur éclairage standard constitue le résultat le plus solide à retenir pour les intégrateurs industriels envisageant des déploiements en entrepôt, en extérieur ou en environnement à éclairage variable. Les caméras événementielles (Prophesee, inivation, Sony IMX636) restent onéreuses et peu présentes dans les pipelines robotiques commerciaux, ce qui limite la portée immédiate du framework. Le travail s'inscrit dans un mouvement plus large d'hybridation sensorielle pour les VLA, en parallèle d'approches tactiles (GelSight) ou proprioceptives. Côté concurrent, Boston Dynamics, Figure et Agility travaillent sur la robustesse des politiques en conditions réelles mais publient peu sur la gestion de l'éclairage. Aucun acteur européen n'est mentionné dans ce papier. Les auteurs ne précisent pas de pipeline de déploiement à l'échelle ni de timeline industrielle : il s'agit d'un résultat de recherche, pas d'un produit shipé.

UEProphesee, fabricant français de caméras événementielles, est explicitement cité comme fournisseur matériel clé, ce qui positionne l'écosystème européen du capteur neuromorphique comme brique potentielle des futurs pipelines VLA industriels robustes.

IA physiqueActu
1 source
GaRLILEO : odométrie radar-jambes-inertielle améliorée et alignée sur la gravité
108arXiv cs.RO 

GaRLILEO : odométrie radar-jambes-inertielle améliorée et alignée sur la gravité

Des chercheurs ont publié sur arXiv (référence 2511.13216v2) GaRLILEO, un framework d'odométrie à temps continu fusionnant radar Doppler embarqué (radar SoC), cinématique des jambes et centrale inertielle (IMU) pour les robots à pattes évoluant sur terrains complexes, escaliers, pentes, environnements non structurés. Le système introduit deux contributions principales : une spline de vitesse ego-motion construite en continu à partir des mesures Doppler du radar et des données proprioceptives des jambes, découplant ainsi l'estimation de vitesse de l'intégration IMU ; et un facteur de gravité à contrainte douce sur la sphère S2, permettant d'estimer le vecteur gravité avec précision sans recourir à LiDAR ni caméra. L'algorithme a été évalué sur un dataset réel multimodalités collecté par l'équipe, couvrant des trajectoires intérieures et extérieures variées. Les auteurs revendiquent des performances état de l'art en odométrie verticale sur escaliers et pentes. Le code et le dataset sont publiés en open source. La dérive verticale est le talon d'Achille des systèmes d'odométrie proprioceptive pour robots bipèdes ou quadrupèdes : les impacts de contact répétés, le glissement des pieds et les vibrations accumulent des erreurs sur les angles de roulis et tangage, rendant la localisation peu fiable dès que le terrain n'est plus plan. Les approches existantes compensent avec du LiDAR ou des caméras, mais ces capteurs extéroceptifs se dégradent dans les scènes pauvres en features ou répétitives (couloirs, tunnels, zones enneigées). GaRLILEO propose une alternative robuste : le radar Doppler, peu sensible aux conditions d'éclairage et aux surfaces texturées, fournit une mesure directe de vitesse sans double intégration, ce qui élimine la source principale d'erreur IMU. Pour les intégrateurs déployant des robots d'inspection ou de logistique en environnement industriel réel, cette combinaison radar-pattes-IMU représente un profil de robustesse différent des stacks LiDAR-SLAM dominants. L'odométrie pour robots à pattes s'est structurée autour de quelques frameworks proprioceptifs de référence, TSIF, Pronto, DRIFT, et de pipelines LiDAR-inertiel comme LIO-SAM ou FAST-LIO. L'ajout du radar comme modalité principale reste marginal dans la littérature legged robotics, contrairement au domaine automobile où les radars 4D SoC (Texas Instruments, Vayyar, Arbe) ont connu une forte adoption. GaRLILEO s'inscrit dans une tendance récente visant à exploiter ces puces radar embarquées bas coût pour la navigation en intérieur dégradé. Les prochaines étapes naturelles incluent la validation sur des plateformes commerciales (Spot de Boston Dynamics, ANYmal de ANYbotics, Unitree B2) et l'intégration dans des pipelines SLAM complets. La mise en open source du dataset multimodale constitue en soi une contribution pour le benchmarking communautaire.

UELe code et le dataset open-source pourraient être exploités par des équipes de recherche européennes travaillant sur la navigation de robots à pattes (ex. ANYbotics en Suisse, labos SLAM EU), mais aucun acteur français ou européen n'est directement impliqué dans les travaux.

RecherchePaper
1 source
CORE Planner : navigation robotique en environnements inconnus par apprentissage par renforcement à mémoire contextuelle
109arXiv cs.RO 

CORE Planner : navigation robotique en environnements inconnus par apprentissage par renforcement à mémoire contextuelle

Une équipe de chercheurs a publié sur arXiv (réf. 2606.29222) un planificateur de navigation autonome baptisé CORE (Contextual-memory Oriented Reinforcement-learning), conçu pour guider un robot dans des environnements inconnus sans carte préalable. L'architecture combine un graphe de visibilité sparse pour la représentation structurée de l'espace, un réseau Transformer pour la compréhension globale de l'environnement, et un mécanisme de mémoire contextuelle pour éviter les optima locaux dans les grandes scènes. Testé face au planificateur traditionnel FAR Planner et à plusieurs baselines d'apprentissage par renforcement, CORE réduit la distance de déplacement de 13 % par rapport à FAR Planner et jusqu'à 48 % face aux meilleures méthodes d'apprentissage, avec des gains qui s'accentuent dans les environnements complexes. Fait notable : le modèle réalise un transfert sim-to-real en zéro-shot, sans fine-tuning sur données réelles, après entraînement exclusif sur des environnements simulés basés sur l'image. Le code est disponible en accès libre sur GitHub. Ce résultat s'attaque à un verrou persistant de la navigation mobile : la dégradation des performances lors du passage du simulateur au monde réel. La plupart des méthodes d'apprentissage par renforcement nécessitent soit une domain randomization poussée, soit un fine-tuning coûteux sur données terrain. Ici, le zéro-shot sim-to-real est démontré en environnement physique sans intervention humaine, résultat significatif si les conditions expérimentales sont généralisables. Pour les intégrateurs et équipes R&D, l'enjeu concret est double : réduction de la distance parcourue (efficacité énergétique, temps de cycle) et capacité à opérer dans des espaces non cartographiés, scénario courant en logistique, BTP ou exploration. La navigation en environnements inconnus s'appuie historiquement sur le SLAM, avec des contributions majeures d'ETH Zurich, Carnegie Mellon ou l'INRIA côté européen. FAR Planner (CMU), utilisé ici comme référence de comparaison, reste une baseline solide mais à règles fixes. Sur le plan industriel, Boston Dynamics, ANYbotics ou Exotec intègrent des planificateurs propriétaires dans leurs flottes de robots mobiles. CORE se positionne comme une alternative légère, entraînable sur image seule, mais reste à ce stade une contribution académique sans déploiement industriel annoncé. La robustesse face aux obstacles dynamiques, non testée dans cette version, constituera l'étape critique pour une éventuelle industrialisation.

UELe code open-source pourrait être évalué par des équipes R&D françaises (Exotec, intégrateurs logistiques) pour la navigation en espaces non cartographiés, mais il n'y a pas de lien institutionnel direct avec la France ou l'UE.

RecherchePaper
1 source
X-Morph : des priors de mouvement humain pour l'apprentissage robotique évolutif multi-morphologies
110arXiv cs.RO 

X-Morph : des priors de mouvement humain pour l'apprentissage robotique évolutif multi-morphologies

Une équipe de chercheurs a publié fin juin 2026 sur arXiv (arXiv:2606.30290v1) X-Morph, un pipeline qui convertit des données de mouvement humain en politiques de locomotion et de loco-manipulation déployables sur des robots à pattes non-humanoïdes. L'approche cible trois morphologies distinctes : un quadrupède, un hexapode, et un quadrupède équipé d'un bras manipulateur. Le pipeline fonctionne en trois étapes : un module de re-ciblage cross-morphologique transforme des séquences de mouvement humain en références cinématiquement cohérentes avec la structure mécanique du robot cible ; ces références sont ensuite suivies par une politique d'apprentissage par renforcement (RL) dite "privileged" qui accède à des informations d'état complètes, puis distillées en une politique étudiante causale utilisable en inférence temps-réel. Les politiques obtenues généralisent à des mouvements humains non vus à l'entraînement et ouvrent trois applications concrètes : téleopération par vidéo, contrôle par prior comportemental, et génération de mouvement conditionnée par texte. La valeur technique de X-Morph tient à ce qu'il propose une réponse directe au problème central de la robotique non-humanoïde : la rareté des données de mouvement robot-spécifiques. Les systèmes humanoïdes comme Figure 02, Optimus Gen 2 ou Atlas bénéficient d'immenses corpus de capture de mouvement humain (AMASS, CMU MoCap, entre autres), mais les quadrupèdes de type Spot, ANYmal ou Unitree Go2 n'ont pas d'équivalent structurel. X-Morph pose l'hypothèse qu'un re-ciblage morphologique rigoureux peut combler cet écart sans collecter de nouvelles données robot. La mécanique RL "privileged" puis distillée est bien établie dans la littérature, notamment chez ETH Zurich et ANYbotics, mais son application à la réutilisation cross-morphologique de données humaines reste peu explorée à cette échelle. La capacité à conditionner les politiques par texte représente par ailleurs une interface opérateur plus accessible pour les intégrateurs industriels. Ce preprint s'inscrit dans une dynamique de recherche qui a accéléré depuis 2023, portée par des laboratoires exploitant les données humaines pour bootstrapper des comportements robotiques généraux : Pi-0 chez Physical Intelligence (Berkeley), GR00T N2 chez NVIDIA, ou Helix chez Figure AI. X-Morph se distingue en ciblant explicitement les morphologies non-humanoïdes, là où la majorité de la recherche reste concentrée sur les bipèdes. Aucun partenaire industriel ni calendrier de déploiement n'est mentionné, ce qui en fait pour l'instant une contribution académique à suivre plutôt qu'un produit disponible. La question ouverte demeure celle du sim-to-real gap sur les morphologies hexapodes, que le papier ne quantifie pas en conditions réelles.

IA physiqueOpinion
1 source
Libérer des mouvements expressifs infinis chez les quadrupèdes via des priors vidéo génératifs
111arXiv cs.RO 

Libérer des mouvements expressifs infinis chez les quadrupèdes via des priors vidéo génératifs

Des chercheurs ont publié le 29 juin 2026 sur arXiv (2606.28237) un pipeline nommé Uni-Mo, capable de générer automatiquement des mouvements expressifs pour robots quadrupèdes sans recourir à des animaux réels comme source de données. Le système enchaîne trois étapes : un LLM produit des descriptions textuelles de mouvements, un modèle de diffusion vidéo synthétise les comportements correspondants sous forme de séquences visuelles, puis ces vidéos sont converties en trajectoires 3D servant à entraîner des politiques de suivi déployées sur un Unitree Go2. Pour stabiliser les générations vidéo naturellement instables sur la durée, les auteurs introduisent une "Identity Consistency Loss" qui impose une cohérence d'apparence du robot entre les frames. Le jeu de données résultant, Quad-Imaginarium (disponible en open source sur GitHub), regroupe 7 488 séquences de mouvements annotées en langage naturel, couvrant 18,5 heures de comportements acrobatiques et expressifs. Sur 392 mouvements tirés aléatoirement et testés physiquement sur un Go2 réel, le taux de succès de déploiement atteint 96,7 %, contre 97,6 % en simulation sur l'ensemble du dataset. Ce résultat est notable parce qu'il contourne une hypothèse tacite qui plombait les approches précédentes : faire passer les données de mouvement par un corps animal réel, ce qui rendait la collecte dépendante d'animaux coopératifs, la reconstruction fragile selon les espèces, et le retargeting mal posé face aux incompatibilités morphologiques. En traitant la rareté des données comme un problème de génération plutôt que de capture, Uni-Mo démontre qu'un pipeline entièrement synthétique peut atteindre un taux sim-to-real supérieur à 96 %, ce qui valide empiriquement l'hypothèse que la diffusion vidéo peut servir de simulateur comportemental crédible pour la robotique quadrupède. Pour les intégrateurs et décideurs B2B, cela signifie potentiellement une voie vers des robots compagnons ou d'inspection aux comportements riches, sans infrastructure de motion capture animale. Le champ du mouvement quadrupède expressif est dominé par des approches d'imitation sur données réelles (Boston Dynamics, ANYbotics, Unitree lui-même) ou de retargeting depuis des séquences canines capturées en laboratoire. Uni-Mo s'inscrit dans une tendance émergente qui mobilise les générateurs vidéo comme oracles de physique approximative, après des travaux similaires dans le domaine humanoïde (notamment autour de Pi-0 de Physical Intelligence et des pipelines VLA). L'Unitree Go2, robot grand public à moins de 3 000 dollars, est ici utilisé comme plateforme de validation, ce qui renforce la reproductibilité de l'approche. Les prochaines étapes probables incluent l'extension à des morphologies différentes et l'intégration de retours proprioceptifs pour fermer la boucle en temps réel.

💬 Le gros truc ici, c'est qu'ils ont retourné le problème : au lieu de capturer des mouvements sur de vrais animaux, ils les génèrent entièrement par diffusion vidéo. 96,7% de succès sur robot physique, c'est pas de la simulation flatteuse, ça valide empiriquement qu'un modèle vidéo peut servir d'oracle comportemental crédible pour la robotique quadrupède. Si tu vois ça se confirmer sur d'autres morphologies, la capture motion animale commence sérieusement à sentir la dette technique.

IA physiqueOpinion
1 source
Booster Lab : un pipeline centré sur les données pour l'apprentissage de politiques de locomotion humanoïde déployables
112arXiv cs.RO 

Booster Lab : un pipeline centré sur les données pour l'apprentissage de politiques de locomotion humanoïde déployables

Des chercheurs de Booster Robotics ont publié le 27 juin 2026 sur arXiv (2606.27813) un article décrivant "Booster Lab", un pipeline de bout en bout pour apprendre et déployer des politiques de locomotion sur des robots humanoïdes. Le système repose sur quatre étapes enchaînées : curation automatisée de données de mouvement, adaptation du modèle robot de l'environnement réel vers la simulation (real-to-sim), apprentissage par renforcement avec la méthode AMP (Adversarial Motion Priors), et transfert simulation-vers-réel (sim-to-real). Le pipeline a été validé sur le robot humanoïde Booster T1, la plateforme principale de l'entreprise, avec des premiers résultats de portabilité obtenus sur le Booster K1. Aucun chiffre de performance brut (temps de cycle, vitesse de marche, taux de succès) n'est disponible dans l'abstract de cette préprint, ce qui limite l'évaluation indépendante des résultats. Le véritable apport de ce travail n'est pas une architecture RL inédite, mais une réponse opérationnelle à un problème concret qui ralentit tout le secteur : la rareté des données de mouvement compatibles avec la morphologie des robots humanoïdes. Les captures humaines brutes sont souvent inutilisables directement, les clips open-source sont hétérogènes en qualité, et même les trajectoires synthétiques issues de simulation nécessitent une vérification de faisabilité physique. En centralisant la curation, l'adaptation de modèle et la vérification dans un même pipeline, Booster Lab propose une infrastructure reproductible plutôt qu'un résultat de labo isolé. La validation croisée sur deux plateformes distinctes (T1 et K1) suggère une ambition de généralisation, mais reste à confirmer sur des benchmarks indépendants. Booster Robotics est une startup chinoise spécialisée dans les humanoïdes à faible coût, positionnée en compétition directe avec Unitree et ses séries H1/G1, ainsi qu'avec Fourier Intelligence. Le T1 est commercialisé comme plateforme de recherche accessible, en opposition aux segments premium occupés par Figure (Figure 02), Agility Robotics (Digit) ou Boston Dynamics (Atlas). L'approche data-centric de ce papier s'inscrit dans la tendance de fond du secteur : après les percées en manipulation portées par des VLA comme pi0 (Physical Intelligence) ou GR00T N2 (NVIDIA), la locomotion naturelle et robuste reste le dernier verrou avant des déploiements industriels crédibles. La suite logique de ce travail serait un benchmark public des politiques apprises et un accès au pipeline de curation pour la communauté.

RecherchePaper
1 source
CWI : système d'imitation du corps entier pour la loco-manipulation de robots humanoïdes
113arXiv cs.RO 

CWI : système d'imitation du corps entier pour la loco-manipulation de robots humanoïdes

Des chercheurs ont publié fin juin 2026 sur arXiv (réf. 2606.27676) le framework CWI (Composite Whole-Body Imitation), une architecture de contrôle pour robots humanoïdes visant à coordonner locomotion et manipulation bimanuelle en simultané. Le système a été évalué en simulation puis déployé sur un LimX Oli, humanoïde pleine taille du fabricant chinois LimX Robotics. L'approche repose sur une dissociation du recours aux données de capture de mouvement (MoCap) : les données MoCap de manipulation diversifiées pilotent le contrôle du haut du corps, tandis que la locomotion est guidée par deux discriminateurs adversariaux (Adversarial Motion Prior, AMP) entraînés sur des clips curatés de marche et d'accroupissement. Une architecture multi-critique réduit les conflits entre objectifs de locomotion, de manipulation et de style de mouvement ; une étape de distillation enseignant-élève produit ensuite une politique conditionnée uniquement sur les poses des mains et des commandes de vitesse et hauteur. La loco-manipulation reste l'un des verrous majeurs de la robotique humanoïde. Les méthodes purement par renforcement, sans MoCap, souffrent de récompenses creuses et nécessitent des curricula finement réglés ; les méthodes imitant le corps entier butent sur le déséquilibre des datasets, les trajectoires de locomotion trop dynamiques dégradant la stabilité globale. CWI propose une dissociation architecturale qui contourne les deux écueils. Le résultat pratique est une téléopération sans équipement MoCap complet, ce qui abaisse le seuil d'intégration industrielle. Pour les intégrateurs et les décideurs B2B, cela signifie qu'un humanoïde capable d'agir dans des environnements mixtes (déplacements et saisie d'objets) devient envisageable sans infrastructure de capture de mouvement coûteuse. Cela dit, la publication ne fournit aucune métrique de temps de cycle ni de volumes de déploiement, ce qui invite à lire ces résultats comme une preuve de concept compétitive, pas comme un produit shipé. CWI s'inscrit dans une vague de travaux combinant apprentissage par renforcement et imitation de mouvement humain, dont l'Adversarial Motion Prior (AMP) de Peng et al. constitue la brique fondatrice. LimX Robotics reste un acteur discret face aux mastodontes du secteur : Figure AI (Figure 03), Tesla (Optimus Gen 3), Physical Intelligence (Pi-0) ou encore Boston Dynamics (Atlas) travaillent sur des architectures comparables intégrant contrôle corps entier et politiques Vision-Language-Action (VLA). CWI ne mentionne ni calendrier de déploiement industriel, ni partenariat commercial : il s'agit d'un preprint arXiv sans revue par les pairs publiée. Les prochaines étapes probables passeront par une validation en conditions réelles plus variées et une publication dans une conférence robotique de référence (ICRA, IROS ou RAL).

RecherchePaper
1 source
Comment allouer un budget de transfert simulation-réel ?
114arXiv cs.RO 

Comment allouer un budget de transfert simulation-réel ?

Une étude publiée sur arXiv (réf. 2606.22062, juin 2026) s'attaque à une question pratique restée sans réponse claire dans la robotique par apprentissage : comment répartir un budget de temps de mesure sur robot réel entre l'identification de système (mesurer précisément les paramètres physiques du robot) et la randomisation de domaine (entraîner sur une large plage de dynamiques simulées) ? Les chercheurs ont conduit une expérience contrôlée sim-à-sim sur un pendule, en substituant un modèle à paramètres cachés au robot physique pour pouvoir varier proprement les gaps de réalité et les niveaux de bruit. Résultat : un faible nombre de rollouts d'identification suffisait à combler l'essentiel de l'écart de transfert. Une fois des données réelles disponibles, les politiques entraînées aux paramètres estimés surpassaient systématiquement celles entraînées sur une bande de randomisation élargie, même lorsque cette bande contenait les vrais paramètres du système. Ce résultat contredit une intuition répandue dans le secteur : celle que "plus de randomisation = plus de robustesse au sim-to-real gap". Les pipelines sim-to-real actuels (notamment pour les mains, les bras, et les humanoïdes) consacrent souvent une fraction importante de l'ingénierie à construire des distributions de randomisation larges via DR (Domain Randomization), parfois au détriment d'une identification soignée. Cette étude suggère que cette stratégie est sous-optimale dans le régime "bénin" où les dynamiques sont identifiables. Pour les intégrateurs robotiques et les équipes de déploiement, la leçon opérationnelle est directe : mesurer d'abord ce qu'il est possible de mesurer, et réserver la randomisation à l'incertitude résiduelle non modélisable, pas l'inverse. Le sim-to-real reste l'un des goulots d'étranglement centraux du robot learning depuis les travaux fondateurs d'OpenAI Robotics sur Dactyl (2019) et les benchmarks de transfert de Meta AI et Google DeepMind. La communauté a largement misé sur des variantes de Domain Randomization (DR) et sur les Visual-Language-Action models (VLA) pour contourner le gap sans nécessiter d'identification fine. Cette étude s'inscrit dans un contre-courant : celui d'une meilleure caractérisation du robot physique via la sysid, une approche défendue également par des travaux récents de Unitree, Boston Dynamics, et par des labos académiques proches du contrôle optimal. La limite explicitement posée par les auteurs est importante : leurs conclusions tiennent dans un régime à deux paramètres inconnus et sans mismatch structurel de modèle ; dans des systèmes plus complexes (contact, déformation, friction multipoint), la randomisation large pourrait reprendre l'avantage. Prochaines étapes naturelles : valider sur des systèmes à plus haute dimensionnalité, des robots articulés réels, et en présence de mismatch structurel explicite.

RecherchePaper
1 source
Apprentissage par renforcement avec mélange d'experts pour la locomotion quadrupède tolérante aux pannes
115arXiv cs.RO 

Apprentissage par renforcement avec mélange d'experts pour la locomotion quadrupède tolérante aux pannes

Des chercheurs du Dynamic Legged Systems Lab de l'Istituto Italiano di Tecnologia (IIT) proposent sur arXiv (prépublication 2506.25965) une architecture de contrôle modulaire pour robots à pattes conçue pour maintenir la locomotion en cas de panne d'actionneur. Le système repose sur un mélange d'experts (Mixture-of-Experts, MoE) piloté par apprentissage par renforcement : un module de diagnostic identifie en temps réel le type de défaillance (joint bloqué, couple réduit, actionneur hors service), puis active l'expert spécialisé correspondant parmi plusieurs politiques de contrôle distinctes, chacune entraînée pour un mode de panne spécifique. Les expériences menées dans le simulateur IsaacLab montrent que ces politiques modulaires surpassent systématiquement des politiques monolithiques de taille comparable sur l'ensemble des scénarios de panne évalués. L'architecture conserve de surcroît des performances compétitives avec une capacité réseau significativement réduite, un critère déterminant pour les plateformes embarquées à ressources de calcul limitées, notamment en contexte d'exploration planétaire. Ce résultat adresse un angle mort persistant du déploiement hors-laboratoire des robots à pattes : la robustesse aux défaillances matérielles en cours de mission. Les politiques monolithiques entraînées par RL, qui ont produit des performances remarquables sur terrain accidenté (ANYmal d'ETH Zurich, Spot de Boston Dynamics, MIT Cheetah), supposent implicitement l'intégrité de l'ensemble des actionneurs. Injecter explicitement l'état diagnostiqué de panne dans la boucle de décision permet à chaque expert de se spécialiser sur un sous-espace comportemental bien délimité, ce qui explique leur supériorité même à capacité réduite. Pour un intégrateur ou un concepteur de mission, l'architecture MoE trace une voie concrète vers des robots capables de poursuivre une mission malgré une défaillance partielle, sans intervention humaine ni recalibration à distance. L'IIT est l'un des laboratoires européens de référence en robotique à pattes, à l'origine de la lignée hydraulique HyQ et HyQReal. La cible applicative explicitement déclarée par les auteurs est l'exploration planétaire, domaine où l'ESA et la NASA cherchent activement des solutions de mobilité résiliente pour des rovers de nouvelle génération. Les approches concurrentes, notamment les politiques adaptatives basées sur l'estimation d'état développées par le Robotics Systems Lab de l'ETH Zurich sur ANYmal, n'exploitent pas aussi directement l'information de diagnostic pour router dynamiquement vers des experts dédiés par mode de panne. Le code est publié en open source sur GitHub (dépôt iit-DLSLab/fault-locomotion-isaaclab) sous IsaacLab, ce qui facilite la reproductibilité et l'adoption par la communauté. Prochaine étape attendue : validation sur plateforme physique, les résultats actuels étant entièrement en simulation.

UEL'IIT, laboratoire européen de référence en robotique à pattes, publie une architecture MoE open source pour la locomotion tolérante aux pannes, offrant une base directement exploitable pour les programmes de rovers résilients de l'ESA.

FR/EU ecosystemePaper
1 source
Commerge : fusion de cartes LiDAR économe, robuste et rapide pour la coordination multi-robots sous contraintes
116arXiv cs.RO 

Commerge : fusion de cartes LiDAR économe, robuste et rapide pour la coordination multi-robots sous contraintes

Une équipe du SPARO Lab publie Commerge (arXiv:2606.25386), un framework de fusion de cartes LiDAR conçu pour des essaims de robots opérant dans des environnements à bande passante limitée, capable de réduire le volume de données échangées entre robots jusqu'à 5 000 fois sans dégradation notable de la précision d'alignement. Sur le jeu de données HeLiPR, le volume transmis passe de 7 000 Mo à 1,3 Mo, soit une réduction de 99,98%. L'architecture repose sur une optimisation cascadée en trois étapes appliquée à un graphe d'échange, où les sommets représentent les keyframes de chaque robot et les arêtes les boucles inter-robots candidates. Ce pipeline identifie le sous-ensemble minimal de scans LiDAR, séquentiellement chevauchants et géométriquement pertinents, qui préserve la cohérence globale de la carte tout en minimisant le coût de transmission. L'évaluation porte sur neuf jeux de données (cinq publics, quatre propriétaires) couvrant des environnements de grotte, d'analogues planétaires, intérieurs et de campus extérieurs, sur des plateformes allant de l'embarqué au poste de travail. Le goulot d'étranglement communicationnel est l'obstacle central au déploiement de flottes de robots mobiles en environnement dégradé : sous-sol minier, tunnels, exploration spatiale ou entrepôts à couverture WiFi partielle. Les approches existantes imposaient un choix binaire entre transmettre l'intégralité des scans (échelle GB, infaisable sur lien bas débit) et un sous-échantillonnage naïf qui détériore la précision d'alignement. Commerge invalide ce compromis en montrant qu'un sous-ensemble sélectionné par théorie des graphes suffit à maintenir la qualité de fusion. Pour un intégrateur ou un COO industriel, cela ouvre la voie à des flottes d'AMR LiDAR capables de construire une carte globale cohérente sur des réseaux contraints (4G dégradé, radio maillée, liaison satellitaire) sans surcharge d'infrastructure. La fusion de cartes LiDAR multi-robots s'inscrit dans le champ du SLAM collaboratif, domaine actif depuis une décennie mais historiquement conditionné à des hypothèses de connectivité peu réalistes, que des travaux comme COVINS, DiSCo-SLAM et Swarm-SLAM ont progressivement atténuées sans résoudre la contrainte de bande passante. Commerge comble directement cet angle mort, avec du code et des matériaux disponibles sur sparolab.github.io/research/commerge. Les prochaines étapes naturelles incluront la validation dans des déploiements réels souterrains ou extraterrestres, contextes où Boston Dynamics, Clearpath Robotics et le programme DARPA SubT ont identifié la communication comme verrou systémique.

RecherchePaper
1 source
Raisonnement par modèle vision-langage pour la cartographie sémantique contextuelle en intralogistique
117arXiv cs.RO 

Raisonnement par modèle vision-langage pour la cartographie sémantique contextuelle en intralogistique

Des chercheurs ont publié le 24 juin 2026 (arXiv:2606.24814v1) un pipeline de cartographie sémantique contextuelle destiné aux robots mobiles autonomes (AMR) opérant en environnements intralogistiques. Le système enchaîne quatre briques : cartographie géométrique par SLAM, segmentation d'instances via SAM (Segment Anything Model de Meta), clustering d'instances multi-vues, puis raisonnement contextuel par un modèle vision-langage (VLM) interrogé en mode zero-shot à vocabulaire ouvert. L'application démontrée porte sur l'estimation de la mobilité des objets -- distinguer ce qui peut être déplacé de ce qui est fixe. Sur les benchmarks rapportés, le pipeline atteint 98,93 % de mIoU en classification sémantique et 89,17 % de précision (mAcc) pour l'estimation de mobilité. Trois VLMs distincts ont été évalués selon deux stratégies de prompting, et une analyse composant par composant complète les résultats. L'enjeu industriel est direct : les AMR en entrepôt naviguent aujourd'hui sur des cartes purement géométriques -- ils localisent les obstacles mais ignorent leur nature et leur statut. Un robot ne distingue pas une palette temporaire d'un rayonnage fixe, ni une cage de manutention mobile d'une infrastructure permanente. Ce travail démontre qu'un VLM généraliste, sans entraînement supervisé ni ontologie prédéfinie, peut inférer ces propriétés contextuelles à partir d'observations multi-vues agrégées. Pour un intégrateur ou un COO d'entrepôt, cela signifie potentiellement une planification de trajectoire et une gestion des obstacles plus robuste face aux environnements dynamiques -- sans reconfiguration manuelle de la carte à chaque réorganisation du sol. Il faut noter que le 89 % de précision sur la mobilité reste perfectible, et que les chercheurs eux-mêmes identifient le raisonnement VLM comme le goulot principal, non la perception bas niveau. Le secteur de l'intralogistique autonome regroupe des acteurs comme Exotec (FR, systèmes Skypod), Mobile Industrial Robots (MiR, groupe Teradyne), Geek+ ou Boston Dynamics (Stretch). La cartographie sémantique y est un problème ouvert depuis plusieurs années : les approches antérieures exigeaient des ontologies d'objets prédéfinies ou un fine-tuning supervisé coûteux pour chaque nouvel environnement. L'utilisation de SAM et de VLMs généralistes en zero-shot s'inscrit dans une tendance plus large -- portée aussi par des travaux comme SayPlan ou ConceptGraphs -- qui cherche à rendre les robots industriels reconfigurables sans réentraînement. Les auteurs ne mentionnent pas de déploiement réel ni de partenaire industriel associé ; il s'agit à ce stade d'un résultat de laboratoire, validé en simulation ou environnement contrôlé, dont la robustesse en entrepôt opérationnel reste à démontrer.

UEExotec (FR) et les intégrateurs AMR européens sont directement concernés : cette approche zero-shot pourrait rendre leurs flottes reconfigurables sans réentraînement coûteux à chaque réorganisation d'entrepôt, sous réserve de validation en environnement opérationnel réel.

💬 Un robot qui distingue une palette temporaire d'un rayonnage fixe sans entraînement supervisé, c'est le chaînon manquant pour que les flottes AMR s'adaptent enfin à l'entrepôt réel, pas à l'entrepôt figé du jour de la mise en service. Le 89 % de précision sur la mobilité, c'est encore loin du prod. Mais zéro ontologie prédéfinie, zéro fine-tuning, ça change le calcul pour un intégrateur comme Exotec qui reconfigurait ses déploiements à la main.

IA physiquePaper
1 source
Mouvement primitif en robotique : une étude approfondie
118arXiv cs.RO 

Mouvement primitif en robotique : une étude approfondie

Publiée sur arXiv sous l'identifiant 2601.02379v2, une revue encyclopédique sur les movement primitives en robotique recense et compare l'ensemble des cadres théoriques développés ces trente dernières années pour représenter les trajectoires de contrôle de robots à partir de démonstrations humaines. Ces primitives de mouvement, blocs élémentaires de motion analogues aux phonèmes du langage, permettent à un système autonome de décomposer un geste complexe en segments réutilisables et recombinables. Les approches couvertes incluent les Dynamic Movement Primitives (DMP), formulés comme des systèmes dynamiques de type amortisseur-ressort, les Probabilistic Movement Primitives (ProMP) couplant statistiquement plusieurs démonstrations, et les extensions neuronales adaptées aux espaces d'état de haute dimension. La revue présente ces frameworks en ordre chronologique, évalue leurs forces et faiblesses, et identifie des applications concrètes : saisie d'objets, mouvements balistiques, enchaînements de tâches en manipulation robotique. Pour les praticiens (intégrateurs, équipes R&D en manipulation, COO industriels), cette synthèse positionne les primitives de mouvement comme une couche intermédiaire critique entre démonstration brute et politique généraliste de bout en bout. Elles permettent le transfert de compétences motrices sans rejeu complet des données d'entraînement et restent interprétables, contrairement aux architectures VLA (Vision-Language-Action) comme π0 de Physical Intelligence ou OpenVLA. La revue souligne en particulier des défis non résolus que ces dernières n'ont pas encore surmontés à l'échelle industrielle : segmentation automatique des démonstrations, passage à l'échelle en environnements non structurés, et couplage de contraintes en temps réel. Les primitives de mouvement ont émergé au début des années 2000 avec les travaux d'Auke Ijspeert, Jun Nakanishi et Stefan Schaal sur les DMP, puis étendues par Paraschos et al. avec les ProMP en 2013. Le champ s'est depuis fragmenté en nombreuses variantes sans synthèse unifiée. Face aux approches purement neuronales (ACT, Diffusion Policy) popularisées par les groupes de Sergey Levine et Chelsea Finn, les primitives se repositionnent comme solution modulaire et interprétable. Les auteurs identifient leur intégration dans des architectures de type foundation model pour la robotique comme prochaine étape structurante, un axe qui mobilise des acteurs aux États-Unis (Boston Dynamics AI Institute, CMU) comme en Europe (DLR, LAAS-CNRS).

UELAAS-CNRS est explicitement identifié comme un acteur européen clé sur l'intégration des primitives de mouvement dans les architectures foundation model pour la robotique, ce qui positionne la recherche française au cœur d'un axe stratégique face aux approches VLA purement neuronales.

RecherchePaper
1 source
Simuler la locomotion robotique dans le sable : la théorie des forces résistives dans un moteur physique open source
119arXiv cs.RO 

Simuler la locomotion robotique dans le sable : la théorie des forces résistives dans un moteur physique open source

Des chercheurs ont intégré la théorie de la force résistive tridimensionnelle (3D RFT) dans le moteur de simulation physique MuJoCo, comblant un angle mort persistant des outils de robotique open-source. La 3D RFT permet d'approximer les forces de réaction du sol lors de la locomotion en milieu granulaire (sable, gravier fin) sans simuler l'interaction avec chaque grain individuellement, ce qui constitue l'approche classique par éléments discrets (DEM), prohibitive en temps de calcul. Les auteurs ont validé leur implémentation sur un robot hexapode à 12 degrés de liberté évoluant en bac à sable : la simulation prédit la distance parcourue et l'enfoncement des pattes à moins de 20 % des valeurs mesurées expérimentalement, avec des tendances cohérentes selon la forme de l'effecteur, la vitesse de déplacement et la charge appliquée. Les travaux sont publiés sur arXiv (2606.19504) et le code est rendu disponible en open source. L'impact pratique est significatif pour les équipes qui développent des robots mobiles destinés à évoluer hors piste. Jusqu'ici, simuler fiablement la locomotion sur sol meuble imposait soit des moteurs DEM spécialisés (CHRONO, LIGGGHTS) avec des temps de calcul rédhibitoires pour l'apprentissage par renforcement, soit des approximations ad hoc peu transférables. Intégrer la RFT directement dans MuJoCo, l'environnement de référence pour l'entraînement de politiques de locomotion, ouvre une voie crédible vers le sim-to-real sur substrats granulaires. La précision de 20 % est honnête pour une approximation analytique et constitue une base exploitable pour l'optimisation de design ou le pré-entraînement de contrôleurs, même si elle reste insuffisante pour garantir un transfert direct sans recalibration. La RFT granulaire a été initialement développée dans les laboratoires de Daniel Goldman (Georgia Tech) pour étudier la locomotion animale dans le sable, avant d'être étendue aux systèmes robotiques. MuJoCo, racheté par DeepMind en 2021 et passé open-source la même année, est aujourd'hui le moteur dominant pour l'entraînement de politiques de locomotion humanoïde et quadrupède chez Figure, Boston Dynamics ou Unitree. Les débouchés concrets de ce travail concernent les rovers planétaires (JPL, ESA), les robots agricoles évoluant en sol labouré, et les plateformes de recherche et sauvetage en milieu sableux. La prochaine étape logique sera l'extension aux substrats hétérogènes et l'intégration dans des pipelines d'apprentissage par renforcement standard pour valider le gain sim-to-real à l'échelle.

RecherchePaper
1 source
SRL : modèle SLIP et apprentissage par renforcement pour des sauts robotiques agiles
120arXiv cs.RO 

SRL : modèle SLIP et apprentissage par renforcement pour des sauts robotiques agiles

Des chercheurs ont publié en juin 2026 sur arXiv (arXiv:2606.18625) un framework hybride baptisé SRL (Spring-loaded Reinforcement Learning), conçu pour améliorer la capacité de saut des robots mobiles sur terrains variés. L'approche fusionne les signaux de contrôle feedforward issus du modèle SLIP (Spring-Loaded Inverted Pendulum, pendule à masse-ressort inversé) avec une boucle de rétroaction en temps réel pilotée par apprentissage par renforcement. Les résultats expérimentaux, obtenus en simulation sur robots bipèdes et quadrupèdes, font état d'une erreur de suivi de position inférieure à 0,1 m et d'une erreur de suivi de vitesse contenue dans un intervalle de ±3 % par rapport aux valeurs cibles. Les auteurs annoncent également une réduction significative du temps d'entraînement par rapport à la méthode RL pure utilisée comme baseline. Des validations sim-to-sim et sim-to-real sont présentées sur des scénarios de saut au sol et en escalier. L'intérêt industriel du saut robotique est réel dans les domaines de la logistique entrepôt et de la recherche et sauvetage, où franchir des obstacles sans infrastructure dédiée représente un avantage opérationnel concret. Le verrou que SRL cherche à lever est connu : le modèle SLIP fournit une dynamique physiquement cohérente mais se dégrade sur terrain irrégulier, faute de modéliser correctement les contacts et la compliance articulaire ; l'RL seul compense cette limitation mais au prix d'une exploration non guidée et coûteuse en données. La combinaison des deux réduit ce coût d'exploration tout en conservant la robustesse adaptative. Il convient toutefois de noter que l'article est une prépublication non encore évaluée par les pairs, et que les métriques de performance sont issues de simulations, la validation sim-to-real reposant sur des environnements de test dont l'amplitude n'est pas précisée dans le résumé. Le modèle SLIP est un outil analytique classique en biomécanique locomotrice, largement exploité depuis les travaux de Raibert des années 1980 pour modéliser la course et le saut des mammifères. Côté concurrents, Boston Dynamics (Spot, Atlas), Unitree Robotics (Go2, H1) et Agility Robotics (Digit) développent des capacités de franchissement d'obstacles, mais leurs approches combinent généralement MPC (Model Predictive Control) et apprentissage sans revendiquer explicitement l'intégration SLIP-RL. SRL se positionne donc sur un créneau de recherche fondamentale qui devra encore démontrer sa transposabilité à des plateformes hardware commerciales avant d'intéresser des intégrateurs industriels.

RecherchePaper
1 source
Le prochain robot humanoïde pourrait ne pas ressembler à un humain
121The Verge 

Le prochain robot humanoïde pourrait ne pas ressembler à un humain

La startup française Genesis AI a présenté Eno, un robot se réclamant du "général purpose" sans reproduire la silhouette humaine. Soutenue par Eric Schmidt, ancien PDG de Google, la société fait le choix radical d'une morphologie repensée : pas de tête au sens classique, une base potentiellement sur roues, une structure compacte et pliable. Seul élément fidèle à l'anatomie : les mains, conçues pour reproduire "exactement la forme et les fonctions" de la main humaine. Genesis AI positionne Eno comme un robot polyvalent capable d'une large gamme de tâches, à l'opposé des machines spécialisées. Les métriques techniques précises (charge utile, degrés de liberté, prix) n'ont pas été communiquées. Ce parti pris interroge une hypothèse dominante du secteur : pourquoi l'humanoïde doit-il ressembler à un humain ? La réponse de Genesis est fonctionnelle. Ce qui compte, c'est la compatibilité avec des environnements et des outils conçus pour des mains humaines, pas la forme du torse ou l'existence d'un visage. Pour les intégrateurs industriels, cela ouvre une piste concrète : des robots ergonomiquement compatibles avec l'espace de travail humain, potentiellement moins coûteux si les composants non fonctionnels sont supprimés. Genesis AI s'inscrit dans une vague de startups françaises de robotique avancée, aux côtés de Wandercraft (exosquelettes) et Enchanted Tools (robots hospitaliers). Le soutien d'Eric Schmidt lui donne une visibilité internationale dans un secteur dominé par Figure AI, Agility Robotics, Boston Dynamics côté américain et Unitree ou Fourier Intelligence côté asiatique. Eno reste à ce stade un teaser : aucun déploiement ni pilote industriel n'a été annoncé, et les performances réelles du système restent entièrement à démontrer.

UEGenesis AI est une startup française dont le projet Eno, soutenu par Eric Schmidt, renforce la visibilité internationale de l'écosystème robotique français, bien que le produit reste à un stade de teaser sans métriques ni déploiement validés.

FR/EU ecosystemeOpinion
1 source
La mémoire flash comme actif périssable : tarification de l'endurance pour les agents incarnés et ses limites
122arXiv cs.RO 

La mémoire flash comme actif périssable : tarification de l'endurance pour les agents incarnés et ses limites

Une équipe de chercheurs a publié sur arXiv (référence 2606.18144) une analyse formelle d'un problème souvent ignoré dans les systèmes robotiques embarqués : l'usure irréversible de la mémoire flash. Chaque écriture consomme un cycle programme/effacement (P/E) sur un stock fini, environ 1 000 cycles pour les puces QLC ou eMMC que montent les robots bas de gamme, et 3 000 pour les TLC premium. Les auteurs traitent cette mémoire comme un capital qui se déprécie et introduisent un "prix fantôme d'endurance" noté η, qui permet d'optimiser le placement des données à travers une hiérarchie RAM, NVM embarquée et cloud. Sur des logs de robots réels, ils mesurent un coefficient d'association valeur-écriture χ : positif (~+1,0×10⁻³) pour la manipulation récurrente à long horizon, nul pour les tâches à court horizon, et négatif pour la téléopération non récurrente. Résultat contre-intuitif : quand χ > 0, l'optimum déplace les souvenirs les plus précieux vers le cloud plutôt que vers la flash locale. Ce résultat intéresse directement les intégrateurs et les équipes déployant des agents d'IA embarquée à grande échelle. La contrainte d'endurance n'est pas théorique : elle est dormante sur les TLC haut de gamme mais active sur les eMMC et QLC que la majorité des robots industriels low-cost utilisent aujourd'hui. Formaliser ce coût permet d'optimiser la durée de vie des composants sans sacrifier les performances opérationnelles. Les tests montrent qu'un contrôleur appris "wear-aware" rivalise avec le routage basé sur les prix en valeur de tâche, tout en prolongeant la durée de vie du matériel. L'article établit ainsi une distinction utile : durée de vie du dispositif et performance de la tâche peuvent être découplées, ce qui n'avait pas été formalisé jusqu'ici. La gestion de mémoire persistante est un défi ouvert en robotique, aujourd'hui amplifié par la prolifération des plateformes humanoïdes (Figure AI, 1X, Boston Dynamics Atlas) et des modèles VLA (Vision-Language-Action), qui génèrent des fréquences d'écriture structurellement plus élevées. Ce travail s'inscrit dans les courants Lifelong Learning et SLAM à mémoire persistante. Les auteurs signalent deux limites importantes : la valeur de tâche n'est observable que via un proxy, et l'optimum non-monotone, prouvé formellement, n'a pas encore été observé dans les données expérimentales. Les prochaines étapes naturelles incluent la validation sur des déploiements longue durée et l'intégration du cadre dans les pipelines mémoire des agents VLA, où la question du coût réel de chaque écriture devient critique à l'échelle.

RecherchePaper
1 source
ReMoBot : apprentissage par imitation en quelques exemples pour la manipulation mobile avec des modèles fondation visuels
123arXiv cs.RO 

ReMoBot : apprentissage par imitation en quelques exemples pour la manipulation mobile avec des modèles fondation visuels

Des chercheurs ont publié ReMoBot (arXiv:2408.15919v4), un framework d'apprentissage par imitation à peu d'exemples conçu pour la manipulation mobile sur robots à vision égocentrique. Évalué sur un Boston Dynamics Spot, le système atteint des taux de succès de 70 % sur la tâche "Table Uncover" et 80 % sur "Gap Cover" en environnement réel, avec seulement 20 démonstrations par tâche. Plutôt que de distiller les démonstrations dans une politique paramétrique classique, ReMoBot adopte une stratégie de récupération : à l'inférence, il identifie dans une base de démonstrations d'experts les séquences les plus pertinentes via une combinaison de similarité d'état, d'alignement temporel des trajectoires et de cohérence des séquences d'actions, puis sélectionne directement les commandes motrices sans aucun entraînement supplémentaire. L'ensemble s'appuie sur des vision foundation models pour extraire des représentations robustes depuis la caméra embarquée du robot, en fonctionnement totalement training-free à l'exécution. L'approche retrieval-based présente deux avantages concrets pour les intégrateurs industriels. D'abord, le coût de collecte de données est drastiquement réduit : 20 démonstrations contre plusieurs centaines requises par les méthodes IL standard (ACT, Diffusion Policy), ce qui accélère le déploiement sur de nouvelles tâches ou variantes. Ensuite, l'absence d'entraînement à l'inférence supprime le risque de surapprentissage sur données insuffisantes, problème récurrent avec les objets déformables où la variabilité des états est élevée. ReMoBot surpasse deux baselines entraînées directement sur données réelles sans transfert sim-to-réel sur deux tâches sur trois. La tâche "Curtain Open" reste problématique, signalant que la manipulation d'objets hautement déformables sous occultations partielles constitue encore un verrou non résolu, y compris pour les approches retrieval. ReMoBot s'inscrit dans la tendance à exploiter les vision foundation models (de la famille DINOv2, CLIP, SAM) pour réduire la dépendance aux données propriétaires et améliorer la généralisation. Sur le Spot de Boston Dynamics, plateforme quadrupède commerciale, la manipulation mobile reste un défi structurel : le robot se déplace en même temps qu'il manipule, rendant l'observation égocentrique partielle et bruitée. Face aux VLA de grande taille comme pi-0 (Physical Intelligence) ou RT-2 (Google DeepMind), qui exigent des volumes de données considérables et une infrastructure d'entraînement lourde, ReMoBot se positionne dans le segment "data-efficient, training-free" particulièrement pertinent pour les intégrateurs ou PME industrielles sans capacité de collecte à grande échelle. La prochaine étape logique serait d'enrichir dynamiquement la base de démonstrations et de valider l'approche dans des environnements industriels hors laboratoire contrôlé.

UELes PME et intégrateurs robotiques européens sans capacité de collecte de données à grande échelle pourraient bénéficier directement de cette approche data-efficient (20 démos vs plusieurs centaines), réduisant la barrière d'entrée au déploiement de manipulation mobile intelligente.

RecherchePaper
1 source
Suivi binaire pour la QA spatiale et la navigation avec des modèles vision-langage ouverts
124arXiv cs.RO 

Suivi binaire pour la QA spatiale et la navigation avec des modèles vision-langage ouverts

Une équipe de chercheurs publie sur arXiv (référence 2606.16902) un agent de localisation spatiale open-source baptisé BinTrack, conçu pour permettre à des robots de service de répondre à des questions du type « où puis-je trouver un pressing sur le chemin du retour ? » et de retourner une coordonnée métrique exploitable directement par les modules de navigation. Le système s'appuie sur un robot quadrupède réel déployé dans des rues publiques de Séoul pour constituer GangnamLoop, un nouveau benchmark multi-trajets en extérieur. BinTrack atteint une amélioration de précision allant jusqu'à 22,8 % par rapport aux autres implémentations open-source sur SpaceLocQA, le benchmark de référence du domaine, et égale les résultats des agents basés sur GPT-4o sur la catégorie « global », la plus difficile. Il offre par ailleurs un gain de vitesse d'inférence supérieur à 1,5x par rapport aux approches précédentes. L'intérêt principal de BinTrack pour les intégrateurs et les décideurs industriels tient à son architecture entièrement embarquée et déconnectée. Les approches existantes de Spatial Question Answering s'appuyaient sur des modèles fermés comme GPT-4o via des agents RAG (retrieval-augmented generation), ce qui implique une dépendance réseau, une latence de communication et des coûts d'API prohibitifs pour une flotte de robots en production. BinTrack remplace cela par une recherche binaire sur les segments de trajectoire entre deux repères spatiaux extraits de la requête, en exploitant l'ordre temporel du trajet. Ce faisant, le travail démontre qu'un modèle de vision-langage open-source peut rivaliser avec GPT-4o sur un benchmark spatial de référence, sans connexion cloud, une hypothèse que beaucoup dans le secteur considéraient non résolue à ce stade. GangnamLoop se distingue des benchmarks indoor habituels : il capture les mêmes lieux sous différentes conditions extérieures et croise le point de vue bas du robot quadrupède avec celui de son propriétaire humain, ce qui en fait un jeu de données plus réaliste pour la navigation piétonne en ville. La recherche spatiale embarquée reste un domaine peu exploré par rapport aux approches cloud-first ; des acteurs comme Boston Dynamics, Unitree ou les équipes robotique de Google DeepMind travaillent sur des problèmes connexes, mais rarement avec une contrainte d'inférence locale aussi explicite. Le code et les données de GangnamLoop sont disponibles publiquement sur GitHub, ce qui ouvre la voie à des évaluations indépendantes et à des intégrations dans des pipelines de navigation autonome en contexte réel.

RechercheOpinion
1 source
ADAPT : entraînement de politique analytique intégrant les perturbations pour la locomotion humanoïde
125arXiv cs.RO 

ADAPT : entraînement de politique analytique intégrant les perturbations pour la locomotion humanoïde

Une équipe de chercheurs a publié le 16 juin 2026 sur arXiv (2606.16542) une méthode baptisée ADAPT (Analytical Disturbance-Aware Policy Training), destinée à améliorer la robustesse locomotrice des robots humanoïdes soumis à des perturbations externes. Le système a été validé sur un Unitree G1 dans trois scénarios représentatifs : poussées au niveau du torse, perturbations en posture statique, et charges asymétriques appliquées aux mains. Dans chaque cas, ADAPT surpasse une politique de référence basée uniquement sur la proprioception (capteurs internes articulaires), avec un meilleur suivi de vitesse et une meilleure stabilité, y compris face à des perturbations hors distribution, c'est-à-dire non rencontrées lors de l'entraînement. La méthode n'exige aucun capteur de force/couple externe : elle s'appuie uniquement sur la dynamique interne du robot pour estimer en ligne les résidus de force et de couple appliqués au corps entier. L'intérêt technique d'ADAPT tient à son observateur de perturbations analytique, fondé sur la physique du corps rigide plutôt que sur un réseau de neurones ou une large randomisation de domaine. Les approches existantes présentent chacune un défaut structurel : la randomisation de domaine dégrade la précision, les objectifs de force spécifiques à une tâche limitent la transférabilité, et les estimateurs appris depuis l'historique de mouvement peinent hors distribution. ADAPT contourne ces compromis en fournissant à la politique un signal d'entrée explicite et physiquement fondé sur les forces et couples perturbateurs estimés, ce qui lui permet de se généraliser à des scénarios jamais vus. Un bénéfice secondaire notable : en pénalisant les perturbations inférées au niveau des articulations inférieures, le système favorise une locomotion plus légère, réduisant les impacts au sol, ce qui peut prolonger la durée de vie mécanique et améliorer la discrétion sonore en milieu de travail. Le Unitree G1 est une plateforme humanoïde commerciale abordable, largement utilisée dans la recherche sur la locomotion apprise, ce qui confère à ces résultats une portée pratique directe. Ce travail s'inscrit dans une tendance plus large où les laboratoires cherchent à combler le fossé sim-to-real sans ajouter de capteurs coûteux, une contrainte forte pour les déploiements industriels à grande échelle. Côté concurrence, des approches similaires ont été explorées par des équipes travaillant sur Boston Dynamics Atlas, Agility Robotics Digit et les humanoïdes Figure et 1X, mais souvent avec des capteurs de force dédiés. ADAPT représente une direction sensorless qui, si elle se confirme sur d'autres plateformes, pourrait simplifier l'intégration matérielle. L'article étant un preprint arXiv non encore évalué par les pairs, la reproductibilité reste à confirmer indépendamment, et les conditions exactes des expériences (vitesses testées, amplitude des poussées) ne sont pas précisées dans le résumé disponible.

IA physiquePaper
1 source
Récupération robuste après chute pour robots bipèdes à roues sans bras par apprentissage guidé par les forces
126arXiv cs.RO 

Récupération robuste après chute pour robots bipèdes à roues sans bras par apprentissage guidé par les forces

Des chercheurs présentent FTSR (Force-guided Teacher-student framework with Stage-wise Rewards), une méthode d'apprentissage par renforcement pour la récupération après chute des robots bipèdes à roues sans bras, publiée sur arXiv en juin 2026 (arXiv:2606.14270). En simulation, une force auxiliaire externe corrélée en temps réel à la hauteur du robot est formulée comme contrainte optimisable : l'algorithme d'apprentissage contraint pousse la politique à réduire progressivement sa dépendance à cette force tout en relevant le corps. Une architecture teacher-student distille la connaissance privilégiée des dynamiques de récupération, structurée par des récompenses progressives par seuils de hauteur (height-progressive stage-wise rewards). La politique est ensuite déployée sur un robot bipède à roues sans bras physique, testée dans des conditions variées et difficiles, et transfère également à un humanoïde à nombreux degrés de liberté (high-DOF). Sans bras ni pattes supplémentaires pour générer des forces d'appui, un bipède à roues figure parmi les morphologies robotiques les plus contraintes pour la récupération après chute. FTSR contourne ce verrou en injectant une force auxiliaire virtuelle pendant l'entraînement en simulation, puis en la supprimant graduellement via une contrainte optimisable : le robot développe ainsi des stratégies de redressement internes sans jamais dépendre d'un artefact absent en conditions réelles. La validation sim-to-real sur robot physique, combinée à la généralisation à un humanoïde high-DOF sans sur-adaptation à une cinématique spécifique, renforce la crédibilité pratique de l'approche pour les équipes travaillant sur plusieurs plateformes. C'est précisément ce gap entre démonstration en simulation et déploiement physique robuste que FTSR cherche à combler, avec des résultats qui méritent d'être suivis. Les robots bipèdes à roues occupent une niche croissante entre les AMR classiques et les humanoïdes complets : ils combinent mobilité sur terrain plat et capacité partielle à franchir des obstacles, à un coût mécanique inférieur. Sur le problème précis de la récupération après chute, les travaux existants se concentrent sur les humanoïdes avec bras (Boston Dynamics Atlas) et les quadrupèdes multi-pattes (ANYmal d'ANYbotics, Unitree Go2), laissant peu de littérature sur les morphologies intermédiaires sans membres supérieurs. FTSR reste à ce stade un preprint arXiv sans déploiement industriel annoncé et sans plateforme commerciale nommée ; les suites naturelles seraient une évaluation sous perturbations extérieures actives et une intégration dans une stack de navigation autonome complète.

RecherchePaper
1 source
Commande prédictive par modèle à impédance corps entier pour l'interaction physique humain-robot sûre sur base flottante
127arXiv cs.RO 

Commande prédictive par modèle à impédance corps entier pour l'interaction physique humain-robot sûre sur base flottante

Des chercheurs ont publié sur arXiv (réf. 2606.14617, juin 2026) une architecture de contrôle à trois niveaux pour robots à base flottante - bipèdes et humanoïdes - conçue pour maintenir l'équilibre tout en tolérant l'interaction physique soutenue avec des opérateurs humains (pHRI, physical human-robot interaction). Le premier niveau est un MPC centroïdal qui planifie les forces de contact sur un horizon de 500 millisecondes. Le deuxième est un contrôleur corps entier (WBC) qui traduit l'équilibre en couples articulaires par projection dans l'espace nul cohérente avec les contraintes de contact. Le troisième est un programme quadratique (QP) à horizon fuyant qui prédit et rejette les perturbations de contact à l'aide d'un état augmenté par filtre de Kalman. Une linéarisation par retour d'état réduit la dynamique de l'effecteur à un double intégrateur à matrice constante dans chaque mode de contact, permettant une précalculation hors-ligne des matrices de coût et une exécution à plus de 1 kHz. Les validations ont été conduites en simulation sur un biped à 17 degrés de liberté et sur l'humanoïde Unitree G1. L'apport central est une garantie formelle d'erreur nulle en régime permanent sous des forces de contact humain soutenues et bornées - une limite connue des contrôleurs WBC à gain fixe, qui accumulent une dérive statique lorsqu'un opérateur guide ou pousse le robot en continu. La cadence à 1 kHz, rendue possible par la précalculation hors-ligne, s'inscrit dans les contraintes temps réel de la robotique industrielle. Un théorème d'équivalence d'impédance établit que la limite horizon infini du contrôleur retrouve une loi d'impédance classique en espace tâche, avec masse, amortissement et raideur effectifs qui s'adaptent automatiquement à la posture et à la configuration de contact - ce qui facilite le réglage intuitif pour des ingénieurs familiers des contrôleurs d'impédance conventionnels. Ce travail étend une architecture Impedance MPC à deux couches pour base fixe publiée antérieurement par les mêmes auteurs. Le passage à la base flottante est non trivial : le robot doit simultanément gérer sa propre stabilité dynamique et absorber les perturbations externes. L'Unitree G1, humanoïde commercialisé autour de 16 000 dollars par Unitree Robotics, sert de banc de validation en simulation. Il faut souligner que l'ensemble des résultats est simulé - aucun essai physique sur robot réel n'est rapporté, ce qui constitue l'étape attendue. Dans un paysage où Boston Dynamics (Atlas), Agility Robotics (Digit) et Figure (03) développent leurs propres solutions WBC pour la coopération humain-robot, cette approche apporte une contribution méthodologique formellement fondée, mais dont la robustesse en conditions réelles reste à démontrer.

RecherchePaper
1 source
Chien robot quadrupède détecte les toxines dangereuses avant l'entrée des pompiers en zone à risque
128Interesting Engineering 

Chien robot quadrupède détecte les toxines dangereuses avant l'entrée des pompiers en zone à risque

Des chercheurs de la Graz University of Technology (TU Graz) en Autriche ont développé un chien robot quadrupède capable de détecter des substances toxiques en zones dangereuses avant l'intervention des pompiers. Le système, téléopéré et compact, intègre des instruments de mesure déjà utilisés par les services d'incendie. Il a été testé lors d'exercices grandeur nature impliquant des scénarios de pollution chimique, où il a démontré sa capacité à transmettre des données en temps réel depuis des zones contaminées. Selon Gerald Steinbauer-Wagner, chercheur et professeur associé en robotique à la TU Graz, le robot mesure les concentrations de polluants et renvoie simultanément images caméra et relevés de capteurs pendant que les équipes s'équipent de leurs tenues de protection. Gerald Czech, de l'Association fédérale autrichienne des sapeurs-pompiers, a confirmé qu'en cas d'incident réel, il enverrait le robot dans la zone contaminée avant tout déploiement humain. L'enjeu opérationnel est significatif. Lors d'accidents chimiques, les pompiers doivent revêtir des combinaisons de protection lourdes de niveau A ou B avant toute mesure sur site, une procédure qui consomme un temps précieux dans des situations où chaque minute compte. Le robot comble ce délai en fournissant une évaluation précoce de la scène, ce qui permet au commandement de baser ses décisions sur des données réelles plutôt que sur des hypothèses. Ce gain d'information réduit l'exposition directe des équipes aux substances toxiques et améliore la conduite opérationnelle. Un point important : les concepteurs ont délibérément évité de créer un nouveau protocole de zéro, en intégrant le robot dans les procédures opérationnelles standard existantes des services Hazmat. Cela réduit la friction d'adoption, souvent sous-estimée dans les projets de robotisation des services d'urgence. Le projet bénéficie du soutien de l'Agence autrichienne de promotion de la recherche (FFG), ainsi que des associations de pompiers styriennes et de Haute-Autriche, et du Disaster Competence Network Austria. Le robot s'appuie exclusivement sur des composants commerciaux standard pour la mobilité, le traitement des données, la communication et la visualisation, ce qui favorise la reproductibilité et limite les coûts de maintenance. Les experts impliqués recommandent d'en faire un équipement permanent des unités Hazmat. Dans le paysage plus large des robots d'inspection et de sécurité, ce système s'inscrit dans une tendance croissante d'utilisation de plateformes quadrupèdes dérivées du Boston Dynamics Spot ou d'équivalents pour des missions de reconnaissance industrielle, une tendance que des acteurs comme ANYbotics ou Ghost Robotics ont déjà commercialisée dans le secteur de l'inspection d'infrastructures. La prochaine étape pour l'équipe de TU Graz serait d'étendre les tests à des scénarios d'incidents réels et de formaliser l'intégration dans les doctrines nationales de réponse aux matières dangereuses.

UELa TU Graz (Autriche) livre aux services Hazmat européens un système quadrupède validé en exercices grandeur nature, ouvrant la voie à une intégration dans les doctrines nationales de réponse aux matières dangereuses.

FR/EU ecosystemePaper
1 source
Rider-Bot établit un record mondial : premier robot à vélo à réaliser un salto avant sans assistance
129Interesting Engineering 

Rider-Bot établit un record mondial : premier robot à vélo à réaliser un salto avant sans assistance

Le laboratoire JSK Robotics de l'Université de Tokyo a présenté Rider-Bot, un robot cycliste autonome qui aurait réalisé le premier salto avant non assisté au monde pour ce type de machine. La démonstration a eu lieu sur surface plane, sans rampe, câble ni support extérieur : le robot a accéléré, décollé, effectué une rotation avant complète de 360 degrés et atterri en position verticale, de manière entièrement autonome. Le système embarque des gyroscopes, des boucles de rétroaction en temps réel et des algorithmes d'apprentissage automatique. Le projet est piloté par le Dr Yuta Sato, chercheur principal. À noter : aucune spécification technique détaillée (nombre de degrés de liberté, charge utile, taux de réussite sur séries de tentatives) n'a été publiée, ce qui situe cette annonce davantage comme une démonstration de faisabilité que comme un résultat reproductible et documenté dans la littérature scientifique. Sur le plan technique, la performance illustre la capacité d'un système de contrôle embarqué à anticiper et compenser les transferts de momentum pendant une manoeuvre acrobatique extrême, problème classique de la locomotion dynamique sur plateformes à équilibre instable. L'intérêt pour les intégrateurs et décideurs industriels réside moins dans le salto lui-même que dans ce qu'il révèle sur la maturité des boucles de contrôle temps réel embarquées. Si les algorithmes développés pour Rider-Bot se généralisent, ils pourraient informer la conception de robots de livraison autonomes, de véhicules navigant sur terrain accidenté, ou de machines d'intervention en environnements dégradés où la stabilité ne peut être garantie a priori. Le fossé entre démonstration contrôlée en laboratoire et déploiement en conditions réelles reste néanmoins non documenté à ce stade. Le laboratoire JSK, actif depuis plusieurs décennies à l'Université de Tokyo dans la recherche en humanoïdes et locomotion dynamique, s'inscrit dans un écosystème japonais dense sur ces thématiques, aux côtés d'AIST (série HRP) et de Honda (ASIMO). Dans le paysage concurrentiel, la démonstration répond indirectement aux exploits acrobatiques de Boston Dynamics, dont le robot Atlas enchaîne saltos arrière et séquences de parkour depuis 2017, et aux travaux sur la locomotion robuste d'ETH Zurich avec ANYmal, mais sur une plateforme cycliste encore peu explorée par les grands acteurs. L'équipe annonce comme prochaines étapes des tests en extérieur et en environnements à obstacles, ainsi qu'un travail d'amélioration de la consistance des réceptions. Aucune collaboration industrielle ni timeline de commercialisation n'a été communiquée.

RecherchePaper
1 source
GuideWalk : apprentissage de la navigation autonome et de la locomotion unifiées pour robots humanoïdes sur terrains variés
130arXiv cs.RO 

GuideWalk : apprentissage de la navigation autonome et de la locomotion unifiées pour robots humanoïdes sur terrains variés

Des chercheurs présentent GuideWalk (arXiv:2606.10449, juin 2026), un framework unifié qui couple navigation autonome et locomotion adaptative pour robots humanoïdes sur terrains variés. L'architecture repose sur trois composantes : un module de navigation qui génère des guidances de vitesse explicites en tenant compte de la traversabilité du terrain, un schéma de distillation à enseignants composites qui agrège commandes directionnelles et actions dynamiquement cohérentes dans une politique unique, puis un affinement par apprentissage par renforcement (RL) couplé à un objectif auxiliaire de clonage comportemental (behavior cloning). Ce dernier mécanisme vise à maintenir les comportements souhaitables issus des enseignants tout en favorisant l'exploration. L'article reste au stade de preprint arXiv sans déploiement industriel annoncé ni métriques benchmarkées publiées dans l'abstract. Le problème technique adressé est structurant pour la robotique humanoïde : l'évitement d'obstacles et la locomotion dynamique sont habituellement traités en silos, ce qui crée des incohérences lorsqu'un robot planifie sur escaliers, sol accidenté ou transitions sol dur/mou. GuideWalk découple explicitement la planification d'obstacles de l'état du terrain, ce qui est une approche architecturale plus propre que les solutions end-to-end brutes ou les pipelines hiérarchiques rigides. Pour les intégrateurs et décideurs B2B, le vrai enjeu est le sim-to-real gap sur locomotion hétérogène : si cette architecture tient ses promesses en évaluation externe, elle pourrait réduire le besoin d'ingénierie terrain-spécifique lors du déploiement en entrepôt ou en environnement industriel non structuré. La navigation humanoïde sur terrains complexes reste un des derniers verrous majeurs avant déploiement opérationnel large, là où la locomotion pure en terrain plat est désormais relativement résolue chez Unitree (H1, G1), Boston Dynamics (Atlas) ou Agility Robotics (Digit). Des approches concurrentes comme GR00T N2 de NVIDIA ou les travaux de Physical Intelligence (Pi-0) s'attaquent au même problème via des Visual Language Action models (VLA) généralisés, tandis que des labos académiques comme CMU ou Berkeley publient régulièrement sur le sim-to-real en locomotion adaptative. GuideWalk s'inscrit dans cette vague mais avec une contribution méthodologique spécifique sur le couplage navigation-locomotion. Les prochaines étapes naturelles seraient une évaluation sur hardware réel (le preprint ne précise pas le robot utilisé) et une comparaison quantitative avec des baselines établies.

RecherchePaper
1 source
Video Friday : ce robot court dans les escaliers sans tomber
131IEEE Spectrum Robotics 

Video Friday : ce robot court dans les escaliers sans tomber

La sélection vidéo hebdomadaire d'IEEE Spectrum de début juin 2026 réunit plusieurs démonstrations robotiques aux profils contrastés. DEEP Robotics publie une vidéo d'un humanoïde récupérant son équilibre sur un escalier dans une séquence que les éditeurs du magazine jugent eux-mêmes impressionnante, tout en soulignant l'incertitude sur sa reproductibilité. La startup Generative Bionics annonce que GENE01, sa première plateforme humanoïde, est passée de la conception au lancement en production en série en seulement trois mois, avec deux configurations interchangeables de membres inférieurs et une couche baptisée "Physical AI" couvrant le contrôle moteur et la modélisation monde-action, sans qu'aucune métrique de charge utile, de degrés de liberté ni de temps de cycle n'accompagne l'annonce. IHMC Robotics présente Alex, son premier humanoïde entièrement développé en interne, qui a effectué ses premiers pas en extérieur sans attache lors d'une démonstration dans le Maryland. Flexiv Robotics dévoile le MICO, un système bimanuel compact sur la plateforme Enlight, orienté collaboration en espace de travail industriel partagé. À l'occasion de l'ICRA 2026, des chercheurs publient CCRobot-S dans IEEE Transactions on Robotics : une équipe de robots grimpeurs câbles reconfigurables capables d'inspecter et d'entretenir en opération parallèle les haubans de ponts à grande portée. Boston Dynamics contribue avec deux vidéos, l'une sur des pieds interchangeables pour Atlas, l'autre montrant le robot apprendre à jouer au football. La revendication la plus saillante de cette sélection est le délai de trois mois de Generative Bionics entre conception et production en série. Si elle se confirme, elle signalerait une compression radicale des cycles de développement matériel dans la robotique humanoïde, un secteur qui exige habituellement plusieurs années d'itération. L'absence de spécifications techniques rend l'évaluation indépendante impossible à ce stade : l'annonce ressemble davantage à une opération de visibilité qu'à une divulgation produit. Les essais en extérieur d'IHMC avec Alex sont une contribution plus modeste mais techniquement crédible : sortir du laboratoire vers un environnement non structuré reste l'un des tests les plus rigoureux de la robustesse locomotrice, et l'un des plus rares à être documentés publiquement, adressant directement le demo-to-reality gap qui frappe de nombreuses démonstrations du secteur. CCRobot-S illustre une autre dynamique, celle des applications robotiques collaboratives à vocation industrielle précise, portées par des contraintes de sécurité et de régulation réelles dans le domaine des infrastructures. Le paysage concurrentiel des humanoïdes reste dense. Figure AI a livré le Figure 03, Tesla teste l'Optimus Gen 3 en production, le modèle VLA pi0 de Physical Intelligence structure plusieurs pilotes commerciaux, et le Digit d'Agility Robotics est déployé dans des entrepôts Amazon. L'Atlas de Boston Dynamics, malgré ses qualités mécaniques, n'a pas encore établi de trajectoire commerciale clairement définie, et les vidéos football semblent davantage viser la notoriété grand public que l'intégration industrielle. IHMC Robotics, laboratoire affilié à Florida International University, a historiquement alimenté l'écosystème en infrastructures et en talents plutôt qu'en produits commerciaux directs. Generative Bionics est un nom nouveau dans le secteur et mérite un suivi si de prochaines publications techniques viennent étayer la revendication des trois mois. Aucun acteur européen n'apparaît directement dans cette sélection, bien qu'Enchanted Tools, Wandercraft et Pollen Robotics restent actifs sur leurs segments respectifs.

HumanoïdesActu
1 source
Vidéo : des robots humanoïdes volent la vedette dans America's Got Talent
132Interesting Engineering 

Vidéo : des robots humanoïdes volent la vedette dans America's Got Talent

Huit robots humanoïdes G1 du fabricant chinois Unitree ont performé en direct sur NBC lors du premier épisode de la saison en cours d'America's Got Talent, diffusé mardi soir aux États-Unis. Aux côtés du danseur Wu Yufei, originaire du Sichuan et connu sous le pseudonyme "Flying Bug", les machines ont exécuté une chorégraphie synchronisée combinant mouvements rythmés et coordination précise avec l'interprète humain. Le numéro a reçu une ovation debout du public en studio et l'approbation unanime des quatre juges, propulsant le duo vers la prochaine étape d'une compétition dotée d'un grand prix d'un million de dollars. Yufei a présenté l'un des robots sous le surnom "Jackie", en référence au kung-fu. Le mode de pilotage des machines pendant la performance (téléopération partielle, séquences préenregistrées ou autonomie hybride) n'a pas été divulgué par l'équipe, un point que les commentateurs spécialisés n'ont pas manqué de relever. La prestation illustre un paradoxe croissant aux États-Unis: l'enthousiasme du grand public pour les humanoïdes chinois se heurte à une pression législative grandissante. Le lendemain même de la diffusion, une proposition de loi bipartisane, le Guard Act, a été déposée au Congrès pour interdire les robots d'origine chinoise jugés risques pour la sécurité nationale. En parallèle, l'American Security Robotics Act avance avec pour objectif d'empêcher les agences fédérales d'acquérir des robots produits par des entreprises chinoises, humanoïdes inclus. Pour les décideurs B2B et les intégrateurs industriels, cette double dynamique crée une incertitude réelle: adopter une technologie qui capte l'adhésion populaire tout en naviguant un risque réglementaire croissant. La visibilité télévisée d'Unitree renforce la crédibilité commerciale de ses machines auprès des acheteurs non spécialisés, un levier marketing qu'aucun salon professionnel ne peut reproduire à cette échelle. Fondée à Hangzhou, Unitree commercialise ses robots à l'international via la plateforme AliExpress d'Alibaba, ciblant les marchés d'Amérique du Nord, d'Europe et du Japon. La société a récemment annoncé un partenariat avec Nvidia pour concevoir un design de référence humanoïde baptisé H2+, dont la disponibilité est prévue pour la fin de l'année. Sur le terrain, les observateurs notent que le déploiement opérationnel des robots chinois à l'étranger se heurte à des obstacles concrets: identification des cas d'usage industriels, collecte de données opérationnelles, et construction de réseaux locaux de maintenance, d'intégration et de calibration. Face à Unitree, le marché des humanoïdes voit s'affronter Figure AI (Figure 02), Tesla (Optimus Gen 2), Boston Dynamics (Atlas électrique), Physical Intelligence (pi0) et Agility Robotics (Digit), tous positionnés sur des verticales industrielles précises. L'apparition télévisée ne règle aucun de ces défis opérationnels, mais marque une étape dans la bataille pour la normalisation culturelle des humanoïdes auprès du grand public américain.

UEUnitree ciblant explicitement les marchés européens via AliExpress, la pression réglementaire américaine sur les robots chinois (Guard Act, American Security Robotics Act) pourrait inspirer des mesures similaires en Europe sur l'acquisition de robotique d'origine chinoise par les entités publiques et industrielles.

Chine/AsieOpinion
1 source
IA incarnée sûre pour les tâches à long horizon : une analyse multi-couches de la manipulation robotique
133arXiv cs.RO 

IA incarnée sûre pour les tâches à long horizon : une analyse multi-couches de la manipulation robotique

Une équipe de chercheurs publie sur arXiv (identifiant 2606.05660, juin 2026) une revue systématique de la sécurité dans les systèmes d'IA incarnée (embodied AI) appliqués à la manipulation robotique à long horizon. Ce survey structure la littérature selon trois niveaux d'intervention : la sécurité au stade de la planification (planning-time), au niveau de la politique de contrôle (policy-time) et pendant l'exécution (execution-time). Les auteurs identifient quatre vecteurs de risque pouvant s'accumuler dans un même système en boucle fermée : le misgrounding sémantique (l'agent interprète mal l'instruction de haut niveau), la propagation d'erreur entre sous-tâches, la dérive d'exécution (execution drift) et les risques physiques liés aux contacts. Ils distinguent par ailleurs trois catégories de garanties dans la littérature existante : formelles, statistiques et heuristiques empiriques, et concluent que les preuves formelles font défaut à chaque couche. L'enjeu est direct pour les intégrateurs et les décideurs industriels. Un bras robotique déployé en entrepôt ou en ligne de production enchaîne des dizaines d'actions sur des horizons temporels étendus, et chaque sous-tâche peut propager silencieusement une erreur vers les suivantes. Or le survey révèle que la sécurité au niveau de la politique de contrôle, au coeur même des modèles VLA (Vision-Language-Action) comme Pi-0 de Physical Intelligence ou GR00T N2 de NVIDIA, est la couche la moins documentée empiriquement. Les mécanismes d'intervention déclenchés par l'incertitude (uncertainty-triggered intervention) restent immatures, et les benchmarks spécifiques à la sécurité en manipulation longue durée sont quasi-inexistants, ce qui rend toute validation rigoureuse avant déploiement aujourd'hui difficile. Ce travail paraît dans un contexte d'accélération industrielle : Figure AI, Boston Dynamics, Unitree et Physical Intelligence multiplient les démonstrations de manipulation dextère, souvent en conditions semi-contrôlées, alimentant un écart potentiel entre annonces marketing et réalité opérationnelle. Il convient de souligner que ce papier est une analyse critique de l'existant, pas un nouveau système ou algorithme. Ses recommandations prioritaires portent sur trois axes : des assurances cross-couche cohérentes de la planification jusqu'à l'exécution physique, des benchmarks dédiés à la sécurité en manipulation longue durée, et des protocoles de déploiement progressifs pour les agents robotiques en environnements réels. En creux, le constat est que les capacités du secteur progressent plus vite que les outils pour en évaluer la sécurité.

UEL'absence de benchmarks formels de sécurité pour la manipulation longue durée concerne directement les industriels européens déployant des bras robotisés, et pourrait alimenter les exigences de validation dans le cadre de l'AI Act pour les systèmes robotiques à haut risque.

RecherchePaper
1 source
Le public américain acclame les robots dansants Unitree pendant que le Congrès cherche à les interdire
134SCMP Tech 

Le public américain acclame les robots dansants Unitree pendant que le Congrès cherche à les interdire

Les robots humanoïdes G1 du fabricant chinois Unitree Robotics ont fait une apparition remarquée dans le show télévisé américain America's Got Talent lors du lancement de sa nouvelle saison, décrochant une ovation debout du public en studio. La performance, diffusée en prime time sur une chaîne nationale américaine, a suscité une adhésion populaire immédiate selon les analystes du secteur, même si les chiffres d'audience définitifs n'ont pas encore été communiqués. Le G1 est un humanoïde bipède commercialisé par Unitree à environ 16 000 dollars, positionné comme l'une des plateformes humanoïdes les moins chères du marché mondial. Ce contraste entre l'enthousiasme du grand public et la méfiance des élus illustre une tension structurelle croissante dans le secteur robotique américain. Alors que des législateurs au Congrès examinent des projets de loi visant à restreindre ou interdire l'utilisation de robots et composants d'origine chinoise dans les infrastructures critiques, une exposition télévisée à grande échelle normalise ces mêmes machines auprès de dizaines de millions de foyers. Pour les décideurs industriels et les intégrateurs, ce clivage complique les arbitrages d'approvisionnement : les plateformes chinoises restent attractives sur le plan tarifaire mais exposent à un risque réglementaire croissant. Unitree a connu une montée en puissance rapide, passant des robots quadrupèdes bon marché (série Go) aux humanoïdes G1 et H1. La société s'impose comme le pendant grand public de Figure AI, Agility Robotics ou Boston Dynamics sur le segment entrée de gamme. Les tentatives législatives américaines de restreindre les robots chinois s'inscrivent dans la continuité des régulations visant Huawei ou DJI, et pourraient accélérer la demande pour des alternatives domestiques comme Apptronik ou Sanctuary AI si elles aboutissent.

UELes intégrateurs européens utilisant des plateformes Unitree s'exposent à un risque réglementaire croissant si l'UE s'aligne sur la trajectoire législative américaine, sur le modèle des restrictions DJI/Huawei.

Chine/AsieOpinion
1 source
CoRe-MoE : un mélange d'experts contrastif pour la locomotion multi-terrain des robots humanoïdes avec adaptation de la démarche
135arXiv cs.RO 

CoRe-MoE : un mélange d'experts contrastif pour la locomotion multi-terrain des robots humanoïdes avec adaptation de la démarche

Une équipe de recherche publie sur arXiv (2606.04718) CoRe-MoE, un framework d'apprentissage par renforcement en deux étapes conçu pour permettre à un robot humanoïde de marcher et de courir sur des terrains variés sans politique distincte par surface. L'architecture repose sur un Mixture-of-Experts (MoE) augmenté d'un objectif contrastif : une première phase entraîne une politique de locomotion de base produisant marche et course avec transitions fluides, puis une seconde phase greffe une branche MoE sensible au terrain, dont le réseau de gating est formé à distinguer structurellement les représentations de sol. L'action finale est une fusion pondérée entre la politique de base et la branche adaptative. Validé en simulation puis déployé en zero-shot sur le Unitree G1, le système traverse escaliers, rampes, marches, obstacles et terrains extérieurs non structurés tout en maintenant un placement de pied précis face à des perturbations externes. L'intérêt de ce travail pour les intégrateurs et décideurs robotiques tient moins à la performance brute qu'à la méthode de découplage. Le problème classique dans l'entraînement multi-tâches est l'interférence de gradients : une politique unifiée marche/course/terrain provoque des conflits d'apprentissage qui dégradent chaque sous-compétence. CoRe-MoE contourne cela en séparant explicitement génération de démarche et adaptation terrain. L'objectif contrastif force une spécialisation claire des experts MoE, défaillance récurrente des implémentations MoE naïves. Le zero-shot sim-to-real sur G1 suggère une réduction du reality gap, point de friction central dans le passage de la simulation au déploiement industriel, bien que le papier ne fournisse pas de métriques de cycle ou de données de déploiement à l'échelle. Le Unitree G1 est un humanoïde 23 degrés de liberté à environ 16 000 dollars, devenu référence de facto pour la recherche en locomotion académique, face au Boston Dynamics Atlas et à l'Agility Robotics Digit plus orientés industrie. CoRe-MoE s'inscrit dans un courant actif de politiques visuomotrices pour humanoïdes, aux côtés de travaux comme GR00T N2 de NVIDIA ou Pi-0 de Physical Intelligence, qui cherchent tous à unifier mobilité et manipulation sous une seule politique généraliste. La prochaine étape naturelle de ce type d'architecture est l'extension aux tâches de manipulation en locomotion, et le test sur des humanoïdes plus lourds à charge utile élevée, où la stabilité dynamique devient critique.

IA physiqueOpinion
1 source
Un fabricant shanghaïen dévoile un robot humanoïde de 1,2 m à double cerveau et design compact
136Interesting Engineering 

Un fabricant shanghaïen dévoile un robot humanoïde de 1,2 m à double cerveau et design compact

JAKA Robotics, société shanghaïenne fondée en 2015 et jusqu'ici connue pour ses cobots industriels, a dévoilé le Pi, un robot humanoïde compact mesurant 1,22 mètre pour 42 kilogrammes. La plateforme intègre 27 degrés de liberté grâce à des modules articulaires intégrés de nouvelle génération, annoncés 15 à 27 % plus compacts que la génération précédente. Les genoux développent jusqu'à 120 Nm de couple pour la locomotion, et chaque bras supporte une charge utile de 3 kilogrammes. L'architecture de contrôle repose sur une plateforme Intel hétérogène à double domaine : un "cerveau" chargé du raisonnement IA, de la perception visuelle, des grands modèles de langage et de la logique applicative, et un "cervelet" dédié au contrôle moteur temps réel via un réseau EtherCAT à latence milliseconde. JAKA présente le Pi comme une plateforme de R&D pour l'intelligence incarnée et l'interaction homme-robot, sans annoncer de déploiement commercial ni de calendrier de production. La principale valeur technique du Pi réside dans son architecture duale, qui sépare explicitement l'inférence IA du contrôle déterministe -- une approche que l'on retrouve chez plusieurs concurrents mais que JAKA documente ici avec des métriques d'intégration concrètes. Pour un intégrateur ou un décideur industriel, la compacité (42 kg, 1,22 m) et le payload de 3 kg par bras positionnent le Pi sur un segment intermédiaire entre les humanoïdes de taille adulte comme Figure 03 ou Tesla Optimus Gen 3 et les plateformes de table. En revanche, les performances annoncées restent à ce stade des spécifications constructeur: aucune vidéo de tâche en conditions réelles n'a été publiée, et la notion de "polyvalence applicative" n'est étayée par aucun benchmark reproductible ni site pilote identifié. JAKA s'est construit sur dix ans une gamme cobot industrielle étendue -- séries Zu (3 à 30 kg), Pro (IP68, milieux hostiles), S Series (contrôle en force), AL/A Series (vision intégrée) -- avant d'amorcer un pivot vers l'intelligence incarnée avec ses humanoïdes K1, K1L et K1W. Le Pi s'inscrit dans cette trajectoire de montée en gamme vers des systèmes IA embarqués. Sur le plan concurrentiel, le marché humanoïde compact est déjà occupé par Unitree (G1, 1,27 m, 35 kg), Agility Robotics (Digit), et côté recherche par des plateformes comme le PR2 ou l'Atlas de Boston Dynamics. En Chine, des acteurs comme Fourier Intelligence ou UBTech développent également des humanoïdes à vocation industrielle. La Chine déploie par ailleurs des robots humanoïdes dans la logistique postale, notamment à Guangzhou, signal d'un marché domestique qui commence à absorber ces systèmes. JAKA n'a pas communiqué de prix, ni de partenaires industriels, ni de calendrier pour des pilotes commerciaux du Pi.

HumanoïdesOpinion
1 source
Transfert de style de mouvement humain pour le contrôle physique de robots humanoïdes
137arXiv cs.RO 

Transfert de style de mouvement humain pour le contrôle physique de robots humanoïdes

Un groupe de chercheurs présente dans un preprint arXiv (2606.03536, soumis le 3 juin 2026) un framework de transfert de style de mouvement pour robots humanoïdes. Le système prend en entrée un court clip humain illustrant un style moteur désiré (rythme de marche, balancement des bras, posture) et un mouvement cible distinct, puis génère un mouvement corps entier stylisé adapté au robot. Le modèle central est un modèle de diffusion latente multi-condition, sensible à la physique, fusionnant conditions de style, de contenu et de trajectoire. La guidance classifier-free permet d'ajuster l'intensité du style sans réentraîner le modèle. Les références générées sont ensuite converties pour le robot Unitree G1 et exécutées par une politique de suivi corps entier entraînée via une stratégie "cluster-and-distill". Sur 125 essais sur robot réel, la méthode atteint un taux de réussite de 96,0 %, avec moins d'artefacts de contact et de jitter que les baselines orientées animation. Ce résultat remet en question le paradigme dominant où chaque comportement expressif d'un humanoïde est soit capturé en démonstration directe, soit scripté manuellement, deux approches coûteuses et non réutilisables entre contenus de mouvement différents. En permettant à un court clip humain de servir de source de style transférable sur des contenus arbitraires, le framework ouvre la voie à une personnalisation motrice procédurale. L'écart simulation-hardware est adressé directement par des régularisations de cohérence de contact et de lissage temporel imposées lors de l'entraînement, un point de friction récurrent dans la chaîne génération-contrôle. Un taux de 96 % sur 125 essais réels représente un résultat solide pour de la recherche académique dans ce domaine, où beaucoup de travaux restent confinés à la simulation. Le Unitree G1 (environ 16 000 dollars) s'est imposé ces 18 derniers mois comme la plateforme de référence pour la recherche humanoïde académique. Ces travaux s'inscrivent dans la tendance des modèles de diffusion appliqués à la génération de mouvement (MDM, MotionDiffuse), prolongée ici jusqu'au contrôle physique sur hardware réel. Dans la course à l'expression motrice des humanoïdes, Boston Dynamics (Atlas), Figure et 1X investissent massivement côté imitation learning et VLA end-to-end, tandis que ce preprint se positionne sur la génération procédurale contrôlée, approche complémentaire. Du côté européen, Wandercraft et Enchanted Tools (France, robot Mirokaï) travaillent sur des problématiques d'expression motrice proches, sur des architectures distinctes. La suite logique serait l'intégration de ce framework dans des pipelines de téléopération ou d'interfaces humain-robot en conditions industrielles réelles.

UEWandercraft et Enchanted Tools (France) travaillent sur des problématiques d'expression motrice similaires et pourraient s'inspirer de cette approche de transfert de style procédural sur hardware réel.

HumanoïdesPaper
1 source
SplitAdapter : loco-manipulation humanoïde sensible à la charge par adaptation factorisée
138arXiv cs.RO 

SplitAdapter : loco-manipulation humanoïde sensible à la charge par adaptation factorisée

SplitAdapter est une architecture présentée sur arXiv (identifiant 2606.03297) visant à améliorer le contrôle de robots humanoïdes en loco-manipulation, soit la combinaison simultanée de la marche bipède et de la manipulation d'objets physiques. Le système part d'une politique de manipulation de boîtes préentraînée qu'il fige, puis lui greffe deux encodeurs de contexte indépendants : l'un capture les propriétés de la charge et de l'objet saisi, l'autre modélise les dynamiques internes du robot. Ces représentations sont injectées via une modulation FiLM hiérarchique (Feature-wise Linear Modulation), combinée à des objectifs split world-model et une régularisation cross-adversariale par gradient reversal (GRL). Les expériences couvrent des objets de 2, 4 et 6 kg, à des hauteurs de prise et de dépôt de 0, 30 et 60 cm, testés en sim-to-sim puis en déploiement sur robot réel. SplitAdapter améliore le taux de succès en tâche complète face à la politique de base et aux baselines FiLM à encodeur unique, avec les gains les plus marqués sous forte charge (6 kg). L'enjeu central est le transfert sim-to-réel sous charge variable : lorsqu'un humanoïde soulève un objet lourd, ses dynamiques changent sensiblement, et les adaptateurs existants qui fusionnent tous les signaux dans une seule représentation latente tendent à perdre en robustesse précisément dans les conditions les plus critiques. La factorisation proposée, un encodeur par source de variation, maintient une séparation explicite entre les incertitudes liées à l'objet et celles liées au robot, ce qui se révèle plus stable sous conditions extrêmes. Pour un intégrateur ou un OEM industriel, cela suggère qu'une politique généraliste préentraînée peut être adaptée modulairement selon la charge sans réentraînement complet, une propriété utile pour des lignes de production où les objets manipulés varient fréquemment. La loco-manipulation sur humanoïdes concentre des investissements massifs : Figure AI déploie son Figure 03 chez BMW, Boston Dynamics pousse Atlas en partenariat avec Hyundai, et des labos comme Physical Intelligence (Pi-0) ou NVIDIA (GR00T N2) misent sur des politiques généralisables de type VLA (Vision-Language-Action). SplitAdapter prend un pari différent, adapter une politique spécialisée existante plutôt que d'en entraîner une nouvelle de bout en bout, ce qui réduit les coûts de calcul mais soulève la question de la généralisabilité hors distribution. Le papier est une préimpression arXiv soumise début juin 2026, non encore évaluée par les pairs ; aucun déploiement industriel ni pilote commercial n'est annoncé à ce stade.

IA physiquePaper
1 source
JAKA Robotics dévoile JAKA Pi, un robot humanoïde compact de 1,22 m pour l'éducation et les services
139Pandaily 

JAKA Robotics dévoile JAKA Pi, un robot humanoïde compact de 1,22 m pour l'éducation et les services

JAKA Robotics, fabricant shanghaïen de robots collaboratifs industriels basé dans le district de Minhang, a présenté le JAKA Pi, un robot humanoïde compact de 1,22 mètre pour 42 kilogrammes. Le système embarque 27 degrés de liberté, avec des modules articulaires 15 à 27 % plus petits en diamètre que la génération précédente. L'articulation du genou délivre 120 Nm de couple pour assurer une locomotion stable, et chaque bras supporte une charge utile de 3 kg pour des tâches de manipulation légère. L'encombrement global est contenu à 1 220 x 420 x 220 mm. L'architecture de contrôle, baptisée "fusion brain" par l'entreprise, repose sur la plateforme de calcul hétérogène Intel et sépare deux domaines distincts : un "cerveau" supérieur dédié au raisonnement IA, aux algorithmes de vision et aux modèles de langage, et un "cervelet" gérant le contrôle moteur temps réel via bus EtherCAT à latence milliseconde. Le produit est présenté comme disponible, mais aucun chiffre de déploiement ni de prix public n'a été communiqué lors de ce lancement. La transition d'un spécialiste des cobots industriels vers un humanoïde de service constitue un signal stratégique notable, même si le positionnement retenu, axé sur l'éducation, la recherche universitaire, l'animation d'expositions et l'accompagnement des personnes âgées, reste dans un segment à faible exigence de fiabilité opérationnelle comparé aux applications logistiques ou manufacturières. La séparation architecturale entre couche IA et couche temps réel via EtherCAT est une approche déjà adoptée par d'autres acteurs du secteur pour résoudre la tension entre latence de l'inférence LLM et déterminisme du contrôle moteur, et représente une décision d'ingénierie sensée plutôt qu'une rupture. La valeur du JAKA Pi pour les intégrateurs et les équipes R&D réside davantage dans sa compacité et dans sa plateforme de développement secondaire ouverte que dans des performances mécaniques exceptionnelles, son payload de 3 kg par bras le plaçant dans une catégorie intermédiaire entre les démonstrateurs de laboratoire et les solutions industrielles. JAKA Robotics a officiellement repositionné sa marque en 2025, abandonnant l'étiquette de fabricant de robots collaboratifs pour celle de société de "robotique intelligente généraliste", et a formalisé un partenariat avec l'Université Jiao Tong de Shanghai pour un centre de recherche conjoint sur l'intelligence incarnée et les systèmes de perception avancée. Le marché des humanoïdes compacts pour l'éducation et le service voit coexister des acteurs très différents : Unitree (H1, G1), Agility Robotics (Digit), Boston Dynamics (Atlas), ainsi que des startups chinoises comme Fourier Intelligence ou Agibot, sans oublier Figure et 1X en Occident. À ce stade, le JAKA Pi s'inscrit davantage comme une annonce de positionnement stratégique que comme un produit à déploiement industriel imminent, en l'absence de données de terrain ou de pilotes clients confirmés.

HumanoïdesOpinion
1 source
LEGS : affinage de VLA sans téléopération pour la loco-manipulation humanoïde dans un monde Gaussian Splatting incarné
140arXiv cs.RO 

LEGS : affinage de VLA sans téléopération pour la loco-manipulation humanoïde dans un monde Gaussian Splatting incarné

Des chercheurs présentent LEGS (Loco-manipulation via Embodied Gaussian Splatting), un simulateur hybride qui combine un avant-plan en maillage 3D avec un arrière-plan photoréaliste en Gaussian Splatting 3D (3DGS) pour entraîner des politiques vision-langage-action (VLA) sur humanoïdes sans téleopération humaine. Un générateur procédural de primitives de mouvement produit automatiquement des démonstrations annotées à grande échelle, tandis qu'une calibration colorimétrique à deux étapes aligne le rendu simulé avec la caméra réelle du robot. Sur un Unitree G1, sur trois tâches de saisie-dépose de difficulté croissante et avec trois architectures VLA (ψ₀, π₀.5 et GR00T N1.6), une politique entraînée exclusivement sur données LEGS égale ou dépasse, selon les auteurs, une politique entraînée sur démonstrations téleopérées. La couverture d'une nouvelle scène coûterait plus de quinze fois moins qu'une collecte par téleopération, une affirmation à vérifier hors du cadre expérimental : les résultats restent au stade de préprint arXiv (2606.01458) non soumis à revue par les pairs. Le résultat le plus structurant est la réduction effective du fossé simulation-réalité pour la loco-manipulation humanoïde corps entier, un problème que les simulateurs à maillage seul n'avaient pas résolu jusqu'ici. L'ablation le confirme : supprimer le fond 3DGS au profit d'un environnement mesh-only dégrade significativement les transferts, établissant le rendu photoréaliste comme facteur déterminant et non accessoire. Sous variations combinées d'apparence d'objet et de scène (scénario LEGS-AUG), la politique LEGS maintient son taux de succès tandis que la politique téleopérée échoue entièrement, ce qui valide empiriquement que les VLA nécessitent une diversité visuelle synthétique pour généraliser. Pour les intégrateurs et équipes robotiques, cela ouvre une voie scalable vers de nouveaux environnements industriels sans mobiliser d'opérateurs dédiés. LEGS s'appuie sur la technique 3DGS, popularisée en 2023 pour la reconstruction photoréaliste de scènes à partir d'images, et l'adapte en fond simulé pour l'entraînement de politiques. Les architectures testées incluent π₀.5 de Physical Intelligence et GR00T N1.6 de NVIDIA, deux acteurs centraux de l'espace VLA humanoïde, aux côtés desquels Boston Dynamics, Figure AI, Agility Robotics et Tesla Optimus avancent sur leurs propres pipelines de données synthétiques. Le Unitree G1, l'un des humanoïdes commerciaux les plus accessibles du marché, ancre les expériences dans un contexte potentiellement déployable. Les suites logiques incluent l'extension au-delà du pick-and-place, la publication du code et des données, et des tests en environnements industriels réels pour valider la robustesse hors laboratoire.

UELes équipes européennes en robotique humanoïde (CEA-List, INRIA, startups FR) pourraient adopter cette approche pour réduire drastiquement les coûts de collecte de données VLA sans téleopération, mais aucun acteur européen n'est impliqué dans l'étude.

IA physiqueOpinion
1 source
URDF-Anything+ : génération bout-en-bout d'actifs articulés prêts pour la simulation
141arXiv cs.RO 

URDF-Anything+ : génération bout-en-bout d'actifs articulés prêts pour la simulation

Une équipe de chercheurs a publié sur arXiv en mars 2026 URDF-Anything+, un modèle de diffusion autorégressive générant des fichiers URDF (Unified Robot Description Format) à partir d'une seule image RGB. Le URDF est le format standard dans l'écosystème ROS et les simulateurs physiques (MuJoCo, Isaac Sim, Gazebo) pour décrire la géométrie et la cinématique des objets articulés. Le système opère dans un espace latent structuré et prédit séquentiellement chaque partie de l'objet avec ses paramètres de joint (type, axe, limites de mouvement), un token de terminaison déterminant dynamiquement le nombre de segments à générer. Évalué sur des benchmarks à grande échelle d'objets articulés, il surpasse les méthodes existantes en reconstruction géométrique, en précision des paramètres de joints et en "physical executability", soit la capacité des URDF produits à s'exécuter directement dans un simulateur sans post-traitement manuel. L'enjeu pour les roboticiens et ingénieurs de simulation est direct : produire des digital twins d'objets articulés réels (tiroirs, portes, vannes, équipements industriels) reste un goulot d'étranglement dans les pipelines de sim-to-real. Les approches classiques imposent segmentation manuelle, retrieval depuis des bibliothèques 3D (PartNet, ShapeNet) ou des pipelines multi-étapes coûteux à maintenir. URDF-Anything+ compresse ce processus en une passe unique, sans retrieval ni post-traitement externe. Le résultat le plus significatif est le transfert zero-shot : des politiques de manipulation entraînées exclusivement en simulation sur des URDF générés ont été transférées dans des environnements réels sans fine-tuning supplémentaire, ce qui constitue une validation directe que le sim-to-real gap sur les objets articulés peut être partiellement absorbé par la fidélité du jumeau numérique. La reconstruction d'objets articulés depuis des observations visuelles est un problème ouvert depuis plus d'une décennie. Des travaux antérieurs comme PARIS, ArticulatedFormer et NSM avaient progressé sur la segmentation et l'estimation cinématique, mais butaient sur la généralisation et l'utilisabilité directe en simulateur. URDF-Anything+ s'inscrit dans la tendance des modèles génératifs 3D orientés simulation, aux côtés des Gaussian Splattings dynamiques et des NeRF articulés. La recherche (arXiv:2603.14010) ne mentionne pas d'affiliation industrielle ni de plan de commercialisation : il s'agit d'un résultat purement académique. L'intégration naturelle serait dans les pipelines de génération de données synthétiques pour la manipulation robotique, domaine où Physical Intelligence, le Boston Dynamics AI Institute et les équipes Nvidia Isaac Lab investissent massivement en ce moment.

UELes équipes académiques européennes en manipulation robotique (INRIA, DLR, TU Munich) pourraient intégrer cet outil dans leurs pipelines de données synthétiques, mais aucun acteur français ou européen n'est directement impliqué.

RecherchePaper
1 source
Suivi corporel intégral contraint pour robots humanoïdes
142arXiv cs.RO 

Suivi corporel intégral contraint pour robots humanoïdes

Des chercheurs ont publié sur arXiv (2606.00374) un framework de contrôle baptisé ConstrainedMimic, conçu pour imposer des contraintes de sécurité en temps réel sur des robots humanoïdes pilotés par apprentissage par renforcement. La démonstration s'appuie sur un Unitree G1 simulé : le système fait tourner la politique de suivi de mouvement whole-body à 300-500 Hz, indifféremment sur CPU, GPU ou TPU, tout en garantissant simultanément l'évitement de collisions (auto-collisions et obstacles externes), le respect des butées articulaires et la stabilité du centre de masse. Les expériences couvrent le suivi de mouvements cinématiques référencés et la téléopération. Le code sera libéré à la publication. L'enjeu sous-jacent est structurant pour l'industrialisation des humanoïdes : les politiques RL apprennent des comportements agiles mais ne savent pas, par défaut, respecter des contraintes ajoutées après entraînement, ce qui bloque le déploiement dans des environnements où les exigences de sécurité évoluent (cellule de travail reconfigurée, proximité opérateur, certification CE). ConstrainedMimic répond à ce problème en combinant deux outils de contrôle classiques, le contrôle en espace opérationnel (OSC) et les control barrier functions (CBF), pour projeter la commande du réseau de neurones dans un espace faisable respectant les contraintes actives. La méthode est entièrement différentiable et n'altère la politique que le strict minimum lorsqu'une contrainte entre en jeu, ce qui la distingue des approches d'override brutales. C'est un pas vers la séparation propre entre performance et sécurité dans les pipelines RL pour humanoïdes. Le sujet s'inscrit dans une course active à la robustesse des politiques whole-body : Figure (Figure 02/03), Boston Dynamics (Atlas), Agility Robotics (Digit) et Unitree investissent massivement en RL locomotion, mais la question des garanties formelles reste un angle mort industriel. Les CBF sont bien établies en robotique mobile (AMR, véhicules autonomes) mais leur intégration dans des politiques RL pour humanoïdes à haute dimension cinématique est encore exploratoire. À noter : l'évaluation reste entièrement en simulation, ce qui laisse ouverte la question du sim-to-real gap sur les contraintes dynamiques, un point que les auteurs n'adressent pas dans cet abstract. La publication du code facilitera la reproductibilité et pourrait accélérer l'adoption dans des labos comme le DLR, l'INRIA ou des intégrateurs industriels européens travaillant sur la certification de robots collaboratifs.

UELa publication du code pourrait permettre à des laboratoires européens comme l'INRIA ou le DLR d'intégrer des garanties formelles de sécurité dans leurs pipelines RL pour humanoïdes, facilitant la certification CE de robots collaboratifs en environnement industriel partagé.

HumanoïdesPaper
1 source
Défaillances silencieuses en IA physique : revue de littérature sur l'autorisation d'actions en temps réel pour les systèmes autonomes
143arXiv cs.RO 

Défaillances silencieuses en IA physique : revue de littérature sur l'autorisation d'actions en temps réel pour les systèmes autonomes

Un article de revue de littérature déposé sur arXiv le 2 juin 2026 (identifiant 2606.00090) pose un problème de sécurité systémique pour les systèmes d'IA physique : les modèles de fondation, modèles vision-langage-action (VLA) et modèles du monde qui pilotent des robots, véhicules, drones et machines industrielles peuvent émettre des commandes physiquement dangereuses tout en paraissant confiants, plausibles et sémantiquement corrects. Les auteurs nomment ce phénomène "silent failure" (défaillance silencieuse) : une action physiquement conséquente est déclenchée avant qu'un contrôleur matériel en aval détecte une anomalie, sous l'effet d'une dérive de capteur, d'une occlusion, d'une erreur d'estimation d'état, d'un glissement de distribution, d'affordances hallucinées ou d'hypothèses physiques invalides. Ces défaillances ne sont capturées ni par la modération de contenu classique des systèmes d'IA, ni par les normes de sécurité robotique traditionnelles. L'enjeu industriel est direct : là où les intégrateurs s'appuient sur des couches de sécurité fonctionnelle (normes ISO 10218, IEC 61508) pensées pour des automates déterministes, les VLA introduisent un générateur d'actions opaque dont les sorties ne respectent aucune enveloppe formellement vérifiable. La revue synthétise un écart récurrent : sur l'ensemble des corpus analysés, modèles de fondation incarnés, simulation robotique, benchmarks de sécurité embodied, contrôle sûr, assurance runtime, estimation d'incertitude, vérification formelle et évaluation de guardrails, aucun flux technique ne fournit à lui seul une frontière d'autorisation complète entre le modèle boîte noire et l'exécution physique. Cela signifie que les déploiements actuels de robots humanoïdes ou d'AGV pilotés par des LLM reposent sur des garde-fous fragmentés dont la couverture n'est pas évaluée de manière unifiée. Pour combler ce vide, les auteurs proposent une formalisation bornée du problème, une définition rigoureuse de la "défaillance physique silencieuse", une taxonomie des fonctions de guardrail runtime, et des critères d'évaluation permettant de comparer ces guardrails comme mécanismes d'assurance. Le papier ne décrit pas de système déployé ni de résultats expérimentaux : c'est une revue structurante, dont l'utilité principale est de fournir un cadre commun à une communauté fragmentée entre labs robotique, sécurité IA et contrôle formel. Les acteurs comme Boston Dynamics (Spot + foundation models), Figure, 1X ou Apptronik, qui poussent vers des déploiements industriels de robots à base de VLA, sont implicitement concernés, tout comme les équipes de recherche travaillant sur Pi-0 (Physical Intelligence) ou GR00T N2 (NVIDIA). La prochaine étape naturelle serait une validation empirique de la taxonomie proposée sur des benchmarks embodied existants comme RoboSuite ou Open-X Embodiment.

UELa mise en évidence d'un vide normatif entre les standards industriels EU (ISO 10218, IEC 61508) et les systèmes VLA opaques concerne directement les intégrateurs européens déployant des robots autonomes sous le régime de l'AI Act.

RechercheOpinion
1 source
Nvidia, Unitree et Sharpa s'associent pour concevoir un robot humanoïde capable d'effectuer un travail réel
144SCMP Tech 

Nvidia, Unitree et Sharpa s'associent pour concevoir un robot humanoïde capable d'effectuer un travail réel

L'accès web n'est pas disponible. Je vais rédiger le résumé à partir du texte fourni et de mes connaissances sur cet écosystème. --- Nvidia, Unitree Robotics et Sharpa ont dévoilé H2+, un design de référence pour robot humanoïde destiné à accélérer le développement industriel à l'échelle mondiale. L'annonce a été faite par Jensen Huang, PDG de Nvidia. H2+ intègre la chaîne complète de développement robotique : collecte de données, entraînement de politiques de contrôle (policy training) et déploiement en conditions réelles. Unitree Robotics, spécialiste chinois des robots humanoïdes à bas coût (G1, H1), apporte l'architecture mécanique, tandis que Sharpa, fabricant singapourien de mains robotiques, contribue la préhension dextère. Nvidia fournit la couche logicielle et matérielle, vraisemblablement via Isaac Sim, OSMO et le modèle de fondation GR00T N2. L'intérêt d'un design de référence commun est de réduire le temps de mise en marché pour les intégrateurs en évitant la redondance dans la phase de prototypage. En unifiant la stack sim-to-real sous un seul écosystème Nvidia, H2+ vise à fermer le gap entre démonstrations en laboratoire et déploiements opérationnels, un obstacle persistant dans la commercialisation des humanoïdes. C'est aussi un signal que Nvidia consolide son rôle d'infrastructure centrale dans la course aux humanoïdes, face à des constructeurs comme Boston Dynamics, Figure ou Agility Robotics qui développent leurs propres pipelines propriétaires. La collaboration reflète une tendance de fond : les grandes plateformes technologiques cherchent à s'imposer comme couche commune là où les fabricants de hardware se fragmentent. Nvidia avait déjà lancé GR00T N2 début 2025 pour standardiser l'entraînement des humanoïdes. Unitree, dont le G1 est commercialisé autour de 16 000 dollars, mise sur le volume et l'accessibilité. Les suites concrètes de H2+, pilotes industriels, disponibilité du SDK, partenaires intégrateurs, n'ont pas encore été précisées dans les informations disponibles.

HumanoïdesOpinion
1 source
Robot bipède DIY : des muscles pneumatiques à la place des moteurs
145IEEE Spectrum Robotics 

Robot bipède DIY : des muscles pneumatiques à la place des moteurs

En 1987, Richard Greenhill, photographe britannique autodidacte passionné de robotique, lance dans son grenier londonien un projet qui n'intéresse personne chez son employeur de l'époque, la startup Intergalactic Robots : construire un humanoïde bipède de taille réelle. Il réunit chaque mercredi soir une douzaine d'enthousiastes, baptisés le Shadow Group, qui assemblent des composants récupérés dans des imprimantes et des déchetteries. Leur machine principale, le Shadow Walker, repose sur un squelette en bois d'érable inspiré des atlas médicaux d'anatomie humaine, dessiné par David Buckley, spécialiste de la robotique et de l'animatronique. Plutôt que des moteurs électriques, Greenhill opte pour 28 muscles pneumatiques, une variante des muscles de McKibben inventés dans les années 1950, qui se contractent ou s'étendent sous air comprimé. Ces actionneurs sont répartis sur huit articulations (hanches, genoux, chevilles, orteils), offrant 12 degrés de liberté. Le robot mesure 168 cm, pèse 38 kg et intègre dans son torse les électrovannes, l'électronique et les interfaces informatiques. L'équipe parvient à lui faire tenir debout et à maintenir son équilibre, y compris après de légères poussées. La marche, en revanche, reste hors de portée. Ce projet illustre un paradoxe structurant des débuts de la robotique humanoïde : la station debout et l'équilibre statique sont des problèmes résolubles avec des moyens modestes, mais la locomotion dynamique exige une fiabilité de capteurs et d'actionneurs que les composants de récupération ne peuvent garantir. Rich Walker, recruté adolescent dans le groupe, tente d'utiliser des réseaux de neurones pour résoudre le problème de l'équilibre, une approche qui anticipe d'une trentaine d'années les architectures d'apprentissage par renforcement aujourd'hui au coeur des locomotion controllers de Boston Dynamics ou Agility Robotics. Les obstacles rencontrés, notamment la défaillance fréquente des valves pneumatiques et la fragilité générale du châssis, documentent en creux pourquoi les muscles artificiels pneumatiques ont largement cédé la place aux actionneurs électriques dans les humanoïdes commerciaux contemporains. Le Shadow Walker émerge dans un contexte d'effervescence institutionnelle : 1987 voit simultanément la création de l'IEEE Robotics and Automation Society et de l'International Federation of Robotics. Sur le plan industriel, Honda travaille depuis 1986 sur ses robots expérimentaux de la série E, dont les travaux conduiront au P2 (1996, 183 cm, 210 kg, premier humanoïde à marche autonome stable) puis à ASIMO. L'approche pneumatique du Shadow Group, documentée par Rich Walker dans une note technique publiée en 1999 sur le site de David Buckley, reste une référence de niche pour les chercheurs explorant les actionneurs bio-inspirés à compliance variable, un domaine qui connaît un regain d'intérêt dans les laboratoires travaillant sur la sécurité humain-robot en manipulation industrielle.

RecherchePaper
1 source
Stratégies de préhension pratiques pour la manipulation mobile en environnement réel
146arXiv cs.RO 

Stratégies de préhension pratiques pour la manipulation mobile en environnement réel

Des chercheurs ont publié en avril 2025 sur arXiv (référence 2504.12512) une étude de terrain portant sur SHOPPER, une plateforme de manipulation mobile conçue pour évaluer des stratégies de préhension dans un supermarché réel. L'environnement choisi n'est pas anodin : un magasin d'alimentation impose une diversité extrême d'objets (formes irrégulières, emballages souples, produits réfléchissants), de configurations d'étagères et de layouts changeants. L'équipe a conduit des centaines de tentatives de saisie distinctes et documente en détail les modes de défaillance observés, sans annoncer de taux de réussite global, ce qui tranche avec la communication habituelle du secteur. Ce travail apporte une valeur rare dans la littérature robotique actuelle : une analyse honnête des échecs en conditions non structurées réelles, plutôt qu'une démonstration soigneusement sélectionnée en laboratoire. Le fossé demo-to-reality reste le principal obstacle au déploiement commercial des manipulateurs mobiles, et les auteurs cherchent précisément à le cartographier. Pour un intégrateur ou un décideur industriel, ce type d'inventaire des cas limites est plus exploitable qu'un benchmark contrôlé : il permet de calibrer les attentes sur ce que les pipelines VLA (Vision-Language-Action) et les approches de grasp planning généraliste peuvent réellement délivrer aujourd'hui hors laboratoire. La recherche en manipulation mobile s'est intensifiée ces deux dernières années, portée par des acteurs comme Apptronik, Agility Robotics (Digit) ou Boston Dynamics (Spot avec bras), mais aussi par des startups spécialisées dans le picking retail comme Symbotic ou des robots de supermarché tels que ceux de Focal Systems. Les approches fondées sur l'apprentissage end-to-end (pi0 de Physical Intelligence, RT-2 de Google DeepMind) promettent une généralisation, mais leur robustesse en environnement chaotique reste peu documentée de façon indépendante. SHOPPER s'inscrit dans une démarche de recherche ouverte visant à fournir à la communauté robotique un référentiel de problèmes concrets non résolus, ce qui suggère des publications de suivi et potentiellement un benchmark partagé.

RecherchePaper
1 source
XPeng présente sa gamme complète d'IA physique au salon automobile GBA 2026
147Pandaily 

XPeng présente sa gamme complète d'IA physique au salon automobile GBA 2026

XPeng a présenté l'intégralité de sa gamme "physical AI" au salon automobile 2026 de la Grande Baie (Guangdong-Hong Kong-Macao Greater Bay Area Auto Show), organisé fin mai à Guangzhou. La démonstration centrale porte sur le système de conduite autonome end-to-end basé sur un réseau de neurones, que XPeng déploie en navigation assistée à l'échelle urbaine depuis plusieurs trimestres. L'entreprise expose également ses travaux en robotique humanoïde et en IA incarnée, articulés autour de trois briques techniques : perception, prise de décision et actuation. L'article source ne précise aucun nom de modèle robot, aucune métrique de charge utile ou de degré de liberté, ni aucun chiffre de déploiement, ce qui signale davantage un teaser de positionnement qu'un lancement produit documenté. Ce salon illustre une tendance structurelle dans l'industrie automobile chinoise : les constructeurs EV se requalifient en sociétés d'IA, avec des piles technologiques qui couvrent désormais la mobilité autonome, la robotique industrielle et l'IA embarquée. Pour les intégrateurs et décideurs B2B, ce mouvement signifie que les acteurs automobiles deviennent des concurrents directs des fournisseurs de robotique traditionnels. La convergence entre châssis, capteurs, compute embarqué et modèles de fondation réduit les barrières à l'entrée pour les déploiements humanoïdes en environnement industriel. Cela dit, l'absence de métriques concrètes dans la communication de XPeng interdit toute comparaison rigoureuse avec Figure (Figure 03), Boston Dynamics (Atlas), ou les plateformes chinoises comme Unitree ou Agibot. XPeng a été l'un des premiers constructeurs chinois à déployer la navigation assistée en ville à grande échelle, ce qui lui confère une base de données réelle conséquente pour entraîner ses modèles. La Baie de Canton concentre une part significative de l'écosystème EV-AI mondial, avec Shenzhen et Guangzhou comme noyaux de R&D et de chaîne d'approvisionnement. La concurrence directe inclut BYD, NIO, Li Auto et Xiaomi, tous engagés dans des investissements massifs en conduite autonome et en IA. La prochaine étape observable pour XPeng sera la publication de benchmarks concrets sur ses robots ou l'annonce de pilotes industriels chiffrés, seuls jalons permettant d'évaluer la portée réelle de cette stratégie "physical AI".

Chine/AsieOpinion
1 source
Estimation de traversabilité auto-supervisée et agnostique au robot pour des environnements ouverts
148arXiv cs.RO 

Estimation de traversabilité auto-supervisée et agnostique au robot pour des environnements ouverts

Une équipe de chercheurs présente COTRATE (Continuous Online TRAversability EsTimation), un framework d'apprentissage en ligne pour l'estimation de traversabilité des terrains par des robots mobiles, publié sur arXiv en mai 2026 (arXiv:2605.28442). Le système apprend de façon auto-supervisée à partir de données non étiquetées collectées par le robot en temps réel. COTRATE fonctionne en deux étapes : un module d'évaluation du terrain exploitant les signaux proprioceptifs et inertiels génère des scores de traversabilité robustes, qui supervisent ensuite un réseau de traversabilité visuelle via une fonction de perte par alignement (alignment loss). Pour limiter l'oubli catastrophique propre à l'apprentissage continu, les auteurs proposent une stratégie de sélection de features basée sur la diversité, s'appuyant sur une mémoire de relecture compacte. Le système a été évalué sur un dataset d'environ 50 000 images collectées avec deux plateformes robotiques sur 11 types de terrains extérieurs, et benchmarké sur des tâches de navigation dans trois environnements extérieurs représentatifs. Le code, le dataset et les modèles pré-entraînés sont disponibles publiquement. La traversabilité est un problème central pour les robots mobiles opérant en environnement non structuré : savoir si un sol est praticable, à quelle vitesse et avec quel risque de chute ou de blocage conditionne directement la sécurité et l'efficacité des missions. Les approches existantes butaient sur un double écueil : soit elles reposaient sur des scores proprioceptifs artisanaux, spécifiques à une plateforme et donc non transférables, soit elles pré-calculaient des clusters sur des données antérieures sans possibilité d'adaptation en ligne. COTRATE lève les deux limitations simultanément : il est robot-agnostic, avec un transfert de connaissances démontré entre plateformes à cinématiques différentes, et il apprend en continu sans coût mémoire ou calcul prohibitif, rendant le déploiement embarqué crédible. C'est un signal pertinent pour les intégrateurs de robots extérieurs dans l'agriculture, l'inspection d'infrastructure ou la défense, secteurs où les conditions terrain varient et où annoter des données à la main reste hors de portée à l'échelle. L'estimation de traversabilité auto-supervisée est un champ actif depuis plusieurs années, porté notamment par des laboratoires travaillant sur les robots quadrupèdes comme ANYmal (ANYbotics) ou Spot (Boston Dynamics) ainsi que sur les UGV de type Clearpath Robotics. Les méthodes antérieures les plus citées dans ce domaine, dont certaines issues d'ETH Zurich ou de CMU, reposaient généralement sur des données pré-collectées ou des heuristiques proprioceptives figées. COTRATE se positionne comme une solution plus générale, bien que la publication soit à ce stade un preprint arXiv sans validation en peer review et qu'aucun partenaire industriel ni déploiement terrain en production ne soit mentionné. Les étapes naturelles seraient une validation sur des plateformes commerciales en conditions réelles prolongées et une intégration dans des stacks de navigation open-source comme Nav2 ou le framework Elevation Mapping de la communauté ETH.

UEImpact indirect via la communauté de recherche européenne (ETH Zurich cité comme référence clé) et pertinence pour les intégrateurs EU en agriculture et inspection d'infrastructure, mais aucun acteur français ni déploiement européen mentionné.

RecherchePaper
1 source
Locomotion naturelle : principe et méthode
149arXiv cs.RO 

Locomotion naturelle : principe et méthode

Un préprint déposé sur arXiv (identifiant 2605.28254) propose un cadre théorique formalisé pour ce que les auteurs appellent la "locomotion naturelle", une famille de mouvements robotiques fondée non pas sur le suivi de trajectoires prescrites, mais sur l'exploitation des dynamiques passives, de la compliance mécanique et des phénomènes de résonance. Le cœur du papier est un principe d'échange : un mouvement est dit "naturel" lorsqu'un oscillateur interne revient périodiquement, que la pose globale du corps dérive de façon nette, et que la puissance moyenne d'échange propulsion-oscillateur (POE power) est nulle sur un cycle complet. L'ensemble des cycles satisfaisant ces conditions forme ce que les auteurs appellent une Natural Locomotion Manifold (NLM). La méthode repose sur une construction fermée puis ouverte : le canal propulsif est d'abord isolé pour révéler un oscillateur effectif interne, structuré par une action-angle scalaire ou par des secteurs modaux non linéaires à plusieurs degrés de liberté, avant d'être rouvert pour reconstruire la pose et vérifier la cohérence du cycle. La démonstration s'appuie sur deux systèmes non holonomes sans glissement : le "Chaplygin-sleigh" avec pendule moteur et une extension à trois corps. Ce travail répond à une question de conception plutôt qu'à un problème de contrôle : quelles architectures passives permettent l'existence de familles NLM certifiées, et combien ? C'est un renversement de perspective par rapport à la robotique locomotrice dominante, où le contrôle actif compense en permanence les imperfections du modèle. Une locomotion ancrée dans les dynamiques passives implique une consommation énergétique structurellement moindre, non par optimisation du contrôleur, mais par design mécanique. Pour les équipes travaillant sur des robots marcheurs ou nageurs à batterie embarquée, ce type de cadre formel peut guider le choix d'architectures mécaniques avant même d'écrire une ligne de code de contrôle. Le domaine de la locomotion passive a pour ancêtre les travaux de Tad McGeer (1990) sur les marcheurs passifs en descente, prolongés par les laboratoires de Cornell, MIT et Delft dans les années 2000. Depuis, la plupart des robots humanoïdes commerciaux, Boston Dynamics Atlas, Figure 03, Unitree H1, ont opté pour un contrôle actif intensif, au prix d'une consommation électrique élevée. Ce préprint, purement théorique et sans validation expérimentale annoncée, ne propose pas encore de robot ni de plateforme de test ; il fournit un outil mathématique. La prochaine étape naturelle serait une validation sur un prototype physique ou en simulation, et une extension à des architectures de robots à pattes à plus de deux degrés de liberté effectifs.

RecherchePaper
1 source
BYD confirme son offensive robotique humanoïde avec le projet de septième génération Yao-Shun-Yu, ciblant particulièrement les concessionnaires et les foyers
150Pandaily 

BYD confirme son offensive robotique humanoïde avec le projet de septième génération Yao-Shun-Yu, ciblant particulièrement les concessionnaires et les foyers

Li Ke, vice-président exécutif de BYD, a détaillé dans une interview récente la stratégie robotique humanoïde du constructeur, développée en interne sous le nom de code "Yao-Shun-Yu". Le projet en est à sa septième génération d'itération, signe d'un cycle de développement soutenu. Les premiers déploiements visent les concessions automobiles 4S à l'international, les réseaux européens étant cités parmi les sites prioritaires. Les robots y assureront accueil client, démonstrations produits et support commercial standardisé en plusieurs langues simultanément, répondant à un problème opérationnel concret : recrutement difficile et coûts élevés dans les marchés étrangers. À plus long terme, BYD envisage un second débouché, le domicile, avec des fonctions de ménage, préparation des repas et compagnie sociale. Aucun chiffre de production, de spécifications techniques ou de calendrier de livraison précis n'a été communiqué ; il s'agit d'une annonce de stratégie, pas d'un produit expédié. L'entrée de BYD dans la robotique humanoïde est structurellement significative pour deux raisons. D'abord, le groupe dispose d'une chaîne d'approvisionnement verticalement intégrée : l'expertise en systèmes logiciels embarqués et en fabrication de précision acquise dans l'automobile électrique se transpose directement à la robotique, où la maîtrise mécanique et le contrôle temps réel sont aussi critiques que l'intelligence artificielle. Ensuite, Li Ke a formulé un diagnostic précis sur l'état du secteur : les humanoïdes chinois présentent généralement un hardware solide mais un "cerveau" IA insuffisant, tandis que les concurrents américains affichent l'inverse. BYD se positionne explicitement comme intégrateur des deux capacités dans une plateforme unique. Si cette convergence se concrétise à l'échelle, elle modifierait les rapports de force dans la commercialisation des humanoïdes industriels, où aucun acteur n'a encore démontré de production de masse rentable. BYD est devenu en 2023 le premier constructeur mondial de véhicules électriques par le volume, précisément sur la base de cette intégration verticale, supplantant Tesla dans plusieurs segments. Le groupe s'inscrit dans une vague plus large de groupes industriels chinois investissant la robotique humanoïde : UBTECH, Unitree et Fourier Intelligence sont déjà actifs sur ce terrain. Côté américain, les références restent Figure Robotics (Figure 02 en déploiement chez Amazon), Boston Dynamics (Atlas), Tesla (Optimus Gen 2) et 1X Technologies. BYD se distingue en se déclarant lui-même acheteur initial à grande échelle dans ses propres usines chinoises, un levier de dérisquage commercial que très peu de roboticiens peuvent activer de façon crédible. Les prochaines étapes annoncées portent sur des pilotes en concessions européennes, sans calendrier précis confirmé à ce jour.

UEBYD cible explicitement les réseaux de concessions automobiles européens comme sites de déploiement prioritaires, ce qui pourrait introduire un acteur chinois à intégration verticale sur le marché européen de la robotique de service B2B.

Chine/AsieActu
1 source