Aller au contenu principal

Dossier Enchanted Tools — Mirokaï — page 4

236 articles · page 4 sur 5

Enchanted Tools et Mirokaï : robot social français à roues, animations expressives, expérimentations en hôpitaux et hôtels.

151TechNode Chine/AsieActu

Elon Musk trouve les combats de robots amusants après avoir regardé la bataille de robots humanoïdes en Chine

Voici la traduction/résumé en français, prêt à publier : Une entreprise de robotique basée à Shenzhen a organisé le 19 juillet un combat entre deux robots humanoïdes EngineAI T800, dont la vidéo est devenue virale au point d'attirer l'attention d'Elon Musk, qui a repartagé les images sur X en commentant que les combats de robots sont amusants. Les deux machines, échangeant coups de poing et coups de pied dans une cage octogonale de style MMA, mesurent 1,73 mètre pour 75 kilogrammes et sont équipées d'articulations hydrauliques haute résistance leur permettant d'exécuter des mouvements de combat proches de ceux d'un humain : jabs, coups de pied circulaires, projections. Moment le plus marquant de l'affrontement, la tête de l'un des robots a été arrachée d'un coup de pied par son adversaire ; privé de ses capteurs céphaliques, il a néanmoins continué à se battre, encaissant et rendant des coups grâce à son système de contrôle central logé dans le torse. L'événement est présenté par ses organisateurs comme la première compétition de combat libre entre robots humanoïdes « de niveau industriel » au monde. Au-delà de l'effet spectacle, l'épisode met en avant la résilience mécanique recherchée par les fabricants chinois de robots humanoïdes : continuer à opérer après la perte d'un module sensoriel critique est un argument de robustesse pertinent pour des usages industriels réels, où chocs et pannes partielles sont fréquents. L'événement s'inscrit surtout dans une course commerciale et médiatique très active entre acteurs chinois (EngineAI, Unitree, Fourier), qui multiplient les démonstrations spectaculaires, boxe, danse, course, désormais combat, pour affirmer la maturité de leurs plateformes face aux Optimus de Tesla ou au Figure 03. La réaction de Musk, qui développe lui-même Optimus, confirme que ces démonstrations chinoises sont suivies de près par les concurrents occidentaux, même si l'écart entre performance en cage contrôlée et déploiement industriel réel reste important ; l'appellation « niveau industriel » avancée par les organisateurs mérite d'être prise avec prudence, aucune application commerciale concrète n'ayant été documentée. EngineAI, jeune pousse chinoise spécialisée dans les robots humanoïdes bipèdes, avait déjà attiré l'attention avec des démonstrations de marche et de course rapide de son T800. Ce combat s'ajoute à une série d'événements similaires organisés en Chine ces derniers mois, marches, matchs de boxe et désormais free-fight, portés par des entreprises comme Unitree, qui cherchent à construire une image de marque autour du spectacle autant que de la technologie. Aucune date ni format n'ont été annoncés pour une suite, et EngineAI n'a communiqué aucun calendrier de commercialisation ou de déploiement industriel pour le T800. Le contraste reste net avec des acteurs occidentaux ou français comme Wandercraft (exosquelettes médicaux) ou Enchanted Tools, qui misent sur des démonstrations orientées usage professionnel plutôt que sur le spectacle de combat.

1 source
152arXiv cs.RO 

RADAR : génération de données robotiques en boucle fermée par planification sémantique et réinitialisation causale autonome de l'environnement

Wandercraft, Exotec, Pollen ou Enchanted Tools ne figurent pas dans cet article, c'est un papier de recherche académique, pas une actualité produit. Voici la traduction-synthèse. Des chercheurs présentent RADAR (Robust Autonomous Data Acquisition for Robotics), un moteur de génération de données robotiques entièrement autonome qui élimine toute intervention humaine du cycle de collecte. Le système s'appuie sur seulement 2 à 5 démonstrations humaines en 3D comme a priori géométriques, puis enchaîne un pipeline en quatre modules : un modèle vision-langage (VLM) génère des tâches pertinentes par ancrage sémantique d'objets et récupération de compétences, un réseau de neurones sur graphes (GNN) traduit ces sous-tâches en actions physiques via de l'apprentissage par imitation en contexte, le VLM évalue ensuite automatiquement la réussite via un pipeline de question-réponse visuelle structuré, et enfin une machine à états finis orchestre la remise à zéro autonome de l'environnement grâce à une planification simultanée avant-arrière selon une séquence causale stricte de type LIFO (dernier entré, premier sorti). En simulation, RADAR atteint jusqu'à 90% de réussite sur des tâches complexes à long horizon, là où les méthodes de référence chutent près de zéro. En conditions réelles, le système exécute des compétences riches en contact comme la manipulation d'objets déformables, en adaptation few-shot et sans fine-tuning spécifique au domaine. L'intérêt pour l'industrie robotique tient au goulot d'étranglement que RADAR cible directement : la collecte de données physiques à grande échelle reste freinée par le coût et le manque de scalabilité des méthodes nécessitant un humain en boucle, notamment pour la remise en configuration manuelle de l'environnement entre chaque essai. En automatisant à la fois la génération de tâches, l'exécution, l'évaluation de succès et surtout la réinitialisation de l'espace de travail, RADAR promet de transformer la collecte en processus auto-suffisant, un argument central pour quiconque cherche à entraîner des politiques VLA (vision-language-action) à l'échelle sans multiplier les téléopérateurs humains. Les chiffres de simulation sont à prendre avec la prudence habituelle pour ce type de benchmark, mais la démonstration en réel sur des tâches de manipulation d'objets déformables, sans fine-tuning dédié, est le signal le plus concret de transférabilité. Ce travail s'inscrit dans la vague de recherche sur la génération de données synthétiques et semi-autonomes pour l'apprentissage robotique, en réaction directe aux limites des approches de téléopération massive utilisées par des acteurs comme Physical Intelligence (Pi-0) ou NVIDIA (GR00T N2). L'article, disponible sur arXiv sous une version révisée (v2), ne précise pas de plateforme robotique commerciale ni de partenariat industriel : il s'agit d'une contribution méthodologique destinée à la communauté recherche, dont l'adoption dépendra de sa reproductibilité et de son intégration dans des pipelines d'entraînement de politiques VLA plus larges.

RecherchePaper
1 source
X Square Robot mise sur une approche full-stack pour l'IA incarnée et la robotique polyvalente
153Robotics & Automation News 

X Square Robot mise sur une approche full-stack pour l'IA incarnée et la robotique polyvalente

Le fabricant chinois de robots humanoïdes X Square Robot, basé à Shenzhen, a récemment bouclé quatre levées de fonds consécutives, confirmant l'intérêt soutenu des investisseurs pour l'IA incarnée (embodied AI). La société développe une approche "full-stack" du robot généraliste, c'est-à-dire qu'elle conçoit à la fois le matériel (actionneurs, capteurs, plateforme mécanique) et les modèles d'IA qui pilotent la perception et la manipulation, plutôt que de s'appuyer sur des briques tierces assemblées. L'objectif affiché est de produire des machines capables d'exécuter une large variété de tâches réelles, à l'opposé des robots historiquement programmés pour une application unique et rigide. Cette stratégie d'intégration verticale illustre un basculement plus large du secteur robotique : la course ne se joue plus seulement sur le hardware, mais sur la capacité à faire tenir un modèle d'IA généraliste (de type VLA, vision-language-action) à l'échelle industrielle, du laboratoire jusqu'au déploiement en usine ou en entrepôt. Pour les intégrateurs et décideurs B2B, le succès ou l'échec de ce pari conditionne directement l'arbitrage entre acheter une plateforme fermée type Optimus ou Figure, ou miser sur des acteurs émergents proposant une pile technologique propriétaire complète. Le nombre de tours de financement consécutifs, sans que les montants précis soient encore détaillés publiquement, signale une pression concurrentielle et une conviction des investisseurs chinois sur ce segment. X Square Robot s'inscrit dans un paysage chinois de plus en plus dense sur l'IA incarnée, aux côtés d'acteurs comme Unitree ou UBTech, dans un contexte où Pékin pousse activement la robotique humanoïde comme filière stratégique. Face à elle, la scène occidentale reste dominée par Tesla (Optimus), Figure AI ou encore Physical Intelligence (Pi-0), tandis qu'en Europe des acteurs comme Wandercraft ou Enchanted Tools explorent des approches plus spécialisées. Les prochaines étapes à surveiller pour X Square Robot concernent la divulgation des montants levés, l'identité des investisseurs, et surtout la transition entre démonstrations en laboratoire et déploiements pilotes vérifiables chez des clients industriels, seul indicateur qui permettra de distinguer l'annonce marketing du produit réellement opérationnel.

Chine/AsieOpinion
1 source
Apprentissage de la manipulation dextérique via guidage par couple de contact issu de démonstrations humaines
154arXiv cs.RO 

Apprentissage de la manipulation dextérique via guidage par couple de contact issu de démonstrations humaines

Wandercraft, Exotec, Pollen et Enchanted Tools ne sont pas mentionnés dans le papier, donc aucune mention forcée. Voici l'article : Une équipe de recherche publie CHORD (Contact Wrench Guidance from Human Demonstration in Robotic Dexterous Manipulation), un framework d'apprentissage par renforcement pour la manipulation dextre à long horizon d'objets rigides et articulés, dans un preprint arXiv daté du 2 juillet 2026 (arXiv:2607.00033v1). L'idée centrale consiste à représenter les mouvements humains et robotiques non pas par des trajectoires articulaires brutes, mais par les forces et couples (wrench) qu'ils induisent sur l'objet manipulé, ce qui permet de comparer directement leur effet plutôt que leur cinématique. Les chercheurs ont construit un benchmark de simulation de 4 739 tâches de manipulation bimanuelle dextre, issu de jeux de données de capture de mouvement et de vidéos reconstruites en interne. Sur 1 831 tâches évaluées, CHORD atteint un taux de réussite moyen de 82,12 %. La méthode se généralise aussi à la manipulation corps entier à partir de démonstrations limitées aux mains ou filmées à la troisième personne, avec 90,77 % de réussite, et les politiques apprises se transfèrent vers le réel en boucle ouverte comme en boucle fermée. L'enjeu dépasse la simple prouesse académique : l'apprentissage par renforcement pour la manipulation riche en contacts est réputé difficile à faire passer à l'échelle, car les démonstrations humaines se transposent mal aux mains robotiques dont la cinématique diffère. En ancrant le signal de guidage dans la physique des forces plutôt que dans les gestes eux-mêmes, CHORD contourne en partie ce fossé d'incarnation. Un benchmark de près de 5 000 tâches, avec transfert vérifié sur robot réel et non seulement en simulation, constitue un test de scalabilité plus rigoureux que la plupart des démonstrations ponctuelles habituelles du secteur. Ce travail s'inscrit dans une tendance plus large exploitant la capture de mouvement et la vidéo humaine pour entraîner des politiques robotiques, en parallèle des approches par imitation ou des modèles vision-langage-action comme Pi-0 ou GR00T N2. Étant un preprint, il reste à valider par relecture par les pairs, avec une portée réelle encore limitée aux conditions de laboratoire décrites.

RecherchePaper
1 source
Puis-je vous aider ? La proactivité dans la collaboration humain-robot en groupe
155arXiv cs.RO 

Puis-je vous aider ? La proactivité dans la collaboration humain-robot en groupe

Des chercheurs ont publié sur arXiv (référence 2606.28469) une étude expérimentale portant sur le rôle de l'initiative robotique dans la collaboration humain-robot à plusieurs participants. Le protocole place des binômes humains en situation de résolution collaborative de puzzles, à l'intérieur d'un escape room instrumenté, en présence d'un robot humanoïde opérant selon deux modalités distinctes : un modèle réactif, où le robot ne répond que lorsqu'il est directement interpellé, et un modèle proactif, où il écoute en continu, contribue de façon autonome et relance l'interaction de sa propre initiative. Les résultats sont mesurés selon trois axes : performance de résolution de puzzles, fréquence des interactions, et évaluations subjectives via les échelles standardisées Godspeed et RoSAS. Le modèle proactif génère mécaniquement plus d'échanges, mais c'est le modèle réactif qui affiche le taux de complétion le plus élevé : 92,86 % contre 71,42 %. Ce résultat contre-intuitif est central pour quiconque déploie des robots collaboratifs dans un contexte industriel ou de service. L'intuition commune voudrait qu'un robot qui anticipe et prend des initiatives améliore la performance collective ; l'étude montre que ce n'est pas systématiquement le cas, et que la proactivité peut fragmenter l'attention, perturber la prise de tour de parole et dégrader la coordination du groupe. Plus significatif encore : l'effet de la modalité d'interaction dépend fortement du profil de l'utilisateur. Les participants ayant une expérience préalable des LLM résolvent les premiers puzzles plus vite en mode réactif ; ceux ayant déjà travaillé avec des robots, ou se déclarant introvertis, modifient leur évaluation des deux modèles de façon distincte. Pour un intégrateur ou un COO, cela signifie qu'il n'existe pas de configuration universellement optimale : le bon niveau d'initiative robotique dépend du profil des opérateurs et de la structure cognitive de la tâche. L'étude s'inscrit dans un corpus croissant de recherches en interaction humain-robot multi-parties (HRI), un champ qui prend de l'importance à mesure que les robots collaboratifs quittent les cellules isolées pour des environnements partagés et non structurés. L'escape room comme banc d'essai contrôlé pour l'HRI est une approche émergente qui permet de tester des dynamiques de groupe réalistes sans infrastructure industrielle lourde. Sur le plan concurrentiel, les questions d'initiative robotique concernent directement les plateformes de cobots sociaux (Boston Dynamics Spot, Furhat Robotics, mais aussi des acteurs européens comme Enchanted Tools avec Miroka) et les systèmes de guidage adaptatif dans la logistique. L'étude ne donne pas de suite opérationnelle immédiate, mais ses données suggèrent qu'une personalisation du niveau de proactivité selon le profil utilisateur, plutôt qu'un réglage global unique, constitue la piste de conception la plus prometteuse.

UELes résultats sur la proactivité robotique concernent directement des acteurs européens comme Enchanted Tools (Miroka) et les intégrateurs de cobots déployant des robots en environnements partagés non structurés.

RecherchePaper
1 source
Modèles vision-langage pour la navigation de robots sociaux déployables : relier le raisonnement sémantique et le contrôle de bas niveau
156arXiv cs.RO 

Modèles vision-langage pour la navigation de robots sociaux déployables : relier le raisonnement sémantique et le contrôle de bas niveau

Des chercheurs ont publié fin juin 2026 une étude de synthèse (arXiv:2606.28760) consacrée à l'intégration des modèles vision-langage (VLM) dans les systèmes de navigation sociale pour robots mobiles. Le papier, qui recense l'état de l'art dans ce domaine encore fragmenté, structure les approches existantes autour de trois composantes interdépendantes : le raisonnement de haut niveau assuré par le VLM, les modules de planification et de contrôle bas niveau, et les mécanismes intermédiaires qui assurent la traduction entre les deux couches. Les auteurs proposent en parallèle une feuille de route structurée couvrant l'ancrage spatial, les représentations intermédiaires, les évaluateurs sémantiques et les modules de contrôle, avec une revue des jeux de données et plateformes d'évaluation disponibles pour la navigation sociale. L'enjeu mis en évidence est précisément celui qui bloque le passage en production de nombreux robots de service : les méthodes classiques de navigation (SLAM, planification métrique, évitement d'obstacles) sont fiables mais aveugles aux normes sociales, aux intentions humaines et au contexte situationnel. Un robot qui calcule la trajectoire optimale dans un couloir d'hôpital ne sait pas, sans couche sémantique, qu'il coupe la route à un soignant pressé ou s'arrête trop près d'un patient. Les VLMs apportent ce raisonnement commun et la compréhension du langage naturel, mais leur latence et leur non-déterminisme les rendent difficiles à coupler directement à des boucles de contrôle temps-réel et safety-critical. L'article argumente que des architectures hybrides, VLM pour le raisonnement, contrôleurs classiques pour l'exécution, sont aujourd'hui la seule voie viable vers le déploiement. Ce travail s'inscrit dans un mouvement plus large d'hybridation entre fondation models et robotique embarquée, porté ces deux dernières années par des papiers comme RT-2 (Google DeepMind), SayCan (Everyday Robots) et les travaux de navigation sémantique de CMU et Stanford. Côté industriel, les plateformes de robots de service (Keenon, Pudu, Bear Robotics côté asie-pacifique ; Enchanted Tools en France avec Miroki) cherchent précisément à résoudre ce passage de l'interaction naturelle au mouvement contraint. Le survey ne décrit pas un système déployé mais un cadre de référence académique, à lire comme une cartographie des briques disponibles plutôt que comme une validation terrain.

UEEnchanted Tools (Miroki, France) est directement concerné par cette feuille de route : le survey valide l'approche hybride VLM + contrôle classique comme voie viable pour les robots de service sociaux, fournissant un cadre de référence utilisable par les équipes R&D européennes travaillant sur le déploiement en milieux contraints.

IA physiqueOpinion
1 source
ReaDy-Go : simulation dynamique réel-vers-sim par Gaussian Splatting 3D pour la navigation visuelle avec obstacles mobiles
157arXiv cs.RO 

ReaDy-Go : simulation dynamique réel-vers-sim par Gaussian Splatting 3D pour la navigation visuelle avec obstacles mobiles

Des chercheurs présentent dans un preprint arXiv (référence 2602.11575, troisième version) un pipeline baptisé ReaDy-Go qui vise à combler l'écart simulation-réalité pour la navigation visuelle robotique en environnements dynamiques. Le principe : reconstruire une scène réelle cible (domicile, restaurant, usine) sous forme de nuage de gaussiennes 3D (Gaussian Splatting, ou GS), puis y insérer des avatars humains animables, eux aussi représentés en GS photoreáliste, dont les mouvements sont synthétisés à partir de trajectoires 2D. Un planificateur expert dédié aux représentations GS dynamiques, couplé à un planificateur humain, génère ensuite automatiquement des milliers de scénarios de navigation depuis des points de vue arbitraires. Les politiques de navigation entraînées sur ces datasets sont ensuite déployées sur robot physique. Les auteurs rapportent des gains de performance en simulation et en conditions réelles face à des obstacles mobiles, ainsi qu'un transfert zero-shot dans un environnement inédit, ce qui suggère une capacité de généralisation au-delà des scènes d'entraînement. L'enjeu industriel est significatif pour les intégrateurs de robots de service et les concepteurs de systèmes AMR (autonomous mobile robots) en environnements non contrôlés. Le verrou principal que ReaDy-Go cherche à lever est double : les méthodes classiques souffrent d'un sim-to-real gap important parce que les scènes d'entraînement sont génériques, et les obstacles dynamiques y sont soit absents, soit représentés par des mannequins non photoréalistes issus de simulateurs comme Isaac Sim ou Gazebo. En ancrant la simulation dans une reconstruction GS de l'environnement cible réel et en peuplant cette scène d'avatars humains photoréalistes et cinématiquement plausibles, l'approche réduit la distance de distribution entre entraînement et déploiement. Il s'agit d'une contribution méthodologique, pas d'un produit commercialisé ; les résultats restent à ce stade des démonstrations académiques, et les métriques annoncées (temps de cycle, taux de succès) gagneraient à être contextualisées par des conditions de test plus variées. Le Gaussian Splatting a émergé comme technique de reconstruction 3D rapide et photoréaliste depuis les travaux de Kerbl et al. en 2023, et plusieurs groupes l'ont depuis exploré pour la simulation robotique, notamment pour la manipulation (voir les travaux de RoboGSim ou GaussianWorld). ReaDy-Go se distingue en ciblant la navigation en présence de piétons, un cas d'usage critique pour les robots de livraison indoor et les plateformes de service en espace public. Sur ce segment, les concurrents directs incluent les pipelines basés sur NeRF (plus lents à l'entraînement), les simulateurs procéduraux type NVIDIA Omniverse, et des approches comme UniSim ou HabitatSim. Aucun acteur européen n'est cité dans le preprint, mais des équipes comme Enchanted Tools (robotique de service, France) ou les labos de navigation de l'INRIA pourraient trouver dans ReaDy-Go une brique de simulation réutilisable. La page projet est accessible et le code pourrait être publié ; les prochaines étapes naturelles seraient des tests à plus grande échelle avec diversité de populations et d'environnements, et une intégration dans des stacks de navigation open-source comme Nav2.

UECette méthode de simulation photoréaliste à base de Gaussian Splatting pourrait être réutilisée par des équipes européennes de navigation robotique (INRIA, Enchanted Tools) pour réduire le sim-to-real gap sans dépendre de simulateurs propriétaires comme Isaac Sim ou NVIDIA Omniverse.

RecherchePaper
1 source
Emcar : contrôleur incarné pour l'animation de robots
158arXiv cs.RO 

Emcar : contrôleur incarné pour l'animation de robots

Une équipe de chercheurs a publié le 25 juin 2026 sur arXiv (2506.26008) la description d'EMCAR, un outil logiciel de programmation de mouvements robotiques basé sur des métaphores artistiques comme la marionnette et le dessin. La plateforme, présentée dans le cadre de la recherche en interaction humain-robot (HRI), adopte une approche no-code : aucune ligne de code n'est requise pour concevoir, tester et déployer des comportements sur des robots collaboratifs. L'article ne précise pas de plateformes matérielles cibles ni de métriques de performance (temps de programmation, taux d'erreur), ce qui limite l'évaluation des gains réels. L'enjeu central est celui de l'accessibilité : la programmation de cobots reste aujourd'hui l'apanage d'ingénieurs formés en robotique ou en ROS, ce qui freine le déploiement dans des environnements non-industriels (médiation culturelle, thérapie, spectacle vivant). En ouvrant l'outil à des artistes et à des profils sans bagage technique, EMCAR vise à élargir le spectre des cas d'usage HRI et à alimenter la recherche participative. Si la démonstration tient à l'échelle, cela confirmerait que l'abstraction par le geste et le mouvement peut substituer efficacement les interfaces de programmation classiques pour des tâches expressives. Ce type d'approche s'inscrit dans un courant établi : Choreograph de SoftBank Robotics pour Pepper et NAO, les interfaces de programmation par démonstration de Universal Robots, ou encore les environnements visuels Scratch-for-robots développés en milieu académique. Des acteurs français comme Enchanted Tools (Miroki) explorent également des paradigmes d'interaction expressifs pour les cobots. La suite dépendra de l'ouverture du code et des validations expérimentales avec des utilisateurs non-techniques, non encore publiées.

UESi EMCAR publie son code en open-source avec validation expérimentale, des acteurs français comme Enchanted Tools (Miroki) pourraient accélérer leurs interfaces de programmation expressive pour cobots dans des secteurs non-industriels (médiation culturelle, thérapie).

RecherchePaper
1 source
Plateforme d'IA incarnée évolutive pour le transfert réel-sim-réel de tâches de manipulation mobile domestique
159arXiv cs.RO 

Plateforme d'IA incarnée évolutive pour le transfert réel-sim-réel de tâches de manipulation mobile domestique

Une équipe de chercheurs a publié sur arXiv (référence 2606.18646v1) les travaux autour de BestMan, une plateforme logicielle conçue pour boucler le cycle real-to-sim-to-real dans le domaine de la manipulation mobile en environnements domestiques. Le système s'articule autour de trois composants : un module de génération automatique de scènes (ASG) qui reconstruit des environnements simulés à partir d'observations réelles, une architecture d'apprentissage de compétences hybrides évaluable à grande échelle en simulation, et un middleware unifié baptisé HUM (Hardware-agnostic and Unified Middleware) assurant le déploiement sur des manipulateurs mobiles hétérogènes. Il s'agit d'une contribution académique sous forme de preprint, pas d'un produit commercialisé ni d'un déploiement industriel annoncé. L'enjeu central que traite BestMan est le fossé sim-to-real, l'un des verrous les plus persistants de la robotique d'intérieur. La manipulation mobile en environnement non-structuré, c'est-à-dire sur des surfaces encombrées, dans des cuisines ou des entrepôts domestiques sans balisage préalable, reste hors de portée des approches qui nécessitent une reconstruction manuelle et coûteuse des scènes de simulation. Le module ASG automatise cette étape, ce qui réduit le coût d'entrée pour les chercheurs souhaitant tester des stratégies de contrôle. Le middleware HUM, s'il tient ses promesses d'agnosticisme matériel, simplifierait le travail des intégrateurs qui opèrent des flottes de robots hétérogènes : une seule pipeline de simulation pour plusieurs plateformes physiques. L'article revendique des benchmarks standardisés, ce qui manquait cruellement dans le champ de la manipulation mobile, mais les métriques précises de performance (taux de succès, temps de cycle, généralisation à des objets inconnus) ne sont pas détaillées dans l'abstract. BestMan s'inscrit dans une vague de plateformes d'intelligence incarnée visant à industrialiser le pipeline simulation-réel : on pense à Isaac Sim de NVIDIA, à Genesis (plateforme de simulation physique open-source), ou encore aux travaux de Physical Intelligence (pi) autour de Pi-0 qui misent sur les VLA (vision-language-action models) pour généraliser sans retraining massif. Côté européen, des acteurs comme Enchanted Tools (Miroki) ou Wandercraft (Atalante) traitent des problèmes adjacents de transfert sim-réel mais sur des morphologies très différentes. L'équipe derrière BestMan ne précise pas de partenariats industriels ni de calendrier de mise à disposition publique de la plateforme : la prochaine étape logique serait une validation sur plusieurs familles de robots et une ouverture du code pour permettre des benchmarks communautaires comparables.

UEImpact indirect potentiel pour les acteurs européens comme Enchanted Tools ou Wandercraft si la plateforme est rendue publique, mais aucun déploiement ou partenariat européen documenté à ce stade.

RecherchePaper
1 source
Advanced Humanoid Forum 2027 en Allemagne
160Robot Magazine FR 

Advanced Humanoid Forum 2027 en Allemagne

Le forum Advanced Humanoid Forum 2027 se tiendra les 20 et 21 janvier 2027 à Munich, en Allemagne. Fondé par Ulrich Moeller, expert de l'industrie robotique, l'événement vise à réunir fabricants de robots humanoïdes, développeurs d'intelligence artificielle, industriels utilisateurs, centres de recherche, investisseurs et intégrateurs en un même lieu. L'objectif déclaré est d'accélérer le passage de la simulation à des déploiements industriels réels. Parmi les acteurs du secteur cités figurent Tesla, Figure AI, Agility Robotics, Apptronik, Sanctuary AI et Unitree, dont les démonstrations publiques restent pour l'instant peu converties en exploitations intensives. Les marchés prioritaires identifiés sont l'industrie manufacturière, la logistique, la santé et la construction, secteurs confrontés à une pénurie croissante de main-d'œuvre. À noter : l'article source est incomplet et ne fournit pas de données précises sur les conférenciers confirmés, le nombre d'exposants attendus ni les tarifs d'inscription. Ce forum pointe un verrou réel : le secteur a accumulé des capacités en laboratoire (marche bipède, préhension, navigation) sans les convertir massivement en valeur industrielle. Le défi n'est plus uniquement moteur, il est systémique, fiabilité en environnement dégradé, certification sécurité, temps de cycle garantis, retour sur investissement démontrable. L'intégration de plusieurs briques technologiques est en jeu : modèles vision-langage-action (VLA) pour l'interprétation d'instructions complexes, jumeaux numériques pour l'apprentissage en simulation avant déploiement terrain, architectures cloud et edge pour la gestion de flottes à grande échelle. Munich est un choix cohérent : l'Allemagne est la première puissance industrielle européenne, avec un tissu dense d'OEM automobiles, d'équipementiers et d'intégrateurs capables d'absorber des pilotes à l'échelle. Plusieurs années de progrès conjoints en IA, vision par ordinateur, actionneurs et capteurs ont permis l'émergence de cette nouvelle génération d'humanoïdes, sans qu'aucun acteur n'ait encore atteint de déploiement de masse documenté avec métriques vérifiables. Tesla Optimus, Figure AI, Agility Robotics (racheté par Amazon), Apptronik, Sanctuary AI et Unitree multiplient les annonces et les vidéos soigneusement choisies, mais les données de production restent rares. Aucun acteur français ou européen n'est mentionné dans l'article source, ce qui constitue un angle manquant : des entreprises comme Enchanted Tools ou Wandercraft sont pourtant actives sur le segment humanoïde en Europe. Le forum reste à ce stade une annonce, pas un événement tenu. Ses prochaines étapes naturelles, publication du programme détaillé et liste des conférenciers industriels confirmés, seront les indicateurs les plus solides de sa capacité réelle à fédérer l'écosystème.

UELe forum à Munich cible directement l'industrie manufacturière et logistique européenne comme premier marché d'adoption des humanoïdes, mais l'absence de constructeurs ou laboratoires européens parmi les participants annoncés en réduit l'impact concret pour l'écosystème FR/EU.

FR/EU ecosystemeOpinion
1 source
Un cadre de téléopération bilatérale pour la manipulation dextérique
161arXiv cs.RO 

Un cadre de téléopération bilatérale pour la manipulation dextérique

Une équipe de chercheurs publie, dans un preprint arXiv déposé en juin 2026 (arXiv:2606.15434), un système modulaire de téleopération bilatérale conçu pour la manipulation dextre en environnements réels à fort contact. L'architecture proposée couple une interface côté opérateur à un bras robotique compliant et à une main mécanique dextre côté robot, dans une boucle de contrôle unifiée. Quatre fonctionnalités centrales sont documentées : le retargeting de posture de main par positions (adaptation des commandes d'une main humaine vers une main robotique de morphologie différente), la commande différentielle du bras, le retour haptique multi-échelle, et un mécanisme de contrôle partagé pour stabiliser les phases de manipulation en contact. Le framework est validé sur une tâche réelle de manipulation dextre, sans que les métriques de performance - latence, temps de cycle, taux de succès - ne soient communiquées dans le résumé public disponible. L'intérêt principal de ce travail pour les équipes de recherche et les intégrateurs ne réside pas dans les performances brutes du système de téleopération lui-même, mais dans sa vocation déclarée de plateforme de collecte de démonstrations haute qualité pour l'apprentissage par imitation (learning from demonstration). À l'heure où les architectures VLA (Vision-Language-Action) - comme pi0 de Physical Intelligence ou GR00T N2 de NVIDIA - exigent des datasets massifs de trajectoires expertes en manipulation fine, la qualité du pipeline de collecte devient un goulot d'étranglement critique. Les auteurs identifient aussi trois problèmes de conception restant ouverts : le mismatch cross-embodiment (écart morphologique entre la main de l'opérateur et celle du robot), la granularité du retour haptique, et le dosage optimal du contrôle partagé. Ce framework s'inscrit dans une tendance de fond visant à standardiser l'infrastructure de collecte de données téléopérées, dans la lignée du système ALOHA de Stanford ou de la plateforme UMI. Les acteurs européens comme Enchanted Tools (France) ou les équipes robotique de l'INRIA travaillent sur des problématiques similaires de couplage haptique et de retargeting pour la manipulation fine. Ce preprint ne présente pas de chiffres de déploiement ni de partenariats industriels annoncés : il s'agit d'une contribution académique amont, dont la suite logique serait la publication d'un dataset de démonstrations et de benchmarks comparatifs sur des tâches de manipulation standardisées.

UELes équipes françaises (Enchanted Tools, INRIA) travaillent sur des problématiques similaires de couplage haptique et de retargeting, ce framework pourrait alimenter leurs pipelines de collecte de démonstrations pour entraîner des modèles VLA.

RecherchePaper
1 source
SyLink Hand : main anthropomorphe à mécanisme de bielles inspiré des synergies pour une dextérité humaine
162arXiv cs.RO 

SyLink Hand : main anthropomorphe à mécanisme de bielles inspiré des synergies pour une dextérité humaine

Une équipe de chercheurs a publié en juin 2026 sur arXiv (preprint 2606.14250) les spécifications techniques de la SyLink Hand, une main robotique anthropomorphe de 520 grammes conçue pour reproduire la cinématique de la main humaine avec un budget de fabrication d'environ 400 dollars. La conception repose sur deux principes combinés : les synergies biomécaniques de la main humaine, identifiées grâce à des gants de capture de mouvement qui révèlent de fortes corrélations entre articulations voisines, et des mécanismes de liaisons rigides (linkages) qui coordonnent plusieurs joints à partir d'un seul actionneur. Résultat : 19 articulations pilotées par seulement 11 actionneurs. L'équipe introduit également une liaison à quatre barres sphérique originale permettant de découpler indépendamment la flexion/extension et l'abduction/adduction à l'articulation métacarpophalangienne (MCP), dans un encombrement compact. Ce rapport de 11 actionneurs pour 19 degrés de liberté est le point saillant de ce travail. Dans la plupart des mains dextres existantes, la multiplication des actionneurs fait exploser masse, coût et complexité de contrôle. En s'appuyant sur les synergies naturelles de la main (le fait que les doigts bougent rarement de façon totalement indépendante), les auteurs réduisent le problème sans sacrifier l'anthropomorphisme cinématique. Un coût de fabrication de 400 dollars positionne la SyLink Hand très en dessous des références académiques comme la Shadow Hand (plusieurs dizaines de milliers d'euros) ou l'Allegro Hand (Wonik Robotics, environ 4 000 dollars). Cela ouvre un couloir d'accessibilité pour la robotique de service, les plateformes de recherche ou l'intégration dans des humanoïdes à budget contraint. Reste à noter que les évaluations présentées sont expérimentales et issues d'un prototype de laboratoire : aucun déploiement industriel ni partenariat industriel n'est annoncé. Cette publication s'inscrit dans une compétition académique et industrielle dense autour des mains robotiques dextres. Shadow Robot (UK) domine le segment haute performance avec la Dexterous Hand, tandis que des projets open-source comme LEAP Hand (Carnegie Mellon, 2023) ou la main de Dexterous Robotics ciblent également le compromis coût/performance. Côté humanoïdes, Figure (Figure 03), Tesla (Optimus Gen 3) et Agility Robotics développent leurs propres solutions de préhension intégrées. En Europe, des acteurs comme Enchanted Tools (France) conçoivent des mains orientées interaction sociale. La SyLink Hand, en tant que preprint sans partenaire industriel déclaré, reste pour l'instant une contribution académique prometteuse. Les suites dépendront de sa capacité à passer des tests de lab aux conditions réelles d'utilisation, notamment en durabilité des liaisons mécaniques sous cycles répétés.

RecherchePaper
1 source
Première mondiale : un chien robot quadrupède traverse des plaques de glace arctiques traîtresses
163Interesting Engineering 

Première mondiale : un chien robot quadrupède traverse des plaques de glace arctiques traîtresses

Un quadrupède de moins de 20 kilogrammes vient de traverser les banquises de l'océan Arctique en navigation autonome, une première revendiquée pour un robot à pattes commercialement disponible. Le Lynx S10, développé par la société chinoise DEEP Robotics (spin-off de l'université de Zhejiang fondé en 2018), a été engagé lors d'une expédition polaire en conditions réelles, naviguant sur des plaques de glace flottantes parsemées de zones d'eau libre. La plateforme standard embarque 16 articulations de précision, quatre caméras ultra grand-angle à haute plage dynamique et des capteurs LiDAR avant/arrière pour la cartographie 3D en temps réel. Elle opère entre -20°C et +55°C, plafonne à 8 m/s sur sol plat, franchit des obstacles de 50 cm de hauteur et supporte une charge utile supérieure à 8 kg. Pour l'Arctique, DEEP Robotics a modifié la machine : les roues standards ont cédé la place à des pattes biomimétiques inspirées du pied de l'ours polaire (surface élargie pour répartir le poids, crampons anti-glisse intégrés), l'indice d'étanchéité est passé de l'IP66 à l'IP67, et les membres ont été redessinés pour fonctionner comme des pagaies dans les zones de gadoue mêlant glace et eau. L'enjeu ne se résume pas à la résistance au froid, que plusieurs plateformes industrielles atteignent déjà. Ce qui est nouveau, c'est la capacité à planifier des trajectoires et éviter des obstacles en autonomie sur un terrain non structuré, instable et potentiellement mortel. Les banquises arctiques cumulent les cas limites qui font échouer les algorithmes classiques : surface déformable, obstacles dissimulés sous la neige, zones d'eau affleurante sans marquage visuel net. La réussite du Lynx S10 valide simultanément plusieurs hypothèses : la fusion LiDAR-caméra HDR est suffisamment robuste pour distinguer neige sèche, glace vive et slush ; le contrôle de gait s'adapte en temps réel à des frictions variables ; la morphologie biomimétique des pattes apporte un gain mesurable là où roues et chenilles peinent. Pour les intégrateurs et décideurs industriels, la portabilité par une seule personne sans logistique lourde ouvre des cas d'usage concrets en milieu polaire, offshore et post-catastrophe. DEEP Robotics occupe un segment intermédiaire dans un marché quadrupède dominé par Boston Dynamics (Spot), Unitree (Go2, B2) et ANYbotics (ANYmal), ce dernier déjà qualifié pour les inspections offshore et les environnements ATEX. Cette expédition arctique s'inscrit dans une stratégie de validation terrain agressive, comparable aux démonstrations industrielles d'Unitree. Aucun concurrent n'a publié de données équivalentes sur des déploiements polaires réels, même si Boston Dynamics a documenté des tests hivernaux avec Spot. En Europe, des acteurs comme Enchanted Tools et Pollen Robotics restent positionnés sur des niches distinctes. DEEP Robotics n'a communiqué ni calendrier de commercialisation ni tarification pour la variante arctique du Lynx S10 : l'expédition demeure à ce stade une preuve de concept documentée, pas un produit commercialisé.

Chine/AsieOpinion
1 source
Main dextérique modulaire et anthropomorphique : conception par analyse comparative multi-paramètres des doigts
164arXiv cs.RO 

Main dextérique modulaire et anthropomorphique : conception par analyse comparative multi-paramètres des doigts

Des chercheurs ont publié en juin 2026 sur arXiv (arXiv:2606.11826) un framework de conception pour mains robotiques anthropomorphiques dextres, fondé sur une approche modulaire de sélection des doigts. Le principe : évaluer quantitativement des prototypes de doigts de manière indépendante, via une batterie de benchmarks, avant leur intégration dans une main complète téléopérée. Les variations testées portent sur le type d'articulation, la structure osseuse, les matériaux de peau et le placement des capteurs. Le framework a été validé sur deux tâches concrètes : la saisie simultanée de plusieurs objets et le vissage d'une ampoule, deux exercices représentatifs de la manipulation dextre à contraintes mécaniques variables. Ce travail s'attaque à un verrou structurel du domaine : la conception de mains dextres souffre d'un espace de design trop vaste, où morphologie, actuation et capteurs interagissent de façon non-linéaire. Les méthodes d'optimisation existantes traitent rarement plus d'un critère à la fois, ce qui rend les comparaisons inter-prototypes difficiles et les itérations coûteuses. En découplant l'optimisation des doigts de la validation au niveau de la main entière, le framework proposé réduit potentiellement le temps de screening et établit un lien quantitatif entre les métriques composant et la performance globale en tâche. Pour les équipes d'ingénierie et les intégrateurs, c'est une promesse de pipeline de développement plus prédictif, moins dépendant de l'empirisme. À noter : l'article est un preprint arXiv, sans peer review encore validé, et les gains de performance sur les deux tâches choisies restent difficiles à extrapoler à des scénarios industriels réels. La conception de mains dextres est un enjeu central pour les robots humanoïdes actuels : Figure AI, 1X, Apptronik, et Agility Robotics dépendent toutes de mains capables d'alimenter des pipelines de téléopération et d'apprentissage par imitation pour entraîner des modèles VLA. Côté académique, des groupes à Stanford, CMU et au MIT travaillent sur des architectures similaires, tandis que Shadow Robotics (UK) reste la référence commerciale en matière de main dextre à actuation tendon. En Europe, Pollen Robotics (Bordeaux) intègre des mains articulées dans sa plateforme Reachy, et Enchanted Tools (Paris) développe des mains expressives pour ses robots Miroka. Ce preprint ne s'accompagne pas d'annonce commerciale ni de calendrier de déploiement, mais la méthodologie de benchmarking modulaire pourrait être adoptée comme standard de facto dans les équipes hardware des startups d'humanoïdes, où la vitesse d'itération sur les effecteurs est aujourd'hui un facteur différenciant clé.

UEPollen Robotics (Bordeaux) et Enchanted Tools (Paris) sont directement mentionnés comme bénéficiaires potentiels de cette méthodologie de benchmarking modulaire, qui pourrait accélérer leurs cycles d'itération sur les effecteurs.

RecherchePaper
1 source
Equanimité dans l'interaction humain-robot : appliquer les principes de la technologie calme
165arXiv cs.RO 

Equanimité dans l'interaction humain-robot : appliquer les principes de la technologie calme

Un article publié en juin 2026 sur arXiv (identifiant 2606.09836) propose un cadre théorique et pratique pour intégrer les principes de la "Calm Technology" dans l'interaction humain-robot (HRI), avec un focus sur l'environnement domestique. Les auteurs formulent des lignes directrices concrètes pour concevoir des robots d'assistance qui privilégient l'équanimité de l'utilisateur, c'est-à-dire des interactions calmes, non intrusives et harmonieuses. L'étude cible spécifiquement les assistants domestiques, identifiés comme opérant dans l'espace le plus intime de la vie quotidienne, ce qui justifie une approche de conception distincte de celle des environnements industriels ou commerciaux. Aucun prototype ni déploiement spécifique n'est présenté : il s'agit d'un article de cadrage conceptuel, pas d'un produit commercialisé. L'enjeu est significatif pour les concepteurs de robots sociaux et domestiques. La "Calm Technology", concept forgé par Mark Weiser et John Seely Brown chez Xerox PARC dans les années 1990, postule que les meilleures interfaces technologiques opèrent à la périphérie de l'attention humaine, n'intervenant au premier plan que lorsque c'est strictement nécessaire. Son application formalisée à la robotique reste encore rare : la majorité des plateformes actuelles sont conçues pour solliciter activement l'utilisateur, créant une charge cognitive continue. L'article argumente que cette posture est incompatible avec les besoins de confort et d'autonomie dans un foyer, et fournit des exemples concrets de fonctionnalités à intégrer pour réduire cette friction attentionnelle. Ce travail s'inscrit dans un courant émergent autour de la robotique responsable et du design comportemental, qui prend de l'ampleur alors que plusieurs acteurs avancent leurs projets de robots domestiques : Enchanted Tools en France avec son robot Miroki, 1X Technologies en Norvège, ou encore Samsung et ses prototypes d'assistants résidentiels. Au-delà des performances mécaniques (payload, degrés de liberté, cycle time), le design de l'interaction devient un différenciateur clé pour l'acceptation sociale de ces systèmes. L'article ouvre des pistes de recherche appliquée sur la modulation de la proactivité robotique, le silence contextuel, et la hiérarchisation des signaux d'alerte, sans citer de calendrier de déploiement ni de partenaires industriels.

UELes lignes directrices proposées pourraient bénéficier aux concepteurs européens de robots domestiques, notamment Enchanted Tools (Miroki, France) et 1X Technologies (Norvège), en fournissant un cadre de design axé sur la réduction de la charge cognitive et l'acceptabilité sociale.

RecherchePaper
1 source
Pourquoi l'usinage suisse de précision est essentiel à l'avenir de la robotique et de l'automatisation
166Robotics & Automation News 

Pourquoi l'usinage suisse de précision est essentiel à l'avenir de la robotique et de l'automatisation

L'essor mondial de la robotique industrielle et des systèmes de fabrication intelligente génère une demande croissante pour des composants mécaniques usinés avec une précision extrême. Les robots collaboratifs, les systèmes d'assemblage automatisé et les équipements de production pilotés par capteurs reposent sur des pièces dont les tolérances s'expriment en microns. L'usinage de décolletage suisse (Swiss machining), technique CNC spécialisée dans la production de pièces cylindriques de petits diamètres à très haute précision, s'impose comme un maillon critique de cette chaîne d'approvisionnement, notamment pour les axes, arbres, vis-mères et composants de transmission intégrés dans les actionneurs et joints des bras robotiques. L'enjeu est structurel : un robot industriel ou collaboratif ne peut maintenir ses performances en production continue que si chaque composant respecte des tolérances serrées sur la durée. Une pièce légèrement hors cote dans un réducteur harmonique ou un rail de guidage peut induire des dérives cumulatives qui compromettent la répétabilité, paramètre central pour tout déploiement en ligne d'assemblage. Cela positionne les sous-traitants en décolletage suisse comme des fournisseurs de premier rang pour les intégrateurs robotiques, au même titre que les fournisseurs de motoréducteurs ou d'électronique embarquée. À noter : l'article reste de niveau "livre blanc promotionnel" et ne cite aucune métrique concrète ni aucun client. Le décolletage suisse est une industrie centenaire dominée par des acteurs européens, notamment en Suisse (canton de Neuchâtel) et dans le Jura français (Arc jurassien), ainsi qu'au Japon et en Allemagne. Face à la montée en charge des commandes robotiques, portée par Figure AI, Boston Dynamics, 1X Technologies ou encore le français Enchanted Tools, ces sous-traitants de précision se retrouvent en position stratégique, à condition d'investir dans l'automatisation de leur propre production pour tenir les volumes demandés par une industrie qui s'industrialise rapidement.

UELes sous-traitants en décolletage de l'Arc jurassien français sont directement positionnés comme fournisseurs stratégiques pour la vague de commandes robotiques mondiale, mais devront investir dans leur propre automatisation pour tenir les volumes.

FR/EU ecosystemeActu
1 source
Completion at the Boundary (CaB) : commutation déployable avec contrôle par complétion sous calibration limitée
167arXiv cs.RO 

Completion at the Boundary (CaB) : commutation déployable avec contrôle par complétion sous calibration limitée

Des agents vision-langage-action (VLA) peuvent aujourd'hui exécuter des instructions en langage naturel, mais les systèmes déployés butent sur un angle mort critique : savoir quand une instruction est terminée. Des chercheurs décrivent dans l'article arXiv:2606.00145 une méthode baptisée Completion at the Boundary (CaB), conçue pour résoudre ce problème de détection de complétion dans un régime dit "à faible calibration", c'est-à-dire sans réapprentissage à l'inférence et avec une seule règle de commutation calibrée une fois sur le jeu de développement, puis réutilisée telle quelle en test. Le problème est particulièrement aigu sur les instructions composites du type "fais A, puis B" : un passage de relais mal chronométré propage une erreur en cascade sur toutes les étapes suivantes. CaB modélise la complétion comme un objet local à l'événement, sous forme de Boundary-Phase Tokens (trois états : Before, Hit, After), préservant ainsi une preuve bilatérale autour de la frontière de transition plutôt que de la comprimer en un scalaire unique. Le module CaB-When exploite cet objet pour décider quand commuter, tandis que CaB-How le réutilise pour conditionner la génération d'actions et stabiliser le comportement pendant le handoff. Les auteurs évaluent CaB sur un benchmark VLA en vue subjective dans Minecraft, via un protocole E1/E2 tenant compte des interventions, et montrent une amélioration de l'exécution composite et de la qualité des transitions à capacité égale. L'enjeu industriel est réel : la majorité des benchmarks VLA mesurent l'exécution d'une tâche atomique, mais les déploiements réels enchaînent des dizaines d'étapes. Sans mécanisme de complétion robuste, un agent peut dépasser sa cible, réexécuter une action terminée, ou passer au mauvais moment sur l'instruction suivante. Le choix d'un régime à faible calibration est significatif : il contraint la méthode à être directement déployable sans fine-tuning par site, ce qui est exactement ce que demande un intégrateur industriel. Le point faible identifié dans l'approche scalaire classique, la fragilité face aux "polarity shifts" entre tâches hétérogènes, est un problème concret que les praticiens connaissent bien mais rarement formalisent. À noter que les expériences restent sur Minecraft et non sur robot physique : le gap sim-to-real n'est pas adressé ici. CaB s'inscrit dans un courant de recherche dense autour des VLA multi-étapes, porté notamment par pi-0 de Physical Intelligence (qui gère déjà des workflows longue durée), GR00T N2 de NVIDIA, et les travaux d'OpenVLA. Le problème de la détection de fin de tâche est connexe aux travaux sur la segmentation temporelle en imitation learning (skill boundaries, option termination dans les HRL). Minecraft est un benchmark établi pour les agents langage-action (cf. STEVE-1, Voyager), ce qui facilite les comparaisons mais éloigne de la manipulation physique. La suite logique serait une validation sur des manipulateurs réels avec des instructions composites de type pick-and-place, terrain où des acteurs comme Enchanted Tools ou Pollen Robotics en Europe pourraient trouver un intérêt direct à intégrer ce type de module de complétion dans leurs pipelines VLA.

UEDes acteurs européens comme Enchanted Tools et Pollen Robotics pourraient à terme intégrer un module de complétion de type CaB dans leurs pipelines VLA, mais le gap sim-to-real reste entier, les expériences se limitant à Minecraft sans validation sur manipulateur physique.

RechercheOpinion
1 source
Intégration IA-IoT-Robotique : panorama des frameworks, tendances émergentes et voie vers la robotique connectée
168arXiv cs.RO 

Intégration IA-IoT-Robotique : panorama des frameworks, tendances émergentes et voie vers la robotique connectée

Une équipe de chercheurs a publié début juin 2026 sur arXiv (réf. 2606.01015) une revue de la littérature consacrée à l'intégration conjointe de l'intelligence artificielle, de l'Internet des objets (IoT) et de la robotique, trois domaines qui progressaient jusqu'ici principalement deux à deux. Les auteurs recensent les travaux existants autour de combinaisons établies, l'AIoT (IA et IoT) et l'Internet of Robotic Things (IoRT, couplant IoT et robotique), et constatent l'absence persistante de cadres de conception unifiés orchestrant les trois disciplines simultanément. Leur principale contribution est une architecture modulaire où des petits modèles de langage (SLM, Small Language Models) assurent l'inférence locale en bordure de réseau (edge), tandis que des grands modèles de langage (LLM) hébergés dans le cloud prennent en charge le raisonnement de haut niveau et la prise de décision autonome. Pour les intégrateurs industriels et les responsables techniques B2B, l'architecture hybride SLM-LLM proposée répond à deux contraintes opérationnelles majeures : réduire la latence en traitant localement les données capteurs, et limiter la dépendance réseau dans des environnements de production. La revue identifie des verrous encore ouverts, notamment l'interopérabilité entre protocoles hétérogènes et la boucle de contrôle par retour d'information dans des systèmes multi-agents distribués. Il convient de souligner que ces résultats restent à ce stade conceptuels : le papier propose un cadre et une taxonomie, pas un système validé en déploiement réel, et l'absence de benchmarks reproductibles est explicitement signalée comme une limite. Ce travail s'inscrit dans un courant académique et industriel que NVIDIA a popularisé sous le terme de Physical AI, désignant des systèmes capables d'agir dans le monde physique via des robots ou des actionneurs connectés. La robotique connectée que dessine ce survey fait écho aux développements de plateformes cloud-robot portés par des acteurs comme Boston Dynamics, ou en Europe par des intégrateurs spécialisés comme Exotec dans les AMR et Enchanted Tools dans la robotique collaborative. Les auteurs identifient eux-mêmes comme prochaine étape la validation expérimentale de leur cadre sur des cas d'usage réels, condition nécessaire pour que l'architecture proposée dépasse le statut de roadmap et devienne une référence opérationnelle pour l'industrie.

UEL'architecture SLM-LLM proposée pourrait bénéficier à terme aux intégrateurs européens comme Exotec (AMR) et Enchanted Tools (cobots), mais reste un cadre conceptuel sans validation terrain ni benchmarks reproductibles.

IA physiquePaper
1 source
EBuddy : orchestrateur de flux de travail pour la collaboration homme-machine industrielle
169arXiv cs.RO 

EBuddy : orchestrateur de flux de travail pour la collaboration homme-machine industrielle

EBuddy est un orchestrateur de procédures guidé par la voix, présenté dans un article de recherche publié sur arXiv (2603.28579, 2026), conçu pour la collaboration humain-machine dans les environnements industriels outillés. Le système repose sur une machine à états finis (FSM) : à chaque instant, l'opérateur dispose d'un cadre décisionnel explicite (état courant et actions admissibles), ce qui contraint l'interprétation des commandes vocales à des transitions cohérentes et réduit les ambiguïtés inhérentes au langage naturel. Via reconnaissance automatique de la parole (ASR) et compréhension d'intention, EBuddy pilote des ressources hétérogènes incluant des logiciels à interface graphique et un robot collaboratif (cobot), en interaction purement vocale. Un pilote industriel porte sur l'inspection de pales d'impulseur et la préparation de programmes de réparation par dépôt direct d'énergie (DED, procédé d'additive manufacturing adapté à la remise en état de pièces à haute valeur), exécutés en collaboration humain-robot. Les auteurs rapportent des réductions "substantielles" de la durée de bout en bout sur l'onboarding des opérateurs, le scan 3D, le traitement des données et la génération de programmes de réparation. Aucune métrique chiffrée précise n'est publiée dans l'abstract disponible, ce qui invite à réserver le jugement aux résultats complets. La problématique ciblée est structurelle dans la maintenance industrielle : le savoir-faire expert est efficace mais peu scalable, et la qualité d'exécution se dégrade quand les procédures sont reconstituées ad hoc d'un opérateur ou d'une session à l'autre. En encapsulant ce savoir dans des artefacts de workflows modulaires, EBuddy réduit la dépendance aux experts terrain et abaisse la courbe d'apprentissage à l'onboarding. L'architecture FSM offre un avantage décisif sur les pipelines LLM non contraints : en bornant l'espace des actions valides à chaque état, elle limite les hallucinations et les erreurs d'interprétation, critique lorsqu'une mauvaise commande peut endommager une pièce coûteuse ou désynchroniser un cobot. Pour les intégrateurs et les décideurs B2B, c'est une démonstration que l'interface vocale peut piloter un cobot en production réelle, à condition d'être ancrée dans un modèle formel de la procédure plutôt que dans un LLM généraliste non contraint. La recherche en orchestration humain-robot par la voix s'inscrit dans un mouvement plus large porté par les VLA (Vision-Language-Action models) et les assistants multi-modaux pour la robotique industrielle. Des approches concurrentes existent côté académique (ETH Zurich et Carnegie Mellon sur la planification de tâches par LLM) et côté industrie, notamment Universal Robots avec son écosystème URCap et Covariant avec son interface de manipulation. Du côté français, Enchanted Tools, avec son robot Miroki centré sur l'interaction naturelle, travaille un espace adjacent. EBuddy se distingue par son accent mis sur la contrainte formelle de l'espace d'actions et par son application au cas d'usage maintenance/repair, moins exploré que l'assemblage ou la logistique. Les prochaines étapes logiques incluent la publication des métriques complètes du pilote et l'extension du système à d'autres procédures DED ou à de nouveaux environnements de production.

UEL'approche FSM pour l'orchestration vocale de cobots en maintenance industrielle (DED) est directement pertinente pour les intégrateurs européens, Universal Robots (danois) domine l'écosystème cobot, et Enchanted Tools (française) opère dans un espace adjacent d'interaction naturelle homme-robot.

IndustrielPaper
1 source
Planification robotique embarquée : éliminer la redondance d'inférence pour une prise de décision efficace
170arXiv cs.RO 

Planification robotique embarquée : éliminer la redondance d'inférence pour une prise de décision efficace

Des chercheurs ont publié REIS (arXiv:2605.31460), un framework de planification robotique embarquée conçu pour réduire la latence d'inférence des modèles de langage et de vision-langage (LLM/VLM) utilisés comme politiques de contrôle. Le constat central : dans les séquences de tâches robotiques, les observations consécutives produisent fréquemment des actions et sous-objectifs identiques, créant une redondance temporelle massive qui gaspille des ressources de calcul sans apporter d'information supplémentaire. REIS répond à ce problème en combinant trois mécanismes : un filtrage de scène léger (scene gating), un routage d'affordances guidé par les caches clé-valeur (KV-steered affordance routing), et un raisonnement délibératif activé uniquement lorsque la situation l'exige. Les expériences ont été menées sur le benchmark ALFRED, référence pour l'instruction-following en environnement 3D simulé, et sur des tâches robotiques en conditions réelles. Les résultats indiquent une suppression significative de l'overhead de raisonnement avec des performances maintenues sur les métriques standards, sans que des chiffres précis de réduction de latence ne soient communiqués dans le résumé public. La latence d'inférence est l'un des freins principaux à l'adoption des architectures VLA (Vision-Language-Action) en environnement industriel. Un système qui interroge un modèle de plusieurs milliards de paramètres à chaque frame de caméra est difficilement déployable sur un manipulateur en temps réel sans infrastructure cloud dédiée. REIS propose une approche inspirée de la cognition humaine : on ne recalcule pas une décision si le contexte n'a pas changé, économisant les cycles GPU pour les moments où la scène évolue réellement. Pour les intégrateurs et COO industriels, c'est une piste concrète pour rendre les politiques VLM opérables sur matériel embarqué, condition souvent non négociable dans les environnements à contraintes de latence ou de confidentialité des données. La tendance à utiliser des LLM/VLM comme cerveau de planification robotique est portée par des travaux notables : RT-2 et RT-X de Google DeepMind, Pi-0 de Physical Intelligence, GR00T N2 de NVIDIA, ou encore les récents travaux d'Enchanted Tools (France) sur les architectures hybrides. Le gap entre démonstrations académiques et déploiement réel reste cependant structurel : les modèles de grande taille nécessitent typiquement un GPU dédié, incompatible avec les contraintes d'un robot mobile compact. REIS s'inscrit dans un axe de recherche croissant sur l'efficacité computationnelle des politiques incarnées, aux côtés de la distillation de politique, la quantization, et le token merging. Aucun partenariat industriel ni timeline de commercialisation ne sont mentionnés : il s'agit d'une contribution de recherche académique, sans produit livré ni déploiement annoncé à ce stade.

UELa réduction de latence d'inférence VLA intéresse indirectement les acteurs européens travaillant sur l'embarquement, mais REIS reste une contribution académique sans déploiement ni partenariat industriel annoncé en Europe.

RechercheOpinion
1 source
Téléopération en temps réel d'un bras manipulateur en environnement dynamique via un cadre VR
171arXiv cs.RO 

Téléopération en temps réel d'un bras manipulateur en environnement dynamique via un cadre VR

Une équipe de chercheurs a publié sur arXiv (preprint 2605.30989, mai 2026) un framework de téléopération en réalité virtuelle pour piloter un bras manipulateur 7-DOF en temps réel dans des environnements dynamiques. Le système intègre un solveur de cinématique inverse (IK) accéléré sur GPU et un module d'optimisation de trajectoires directement dans l'interface VR, générant des commandes articulaires réalisables à chaque cycle de contrôle. Les expériences couvrent trois scénarios : environnement sans obstacle, avec obstacles statiques, et avec obstacles en mouvement. Dans les trois cas, le système maintient une trajectoire conforme aux intentions de l'opérateur tout en produisant des déviations sécurisées lorsqu'un obstacle interfère avec le chemin commandé. L'intérêt de cette approche réside dans l'adresse d'une lacune connue : la majorité des systèmes de téléopération VR existants ont été conçus comme outils de collecte de données pour l'apprentissage par imitation, sans traiter explicitement les risques de collision ni les erreurs d'opérateurs novices. Ce framework cible un déploiement opérationnel réel dans des environnements à accès difficile ou dangereux (zones irradiées, maintenance industrielle à distance). La capacité à gérer des obstacles mobiles en temps réel, sans interrompre la boucle de contrôle, représente un passage de la démonstration en labo vers une robustesse compatible avec le terrain. Cela dit, les conditions exactes des tests (vitesse des obstacles, latence réseau, durée des séquences) ne sont pas détaillées dans l'abstract, ce qui invite à la prudence sur la généralisation des résultats. La téléopération VR pour la manipulation robotique connaît un regain d'intérêt depuis 2022-2023, portée par des projets comme AnyTeleop, UMI (Universal Manipulation Interface) de Stanford, et les systèmes de collecte de données de Physical Intelligence (pi0). Ces travaux ont majoritairement servi à entraîner des politiques de manipulation, reléguant la sécurité opérationnelle au second plan. En Europe, des acteurs comme Enchanted Tools et des laboratoires comme le LIRMM travaillent sur des problématiques voisines d'interaction humain-robot sécurisée. Ce preprint se positionne comme une brique vers une téléopération déployable plutôt que comme un produit fini, et les prochaines étapes restent à définir : intégration avec des politiques VLA, tests en conditions réelles ou validation en environnement industriel certifié.

UEImpact indirect : le LIRMM et Enchanted Tools travaillent sur des problématiques voisines de téléopération sécurisée, mais ce preprint ne les implique pas et n'est associé à aucun déploiement ou financement européen documenté.

RecherchePaper
1 source
À qui est cet objet ? Inférence contextuelle de propriété par questionnement sous incertitude
172arXiv cs.RO 

À qui est cet objet ? Inférence contextuelle de propriété par questionnement sous incertitude

Des chercheurs ont publié sur arXiv (arXiv:2605.28087) un framework appelé COIN, Context-Aware Object Ownership Inference with Uncertainty-Guided Questioning, conçu pour permettre aux robots de service d'inférer à qui appartient un objet. L'objectif est de résoudre des instructions courantes comme "apporte-moi ma tasse", qui supposent que le robot sache distinguer les objets selon leur propriétaire. Le système combine un grand modèle de langage (LLM) pour estimer des scores de propriété à partir de l'historique d'utilisation des objets et des profils des utilisateurs présents, avec une couche de prédiction conforme (conformal prediction) qui construit un ensemble de propriétaires plausibles. Quand l'incertitude dépasse un seuil, le robot génère activement des questions pour lever l'ambiguïté. Les expériences, menées en environnement domestique simulé, rapportent un Subset Accuracy de 0,988 et un Mean Jaccard Index de 0,991, y compris dans des scénarios de partage temporaire ou de copropriété. Ce travail s'attaque à un problème structurel de la robotique de service : la propriété d'un objet est un attribut latent, non observable directement, et les approches existantes reposent typiquement sur le seul critère de l'utilisation récente, ce qui les rend fragiles dès qu'un objet change de main temporairement. L'intégration d'un LLM pour le raisonnement contextuel, combinée à une gestion explicite de l'incertitude via la prédiction conforme, représente une architecture plus robuste pour des déploiements réels. Pour un intégrateur travaillant sur des robots d'assistance à domicile ou en Ehpad, c'est un signal que les systèmes de compréhension sémantique des instructions deviennent suffisamment fiables pour envisager des scénarios multi-utilisateurs. À noter que les résultats sont obtenus en simulation uniquement, et qu'aucune validation sur robot physique n'est mentionnée dans l'article. Ce gap sim-to-real reste la principale inconnue. La robotique de service domestique connaît une accélération des travaux en HRI (Human-Robot Interaction), avec des acteurs comme 1X, Apptronik, ou encore le français Enchanted Tools sur le segment des robots conversationnels. Le projet dispose d'une page dédiée, ce qui suggère une poursuite des travaux, mais aucune timeline de déploiement ni partenariat industriel n'est annoncé à ce stade.

UEEnchanted Tools est cité comme exemple d'acteur français dans le segment des robots conversationnels, mais ce travail de recherche n'implique pas directement d'entités françaises ou européennes.

RecherchePaper
1 source
Vers une navigation socialement adaptée dans les immeubles résidentiels : la méthode Look Further
173arXiv cs.RO 

Vers une navigation socialement adaptée dans les immeubles résidentiels : la méthode Look Further

Des chercheurs ont publié sur arXiv (réf. 2605.26710) une étude portant sur la navigation sociale d'un robot de livraison dans les couloirs d'immeubles résidentiels. L'approche centrale, baptisée Proactive Lane-Changing (PLC), consiste à déporter latéralement le robot du centre vers le côté du couloir dès qu'un piéton est détecté à plus de huit mètres, soit deux à quatre fois la distance de réaction habituelle des systèmes actuels. Une étude utilisateur avec 42 participants a évalué cette stratégie selon trois critères : sécurité, fluidité et politesse. En couloir droit (approche frontale), le PLC surpasse de façon statistiquement significative les comportements classiques de la littérature - ralentissement, arrêt, évitement réactif en proximité - sur les trois dimensions. En revanche, dans les scénarios d'intersection à angle mort, aucune des approches testées ne se distingue, les préférences des participants restant très dispersées. Ce résultat interroge les intégrateurs de robots AMR en milieu indoor résidentiel. La navigation sociale s'est longtemps concentrée sur la zone de "personal space" - typiquement moins de deux mètres - en appliquant des règles d'évitement réactif. L'étude démontre qu'étendre la distance de réaction modifie la perception globale du mouvement robotique, pas uniquement la sensation d'intrusion à courte portée. C'est un signal utile pour les concepteurs de comportements : l'expérience utilisateur en couloir relève du design d'interaction à grande échelle spatiale, pas seulement de la sécurité physique. L'absence de résultat probant aux intersections souligne cependant que le problème des angles morts reste entier et que le PLC n'est pas une solution universelle. Le travail s'inscrit dans un champ actif depuis la popularisation des robots de service indoor et l'émergence de modèles comme le Social Force Model. Côté industrie, des acteurs comme Keenon, Aethon ou Savioke ont déployé des robots de livraison en hôtellerie et milieu hospitalier sans traiter explicitement la navigation sociale à longue distance. En Europe, Enchanted Tools (France, robot Miroka) et d'autres opèrent dans des environnements comparables et pourraient bénéficier de ce type d'approche comportementale. L'étude reste au stade de la recherche publiée : ni code disponible, ni déploiement commercial annoncé.

UEEnchanted Tools (France, robot Miroka) et d'autres acteurs européens de robots de service indoor pourraient intégrer l'approche PLC pour améliorer la navigation sociale à longue distance dans les couloirs résidentiels.

RecherchePaper
1 source
LimX Dynamics dévoile Luna, un robot humanoïde qui apprend à danser par IA
174TechNode 

LimX Dynamics dévoile Luna, un robot humanoïde qui apprend à danser par IA

LimX Dynamics a dévoilé lundi son robot humanoïde Luna, commercialisé à 298 000 RMB (environ 41 000 dollars). Mesurant 160 cm de haut, le Luna embarque 27 degrés de liberté répartis sur l'ensemble du corps et s'appuie sur le moteur de contrôle de mouvement SYS 0 de deuxième génération développé en interne. La machine reçoit également une autonomie batterie et un système de refroidissement améliorés par rapport à la génération précédente. Sur le plan logiciel, LimX intègre des capacités d'interaction multimodale et une interface sans code permettant de configurer des déclencheurs de tâches en langage naturel : l'utilisateur décrit son besoin, le robot génère automatiquement les workflows d'exécution correspondants. Les cas d'usage ciblés incluent l'assistance en centre commercial, les expériences de jeu de rôle immersif (personnages NPC humanoïdes) et les interactions en parcs à thème. La fonctionnalité la plus originale est l'apprentissage de chorégraphies par analyse de séquences vidéo : le robot reproduit des mouvements de danse à partir d'un simple clip. Ce positionnement dans le segment entertainment et commercial illustre une tendance de fond : plusieurs constructeurs d'humanoïdes cherchent à rentabiliser leurs plateformes avant d'atteindre la maturité industrielle lourde. À 41 000 dollars, le Luna se place dans une fourchette accessible pour des opérateurs de loisirs ou des intégrateurs retail, bien en dessous des plateformes à vocation industrielle comme l'Optimus de Tesla ou le Figure 03. La promesse du no-code et du langage naturel réduit théoriquement la barrière à l'intégration, un argument clé pour les décideurs B2B sans équipe robotique dédiée. Reste à évaluer la robustesse réelle du SYS 0 en conditions d'exploitation intensive et la fiabilité de l'apprentissage vidéo : la démonstration de danse est visuellement frappante, mais aucun chiffre de performance (précision, taux d'échec, temps d'apprentissage) n'est communiqué. LimX Dynamics est un constructeur chinois spécialisé en locomotion bipède et quadrupède, déjà connu pour ses plateformes de recherche CL-1 et P1. La société s'inscrit dans un écosystème chinois de la robotique humanoïde en pleine accélération, aux côtés d'Unitree (G1, H1), de Fourier Intelligence et d'Agibot. Face à eux, les acteurs occidentaux comme Boston Dynamics (Atlas), Agility Robotics (Digit) ou Physical Intelligence (Pi-0) ciblent davantage la logistique industrielle. LimX choisit une entrée par le marché grand public et l'entertainment, une stratégie qui rappelle celle d'Enchanted Tools en Europe avec son robot Miroki. Les prochaines étapes annoncées concernent des déploiements en centres commerciaux et parcs à thème en Chine, sans calendrier précis ni données de volume communiquées à ce stade.

Chine/AsieOpinion
1 source
L’IA physique : le prochain marché que surveille déjà Wall Street
175Robot Magazine FR 

L’IA physique : le prochain marché que surveille déjà Wall Street

Wall Street identifie désormais la "Physical AI" comme le prochain cycle d'investissement majeur après l'IA générative. Selon plusieurs cabinets spécialisés, le marché mondial de la robotique intelligente et de l'IA physique pourrait dépasser 3 000 milliards de dollars d'ici 2040. Goldman Sachs est plus précis sur le segment humanoïde : 150 milliards de dollars d'ici 2035, avec un marché global de robotique intelligente franchissant les 400 milliards. NVIDIA, valorisé à plus de 3 000 milliards de dollars en 2026, est présenté comme le principal bénéficiaire actuel de cette tendance, son PDG Jensen Huang ayant publiquement intégré la "Physical AI" à sa feuille de route. Tesla, de son côté, est repositionnée dans cette grille de lecture grâce à son robot humanoïde Optimus, au-delà de son coeur de marché automobile. À noter : ces chiffres sont des projections de marché, pas des revenus confirmés, et l'article ne cite aucune métrique opérationnelle de déploiement. La rupture que pointe cet article est structurelle : l'IA générative est restée confinée aux écrans (texte, images, code), tandis que la Physical AI vise à en faire une force de travail dans le monde réel, capable de manipuler des objets, se déplacer et exécuter des tâches physiques de manière autonome. Pour un COO industriel ou un intégrateur, ce changement de paradigme est pertinent dans un contexte de pénuries de main-d'oeuvre persistantes et d'accélération de l'automatisation. Ce qui change pour les décideurs B2B, c'est l'horizon de planification : les fonds se positionnent déjà, ce qui signifie que les valuations des acteurs émergents (robotique, simulation, edge computing industriel) vont probablement se comprimer dans les 18 à 36 prochains mois, avant même que des déploiements à grande échelle soient prouvés. Ce récit s'inscrit dans un cycle bien rodé : après le cloud (AWS, Azure), puis l'IA générative (NVIDIA, OpenAI), les analystes financiers cherchent le prochain thème de surperformance. NVIDIA a amorcé ce pivot avec ses plateformes Isaac (simulation robotique) et Cosmos (world model pour robots), et ses partenariats avec Figure, 1X, Agility Robotics ou Boston Dynamics. Tesla joue la même carte avec Optimus, dont les premières vidéos de ligne de production interne ont été diffusées fin 2024, sans chiffres de cadence publiés. L'article reste toutefois une analyse financière généraliste : il ne cite aucun robot spécifique avec des métriques techniques (DOF, payload, cycle time), aucun site de déploiement confirmé, et aucun acteur européen malgré la pertinence d'entreprises comme Wandercraft ou Enchanted Tools sur ce segment. Les prochaines étapes annoncées restent floues, ce qui est caractéristique du registre "thème d'investissement émergent" plutôt que d'un bilan opérationnel.

UELa dynamique d'investissement Wall Street sur la Physical AI devrait indirectement comprimer les valorisations des startups robotiques européennes dans les 18-36 mois, avant tout déploiement prouvé, ce qui rend la fenêtre de levée de fonds pour des acteurs comme Wandercraft ou Enchanted Tools potentiellement plus courte.

IA physiqueOpinion
1 source
RED : ordonnancement adaptatif de DAG en temps réel pour l'inférence robotique en environnements dynamiques
176arXiv cs.RO 

RED : ordonnancement adaptatif de DAG en temps réel pour l'inférence robotique en environnements dynamiques

Des chercheurs ont publié le 26 mai 2026 sur arXiv (identifiant 2605.24044) une architecture de planification temps-réel baptisée RED, pour Robotic Environmental Dynamics scheduling. L'objectif : permettre à des robots déployés dans des environnements dynamiques d'exécuter simultanément plusieurs réseaux de neurones profonds sur du matériel embarqué contraint, sans violer les contraintes de timing. Le système a été implémenté et évalué sur deux familles de plateformes : la gamme NVIDIA Jetson (standard de facto du bord embarqué robotique) et des MacBook équipés de puces Apple M-series. Les charges de travail testées couvrent des scénarios de navigation autonome représentatifs de l'inférence robotique réelle. L'architecture repose sur un ordonnanceur sensible aux échéances qui attribue des sous-échéances intermédiaires aux tâches organisées en graphes orientés acycliques (DAG), permettant de gérer des graphes de calcul évolutifs et des inférences asynchrones induites par des conditions imprévisibles. Le problème visé est concret et sous-estimé en production : lorsqu'un robot perçoit son environnement en temps réel, les tâches d'inférence ne sont pas statiques. De nouveaux objets apparaissent, les relations de précédence entre tâches changent, et la structure globale du calcul évolue à l'échelle de la milliseconde. RED introduit une procédure de raffinement de charge couplée à une reconstruction du graphe pour aligner la structure des MIMONet (réseaux multi-entrées multi-sorties qui mutualisent les poids afin de réduire la pression mémoire) avec les exigences de planifiabilité. Les auteurs annoncent des gains sur les méthodes existantes en débit, respect des échéances, robustesse aux interférences et overhead d'exécution, sans publier de métriques chiffrées dans le résumé, ce qui rend toute évaluation indépendante de l'amplitude réelle des améliorations impossible à ce stade. Ce travail s'inscrit dans un domaine en forte activité : l'inférence embarquée pour la robotique autonome, où l'edge computing doit concilier contraintes temps-réel strictes et workloads d'IA croissants. RED se positionne face aux ordonnanceurs EDF (Earliest Deadline First) classiques et aux executors ROS 2. Il n'y a pas d'annonce de commercialisation associée : il s'agit d'un preprint académique, dont les suites dépendront du peer-review et d'éventuelles collaborations industrielles. Les équipes travaillant sur des architectures VLA (Vision-Language-Action) embarquées, notamment en Europe chez Enchanted Tools ou Wandercraft, trouveront dans cette approche une piste concrète pour résoudre le sim-to-real gap lié aux contraintes d'ordonnancement.

UELes équipes embarquées européennes travaillant sur des architectures VLA, notamment Enchanted Tools et Wandercraft, pourraient exploiter l'approche RED pour résoudre les contraintes d'ordonnancement temps-réel sur matériel contraint.

RecherchePaper
1 source
COLSON : navigation sociale contrôlable par apprentissage par renforcement basé sur la diffusion
177arXiv cs.RO 

COLSON : navigation sociale contrôlable par apprentissage par renforcement basé sur la diffusion

Des chercheurs proposent COLSON (Controllable Learning-based Social Navigation), une méthode de navigation sociale pour robots mobiles autonomes (AMR) en milieux piétons, fondée sur l'apprentissage par renforcement couplé à des modèles de diffusion. Publiée sur arXiv (2503.13934v2), cette étude traite d'un verrou persistant pour les robots de service : naviguer de façon fluide et socialement cohérente parmi des piétons dynamiques, sans violer leurs espaces de proximité ni générer de comportements erratiques. Les approches à base de règles telles qu'ORCA ou DWA montrent leurs limites dans les environnements denses, tandis que les méthodes de deep RL conventionnelles reposent sur des distributions gaussiennes qui contraignent la variété des trajectoires produites. COLSON contourne cette limitation en exploitant les distributions d'actions plus riches offertes par les modèles de diffusion appliqués au RL, capables de représenter des comportements multimodaux (hésiter, contourner à gauche ou à droite) que les politiques gaussiennes tendent à lisser. L'apport central de la méthode est sa capacité de généralisation à des scénarios inédits sans ré-entraînement. Dans les démonstrations présentées, le robot adapte son comportement à des obstacles statiques absents du jeu d'entraînement, ou change d'objectif pour accompagner un piéton cible tout en évitant les autres passants. Pour les intégrateurs d'AMR en milieux hospitaliers, aéroportuaires ou logistiques, cette propriété de contrôlabilité zero-shot est stratégiquement importante : elle réduit le coût de re-paramétrage à chaque nouveau site de déploiement. Elle valide aussi partiellement l'hypothèse que les diffusion models peuvent atténuer le sim-to-real gap en navigation sociale, en générant des distributions d'actions plus robustes face à l'imprévu. Le champ de la social navigation par deep RL est actif depuis une décennie, avec des travaux fondateurs comme CADRL (2017), SARL et CrowdNav. L'application des modèles de diffusion au RL dans la robotique est plus récente, s'appuyant notamment sur Diffusion Policy (Columbia/MIT, 2023) dans le domaine de la manipulation. COLSON transfère cette logique vers la planification de mouvement en espace ouvert. Il s'agit à ce stade d'un preprint académique avec validation uniquement en simulation ; aucun déploiement sur robot réel ni partenariat industriel n'est mentionné, ce qui invite à tempérer les conclusions. Les éditeurs actifs sur la navigation sociale autonome incluent Boston Dynamics, ANYbotics et Clearpath Robotics, et côté européen Enchanted Tools (France) ou PAL Robotics (Espagne) pour les robots de service. Les prochaines étapes naturelles seraient une validation en environnement réel et un benchmarking sur les datasets standardisés ETH/UCY.

UELes intégrateurs AMR européens (dont Enchanted Tools en France, PAL Robotics en Espagne) pourraient à terme bénéficier de la contrôlabilité zero-shot de COLSON pour réduire les coûts de redéploiement multi-sites, mais la méthode reste validée uniquement en simulation sans partenariat industriel déclaré.

RecherchePaper
1 source
Le robot humanoïde Tinnie devient apprenti dans un projet de rénovation, une première mondiale
178Interesting Engineering 

Le robot humanoïde Tinnie devient apprenti dans un projet de rénovation, une première mondiale

Un robot humanoide d'Unitree Robotics, baptisé "Tinnie", s'apprête à intégrer un chantier de rénovation résidentielle en Australie dans le cadre d'un projet intitulé "The Farmhouse". La propriété couvre 8,3 acres à Mulgoa, à quelques minutes du nouvel aéroport international de l'ouest de Sydney. Le site présente un indice BAL 29 (Bushfire Attack Level), correspondant à une exposition élevée aux attaques par braises et chaleur rayonnante, et héberge une faune reptilienne ajoutant une contrainte de sécurité supplémentaire. L'initiative est portée par Cherie Barber, animatrice de télévision surnommée "la Reine de la Rénovation" en Australie, et son partenaire Matt Hume, qui ont coordonné le projet avec Unitree Robotics pendant six mois, incluant un déplacement en Chine pour observer le robot en action. Le nom "Tinnie" est un double clin d'oeil à l'Homme de Fer-blanc du Magicien d'Oz et au slang australien désignant une bière en canette. La mission du robot ne comprend aucune tâche physique: il accueillera les équipes sur site, conduira les inductions de sécurité, consultera les codes du bâtiment, vérifiera les spécifications produits et conseillera sur les décisions de conception. Le projet sera documenté dans une série télévisée nationale australienne et en épisodes bimensuels sur la chaîne YouTube de Cherie Barber. Ce déploiement se distingue nettement des démonstrations industrielles récentes d'humanoïdes: Tinnie ne manipule ni outils ni matériaux, et son rôle reste strictement informationnel. Pour les intégrateurs et décideurs B2B du secteur du bâtiment, la question légitime est de savoir si la forme humanoïde apporte une valeur ajoutée réelle par rapport à une tablette ou un assistant vocal embarqué sur chantier. La communication officielle ne cite aucune métrique de performance: pas de taux d'adoption par les ouvriers, pas de réduction du temps de cycle, aucun indicateur de productivité mesurable. La revendication de "première mondiale" mérite donc d'être tempérée: il s'agit davantage d'une expérience sociale médiatisée que d'un pilote industriel formalisé. Ce qui reste potentiellement instructif pour le secteur, c'est l'exposition du robot à un environnement de chantier actif soumis à des contraintes réglementaires et environnementales réelles, loin des conditions contrôlées de laboratoire. Unitree Robotics est un fabricant chinois positionné sur le segment accessible des robots humanoïdes et quadrupèdes, dont le H1 et le G1 sont commercialisés bien en dessous des tarifs pratiqués par Figure AI ou Boston Dynamics. L'entreprise cherche à multiplier les déploiements visibles à l'international pour crédibiliser ses plateformes face à une concurrence qui progresse sur des cas d'usage plus opérationnels: Boston Dynamics déploie Spot en inspection de chantier, Built Robotics opère des engins autonomes en génie civil, et en Europe, Enchanted Tools (France) développe des approches robotiques collaboratives en environnement de travail mixte. Le projet "The Farmhouse" intègre également un volet de vie autonome, avec serre maraîchère, verger, ruches et poulailler, ce qui renforce l'impression d'une opération de contenu lifestyle plutôt que d'une validation technologique rigoureuse. Les prochaines étapes annoncées se limitent à la production audiovisuelle, sans timeline de déploiement à plus grande échelle ni partenariats industriels communiqués.

HumanoïdesOpinion
1 source
Pourquoi les fondateurs les plus prospères en robotique sont des penseurs systémiques
179Robotics Business Review 

Pourquoi les fondateurs les plus prospères en robotique sont des penseurs systémiques

L'épisode 244 du podcast The Robot Report, publié cette semaine, met en vedette Ajay Agarwal, associé chez Bain Capital Ventures (BCV), où il investit depuis plus de vingt ans dans des sociétés technologiques en phase précoce, avec un focus sur les logiciels, l'IA, la logistique et l'automatisation industrielle. L'entretien couvre son thèse d'investissement en robotique, sa méthode pour identifier les fondateurs à fort potentiel, et son regard sur la montée en puissance des robots humanoïdes. L'émission aborde également les actualités de la semaine : la publication des lauréats 2026 des RBR50 Robotics Innovation Awards, la nouvelle version Stretch 4 de Hello Robot (plus grande, plus rapide et plus puissante que ses prédécesseurs), et le dévoilement de la SmartBay d'Automated Tire, une station autonome de changement de pneus. La thèse centrale d'Agarwal, implicite dans le titre de l'épisode, est que les fondateurs les plus performants en robotique sont des "systems thinkers" : ils ne conçoivent pas des composants isolés, mais des systèmes complets intégrant mécanique, software, logistique et modèle économique. Ce cadre analytique, forgé au fil de deux décennies d'investissements, a une pertinence directe pour les décideurs industriels et les intégrateurs : il suggère que la sélection de partenaires technologiques devrait se faire sur la capacité à penser bout-en-bout, pas uniquement sur la performance technique d'un sous-système. Dans un marché où les démos restent souvent déconnectées de la réalité opérationnelle, ce type de discernement investisseur constitue un signal utile sur les entreprises réellement bancables à l'échelle. Agarwal est notamment connu pour avoir piloté l'investissement historique de BCV dans Kiva Systems, la société de robots de manutention entrepôt rachetée par Amazon en 2012 pour 775 millions de dollars et rebaptisée Amazon Robotics, devenue depuis une référence structurante du secteur AMR (autonomous mobile robots). Cette prise de position précoce illustre sa capacité à identifier des changements de paradigme avant qu'ils ne deviennent évidents. Aujourd'hui, il observe de près l'essor des humanoïdes, un segment dominé par Figure AI, 1X Technologies, Agility Robotics (filiale Amazon), Boston Dynamics et Tesla Optimus, avec des acteurs européens comme Enchanted Tools ou Wandercraft encore à l'écart des grands cycles de financement américains. La prochaine étape concrète mentionnée dans l'épisode est le Robotics Summit & Expo 2026, co-organisé par The Robot Report, qui réunit plus de 70 intervenants confirmés issus de Tesla, Toyota Research Institute, AWS ou Brain Corp, et constitue un baromètre sectoriel pour les mois à venir.

UELa mention d'Enchanted Tools et Wandercraft comme acteurs européens encore à l'écart des grands cycles de financement américains constitue un signal indirect sur le déficit de capital-risque en Europe pour les humanoïdes.

BusinessActu
1 source
Des données de caméras corporelles sur des travailleurs humains servent à entraîner des cerveaux robotiques dans un essai coréen
180Interesting Engineering 

Des données de caméras corporelles sur des travailleurs humains servent à entraîner des cerveaux robotiques dans un essai coréen

La startup sud-coréenne RLWRLD a annoncé un partenariat avec le Lotte Hotel Seoul, le groupe logistique CJ Logistics et des enseignes Lawson pour constituer une base de données de gestes professionnels humains destinée à l'entraînement de robots. Les employés de ces sites portent des caméras-corps pendant l'exécution de tâches courantes mais techniquement exigeantes : pliage de serviettes de banquet et mise en place de tables à l'hôtel, opérations d'entrepôt chez CJ Logistics, organisation de rayonnages en commerce de détail. Ces flux vidéo, enrichis de données de mouvement et de force, alimentent le modèle fondationnel RLDX-1, présenté en 2025, qui cible la manipulation robotique haute précision avec des mains à haut degré de liberté (DoF). L'architecture centrale, baptisée Multi-Stream Action Transformer (MSAT), traite en flux parallèles les signaux visuels, de mouvement, de mémoire et de couple (torque), qu'elle fusionne ensuite pour générer les actions motrices. Le système intègre également un modèle vision-langage-action (VLA) spécialisé robotique, des modules de physique et de mouvement, et une interface cognitive qui compresse la perception en tokens mémoire pour le suivi de tâches longues. RLWRLD affirme que RLDX-1 dépasse les VLA leaders sur des benchmarks spatiaux, temporels et en contact riche, en simulation comme en conditions réelles, sans chiffres de latence ni taux de succès indépendants publiés à ce stade, ce qui invite à la prudence avant de valider ces affirmations. Ce projet illustre un changement de paradigme dans la collecte de données robotiques : au lieu de téléopération ou de simulation synthétique seule, RLWRLD mise sur la capture in situ d'expertise métier réelle, là où la dextérité humaine est déjà optimisée par des années de pratique. Pour les intégrateurs et les équipementiers industriels, cela signale que le goulot d'étranglement du sim-to-real gap pourrait être partiellement contourné par du data collection en environnement de production réel. La capacité de RLDX-1 à se généraliser sur des configurations single-arm, dual-arm et humanoïde depuis un modèle unique réduit potentiellement les coûts de fine-tuning par plateforme. La gestion de la mémoire à long horizon via tokens de cognition est une réponse directe à la limite connue des VLA actuels sur les tâches séquentielles complexes, problème documenté chez des équipes comme Physical Intelligence (Pi-0) ou chez l'équipe GR00T de NVIDIA. RLWRLD s'inscrit dans une vague coréenne de robotique physique soutenue par des programmes gouvernementaux de numérisation des savoir-faire pour l'IA industrielle. Sur le plan compétitif, la startup se positionne face à Physical Intelligence (Pi-0, États-Unis), à l'équipe GR00T N2 de NVIDIA, à Figure (Figure 03) et à 1X Technologies dans la course aux modèles fondationnels pour la manipulation. La Corée du Sud mobilise sa base manufacturière dense, automobile, électronique, logistique, comme terrain de collecte de données, ce que ni les laboratoires américains ni les acteurs européens comme Wandercraft ou Enchanted Tools ne répliquent à cette échelle sectorielle. Les prochaines étapes annoncées incluent l'extension des captations à d'autres secteurs et le déploiement du modèle sur des plateformes humanoïdes commerciales, sans calendrier précis communiqué.

UELa Corée du Sud construit à grande échelle un avantage compétitif en données d'expertise industrielle réelle que les acteurs européens ne répliquent pas encore, creusant l'écart sur les modèles fondationnels de manipulation robotique.

Chine/AsieOpinion
1 source
RLWRLD lance RLDX-1, un modèle fondation centré sur la dextérité pour mains robotiques
181Robotics Business Review 

RLWRLD lance RLDX-1, un modèle fondation centré sur la dextérité pour mains robotiques

La startup sud-coréenne RLWRLD a présenté la semaine dernière RLDX-1, un modèle de fondation conçu spécifiquement pour les mains robotiques à haut nombre de degrés de liberté (DoF). L'architecture multi-flux couvre les configurations single-arm, dual-arm et humanoïde, et intègre l'ensemble du cycle robotique : collecte de données, entraînement et déploiement. RLWRLD structure ses travaux autour d'un benchmark maison, DexBench, qui organise les défis industriels en cinq régimes de dextérité : diversité de préhension, précision spatiale, précision temporelle, précision de contact, et conscience du contexte. Pour chaque régime, un module dédié : un VLM (vision language model) fin-tuné sur des questions-réponses spatiales pour la localisation précise des contacts ; un module de mouvement extrayant des correspondances visuelles spatio-temporelles pour anticiper les objets en déplacement sur convoyeur ; un module physique qui traite couple et force tactile comme des flux séparés, permettant de prédire les transitions de contact avant qu'elles n'arrivent. Les données d'entraînement combinent téleopération synthétique et démonstrations humaines pour couvrir la manipulation en main (in-hand dexterity) inaccessible à la téléopération standard. L'enjeu est concret : les robots échouent encore sur des tâches en apparence banales comme verser du café depuis une cafetière qui s'allège, attraper un objet en mouvement sur un convoyeur, ou visser un écrou hexagonal avec des doigts. Ce "dernier kilomètre" de l'automatisation industrielle est précisément la cible de RLDX-1. L'architecture multi-flux, où chaque modalité (couple haute fréquence, frames vidéo, mémoire d'état) dispose de sa propre capacité gradient, répond à un problème réel d'optimisation : dans un transformer classique, la modalité dominante absorbe toute la capacité au détriment des autres. Cela dit, les affirmations de RLWRLD sur des performances "état de l'art" restent à valider indépendamment -- les vidéos de démonstration ne constituent pas des métriques de taux de succès en conditions industrielles réelles, et aucun cycle time chiffré n'est communiqué. RLWRLD s'inscrit dans une vague de startups cherchant à combler le fossé entre modèles d'action généralistes et déploiements industriels réels. Elle affronte des acteurs aux ressources bien supérieures : Physical Intelligence avec son modèle pi0 (fondée par d'anciens de Google et Stanford, 400 M$ levés en 2024), Figure AI avec son humanoïde Figure 03, ou encore Agility Robotics et 1X. En Europe, des acteurs comme Enchanted Tools (humanoïde Mirokaï) ou Wandercraft se positionnent sur la mobilité et l'assistance plutôt que sur la manipulation haute-dextérité, laissant ce créneau industriel quasi exclusivement aux acteurs américains et asiatiques. Aucun déploiement pilote chez un client industriel n'a été annoncé à ce stade par RLWRLD.

IA physiqueOpinion
1 source
Conception de robots logistiques hospitaliers : les clés du succès au Robotics Summit
182Robotics Business Review 

Conception de robots logistiques hospitaliers : les clés du succès au Robotics Summit

Le Robotics Summit & Expo, qui se tient les 27 et 28 mai 2026 à Boston, accueillera une session consacrée à la conception de robots logistiques hospitaliers, programmée à 16h15 le premier jour de l'événement. Trois praticiens y interviendront : David Crabb, fondateur et CEO de Rovex Technologies, médecin urgentiste certifié et informaticien clinique formé à l'Université de Floride, qui a quitté ses fonctions hospitalières en 2025 pour se consacrer à sa startup robotique ; Spencer Krause, président et CEO de SKA Robotics, ingénieur roboticien avec plus de 25 ans d'expérience, diplômé de Carnegie Mellon en développement de systèmes robotiques, ayant travaillé pour plusieurs entreprises du Fortune 100 ; et Peter Seiff, CEO de ST Engineering Aethon, acteur historique du secteur depuis 20 ans, dont les robots assurent actuellement la distribution de repas et de linge dans de nombreux hôpitaux américains. Seiff cumule plus de 30 ans dans la robotique de santé, avec des passages chez Automated Healthcare et McKesson. Ce panel illustre une réalité souvent éclipsée par les démonstrations de robots chirurgicaux ou de rééducation : la logistique hospitalière automatisée est un marché mature, déployé à grande échelle, avec des acteurs comme Aethon dont les flottes sont opérationnelles dans des établissements réels depuis deux décennies. Le fait que trois profils aussi différents, un médecin devenu entrepreneur, un ingénieur systèmes venu du terrain industriel, et un exécutif rompu aux acquisitions dans le healthcare, partagent la même scène signale que la conception de robots hospitaliers réclame une convergence rare entre contraintes cliniques, ingénierie mécanique et viabilité commerciale. Pour les intégrateurs et décideurs B2B, c'est un signal que le segment "indoor hospital AMR" dépasse le stade du pilote et exige désormais une approche produit structurée. ST Engineering Aethon est la référence de longévité dans ce segment : fondée au début des années 2000, rachetée par ST Engineering (groupe singapourien coté), la société a traversé plusieurs cycles d'acquisition tout en maintenant ses déploiements actifs. Ses concurrents directs sur la logistique intra-hospitalière incluent Swisslog (filiale KUKA), Omnicell côté pharmacie automatisée, et des entrants plus récents comme Savioke ou Keenon Robotics sur le créneau de la livraison de plateau-repas. Du côté français, Enchanted Tools (robot Miroka) positionne également ses solutions vers les environnements de soin, même si son déploiement hospitalier à grande échelle reste à démontrer. Le Robotics Summit, co-organisé par The Robot Report et WTWH Media, rassemble plus de 70 intervenants confirmés, dont des représentants de Tesla, Toyota Research Institute, PickNik Robotics et Robust AI, avec plus de 50 sessions réparties sur des tracks IA, design, technologies habilitantes, santé et logistique.

UELa mention d'Enchanted Tools (FR) comme entrant potentiel sur la logistique hospitalière et de Swisslog/KUKA (DE) comme concurrent établi signale que ce segment AMR intra-hospitalier, en phase de maturité aux États-Unis, constitue un marché à surveiller pour les acteurs européens.

IndustrielActu
1 source
Le robot humanoïde reçoit une tête avec écran OLED incurvé pour améliorer son efficacité
183Interesting Engineering 

Le robot humanoïde reçoit une tête avec écran OLED incurvé pour améliorer son efficacité

LG Display a présenté au SID Display Week 2026 de Los Angeles un écran P-OLED de 7,2 pouces conçu spécifiquement pour les robots humanoïdes, marquant la première démonstration publique d'un tel composant par l'entreprise coréenne. Le panneau repose sur la troisième génération de la plateforme Tandem OLED de LG, rebaptisée "Tandem OLED" pour les usages robotiques, et utilise un substrat plastique en polyimide plutôt que du verre, ce qui lui confère une flexibilité suffisante pour épouser les surfaces courbes d'un visage mécanique. L'interface affiche des informations fonctionnelles, niveau de batterie, météo, mode veille, calendrier, salutations, tandis que la majorité de l'écran reste éteinte lors des démonstrations, exploitant le principe OLED où chaque pixel s'éteint indépendamment. Résultat : la troisième génération Tandem réduit la consommation énergétique de 18 % par rapport à la génération précédente, limitant la dissipation thermique dans un châssis où les composants électroniques sont sensibles à la chaleur. Le panneau atteint 1 000 nits de luminosité, opère entre -30 °C et 85 °C, et est qualifié pour plus de 15 000 heures de fonctionnement, des spécifications empruntées à la filière OLED automobile du groupe. L'enjeu industriel de cette annonce va au-delà de l'esthétique : un écran facial n'est pas qu'un gadget de communication HRI (human-robot interaction), c'est un composant thermique, énergétique et mécanique à part entière. Pour les intégrateurs de robots de service, la capacité à afficher un statut opérationnel sans drain notable sur la batterie, tout en résistant aux contraintes thermiques d'un environnement industriel ou domestique, représente un critère de sélection concret. La flexibilité du substrat ouvre par ailleurs la voie à des designs de carrosserie moins contraints par la géométrie plane des dalles rigides. Il est toutefois utile de noter que LG Display parle pour l'instant d'un prototype présenté en salon : aucun engagement de production en série ni de fenêtre de disponibilité commerciale n'a été communiqué. Ce dévoilement s'inscrit dans la stratégie plus large de LG Electronics, qui a lancé le robot humanoïde LG CLOiD en janvier 2026 au CES de Las Vegas. CLOiD embarque deux bras articulés à 7 degrés de liberté chacun, cinq doigts à actionnement indépendant, une base mobile autonome et une tête-hub équipée de caméras, capteurs et d'une interface IA reposant sur des modèles VLM (Vision Language Model) et VLA (Vision Language Action), entraînés sur plusieurs dizaines de milliers d'heures de données de tâches domestiques. LG a également annoncé LG Actuator AXIUM, une plateforme d'actionneurs modulaires destinée aux robots de service et aux appareils électroménagers intelligents. Sur ce segment, LG se positionne en concurrent direct de Samsung Robotics, Boston Dynamics (Spot/Atlas chez Hyundai) et des acteurs spécialisés comme Enchanted Tools en France, qui développe Miroki pour des usages hospitaliers et de services.

HumanoïdesOpinion
1 source
SF Express, Sequoia China et IDG investissent dans une licorne en robots humanoïdes issue de Tsinghua
184Pandaily 

SF Express, Sequoia China et IDG investissent dans une licorne en robots humanoïdes issue de Tsinghua

Wujie Power (无界动力), spin-off de l'université Tsinghua spécialisé dans les robots humanoïdes à usage général, a bouclé un tour de financement impliquant des investisseurs chinois et internationaux de premier rang. Ce tour est co-dirigé par Envision Group et le Fonds d'investissement en intelligence artificielle de Pékin, avec la participation récurrente de Sequoia China, Linear Capital, Hillhouse Ventures, Baidu Ventures et Yunshan Capital. La société est par ailleurs sur le point de clôturer une tranche additionnelle dite "angel+++" auprès de capitaux américains et en renminbi, portant le financement total au stade angel à plus de 200 millions de dollars. Ce tour intervient dans la continuité d'un tour stratégique d'un milliard de yuans finalisé en mars 2026. Simultanément, StarTrace (星动纪元), autre constructeur d'humanoïdes issu du même écosystème d'investisseurs, a clôturé un tour dépassant également 200 millions de dollars. Le géant de la logistique SF Express figure parmi les nouveaux entrants, rejoignant le capital à l'intersection de la robotique et de l'automatisation de la chaîne d'approvisionnement. L'annonce ne précise ni la valorisation exacte ni les spécifications techniques du robot : pas de charge utile, de degrés de liberté ou de cadence opérationnelle communiqués. Ces levées consécutives confirment l'appétit persistant du capital-risque chinois pour l'IA incarnée (embodied AI), mais signalent surtout un mouvement stratégique côté industrie. La présence de SF Express au capital est un indicateur concret : un opérateur logistique de cette envergure n'engage pas plusieurs dizaines de millions sans anticiper un horizon d'intégration dans ses entrepôts ou centres de tri. Pour les décideurs B2B, cela suggère que la logistique reste le premier terrain de déploiement visé par les humanoïdes chinois en 2026-2027, avant le manufacturing. Les deux tours simultanés (Wujie Power + StarTrace) indiquent également une stratégie de portefeuille coordonnée, plutôt qu'une conviction isolée sur un seul acteur. Wujie Power s'inscrit dans la vague de spin-offs académiques issus de Tsinghua ces deux dernières années, aux côtés d'acteurs comme Unitree Robotics, Agibot et UBTECH, qui ont tous intensifié leurs levées et annonces produit en 2025-2026. Face à eux, les constructeurs occidentaux Figure AI, Agility Robotics (désormais dans l'orbite d'Amazon) et 1X Technologies avancent sur leurs propres déploiements, tandis qu'en Europe Enchanted Tools et Wandercraft restent à plus petite échelle de capitalisation. La course sino-américaine sur l'humanoïde s'accélère avec des capitaux publics et privés engagés des deux côtés. Les prochaines étapes probables pour Wujie Power sont la clôture de la tranche angel+++ et l'annonce de premiers pilotes industriels, possiblement en logistique avec SF Express en client-investisseur.

UELa concentration de plus de 400 M$ sur deux tours simultanés chez des constructeurs d'humanoïdes chinois accentue l'écart de financement avec Enchanted Tools et Wandercraft, fragilisant le positionnement concurrentiel européen à moyen terme.

Chine/AsieOpinion
1 source
Impression 3D de robots auto-pliants à actionnement passif avec modules fonctionnels intégrés
185arXiv cs.RO 

Impression 3D de robots auto-pliants à actionnement passif avec modules fonctionnels intégrés

Des chercheurs ont soumis sur arXiv (référence 2605.04757, mai 2025) une méthode de fabrication de robots auto-pliants à partir de développés plats imprimés en 3D dans un PLA conducteur. Le principe repose sur des élastiques acheminés à travers des crochets intégrés: en libérant leur énergie mécanique, ils replient la feuille en géométries tridimensionnelles préprogrammées, sans aucun stimulus externe (ni chaleur, ni lumière, ni humidité). L'état plat avant déploiement autorise le positionnement précis de l'électronique et des aimants. Le même substrat sert d'électrode pour la détection tactile capacitive et supporte une palette I/O réutilisable équipée de capteurs Hall et de moteurs ERM (masses excentriques rotatives), assurant la détection d'ancrage et l'actionnement par vibration. L'équipe publie également un modèle analytique fermé qui équilibre rigidité des charnières et moment des élastiques pour prédire les angles de pliage à l'équilibre; validé expérimentalement, ce modèle produit une carte de conception reliant épaisseur de charnière, taille des élastiques et espacement des crochets aux angles cibles. Trois démonstrateurs ont été réalisés: un cube polyédrique illustrant le potentiel pour des collectifs modulaires, un préhenseur déployable, et un doigt à tendons. La fabrication par origami robotique dépendait jusqu'ici de stimuli exogènes: polymères à mémoire de forme activés thermiquement, hydrogels hygroscopiques, ou bilames sous UV. L'approche élastique s'affranchit de ces contraintes en utilisant uniquement du PLA conducteur standard, simplifiant l'industrialisation et réduisant les coûts. Le modèle analytique constitue un apport concret: il transforme la conception de structures pliables d'un processus empirique en démarche prédictive, limitant les itérations de prototypage. La convergence "substrat = électrode = structure mécanique" réduit par ailleurs le nombre de composants discrets, un avantage direct pour les intégrateurs de systèmes modulaires ou de robots à bas coût. Ce travail s'inscrit dans le courant actif de la robotique origami, porté notamment par le Wyss Institute de Harvard et le CSAIL du MIT. La singularité de l'approche tient à l'énergie élastique passive sur PLA conducteur, distincte des voies pneumatiques ou magnétiques couramment explorées. Il s'agit d'un preprint académique sans produit commercialisé ni déploiement annoncé: les trois démonstrateurs restent des preuves de concept. Les prochaines étapes naturelles porteraient sur la durabilité mécanique sur cycles répétés et la mise à l'échelle des collectifs modulaires. En Europe, des acteurs comme Enchanted Tools ou des laboratoires tels que le LIRMM pourraient trouver dans cette méthode de fabrication un levier pertinent pour réduire les coûts de prototypage.

UEDes laboratoires européens comme le LIRMM et des startups comme Enchanted Tools pourraient exploiter cette méthode de fabrication origami passive pour réduire les coûts de prototypage de robots modulaires.

RecherchePaper
1 source
Cadre de commande SDRE hors ligne en trois étapes pour reproduire le mouvement humain sur un robot bipède suspendu
186arXiv cs.RO 

Cadre de commande SDRE hors ligne en trois étapes pour reproduire le mouvement humain sur un robot bipède suspendu

Une équipe de recherche a publié sur arXiv (réf. 2506.04680) une stratégie de contrôle en trois étapes permettant à un robot bipède suspendu de reproduire fidèlement des mouvements humains capturés par mocap, avec une erreur quadratique moyenne (RMSE) inférieure à 3 degrés sur l'ensemble des articulations testées. Le pipeline repose d'abord sur un contrôleur SDRE (State-Dependent Riccati Equation) qui génère des trajectoires de couple optimales à partir du modèle dynamique du système bipède. Une deuxième étape produit des séquences de commandes en vitesse et accélération articulaires via une optimisation paramétrée intégrant les contraintes des actionneurs. La troisième étape applique un contrôleur hybride PID-LQR piloté par les données pour minimiser l'écart entre le mouvement cible et celui effectivement exécuté. Le dispositif expérimental est un robot bipède suspendu conçu spécifiquement pour l'évaluation d'exosquelettes anti-gravité, validé sur deux tâches : squat répétitif et marche. L'enjeu est direct pour l'industrie de l'exosquelette : les protocoles d'homologation impliquent aujourd'hui des sujets humains, ce qui introduit des risques de sécurité et complique la reproductibilité des tests. Remplacer le porteur par un robot calibré sur ses propres données de capture de mouvement ouvre la voie à des bancs d'essai systématiques, automatisés et comparables entre laboratoires. La précision annoncée, moins de 3° de RMSE moyen, est suffisante pour valider des algorithmes d'assistance articulaire sur des cycles locomoteurs complets, même si les auteurs ne précisent pas les conditions de charge ni la fréquence de cycle, deux paramètres déterminants pour juger de la transférabilité à des exosquelettes industriels ou médicaux. Le problème de la reproduction de mouvement humain sur robot hétérogène est un verrou classique en robotique de rééducation, aggravé par les différences de cinématique et d'actionnement entre humain et machine. L'approche SDRE, plus flexible que le LQR classique sur systèmes non-linéaires, n'est pas nouvelle mais son association à un raffinement PID-LQR guidé par les données constitue une contribution méthodologique incrémentale. En France, Wandercraft développe l'exosquelette Atalante pour la rééducation neurologique et fait face aux mêmes problématiques de test reproductible ; Pollen Robotics et Enchanted Tools opèrent sur des segments adjacents. Au niveau international, les équipes de Boston Dynamics, Agility Robotics et Apptronik publient sur des défis similaires en sim-to-real pour bipèdes. La prochaine étape logique pour les auteurs serait de valider le framework sur une plateforme non suspendue, condition nécessaire pour que l'approche soit utilisable en certification exosquelette en conditions réelles.

UEWandercraft (Atalante) et d'autres acteurs français de l'exosquelette sont directement concernés : ce framework de test robotisé et reproductible pourrait informer les futurs protocoles d'homologation d'exosquelettes médicaux et industriels en Europe, réduisant le recours à des sujets humains lors des certifications.

ExosquelettesPaper
1 source
Jiao : combler le fossé entre isolation et personnalisation en robotique à criticité mixte
187arXiv cs.RO 

Jiao : combler le fossé entre isolation et personnalisation en robotique à criticité mixte

Des chercheurs ont publié le 6 mai 2026 sur arXiv (réf. 2605.03641) une architecture baptisée Jiao, conçue pour résoudre un problème structurel en robotique grand public : faire cohabiter sur un même processeur multicoeur un contrôle temps réel critique, des pipelines de perception et des applications utilisateur. L'approche repose sur trois composants : un "Safe IO Cell" assurant un override matériel d'urgence, un "Parameter Synchronization Service" encapsulant la complexité inter-domaines, et un "Safety Communication Layer" aligné sur la norme IEC 61508. Évaluée sur plateforme ARM Cortex-A55, l'architecture réduit la gigue de période (cycle-period jitter) de 84,5 %, ramenant l'erreur de timing en queue de distribution (p99) de 69,0 μs à 7,8 μs, tout en éliminant la totalité des excursions supérieures à 50 μs. Le problème central que Jiao cherche à résoudre est ce que les auteurs appellent l'"expertise asymmetry" : les hyperviseurs à partitionnement statique, issus de l'automobile via AUTOSAR, offrent une isolation matérielle robuste, mais leur configuration suppose une maîtrise système que les développeurs d'applications robotiques n'ont généralement pas. Cette friction bloque l'adoption des architectures à criticité mixte dans les robots de service et domestiques. Les résultats de timing sont concrets : une gigue p99 sous 8 μs est une condition souvent nécessaire pour les boucles de contrôle bas niveau opérant typiquement à 1 kHz. Si ces chiffres se confirment en production, l'architecture permettrait à un intégrateur de faire tourner simultanément un RTOS pour la sécurité fonctionnelle et un Linux généraliste pour les applicatifs, sans compromettre les garanties temporelles. Ce travail s'inscrit dans la migration des architectures embarquées automobiles vers la robotique mobile et les cobots. L'ARM Cortex-A55, cible du benchmark, équipe de nombreuses plateformes embarquées milieu de gamme, ce qui donne une pertinence pratique aux résultats. Il s'agit d'un preprint de recherche, pas d'un produit commercialisé : aucun déploiement ni partenariat industriel n'est annoncé. Les suites logiques seraient une validation sur des stacks robot réels comme ROS 2 ou microROS, et une certification IEC 61508 SIL 2 ou 3. Aucun acteur européen n'est mentionné dans les travaux, bien que des sociétés comme Wandercraft ou Enchanted Tools adressent des problématiques adjacentes de systèmes embarqués à contraintes critiques.

RecherchePaper
1 source
Combler le fossé entre les corps : édition vidéo inter-embodiment disentangled
188arXiv cs.RO 

Combler le fossé entre les corps : édition vidéo inter-embodiment disentangled

Une équipe de chercheurs a publié le 6 mai 2026 sur arXiv (réf. 2605.03637) un framework génératif pour convertir des vidéos de démonstration humaine en séquences d'exécution robotique plausibles, sans données appariées humain-robot. La méthode décompose la vidéo source en deux espaces latents orthogonaux: l'un encodant la tâche accomplie, l'autre la morphologie du corps en mouvement. Un double objectif contrastif impose cette séparation en minimisant l'information mutuelle entre les deux espaces pour garantir leur indépendance, tout en maximisant la cohérence intra-espace pour stabiliser les représentations. Un adaptateur à faible coût paramétrique injecte ces codes latents dans un modèle de diffusion vidéo figé, produisant des démonstrations robotiques morphologiquement précises et cohérentes dans le temps à partir d'une seule séquence humaine. L'enjeu est critique: les approches existantes génèrent des représentations enchevêtrées où l'information de tâche reste couplée à la cinématique humaine spécifique, ce qui bloque le transfert vers d'autres morphologies. En découplant explicitement ces deux dimensions, la méthode ouvre la voie à l'exploitation des vastes corpus de vidéos humaines disponibles sur internet pour entraîner des politiques de manipulation robotique, sans collecte de démonstrations robot coûteuse par télé-opération. Les expériences rapportent des vidéos générées temporellement consistantes et morphologiquement fidèles, bien que l'abstract ne fournisse pas de métriques quantitatives comparatives avec les baselines; les résultats visuels restent la principale validation. Pour un intégrateur ou un décideur industriel, la promesse est de réduire significativement le coût de labeling nécessaire à l'apprentissage de nouveaux comportements de manipulation. Cette publication s'inscrit dans une compétition intense autour des politiques de manipulation généralisables: Pi-0 (Physical Intelligence), GR00T N2 (NVIDIA) et OpenVLA (UC Berkeley) cherchent tous à réduire la dépendance aux démonstrations robot propriétaires. L'approche par édition vidéo emprunte un chemin différent des VLA classiques: plutôt qu'apprendre une politique directement depuis des vidéos humaines, elle synthétise d'abord une démonstration robot plausible exploitable par les pipelines d'imitation learning standards. Il s'agit à ce stade d'un preprint préliminaire, sans déploiement industriel ni partenariat annoncé. Le cadre latent disentangled proposé pourrait néanmoins rapidement intéresser des acteurs comme 1X Technologies ou Apptronik, et côté européen, des équipes travaillant sur l'imitation learning comme certains labs INRIA ou des spin-offs de manipulation comme Enchanted Tools.

UEDes équipes INRIA et des spin-offs de manipulation comme Enchanted Tools pourraient bénéficier de cette approche pour réduire le coût de collecte de démonstrations robotiques, mais aucun partenariat ou déploiement européen n'est impliqué à ce stade.

IA physiqueOpinion
1 source
Affection robotique : opportunités de l'IA haptique pour le toucher social des robots par approche multi-deep-learning
189arXiv cs.RO 

Affection robotique : opportunités de l'IA haptique pour le toucher social des robots par approche multi-deep-learning

Une équipe de chercheurs propose, dans un article de positionnement déposé sur arXiv en mai 2025 (arXiv:2605.02538), une architecture multi-modèles pour traiter le toucher social affectif en robotique. Le problème ciblé est précis : si la préhension et la dextérité robotiques ont significativement progressé grâce au retour haptique, les gestes affectifs - poignées de main, caresses rassurantes, contacts sociaux codifiés - restent non résolus en interaction humain-robot (HRI). Les auteurs proposent de décomposer le toucher affectif en sous-tâches spécialisées, chacune traitée par un modèle dédié, dans une architecture distribuée en boucle fermée inspirée de la neurobiologie. Ce cadre repose sur un protocole de partage d'état pair-à-pair et s'intègre dans un pipeline Sim-to-Real pour faciliter le transfert de l'entraînement en simulation vers les plateformes physiques. Il s'agit à ce stade d'un cadre conceptuel sans validation expérimentale publiée. Le verrou adressé est réel : un robot capable de saisir un objet de cinq kilos avec précision peut échouer à simuler une poignée de main naturelle. Les auteurs introduisent la notion de "vallée de l'étrange haptique" (haptic uncanny valley), par analogie avec son équivalent visuel - un toucher robotique "presque juste" génère un inconfort plus marqué qu'un contact clairement artificiel. L'approche multi-modèles distribuée, à l'opposé d'un mouvement moteur monolithique, permettrait un développement cumulatif et modulaire : les équipes spécialisées en haptique, en IA et en robotique peuvent contribuer indépendamment. Pour les intégrateurs de robots sociaux dans les secteurs médical, thérapeutique ou d'assistance à la personne, cela ouvre une voie vers des interactions physiques acceptables et objectivement mesurables. La robotique sociale s'est longtemps concentrée sur l'expressivité faciale et vocale - Pepper de SoftBank Robotics, Paro de l'AIST japonais - en laissant le toucher en marge. Les travaux sur le retour haptique dans la manipulation (MIT, Stanford) ont ouvert la voie, mais sans cibler spécifiquement la dimension affective. Les acteurs industriels aujourd'hui dominants - Figure AI avec Figure 02, Boston Dynamics, 1X Technologies - concentrent leurs efforts sur la locomotion et la manipulation de charges, pas sur la qualité sociale du contact physique. Ce papier de positionnement structure un agenda de recherche interdisciplinaire dont les prochaines étapes attendues seront l'implémentation et l'évaluation sur des robots compagnons ou d'assistance, segments où des acteurs européens comme Enchanted Tools (France) et des projets d'assistance à la dépendance commencent à émerger.

UELa proposition d'un cadre modulaire pour le toucher affectif représente une piste de R&D pertinente pour des acteurs français comme Enchanted Tools, actifs sur les robots d'assistance et de compagnie.

RecherchePaper
1 source
Le fondateur d'iRobot veut placer un compagnon robotique dans votre foyer
190IEEE Spectrum Robotics 

Le fondateur d'iRobot veut placer un compagnon robotique dans votre foyer

Colin Angle, cofondateur d'iRobot - la société derrière le Roomba et la plus grande réussite commerciale de l'histoire de la robotique domestique - a présenté le 4 mai 2026 le premier robot de sa nouvelle entreprise, Familiar Machines & Magic (FM&M). Baptisé "Familiar", ce quadrupède à 23 degrés de liberté est recouvert d'une peau tactile personnalisée, équipé d'un réseau de microphones, d'un système de vision et d'une pile d'IA embarquée reposant sur un modèle multimodal compact optimisé pour le raisonnement social, combinant en temps réel vision, audio, langage et mémoire. La forme est délibérément celle d'un ours très abstrait - ni chien, ni chat - suivant la stratégie de Paro et Pleo : l'absence de référent animal direct réduit les attentes préconçues de l'utilisateur. Destiné aux adultes, Familiar est conçu pour vivre dans un foyer, chercher le contact de ses habitants et les aider à instaurer des routines positives - limiter le temps d'écran, inciter à sortir marcher. Aucun prix ni date de commercialisation n'ont été communiqués : il s'agit à ce stade d'un premier prototype présenté publiquement. Morgan Pope, ancien chercheur chez Disney Research, figure parmi les cofondateurs clés. Ce lancement teste une hypothèse industrielle précise : deux avancées récentes rendraient aujourd'hui crédible un robot social grand public viable. Pope identifie d'abord les robots bipèdes de Disney pilotés par apprentissage par renforcement (RL), qui ont démontré qu'une locomotion adaptative sur terrain varié ne nécessite plus d'actionneurs coûteux à faible jeu mécanique. Ensuite, les modèles génératifs multimodaux, dont Pope reconnaît ouvertement qu'ils excellent à créer "l'illusion plausible d'intelligence" - suffisante pour rendre un personnage cohérent sans compréhension profonde du monde physique. Pour les intégrateurs et décideurs, c'est un signal que le ratio performance/coût du hardware embarqué et du software a franchi un seuil. Le positionnement "coaching comportemental" tente de distinguer Familiar des gadgets de compagnie en lui assignant une utilité mesurable, là où ses prédécesseurs peinaient à justifier leur prix. La catégorie des robots sociaux grand public accumule les échecs commerciaux : Jibo, Cozmo, et le premier AIBO de Sony ont illustré la difficulté à convaincre au-delà des early adopters. Angle dispose d'une crédibilité rare dans ce contexte : iRobot a vendu des dizaines de millions de Roombas avant d'être racheté par Amazon en 2022, puis revendu. FM&M se positionne face à l'AIBO actuel de Sony (quadrupède social, environ 2 900 euros), mais avec une proposition d'IA comportementale plus ambitieuse et un traitement local plutôt que cloud. Aucun acteur français ou européen n'opère directement sur ce segment résidentiel - Enchanted Tools avec Miroki cible le secteur tertiaire. Les prochaines étapes de FM&M restent non communiquées : pas de timeline de lancement, pas de partenaire distributeur annoncé.

IA physiqueOpinion
1 source
Graphes de scènes spatio-temporels prédictifs pour scènes semi-statiques
191arXiv cs.RO 

Graphes de scènes spatio-temporels prédictifs pour scènes semi-statiques

Une équipe de chercheurs publie dans un preprint arXiv (réf. 2605.00121, mai 2025) une méthode de représentation spatio-temporelle-sémantique permettant à un robot de prédire l'état futur d'un environnement qui change de manière structurée entre les observations. La méthode repose sur deux composants : un filtre bayésien nommé Perpetua\, chargé d'inférer les états successifs de l'environnement, et une structure de graphe de scène 3D baptisée PredictiveGraphs, dans laquelle les nœuds représentent des objets et les arêtes encodent des relations spatio-sémantiques via des instances de Perpetua\. L'exemple illustratif donné est celui d'une tasse se déplaçant cycliquement entre placard, plan de travail et évier selon une routine quotidienne. La validation expérimentale couvre simulations et tests en environnement réel, où un espace domestique a subi des changements semi-statiques à raison d'une perturbation toutes les deux heures sur une période de trois semaines. L'enjeu opérationnel est significatif pour les robots déployés dans des environnements non contrôlés comme les entrepôts, les hôpitaux ou les domiciles. La grande majorité des représentations spatiales actuelles, des NeRF sémantiques aux graphes de scène 3D comme Hydra ou SceneGraphFusion, sont statiques ou réactives : elles gèrent les changements détectés en direct mais ne prévoient pas les états futurs. PredictiveGraphs s'attaque au "semi-static gap" : l'objet n'est pas présent au moment de l'observation, mais le robot doit pouvoir le localiser pour une tâche ultérieure. Dans les conditions de test, la méthode surpasse les approches de référence y compris face à des shifts de distribution, autrement dit lorsque les habitudes d'utilisation des objets dévient du schéma appris. Cette robustesse est une propriété critique pour des déploiements industriels où les routines humaines évoluent dans le temps. Les graphes de scène 3D pour la robotique ont connu un essor marqué depuis les travaux fondateurs de Rosinol et al. au MIT SPARK Lab en 2020 et le système open-source Hydra. Le raisonnement temporel sur ces structures reste néanmoins peu exploré : quelques travaux récents ont esquissé la piste via du SLAM probabiliste ou des représentations dynamiques partielles, sans modélisation explicite des cycles comportementaux récurrents. PredictiveGraphs occupe ce créneau. Ce preprint ne mentionne ni partenariat industriel ni calendrier de déploiement, et les expériences restent à l'échelle d'un appartement. La suite logique impliquerait une validation en environnement plus large, entrepôt ou établissement de soin, territoire où des acteurs européens comme Enchanted Tools avec son robot Mirokaï, ou des intégrateurs AMR opérant en espace contraint, commencent à chercher exactement ce type de raisonnement prédictif sur la disposition des objets.

UEImpact indirect : des robots opérant en espaces semi-contrôlés, comme le Mirokaï d'Enchanted Tools (France) ou les AMR européens en entrepôt, sont précisément les cibles applicatives identifiées, mais aucun partenariat ni transfert technologique n'est engagé à ce stade.

RecherchePaper
1 source
Combler l'écart de latence : pourquoi l'IA physique exige des architectures edge-first
192Robotics Business Review 

Combler l'écart de latence : pourquoi l'IA physique exige des architectures edge-first

Les systèmes vision industriels déployés en cloud affichent des latences aller-retour de 100 à 200 millisecondes pour la chaîne complète (acquisition image, inférence, retour commande). La norme ISO/TS 15066 sur le Speed and Separation Monitoring (SSM) impose pourtant au robot de maintenir en permanence une distance de séparation protectrice vis-à-vis de l'opérateur, et de réduire sa vitesse ou stopper dès que cette distance est franchie. À une vitesse de bras modérée de 2 m/s, une latence de 150 ms représente une zone aveugle de 300 mm dans la cellule, soit la différence entre une opération conforme et un incident. Pour compenser, les intégrateurs élargissent les zones de sécurité et plafonnent les vitesses, annulant l'essentiel du bénéfice productivité visé par la collaboration. L'architecture proposée consiste à déplacer l'inférence IA vers un processeur edge localisé dans la cellule, connecté directement au contrôleur robot via EtherCAT, PROFINET IRT ou les API temps-réel des constructeurs (URScript pour Universal Robots, RAPID pour ABB, KAREL pour FANUC), en contournant le PLC pour les ajustements cinématiques dynamiques. L'enjeu pour les intégrateurs et les décideurs industriels est d'atteindre une latence end-to-end inférieure à 30 ms, seuil identifié comme nécessaire pour un SSM proactif en environnement dynamique. Les PLCs industriels classiques, conçus pour des cycles de scrutation de 10 à 50 ms sur des entrées-sorties discrètes déterministes, ne sont pas dimensionnés pour ingérer les flux haute bande passante issus du suivi squelettique, de l'analyse de micro-mouvements et de l'estimation de l'état opérateur. Y router les inférences IA ajoute un cycle complet plus l'overhead fieldbus, suffisant pour briser le déterminisme nécessaire. Le modèle edge-direct débloque ainsi deux niveaux de valeur simultanément : le maintien du temps de cycle dans les cellules high-mix à haute variabilité, et la conformité SSM sans recourir à des vitesses réduites permanentes. À noter : l'article ne fournit pas de données de validation expérimentale sur cellules de production réelles, ce qui sera déterminant pour les intégrateurs en phase d'évaluation. L'article est publié par Cogniedge.ai, startup positionnée sur les architectures edge pour la robotique collaborative, dans un contexte de transition progressive des lignes brownfield vers des configurations HRC sans cage de protection. La norme ISO/TS 15066 encadre ce déploiement depuis 2016, mais son application reste freinée par des architectures logicielles héritées. Sur le marché, des acteurs comme SICK (capteurs de sécurité vision), Pilz (PNOZ, SafetyBUS) ou Veo Robotics (racheté par FANUC en 2023 après avoir développé une approche similaire de vision 3D pour SSM) adressent des segments proches. Du côté européen, des entreprises comme Pollen Robotics ou Enchanted Tools travaillent sur des plateformes robotiques à latence réduite, mais davantage dans des contextes de service que d'assemblage industriel. Les prochaines étapes logiques pour Cogniedge.ai seraient de publier des benchmarks comparatifs et de sécuriser des pilotes en production réelle, deux éléments absents de cette publication.

UELes intégrateurs européens soumis à l'ISO/TS 15066 pourraient adopter ces architectures edge-direct pour maintenir la conformité SSM sans sacrifier les temps de cycle sur les lignes HRC brownfield, mais l'absence de validation expérimentale retarde toute décision d'adoption.

IndustrielOpinion
1 source
DC-Ada : adaptation décentralisée des capteurs par récompense seule pour des équipes multi-robots hétérogènes
193arXiv cs.RO 

DC-Ada : adaptation décentralisée des capteurs par récompense seule pour des équipes multi-robots hétérogènes

Une équipe de chercheurs propose DC-Ada, une méthode d'adaptation décentralisée pour les équipes multi-robots hétérogènes, publiée sur arXiv (2604.03905). Le problème ciblé est concret : lorsqu'un essaim de robots est déployé, les plateformes diffèrent souvent en modalités de capteurs, en champs de vision, en portée, et en modes de défaillance. Un contrôleur entraîné sur une configuration "nominale" se dégrade significativement dès qu'un robot présente des capteurs manquants ou non conformes, même si la tâche reste identique. DC-Ada répond à ce problème en maintenant la politique partagée préentraînée entièrement gelée, et en adaptant uniquement des transformations d'observation compactes, propres à chaque robot, pour les faire correspondre à une interface d'inférence fixe. La méthode est sans gradient et ne nécessite qu'un minimum de communication : elle repose sur une recherche aléatoire accept/refus avec tirage à nombres aléatoires communs, sous un budget strict de 200 000 pas d'environnement joints par run. Les expériences couvrent trois tâches (logistique d'entrepôt, recherche et sauvetage, cartographie collaborative), quatre régimes d'hétérogénéité (H0 à H3) et cinq graines, comparées à quatre baselines. Les résultats offrent une image nuancée qui mérite d'être soulignée : aucune méthode ne domine sur l'ensemble des tâches et métriques. La normalisation d'observation est la plus robuste en termes de récompense pour la logistique d'entrepôt et compétitive en recherche et sauvetage, tandis que la politique gelée sans adaptation donne les meilleures récompenses en cartographie collaborative. DC-Ada se distingue précisément dans les scénarios de cartographie sévère (H3), où il améliore le taux de complétion de mission. Surtout, il n'exige que des retours scalaires d'équipe, sans fine-tuning de politique ni communication persistante entre agents, ce qui le rend utilisable à l'heure du déploiement sans modifier l'infrastructure existante. Ce travail s'inscrit dans une tendance croissante à traiter la robustesse post-déploiement comme un problème distinct de l'entraînement. Les approches concurrentes incluent les méthodes d'adaptation centralisées, le fine-tuning par domaine, et les techniques de transfert sim-to-réel classiques, qui supposent toutes un accès à la politique ou à des gradients. La limite principale de DC-Ada reste son évaluation sur simulateur 2D déterministe uniquement : la validation sur hardware réel avec des capteurs physiquement défaillants reste à démontrer. Les prochaines étapes logiques sont l'extension à des équipes plus larges, des environnements stochastiques, et une évaluation sur des plateformes physiques hétérogènes comme celles que développent des acteurs européens tels que Enchanted Tools ou les écosystèmes ROS2 industriels.

RecherchePaper
1 source
IA incarnée et création artistique : Alter-Art, un robot avatar pour explorer l'art
194arXiv cs.RO 

IA incarnée et création artistique : Alter-Art, un robot avatar pour explorer l'art

Des chercheurs ont publié sur arXiv (arXiv:2604.26473) un travail exploratoire autour du paradigme qu'ils nomment "Alter-Art" : permettre à un artiste humain d'habiter un corps robotique, baptisé Alter-Ego, pour créer dans le monde physique. Le système repose sur une téléopération immersive combinée à une actuation dite "compliant" (articulations à compliance variable, capables d'absorber les forces de contact sans rigidité excessive), offrant un retour sensoriel en première personne. Trois domaines artistiques ont été testés : la danse, le théâtre (aux côtés d'acteurs humains en chair et en os) et la peinture sur toile. L'article ne communique pas de spécifications hardware précises, nombre de degrés de liberté, payload, latence de la boucle de téléopération, ce qui limite l'évaluation externe des performances réelles du système. L'intérêt de ce travail pour la communauté robotique ne réside pas tant dans les specs techniques que dans le cadre conceptuel qu'il propose : l'embodiment comme principe de design central, distinct à la fois du robot autonome et du robot collaboratif. Les retours qualitatifs des artistes indiquent qu'un sentiment de présence dans le corps robotique se développe rapidement, et que les contraintes physiques du robot, cinématique limitée, inertie, précision motrice différente, influencent activement le processus créatif plutôt que de simplement le contraindre. Pour les intégrateurs et chercheurs en téléprésence, cela valide l'idée que la compliance mécanique n'est pas qu'un paramètre de sécurité mais un vecteur d'expressivité. L'accessibilité artistique pour des personnes à mobilité réduite est également mentionnée comme application concrète. Ce travail s'inscrit dans une tendance plus large autour de la téléprésence incarnée (embodied telepresence), un champ où des groupes comme ceux travaillant sur les interfaces haptiques (Shadow Robotics, Kinova) ou les robots de téléprésence sociale croisent désormais les arts vivants. En France, des acteurs comme Enchanted Tools (Miroki) et Pollen Robotics (Reachy) explorent des territoires adjacents, interaction sociale et manipulation expressive. L'équipe ne précise pas d'étapes de déploiement ni de partenariats industriels annoncés ; l'article reste à ce stade une contribution académique exploratoire, sans prototype commercialisé ni timeline de mise sur le marché.

UELes résultats sur la compliance mécanique comme vecteur d'expressivité pourraient nourrir la réflexion de design des acteurs français comme Enchanted Tools (Miroki) et Pollen Robotics (Reachy), actifs dans l'interaction sociale et la manipulation expressive, sans impact opérationnel immédiat.

RecherchePaper
1 source
Conception de processus par personas pour des environnements de travail humain-robot inclusifs pour les personnes en situation de handicap
195arXiv cs.RO 

Conception de processus par personas pour des environnements de travail humain-robot inclusifs pour les personnes en situation de handicap

Une équipe de recherche publie sur arXiv (arXiv:2604.26527) une méthodologie de conception de postes de travail humain-robot adaptés aux personnes en situation de handicap, reposant sur une approche dite "par personas". Le principe : plutôt que de concevoir un système pour un individu spécifique, les chercheurs abstraient les handicaps les plus fréquents en milieu professionnel sous forme de personas typiques, puis décomposent chaque processus de travail en actions séquentielles. Pour chaque combinaison action-persona, des stratégies d'adaptation sont développées par design thinking, classées selon le niveau d'assistance robotique requis, puis encodées dans un arbre de comportement (behavior tree). Le système a été démontré sur une tâche de pliage de boîtes en collaboration avec un robot, en couvrant sept personas présentant des handicaps différents. L'enjeu industriel est réel : les systèmes HRI existants pour l'intégration des travailleurs handicapés sont aujourd'hui quasi exclusivement personnalisés, ce qui les rend difficilement scalables au-delà d'un utilisateur unique. L'approche par personas vise à combler ce manque en permettant une conception "universelle" sans nécessiter une expertise clinique pointue pour chaque déploiement. L'utilisation d'arbres de comportement offre en outre une adaptation dynamique en ligne, le robot ajuste son niveau d'intervention en temps réel selon le profil identifié de l'opérateur. Les auteurs rapportent des "résultats prometteurs", formulation prudente qui reflète le stade préliminaire de la démonstration : une seule tâche de laboratoire, sept personas simulées, sans validation terrain réelle. Ce travail s'inscrit dans un champ de recherche en croissance rapide, à l'intersection de la cobotique industrielle et du design inclusif. Le paradigme du "universal design", issu de l'architecture et de l'ergonomie, est ici transposé à la robotique collaborative, un transfert encore peu documenté dans la littérature HRI. Aucun acteur industriel ni partenaire terrain n'est mentionné dans ce preprint, ce qui limite la portée immédiate des conclusions. Les prochaines étapes naturelles seraient une validation avec des utilisateurs réels en situation de handicap, et une extension à des processus industriels plus complexes que le pliage de carton. Du côté européen, des acteurs comme Enchanted Tools ou des laboratoires spécialisés en robotique d'assistance (INRIA, DLR) pourraient trouver dans cette approche un cadre méthodologique directement applicable à leurs travaux sur l'autonomie et l'adaptation comportementale.

UELe cadre méthodologique proposé pourrait être adopté par des laboratoires européens comme l'INRIA ou le DLR pour structurer leurs travaux sur l'adaptation comportementale des cobots en contexte inclusif.

RecherchePaper
1 source
EmbodiedLGR : un graphe léger pour la mémoire sémantique-spatiale des agents robotiques
196arXiv cs.RO 

EmbodiedLGR : un graphe léger pour la mémoire sémantique-spatiale des agents robotiques

Des chercheurs ont publié le 23 avril 2026 sur arXiv (référence 2604.18271) les travaux sur EmbodiedLGR-Agent, une architecture mémoire pour robots mobiles combinant graphe sémantique léger et retrieval-augmented generation. Le système repose sur un modèle visuo-langagier (VLM) à faible empreinte paramétrique qui indexe en continu les objets détectés, leurs positions et leurs relations spatiales dans un graphe dense, tout en conservant des descriptions de haut niveau des scènes observées via une couche RAG classique. L'ensemble tourne localement, sans dépendance cloud. Évalué sur le benchmark NaVQA, EmbodiedLGR-Agent atteint des performances état de l'art sur les temps d'inférence et de requête pour les agents robotiques embarqués, tout en maintenant une précision compétitive sur la tâche globale de question-réponse spatiale. Le système a également été déployé sur un robot physique réel, validant son utilité hors simulation. Ce qui mérite attention, c'est moins la précision brute que la latence : dans les interactions humain-robot, un agent qui répond "où sont les ciseaux ?" en temps humain change radicalement l'expérience utilisateur. La majorité des architectures mémoire robotiques actuelles sacrifient la réactivité à la richesse sémantique, ou inversement. L'approche hybride graphe + RAG tente de résoudre ce compromis sans exploser les ressources de calcul embarqué. Le déploiement sur robot physique, et non en simulation pure, est un signal concret, même si l'article ne précise pas la plateforme matérielle ni les métriques de latence chiffrées en millisecondes, ce qui limite la comparabilité directe avec d'autres systèmes. L'enjeu de la mémoire sémantique-spatiale est un chantier ouvert depuis plusieurs années dans la communauté robotique, avec des approches comme les scene graphs neuraux, ConceptGraphs ou encore les travaux de SayPlan. EmbodiedLGR se positionne sur le segment des architectures légères et déployables sur matériel contraint, là où des solutions comme celles de Boston Dynamics ou des startups comme Skild AI misent plutôt sur la puissance de calcul embarquée ou le traitement distant. Sur le front européen, des acteurs comme Enchanted Tools (Mirokaï) ou Wandercraft travaillent également sur la cognition embarquée, mais dans des contextes applicatifs distincts. Les prochaines étapes naturelles seraient une évaluation sur des benchmarks plus récents (Habitat, OpenEQA) et une publication des temps de latence mesurés sur plateforme physique.

RechercheOpinion
1 source
DART : commande prédictive augmentée par apprentissage pour la manipulation bi-bras non préhensile
197arXiv cs.RO 

DART : commande prédictive augmentée par apprentissage pour la manipulation bi-bras non préhensile

Des chercheurs ont publié sur arXiv (référence 2604.17833) les travaux autour de DART, un framework bimanuel conçu pour la manipulation non préhensile d'objets posés sur un plateau. L'approche repose sur un contrôleur prédictif non linéaire (MPC) couplé à un contrôleur d'impédance par optimisation, permettant de déplacer des objets sur le plateau sans les saisir directement. Le système évalue trois stratégies de modélisation de la dynamique plateau-objet : un modèle analytique physique, un modèle par régression en ligne adaptatif en temps réel, et un modèle de dynamique entraîné par apprentissage par renforcement (RL), ce dernier offrant une meilleure généralisation sur des objets aux propriétés variées. Les évaluations ont été réalisées en simulation sur des objets de masses, géométries et coefficients de friction différents. Les auteurs revendiquent que DART constitue le premier framework dédié à ce type de tâche en configuration bimanuelle. L'intérêt technique de DART réside dans la comparaison rigoureuse des trois approches de modélisation sur des métriques concrètes : temps de stabilisation, erreur en régime permanent, effort de contrôle et généralisation. Ce benchmark interne est utile pour les équipes d'intégration robotique qui doivent choisir entre modèles physiques (précis mais rigides), adaptation en ligne (réactive mais computationnellement coûteuse) et RL (flexible mais plus difficile à certifier). L'association MPC et contrôleur d'impédance est une piste crédible pour la manipulation d'objets fragiles ou instables, un verrou important en robotique de service. Toutefois, la validation reste strictement en simulation : le passage au réel implique des défis de perception, de latence et de calibration que le papier ne traite pas encore. Ce travail s'inscrit dans un intérêt croissant pour la robotique de service en hôtellerie et restauration, où des acteurs comme Bear Robotics (Servi), Keenon Robotics ou encore Enchanted Tools (Miroki, développé en France) positionnent leurs plateformes sur des tâches de transport et de service en salle. Les approches dominantes jusqu'ici privilégient la navigation autonome avec préhension classique ; la manipulation non préhensile sur plateau reste peu explorée à l'échelle produit. La prochaine étape naturelle pour DART serait une validation sur plateforme physique, avec des bras commerciaux type Franka Research 3 ou Universal Robots, avant d'envisager une intégration dans un robot mobile de service.

UEEnchanted Tools (Miroki, France) est cité comme acteur du service robotique susceptible de bénéficier de ce type de manipulation non préhensile sur plateau, mais le travail reste en simulation sans transfert réel annoncé.

RecherchePaper
1 source
GIST : extraction de connaissances multimodales et ancrage spatial par topologie sémantique intelligente
198arXiv cs.RO 

GIST : extraction de connaissances multimodales et ancrage spatial par topologie sémantique intelligente

Des chercheurs ont publié GIST (Grounded Intelligent Semantic Topology), un pipeline de traitement multimodal capable de transformer un nuage de points 3D capturé avec un équipement grand public en une carte de navigation sémantiquement annotée. Le système construit d'abord une carte d'occupation 2D, en extrait la topologie spatiale, puis y superpose une couche sémantique légère par sélection intelligente de keyframes. Quatre modules sont démontrés en aval : un moteur de recherche sémantique capable d'inférer des alternatives catégorielles quand la correspondance exacte échoue, un localisateur one-shot atteignant 1,04 mètre d'erreur de translation moyenne (top-5), un classificateur de zones segmentant le plan de sol en régions sémantiques de haut niveau, et un générateur d'instructions de navigation en langage naturel ancré visuellement dans des repères contextuels. Une évaluation in situ sur cinq participants affiche un taux de succès de navigation de 80 % en s'appuyant uniquement sur des instructions verbales. L'intérêt pour les intégrateurs industriels réside dans l'approche bas coût : GIST ne requiert pas de LiDAR haute précision, mais exploite un nuage de points mobile grand public, ce qui abaisse significativement le seuil d'entrée pour des déploiements en entrepôt, hôpital ou grande surface. La robustesse à la distribution longue des sémantiques visuelles, problème classique dans les environnements retail denses où les rayonnages changent fréquemment, est explicitement adressée, là où les VLMs (Vision-Language Models) courants échouent sur le grounding spatial en environnement encombré. Cela dit, l'évaluation reste exploratoire (N=5), et les résultats ne constituent pas une validation à l'échelle industrielle. Le papier s'inscrit dans un courant de recherche actif autour de la navigation sémantique pour l'IA incarnée, en concurrence directe avec des approches comme les semantic maps dérivées de NeRF ou les pipelines SLAM enrichis par LLM. Côté Europe, des acteurs comme Enchanted Tools (robots hospitaliers) ou Exotec (systèmes AMR pour entrepôts) pourraient trouver dans ce type de représentation topologique une brique utile pour la localisation fine et la génération d'instructions opérateur. L'article est disponible en preprint sur arXiv (2604.15495) et n'a pas encore été soumis à évaluation par les pairs au moment de sa publication.

UEDes acteurs français comme Enchanted Tools (robots hospitaliers) et Exotec (AMR entrepôts) pourraient exploiter ce type de cartographie sémantique bas coût pour améliorer la localisation fine et la génération d'instructions opérateur, sans investissement LiDAR haute précision.

RecherchePaper
1 source
Maniformer lance une plateforme de données d'IA physique tout-en-un pour préparer l'ère de l'AGI
199Pandaily 

Maniformer lance une plateforme de données d'IA physique tout-en-un pour préparer l'ère de l'AGI

Maniformer, startup chinoise spécialisée dans l'infrastructure de données pour l'IA physique, a officiellement lancé sa plateforme de services de données en un seul guichet, accompagnée de la gamme matérielle MEgo et du système de gouvernance MEgo Engine. La gamme MEgo comprend trois composants : le MEgo Gripper pour la capture de données de manipulation robotique, le MEgo View, un dispositif de collecte portable à tête montée, et le MEgo Engine pour le traitement et la gouvernance des données. Ces outils affichent une précision millimétrique, une synchronisation sub-milliseconde et une perception panoramique supérieure à 300 degrés. Le système est nativement compatible avec le robot G2 Air, garantissant la cohérence entre environnements simulés et réels. Selon Yao Maoqing, président-directeur général, l'entreprise vise une capacité de production de dizaines de millions d'heures de données d'ici 2026, puis des dizaines de milliards d'heures d'ici 2030. Le problème que Maniformer cherche à résoudre est structurel : les données d'interaction physique réelle disponibles pour l'IA incarnée représentent moins de 1/20 000 de ce qui existe pour les grands modèles de langage. Ce déficit, combiné à l'absence de standards, à des problèmes de qualité hétérogène et à des inadéquations entre offre et demande, freine concrètement la commercialisation des robots autonomes. En proposant une infrastructure full-stack couvrant la télé-opération réelle, la collecte sans robot dédié et la génération synthétique par simulation, Maniformer cherche à décorréler la production de données de la disponibilité des plateformes robotiques elles-mêmes, une approche qui, si elle tient ses promesses, pourrait accélérer significativement le cycle sim-to-real pour les intégrateurs et les équipes R&D. L'analogie revendiquée avec l'électricité ou l'eau comme utilities est ambitieuse ; elle reste à valider à l'échelle industrielle. L'entreprise s'inscrit dans un contexte de course mondiale aux données d'entraînement pour robots humanoïdes et manipulateurs, où des acteurs comme Physical Intelligence (Pi-0), Boston Dynamics, Figure AI ou Unitree investissent massivement dans leurs propres pipelines de données propriétaires. La stratégie de Maniformer est différente : se positionner en fournisseur tiers d'infrastructure, à la manière d'un AWS pour la donnée physique. L'initiative "Hive" annoncée vise à fédérer des partenaires mondiaux pour co-construire des standards sectoriels, une démarche de standardisation qui, si elle aboutit, pourrait bénéficier à l'ensemble de l'écosystème, y compris aux acteurs européens comme Enchanted Tools ou Wandercraft qui peinent à constituer des datasets suffisants. La prochaine étape annoncée est le déploiement d'un réseau global de collecte de données, sans calendrier précis communiqué au-delà de l'horizon 2026.

UESi l'initiative 'Hive' de standardisation aboutit, les acteurs européens comme Enchanted Tools ou Wandercraft pourraient bénéficier d'une infrastructure de données partagée pour accélérer leurs pipelines sim-to-real.

Chine/AsieActu
1 source
Le vrai défi de la robotique n’est pas technique
200Robot Magazine FR 

Le vrai défi de la robotique n’est pas technique

Dominique Carricart, expert en intégration robotique industrielle, publie le 16 avril 2026 une tribune dans laquelle il défend une thèse contre-intuitive : depuis trente ans de terrain, les projets robotiques n'échouent pas pour des raisons techniques, mais pour des raisons humaines. Son point de départ est autobiographique : en 1996, embauché chez Renault à 23 ans pour accompagner la transition des robots hydrauliques vers les robots électriques, il se heurte immédiatement à la résistance de techniciens expérimentés qui maîtrisaient une logique câblée que les écoles n'enseignaient déjà plus. Ce choc de cultures lui a appris une règle qu'il observe depuis dans chaque projet : l'intégration d'une technologie ne se réduit pas à son installation. La vraie variable d'échec, c'est la question que chaque opérateur se pose en silence dès qu'un robot entre dans l'atelier, "Est-ce que mon emploi va disparaître ?", et que les directions évitent systématiquement d'aborder. Cette peur non adressée se traduit en coûts opérationnels concrets : désengagement, sabotage passif, robots tournant durablement sous leurs capacités nominales, pannes non signalées. Carricart identifie quatre profils récurrents chez les industriels : ceux qui refusent la technologie par crainte du risque, ceux qui l'utilisent sur un périmètre très restreint sans aller plus loin, ceux qui ont investi dans un robot aujourd'hui à l'arrêt faute de compétences internes pour le reprogrammer, et enfin les plus paradoxaux, ceux qui ont éliminé tout contrôle humain au profit de l'automatisation et génèrent des taux de rebut élevés. L'enseignement commun à ces quatre cas : le problème n'est jamais la machine. C'est la gouvernance humaine qui l'entoure. Pour les intégrateurs et les directeurs industriels, cette grille de lecture est directement actionnable : le ROI d'un déploiement robotique est autant une fonction de l'accompagnement du changement que de la performance mécanique. Ce constat prend une dimension nouvelle avec l'émergence des robots humanoïdes, dont plusieurs modèles étaient visibles au salon Global Industrie 2026. Leur argument commercial central, les ateliers existants étant conçus pour des corps humains, un robot anthropomorphe s'y intègre sans refonte d'infrastructure, est réel, mais Carricart souligne un effet collatéral ignoré : l'impact psychologique d'un humanoïde mobile est radicalement différent de celui d'un bras dans une cage. Un manipulateur industriel est perçu comme un outil ; un robot qui marche et saisit des objets dans l'espace de travail humain déclenche des réponses émotionnelles d'une autre nature. L'auteur, dont la tribune s'inscrit dans un contexte de montée en puissance des acteurs du secteur, Figure, Boston Dynamics, 1X, et côté francophone des initiatives comme Enchanted Tools, ne cite pas de déploiements chiffrés ni de données comparatives, ce qui limite la portée empirique de l'argument, mais la trajectoire observée depuis 1996 donne à son propos une crédibilité de praticien que les annonces de laboratoire ne contredisent pas.

UELa grille de lecture de Carricart sur la conduite du changement est directement applicable aux industriels français et européens évaluant un déploiement humanoïde après Global Industrie 2026, avec une mention explicite d'Enchanted Tools comme acteur francophone émergent.

IndustrielOpinion
1 source