Aller au contenu principal
Une nouvelle puce pourrait aider les petits robots à traverser des environnements complexes
RechercheMIT News Robotics 

Une nouvelle puce pourrait aider les petits robots à traverser des environnements complexes

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs du MIT ont conçu un système-sur-puce baptisé Gleanmer, capable de générer des cartes 3D en temps réel à partir d'un flux de caméra de profondeur, avec une consommation d'environ 6 milliwatts, soit l'équivalent d'une LED. Cette performance s'obtient grâce à une co-conception algorithme-matériel : l'équipe, menée par la professeure Vivienne Sze (EECS/RLE) et le professeur Sertac Karaman (aéronautique, directeur du LIDS), a couplé leur algorithme de cartographie GMMap à un accélérateur matériel dédié. Les co-premiers auteurs Zih-Sing Fu et Peter Zhi Xuan Li ont présenté ces travaux à l'IEEE Very Large-Scale Integrated Circuits Symposium. L'application cible annoncée : de petits UAVs à batterie limitée, comme ceux qui pourraient inspecter des conduits HVAC industriels pour détecter des fuites de gaz en naviguant dans des espaces confinés avec évitement d'obstacles.

La différence technique réside dans la représentation géométrique. Là où les approches classiques modélisent l'espace en voxels, des cubes 3D qui demandent de charger et retraiter chaque image de profondeur plusieurs fois, Gleanmer utilise des gaussiennes, des ellipsoïdes dont la taille, la forme et l'orientation s'adaptent librement à la géométrie des objets. Un seul ellipsoïde allongé peut remplacer des dizaines de voxels pour représenter une surface courbe, ce qui réduit drastiquement l'empreinte mémoire. L'innovation clé est une technique de génération de gaussiennes en un seul passage sur l'image de profondeur : une fois traitée, l'image est effacée et n'a pas besoin d'être stockée. Résultat : des cartes denses incluant obstacles et espace libre, suffisantes pour planifier un chemin sans collision, générées sans le GPU ni la mémoire vive que requièrent habituellement les pipelines de cartographie dense. Pour un intégrateur robotique, cela signifie qu'il devient envisageable d'embarquer de la navigation autonome sur des plateformes où la contrainte énergétique était jusqu'ici rédhibitoire.

Ce travail s'inscrit dans un effort plus large de miniaturisation des capacités de cartographie et de localisation simultanées (SLAM). Les systèmes embarqués actuels capables de cartographie 3D dense en temps réel, qu'il s'agisse de solutions comme Intel RealSense couplées à des SBC, ou des implémentations GPU embarquées type Nvidia Jetson, consomment plusieurs watts à quelques dizaines de watts, plusieurs ordres de grandeur au-dessus des 6 mW de Gleanmer. Les auteurs mentionnent aussi un second débouché : les casques de réalité augmentée légers, pour des applications médicales ou de maintenance industrielle, où l'autonomie de la batterie conditionne l'usage prolongé. Le composant n'est pour l'instant qu'un prototype de recherche présenté en symposium ; aucun partenariat industriel ni calendrier de productisation n'a été annoncé. Les prochaines étapes naturelles seraient une validation sur plateforme réelle en vol, et une intégration dans une chaîne SLAM complète incluant localisation, pas seulement cartographie.

À lire aussi

Un nouveau système d'IA aide les robots à transférer leur entraînement virtuel vers des tâches réelles
1Interesting Engineering 

Un nouveau système d'IA aide les robots à transférer leur entraînement virtuel vers des tâches réelles

Des chercheurs de l'Aston University et de l'University of Birmingham ont publié dans Scientific Reports une méthode d'entraînement robotique visant à réduire le "sim-to-real gap", ce fossé persistant entre les performances d'un robot en simulation et son comportement réel. L'approche, développée dans le cadre du projet REBELION financé par UK Research and Innovation, utilise un générateur de variations d'environnement piloté par IA : pendant la phase de simulation, le système introduit automatiquement des perturbations (bruit capteur, variabilité des matériaux, forces inattendues) pour entraîner le robot à des conditions plus proches du terrain. La validation expérimentale porte sur des tâches de manipulation et de découpe impliquant une interaction physique avec des matériaux, puis un ajustement avec un volume minimal de données réelles. Le cas d'usage mis en avant est le recyclage de batteries lithium-ion, où les robots doivent opérer autour de cellules endommagées ou potentiellement dangereuses, rendant les cycles de test physiques coûteux et risqués. L'intérêt industriel est direct : la dépendance à de longs cycles de test en environnement réel est l'un des principaux freins au déploiement rapide de robots dans des lignes de production ou des ateliers de recyclage. En permettant de compresser l'essentiel de l'apprentissage en simulation tout en garantissant un transfert fiable avec peu de données réelles, cette approche pourrait raccourcir significativement les timelines d'intégration et réduire les coûts opérationnels pour les industriels. Elle valide aussi une hypothèse qui fait débat dans le secteur depuis plusieurs années : que le sim-to-real gap n'est pas une fatalité, mais un problème d'exposition à la variance pendant l'entraînement. La vision formulée par le Dr. Alireza Rastegarpanah, assistant professor en applied AI and robotics à Aston University, est celle de systèmes robotiques "plug-and-play", entraînés une fois en simulation et redéployés rapidement dans un nouveau contexte sans reconfiguration lourde. C'est une promesse ambitieuse, et les résultats publiés restent limités à un périmètre de tâches contrôlées ; aucun chiffre de performance comparative (taux de succès, cycles de recalibration) n'est rendu public dans la version relayée. Le sim-to-real gap est un problème structurel documenté depuis les premières applications de reinforcement learning en robotique. Des acteurs comme Boston Dynamics, Agility Robotics ou encore Wandercraft (France, exosquelettes) utilisent des combinaisons de domain randomization et de transfert par imitation pour y répondre, avec des niveaux de maturité variables selon les tâches. Le projet REBELION s'inscrit dans un effort européen plus large sur l'automatisation du recyclage de batteries, filière en forte croissance avec l'essor des véhicules électriques. Les prochaines étapes annoncées par l'équipe visent à élargir la méthode à des environnements industriels plus incertains et à des applications en manufacturing avancé et opérations autonomes, sans calendrier précis communiqué.

UELa méthode du projet REBELION (financé UKRI, inscrit dans un effort européen) pourrait accélérer le déploiement de robots dans les filières EU de recyclage de batteries lithium-ion, secteur stratégique pour la transition électrique.

RecherchePaper
1 source
Coordination multi-robots adaptative et ouverte à travers des environnements, partenaires et échelles inédits
2arXiv cs.RO 

Coordination multi-robots adaptative et ouverte à travers des environnements, partenaires et échelles inédits

Une équipe de recherche publie sur arXiv (2607.04972v1) un nouveau cadre nommé HOLA, pour Hypergraphic Open-ended Learning Algorithm, destiné à coordonner des équipes de robots capables de s'adapter simultanément à des environnements inconnus, des partenaires inconnus et des tailles d'équipe variables. Contrairement aux approches classiques qui supposent une composition d'équipe fixe (le "closed-world assumption"), les chercheurs modélisent la coopération via un jeu sous forme hypergraphique, une construction théorique des jeux qui capture les relations coopératives à l'échelle de l'équipe entière plutôt que seulement des interactions par paires, à la différence des architectures de réseaux de neurones sur graphes. L'algorithme HOLA entraîne les agents en élargissant progressivement la diversité des partenaires et des environnements plutôt qu'en optimisant pour une configuration figée. Testé sur des tâches de poursuite coopérative, le système a été validé sur des essaims multi-drones et multi-quadrupèdes, avec des déploiements réels sur les plateformes Crazyflie (drones du fabricant suédois Bitcraze) et Zsibot L1 (quadrupèdes), sans réglage fin supplémentaire lors du transfert du simulateur au matériel physique. Ce résultat compte pour l'industrie de la robotique en essaim et multi-agents parce qu'il attaque de front un angle mort connu du secteur: la plupart des systèmes multi-robots démontrés en recherche restent calibrés pour une équipe et un environnement fixés à l'avance, ce qui limite leur usage en conditions réelles où les partenaires, leur nombre et le terrain changent en permanence. Un transfert sim-to-réel direct et sans fine-tuning, s'il se confirme à plus grande échelle, réduit un coût d'ingénierie important pour les intégrateurs qui déploient des flottes hétérogènes de drones ou de robots à pattes. Le travail s'inscrit dans la lignée de l'apprentissage par renforcement multi-agents et des méthodes d'apprentissage "open-ended" par diversification progressive des adversaires et partenaires, popularisées notamment dans les jeux de population type league training. Les auteurs annoncent avoir surpassé toutes les méthodes de référence sur les trois axes d'adaptabilité testés (environnement, partenaires, échelle), ouvrant la voie à des essais sur des flottes plus larges et des plateformes robotiques supplémentaires.

UELe système est validé sur les drones Crazyflie du fabricant suédois Bitcraze, une plateforme robotique européenne utilisée pour ces travaux de recherche avancée en coordination multi-agents.

RecherchePaper
1 source
Le nouveau système de Galbot aide les robots humanoïdes à bouger naturellement pendant une conversation
3Interesting Engineering 

Le nouveau système de Galbot aide les robots humanoïdes à bouger naturellement pendant une conversation

Galbot, entreprise chinoise de robotique, a dévoilé RoboGesture, un framework destiné à générer en temps réel des gestes synchronisés avec la parole pour les robots humanoïdes. Développé avec des chercheurs de l'université Tsinghua, de l'université de Pékin, du Beijing Institute of Technology, du Harbin Institute of Technology et du Shanghai Qi Zhi Institute, le système sera présenté à l'European Conference on Computer Vision (ECCV) 2026. Annoncé le 5 septembre 2026 sur le compte X de Galbot, RoboGesture ferme la boucle écoute-réponse-geste en environ deux secondes. Le système convertit la parole entrante en tokens audio via le codec Mimi, puis analyse le signal à plusieurs niveaux : les caractéristiques de bas niveau captent le rythme et les variations de ton, tandis que les couches plus profondes extraient le sens sémantique. La composante sémantique a été entraînée sur 300 catégories de gestes. Les signaux sont ensuite transmis à un modèle de génération de mouvement fondé sur un transformer à diffusion, qui produit des trajectoires dans un espace de mouvement continu plutôt que des commandes fixes, permettant un enchaînement fluide des gestes. Cette annonce vise une limite récurrente des robots humanoïdes commerciaux : des mouvements souvent perçus comme mécaniques, répétitifs ou déconnectés du discours, un défaut qui nuit à l'acceptation des robots dans des rôles d'accueil, de guide ou d'assistance sociale. Les chercheurs affirment s'attaquer à trois obstacles concrets : le manque de données d'entraînement, la difficulté à relier la parole au mouvement approprié, et les risques de sécurité lorsque des gestes générés par IA sont transférés à un robot physique. Ils identifient également un problème baptisé « éclipse de modalité », où le modèle se met à répéter des gestes issus de ses mouvements précédents au lieu de réagir à la nouvelle parole ; une méthode de guidage nommée Anti-Inertia classifier-free guidance masking est présentée comme correctif. Ces travaux restent toutefois au stade de la recherche académique : la démonstration diffusée sur X ne constitue pas une validation indépendante, et aucun chiffre de déploiement, de coût ou de robustesse en conditions réelles n'est fourni, ce qui invite à la prudence sur la portée réelle du système hors laboratoire. Galbot s'inscrit dans la vague des start-up chinoises de robotique généraliste qui, comme leurs homologues américaines telles que Figure avec son modèle Figure 03, Tesla avec Optimus, ou les initiatives fondées sur des modèles VLA comme Pi-0 de Physical Intelligence ou GR00T N2 de Nvidia, cherchent à doter les humanoïdes de capacités de manipulation et de perception avancées. RoboGesture se distingue en ciblant spécifiquement la communication non verbale plutôt que la manipulation ou la locomotion, un axe encore peu exploré par une concurrence surtout focalisée sur les tâches industrielles ou logistiques. La présentation prévue à l'ECCV 2026, conférence académique de référence en vision par ordinateur, signale une publication scientifique plutôt qu'un lancement commercial : l'article ne mentionne ni pilote annoncé, ni calendrier de déploiement, ni partenaire industriel identifié à ce stade.

RecherchePaper
1 source
Suivi Robuste à la Dégénérescence pour Environnements Géométriquement Complexes par Lidar FMCW
4arXiv cs.RO 

Suivi Robuste à la Dégénérescence pour Environnements Géométriquement Complexes par Lidar FMCW

Un papier publié sur arXiv (référence 2603.10248v3, version révisée) présente un système de navigation Teach and Repeat (T&R) conçu pour rester fiable dans les environnements géométriquement dégénérés, ces terrains peu structurés où les méthodes de localisation classiques perdent leurs repères. Le T&R permet à un robot de répéter automatiquement un trajet déjà parcouru sans GPS, ce qui le destine aux mines souterraines ou à la navigation lunaire. Les systèmes T&R actuels reposent généralement sur l'algorithme ICP (Iterative Closest Point), qui devient mal conditionné sur des terrains plats ou peu texturés et dégrade la localisation. Les auteurs proposent à la place un système fondé sur un lidar FMCW (Frequency-Modulated Continuous-Wave), qui mesure directement la vitesse radiale de chaque point par effet Doppler. Il combine une odométrie basée sur cette vitesse Doppler, indépendante de la géométrie de la scène et dotée d'une estimation d'incertitude de pose stable en cas de dégénérescence, avec une localisation scan-to-map qui exploite la courbure locale de chaque point pour améliorer l'association des données et unifier la détection de dégénérescence entre translation et rotation. Lors d'essais de terrain en boucle fermée sur des environnements de complexité variable, le système a mené à bien la navigation autonome, y compris sur un terrain d'aéroport plat et peu texturé où un système ICP conventionnel a échoué. Le code doit être publié en open source, mais le lien fourni dans le papier est un espace réservé non actif. Pour l'industrie de la robotique mobile en environnements extrêmes, l'apport cible un point faible connu du secteur : l'échec de l'ICP dans les couloirs rectilignes, tunnels lisses ou terrains plats sans relief exploitable, un cas fréquent en exploration minière ou en mission planétaire. Utiliser un lidar FMCW à mesure Doppler plutôt qu'un lidar temps de vol classique diffère de l'approche dominante, qui compense la dégénérescence géométrique par fusion multi-capteurs plutôt que par une modalité de mesure intrinsèquement plus riche. Si l'approche se confirme au-delà du cadre expérimental décrit, elle pourrait réduire la dépendance des systèmes de navigation souterraine ou lunaire à des architectures multi-capteurs coûteuses. Le résumé ne fournit toutefois aucun chiffre de robustesse (taux de réussite, dérive, distance parcourue), ce qui limite la portée de la comparaison avec l'ICP. Le Teach and Repeat est une technique de navigation topométrique éprouvée, historiquement développée pour des robots opérant sans GPS, en contexte minier ou planétaire. Le papier se positionne explicitement contre les systèmes ICP conventionnels, pris comme référence directe dans les tests sur terrain d'aéroport. Le lidar FMCW reste une technologie émergente en robotique mobile face aux lidars à temps de vol dominant le marché, dans la lignée de son usage déjà exploré côté automobile pour l'estimation de mouvement par effet Doppler. La suite annoncée est la publication du code en open source, dont le lien reste pour l'instant un espace réservé, sans calendrier ni partenaire industriel précisés au-delà des essais de terrain décrits.

RecherchePaper
1 source