Aller au contenu principal
ORICF : un framework ouvert pour l'inférence et le contrôle en robotique
InfrastructurearXiv cs.RO 

ORICF : un framework ouvert pour l'inférence et le contrôle en robotique

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs ont publié le 12 mai 2026 sur arXiv (identifiant 2605.09656v1) un framework open source baptisé ORICF (Open Robotics Inference and Control Framework), conçu pour réduire le coût computationnel du déploiement de modèles d'IA sur robots mobiles. La plateforme, modulaire et agnostique aux modèles, permet de composer des pipelines d'inférence multimodaux via de simples fichiers de configuration YAML, sans modification du code source. Son mécanisme central, l'edge offloading, consiste à délocaliser les tâches d'inférence vers des machines externes proches du robot plutôt que de les exécuter en embarqué. Validé sur un robot mobile équipé de ROS2, le système combinait reconnaissance automatique de la parole (ASR), un grand modèle de langage (LLM) et un réseau de neurones convolutif (CNN) pour répondre à des questions orales sur les personnes détectées par sa caméra. Par rapport à une exécution entièrement embarquée, ORICF réduit l'utilisation des ressources de calcul côté robot de 83,16% et la consommation énergétique estimée de 65,8%, tout en préservant la modularité et la reproductibilité du pipeline.

Ces résultats adressent l'un des freins les plus concrets au déploiement de modèles fondamentaux sur robots de service ou industriels : la contrainte matérielle embarquée. En déchargeant dynamiquement l'inférence sur des serveurs edge locaux ou des postes de travail voisins, ORICF rend envisageable l'utilisation de modèles lourds (LLM, VLM) sur plateformes à faible puissance de calcul. La spécification déclarative YAML simplifie également les changements de modèles ou de cibles matérielles, avantage concret pour les équipes intégration qui gèrent plusieurs configurations de déploiement. À noter cependant : la validation ne porte que sur un prototype unique en laboratoire, et les métriques de latence de bout en bout en conditions réelles ne sont pas détaillées dans le preprint, ce qui limite l'extrapolation aux environnements industriels.

ORICF s'inscrit dans un mouvement plus large d'outillage de la robotique embarquée avec des modèles fondamentaux, alors que ROS2 s'est imposé comme infrastructure standard pour les robots de recherche et de plus en plus industriels. Plusieurs approches concurrentes ciblent le même problème : Isaac ROS de NVIDIA propose une pile d'inférence optimisée pour hardware Jetson, tandis que des acteurs comme Hailo adressent le déploiement sur puces dédiées. Le preprint ne cite pas d'affiliation universitaire ni d'entreprise sponsor visible, ce qui reste un signal à surveiller pour évaluer la maturité et la continuité du projet. Les prochaines étapes logiques seraient une validation sur des plateformes robotiques hétérogènes et une évaluation de latence en conditions opérationnelles réelles.

Dans nos dossiers

À lire aussi

EVA-Client : framework unifié de collecte, d'inférence et de déploiement pour politiques incarnées sur robots réels
1arXiv cs.RO 

EVA-Client : framework unifié de collecte, d'inférence et de déploiement pour politiques incarnées sur robots réels

Un nouveau framework open-source baptisé EVA-Client vient formaliser une brique jusqu'ici bricolée maison par chaque laboratoire de robotique manipulatrice : le pont entre un serveur d'inférence de politique et le robot physique. Publié sur arXiv début juillet 2026, l'outil unifie en un seul code base les trois étapes critiques de la boucle d'itération sur robot réel, déploiement, collecte de données et évaluation. Son architecture découple explicitement trois couches orthogonales, les backends robots, les stratégies d'inférence et les middlewares de transport, de sorte qu'ajouter un nouveau bras ou un nouvel algorithme ne touche qu'une seule couche du système. EVA-Client propose aussi trois modes d'exécution inspectables, Debug, Collect et Eval, allant de la simulation en boucle ouverte au contrôle temps réel continu. Surtout, chaque run d'évaluation enregistre automatiquement des rollouts complets au format prêt pour l'entraînement, avec logs exhaustifs et un visualiseur de comparaison côte à côte, transformant chaque test en donnée réutilisable plutôt qu'en simple observation perdue. Le framework consolide enfin les principales stratégies d'inférence temps réel du secteur, exécution synchrone et asynchrone, lissage temporel façon ACT, Real-Time Chunking, et une base asynchrone naïve servant de référence, derrière une seule interface de configuration. Pour les équipes qui entraînent des politiques d'imitation ou des modèles VLA (vision-language-action), ce type d'infrastructure comble un angle mort réel : la littérature regorge de nouvelles architectures de politiques, mais la mise en production sur robot réel reste souvent un patchwork non reproductible, ce qui complique les comparaisons équitables entre méthodes et ralentit le passage du prototype au déploiement en série. En traitant chaque évaluation comme une collecte de données, EVA-Client attaque directement le problème du volume de données réelles, goulot d'étranglement classique face aux modèles génératifs entraînés sur des corpus web massifs. Ce travail s'inscrit dans une vague plus large d'outillage d'infrastructure pour l'IA incarnée, à mesure que des modèles fondation comme Pi-0, GR00T N2 ou Helix gagnent en maturité et que le goulot se déplace de l'algorithme vers l'ingénierie de déploiement. Contrairement aux piles propriétaires fermées de certains acteurs commerciaux, une approche ouverte et modulaire pourrait faciliter les comparaisons inter-laboratoires et accélérer l'adoption par des équipes académiques ou industrielles ne disposant pas de stack maison.

InfrastructureOpinion
1 source
ROSA : un système d'inférence de modèles fondation pour usines de robots
2arXiv cs.RO 

ROSA : un système d'inférence de modèles fondation pour usines de robots

Une équipe de recherche propose ROSA, un système de service d'inférence pour les modèles fondation de robotique (RFM), décrit dans un preprint publié sur arXiv (2607.01088, 1er juillet 2026). Contrairement aux systèmes existants qui traitent l'inférence comme un problème de calcul en périphérie, avec un GPU embarqué ou dédié par robot, ROSA repose sur trois principes: un pool de GPU partagé accessible en réseau par toute une flotte de robots, une abstraction de programmation "robotics-aware" gérant des pipelines multi-modèles avec exigences de performance par tâche et gestion des échecs, et un ordonnancement piloté par l'objectif global de l'usine plutôt que par la latence d'une seule requête. L'équipe l'a implémenté sur Ray Serve pour l'orchestration distribuée, avec vLLM, PyTorch et JAX comme moteurs d'inférence, et l'a évalué sur des robots réels ainsi que sur des charges de travail synthétiques à grande échelle. Résultat annoncé: jusqu'à 12,06 fois plus de productivité d'usine qu'avec des systèmes de service dédiés classiques, un chiffre qui reste à confirmer sur des déploiements industriels réels plutôt que sur les scénarios de test choisis par les auteurs. L'intérêt de ROSA est de remettre en cause l'hypothèse dominante selon laquelle l'inférence d'un modèle de robot doit tourner localement, robot par robot. En mutualisant des GPU de classe serveur sur le réseau, l'approche promet de meilleures performances d'inférence, une autonomie de batterie accrue et un taux d'utilisation GPU plus élevé, des enjeux critiques pour les industriels qui envisagent des flottes de robots humanoïdes ou mobiles plutôt que des unités isolées. Cela rapproche l'infrastructure de service robotique du modèle déjà adopté pour les grands modèles de langage en cloud, un signal utile pour les intégrateurs et décideurs qui raisonnent en coût par flotte plutôt qu'en coût par robot. Le travail s'inscrit dans la vague plus large des modèles fondation de robotique (VLA) qui rendent les robots généralistes envisageables en usine, où l'inférence reste souvent le goulot d'étranglement plutôt que l'apprentissage lui-même. Il s'agit ici d'une contribution académique, pas d'un produit commercialisé: aucun acteur français ou européen n'est cité, et le passage à l'échelle en production reste à démontrer au-delà des bancs d'essai présentés.

InfrastructureActu
1 source
AMD dévoile le module Kria pour le contrôle en temps réel et la mémoire unifiée des robots
3Robotics Business Review 

AMD dévoile le module Kria pour le contrôle en temps réel et la mémoire unifiée des robots

AMD a dévoilé sa nouvelle gamme Ryzen AI Embedded X100, associée à la plateforme Kria AI Robotics, pour cibler les charges de calcul de l'IA physique. Le fabricant promet un contrôle temps réel déterministe, une mémoire unifiée entre CPU, GPU et NPU, et une pile logicielle ouverte non liée à un fournisseur unique. Le X100 succède au P100 et devient le SoC phare de la gamme robotique d'AMD. Il vise le temps réel "ferme" via des optimisations Linux et BIOS, avec une latence d'interruption ciblée sous 7 microsecondes, complétées par des fonctions de qualité de service AMD (réservation de cache L3, allocation de bande passante mémoire, isolation des threads). Pour le temps réel "dur", AMD recommande une virtualisation par hyperviseur Zen, une machine virtuelle FreeRTOS et l'isolation de VM. Le module Kria AI SoM, bâti sur ce SoC, adopte le format standard COM-HPC plutôt qu'un connecteur propriétaire, avec une fermeture de boucle de contrôle annoncée à 1,5 microseconde. Selon Rob Bauer, responsable produit chez AMD pour le portefeuille APU embarqué x86, la puce délivrerait trois fois la puissance de calcul FP32 du NVIDIA Thor sur des charges de traitement du signal, un segment où AMD dit rester compétitif malgré l'optimisation poussée de Thor pour l'inférence. Cette annonce vise directement la position dominante de NVIDIA sur l'IA physique, incarnée par ses puces Orin et Thor, en offrant aux intégrateurs une alternative capable, selon AMD, de mettre la pression sur les prix. La mémoire unifiée réduit les copies de données entre unités de calcul, un point sensible pour la perception, la fusion de capteurs et la planification de trajectoire, tâches critiques pour les bras industriels, les robots mobiles autonomes et les humanoïdes. Un stack logiciel ouvert, non verrouillé, répond aussi à une demande croissante des intégrateurs de ne pas dépendre d'un seul écosystème propriétaire. Les chiffres avancés (3,4 fois la performance temps réel du Thor T5000, 1,6 fois de capacité de calcul disponible, 2,3 fois de capacité pour l'IA agentique) restent toutefois des mesures internes d'AMD, sans benchmark indépendant publié à ce stade, ce qui invite à la prudence sur leur portée réelle en conditions de déploiement. L'offensive s'accompagne du lancement du Robotics Development Kit, de la suite logicielle open source AMD Robotics Sophie Suite, et d'un réseau de partenaires robotique. Cette stratégie plein-stack doit être présentée plus en détail lors du salon RoboBusiness 2026. Il s'agit pour l'instant d'une annonce de plateforme et de composants, pas encore de déploiements industriels documentés à grande échelle, un point que le secteur devra vérifier une fois les premiers intégrateurs équipés du Kria AI SoM.

InfrastructureActu
1 source
NVIDIA lance Halos, un système de sécurité complet pour la robotique
4Robotics Business Review 

NVIDIA lance Halos, un système de sécurité complet pour la robotique

NVIDIA a lancé Halos for Robotics, un système de sécurité à pile complète pour la robotique industrielle et l'IA physique. Premier intégrateur officiel : Agility Robotics, dont les humanoïdes opèrent en entrepôts et usines pour Amazon, GXO, Schaeffler et Toyota Motor Manufacturing Canada. L'architecture couvre trois couches : la plateforme de calcul NVIDIA IGX Thor avec le Holoscan Sensor Bridge pour la connectivité capteurs en temps réel ; Halos OS incluant Halos Core ; et le Outside-In Safety Blueprint, un programme open source disponible sur GitHub qui pilote le comportement du robot via des caméras externes et des agents IA. NVIDIA revendique 18 600 années-ingénieur de développement sécurité issus de son activité véhicule autonome. L'écosystème associe des partenaires logiciels (QNX, Amazon FreeRTOS, Acontis), fabricants de systèmes embarqués (Advantech, NexCobot), fournisseurs de semi-conducteurs (Infineon, NXP, SICK, STMicroelectronics, Texas Instruments) et organismes de certification (TÜV Rheinland, TÜV SÜD, UL Solutions, exida, SGS, CertX). Halos Core est déjà certifié ISO 26262 par TÜV SÜD. Le système est disponible en early access pour les développeurs enregistrés, en configurations Linux et Linux+QNX. L'enjeu de Halos est de répondre à un problème structurel : l'absence d'architecture de sécurité standardisée pour des robots autonomes opérant aux côtés de travailleurs. Les intégrateurs composaient jusqu'ici avec des solutions hétérogènes, ce qui complexifiait la certification et freinait le passage à l'échelle. En proposant une pile unifiée du silicium à la supervision logicielle, NVIDIA cherche à s'imposer comme substrat commun de la sécurité robotique industrielle. La certification ISO 26262 de Halos Core est un signal concret : NVIDIA transfère une base éprouvée du monde AV vers la robotique, ce qui pourrait raccourcir les cycles de validation pour les intégrateurs et réduire les coûts de certification tiers. NVIDIA construit depuis plusieurs années une position dans la robotique via les plateformes Isaac, Omniverse et les modèles de fondation GR00T N2. Halos complète cette stratégie d'infrastructure : vendre le substrat computationnel et logiciel, pas les robots eux-mêmes. Les concurrents directs incluent FORT Robotics dans les solutions de sécurité embarquée (qui figure d'ailleurs parmi les partenaires Halos), ainsi que les approches propriétaires de Boston Dynamics ou Fanuc. L'annonce reste un early access sans données publiques de déploiement à grande échelle avec Halos effectivement activé. Les prochaines inspections de certification de l'IGX Thor et du Holoscan Sensor Bridge par TÜV Rheinland constitueront le vrai indicateur de maturité opérationnelle du système.

UESTMicroelectronics (France/Italie) figure parmi les partenaires semi-conducteurs de Halos, et les organismes TÜV Rheinland et TÜV SÜD (Allemagne) sont intégrés au programme de certification, ce qui peut raccourcir les cycles de validation réglementaire pour les intégrateurs robotiques européens.

InfrastructureOpinion
1 source