Aller au contenu principal
SOAR : optimisation conjointe en temps réel pour l'allocation des commandes et l'ordonnancement des robots mobiles
IndustrielarXiv cs.RO 

SOAR : optimisation conjointe en temps réel pour l'allocation des commandes et l'ordonnancement des robots mobiles

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs, en collaboration avec Geekplus, ont publié SOAR (Simultaneous Order Allocation and Robot Scheduling), un framework d'apprentissage par renforcement profond conçu pour optimiser en temps réel la coordination des robots dans les systèmes de préparation de commandes automatisés (RMFS, Robotic Mobile Fulfillment Systems). Déposé sur arXiv en mai 2026 (arXiv:2605.03842), le système unifie deux sous-problèmes classiquement découplés, l'allocation des commandes et la planification des robots mobiles, en un seul agent décisionnel. Sur des données industrielles réelles fournies par Geekplus, SOAR réduit le makespan global de 7,5 % et le temps moyen de complétion des commandes de 15,4 %, avec une latence de décision inférieure à 100 ms. La viabilité du système a été confirmée par un déploiement en environnement de production via une procédure sim-to-real. Techniquement, le problème est formulé comme un processus de décision de Markov piloté par événements (Event-Driven MDP), où l'agent réagit à des événements asynchrones (fin de tâche, arrivée de commande) grâce à un Heterogeneous Graph Transformer encodant l'état de l'entrepôt, complété par une stratégie de reward shaping pour gérer la rareté du signal de récompense sur les longues séquences.

Les RMFS équipent aujourd'hui les grands centres logistiques : des flottes de robots mobiles (AMR) transportent des étagères entières vers des postes de picking humains ou automatisés. Le goulot d'étranglement traditionnel vient du couplage fort entre allocation et ordonnancement : les approches décomposées sacrifient l'optimalité globale pour garantir la réactivité, tandis que les modèles d'optimisation classiques comme les MILP ou CP-SAT sont trop lents pour des environnements à haute cadence. SOAR casse ce compromis en prouvant qu'un agent de deep RL peut raisonner globalement tout en répondant en moins de 100 ms, ce qui constituait un verrou industriel reconnu. Plus significatif encore, la validation sim-to-real en conditions de production distingue ce travail de la majorité des publications académiques qui restent cantonnées à la simulation.

Geekplus, fondé en 2015 à Pékin, est l'un des leaders mondiaux des AMR pour la logistique d'entrepôt, avec des déploiements dans plus de 40 pays chez des clients comme Decathlon et JD.com. Sa participation directe à cette recherche signale une intégration croissante entre laboratoires académiques et industriels pour raccourcir le cycle lab-to-production. Sur le marché, Geekplus concurrence Hai Robotics et AutoStore, mais aussi en Europe des acteurs comme Exotec (France), dont le système Skypod adresse des problèmes similaires de coordination multi-robots à grande échelle. SOAR s'inscrit dans un corpus actif de travaux sur le RL multi-agent pour la planification en entrepôt, mais se distingue par son approche unifiée et son ancrage en production confirmé. Le code est disponible en open source sur GitHub, ce qui devrait faciliter son adaptation à d'autres architectures RMFS.

Impact France/UE

Le code open-source SOAR, validé en production chez des clients de Geekplus dont Decathlon, constitue une référence technique directe pour Exotec et les intégrateurs AMR européens confrontés aux mêmes problèmes de coordination multi-robots à grande échelle.

Dans nos dossiers

À lire aussi

Modélisation par réseau de Petri et ordonnancement sans interblocage pour systèmes AGV hétérogènes attachables
1arXiv cs.RO 

Modélisation par réseau de Petri et ordonnancement sans interblocage pour systèmes AGV hétérogènes attachables

Une équipe de chercheurs a publié sur arXiv (identifiant 2508.00724) un cadre de planification sans interblocage pour des systèmes de véhicules autoguidés (AGV) hétérogènes et attachables, où des unités "porteuses" (carriers) et des "navettes" (shuttles) peuvent s'accoupler physiquement pour accomplir des tâches coopératives avant de se séparer à la demande. Ce mode d'opération introduit une difficulté computationnelle sévère : la synchronisation imposée par les couplages physiques rend la flotte fortement interdépendante et vulnérable aux interblocages (deadlocks), situations où aucun véhicule ne peut progresser parce que chacun attend qu'un autre se déplace. Pour y répondre, les auteurs proposent un modèle en réseau de Petri intégré dans un algorithme de recherche adaptative à grand voisinage (ALNS), capable de transformer des permutations statiques de tâches en processus collaboratifs dynamiques et de prévenir proactivement les interblocages par analyse structurelle. L'intérêt industriel de ce travail tient à la combinaison de deux verrous : la planification de flottes hétérogènes (où les AGV ne sont pas interchangeables) et la gestion des deadlocks sans exploration exhaustive de l'espace d'états. Les expériences sur instances réelles et synthétiques montrent que l'ALNS proposé surpasse à la fois la politique opérationnelle actuellement déployée sur site, les solveurs exacts, et les métaheuristiques de référence, avec un gain significatif en efficacité computationnelle. Une analyse de sensibilité fournit par ailleurs des recommandations concrètes pour le dimensionnement optimal de la flotte, ce qui rend le cadre potentiellement actionnable pour des décideurs logistiques ou des intégrateurs industriels. Ce travail s'inscrit dans un courant de recherche actif sur la coordination de flottes AMR et AGV hétérogènes, domaine où des acteurs comme Exotec en France (systèmes Skypod) ou Geek+ et Quicktron en Asie proposent des flottes spécialisées mais généralement homogènes. La thèse centrale du papier reste à confronter à des déploiements industriels à grande échelle : les instances "réelles" mentionnées dans le résumé ne sont pas quantifiées en termes de nombre d'AGV ou de volume de tâches traités, ce qui limite la portée immédiate des conclusions. Les extensions naturelles incluent l'intégration de contraintes de recharge, la gestion de topologies dynamiques, et la validation sur des benchmarks standardisés du secteur AMR.

UELe cadre proposé pourrait à terme informer la conception de flottes AGV hétérogènes chez des acteurs européens de la logistique robotisée comme Exotec, dont les systèmes Skypod actuels restent homogènes.

IndustrielPaper
1 source
Comment concevoir des rails de robot et des systèmes à 7ème axe pour les environnements réels
2Robotics Business Review 

Comment concevoir des rails de robot et des systèmes à 7ème axe pour les environnements réels

Güdel Inc., filiale américaine du groupe suisse Güdel Group AG, organise un webinaire technique le 12 mai 2026 à 14h heure de l'Est, intitulé "Harsh and Dirty by Design: Engineering Robot Tracks and 7th Axis Systems for Real-World Environments". Deux expertes prendront la parole : Molly Lynch, account manager pour la région Midwest chez Güdel avec 15 ans d'expérience en automatisation industrielle, et Brenda Courim, directrice des ventes et du marketing de Güdel, forte de plus de 30 ans dans le secteur manufacturier dont environ 20 ans en ingénierie de conception principalement dans l'industrie automobile, diplômée en génie mécanique de l'Université du Michigan. La session s'adresse aux ingénieurs robotique, intégrateurs système, concepteurs d'automatisation et responsables de maintenance confrontés à des environnements industriels sévères. Les rails de translation et systèmes de 7e axe sont parmi les composants les plus exposés d'une cellule d'automatisation, et c'est précisément là que réside le problème structurel que le webinaire cherche à adresser. Conçus pour des environnements propres et contrôlés, ces systèmes sont soumis en conditions réelles à des projections de soudure, des poussières abrasives, de l'humidité, des produits chimiques, des overspray de cabines de peinture et des écarts de température extrêmes. Les modes de défaillance typiques identifiés incluent le contournement des joints d'étanchéité (seal bypass), l'endommagement des roulements, la corrosion et la perte d'alignement. Les intervenantes défendront des approches de conception spécifiques, notamment les guidages à rouleaux (roller guideways), les galets suiveurs (cam followers), les racleurs mécaniques, les capots de protection de rail et les traitements de surface protecteurs. La thèse centrale est que la maintenance préventive ne peut pas rester une réaction aux pannes : elle doit être intégrée dès la phase de conception du système, ce qui implique des choix d'architecture de rail et de configuration influençant directement l'exposition à la contamination et l'accessibilité pour l'entretien. Güdel Group AG, fondé en Suisse en 1954, est l'un des acteurs historiques des systèmes de mouvement linéaire et des rails de déplacement pour robots industriels, avec une présence significative dans les secteurs automobile, logistique et métallurgie. Le marché des 7e axes pour robots articultés comprend également des solutions de Rollon (désormais intégré dans Nadella Group), de constructeurs comme KUKA ou Fanuc via leurs divisions d'accessoires, et diverses offres d'intégrateurs régionaux. Cet événement est à classer comme un webinaire promotionnel d'un fournisseur, non comme la publication d'une étude indépendante ou d'un benchmark sectoriel, et aucune donnée comparative externe n'est annoncée au programme.

IndustrielActu
1 source
De la planification en temps réel à l'exécution fiable : une coordination évolutive pour des flottes hétérogènes de robots en environnement industriel
3arXiv cs.RO 

De la planification en temps réel à l'exécution fiable : une coordination évolutive pour des flottes hétérogènes de robots en environnement industriel

Traduction demandée : je rédige directement l'article en français selon les consignes éditoriales. Une équipe de recherche présente SCALE, un framework de coordination réactive en temps réel pour flottes de robots hétérogènes en environnement industriel, détaillé dans un article publié le 2 juillet 2026 sur arXiv (2607.00591v1). Le système s'attaque à un problème concret : quand plusieurs robots aux capacités de mouvement différentes évoluent à forte densité dans un même espace, les délais de communication et les aléas d'exécution font dévier les trajectoires des hypothèses temporelles calculées en amont, ce qui provoque des attentes en cascade et des embouteillages qui se propagent dans toute la flotte. Pour y remédier, les chercheurs introduisent un mécanisme de réduction des conflits induits par le mouvement, permettant de générer en ligne des trajectoires réalisables, ainsi qu'un hypergraphe de précédence conjuguée généralisé (CAPH) qui réajuste dynamiquement l'ordre de passage entre robots face aux perturbations. Le dispositif a été validé par des expérimentations poussées et un déploiement de trois jours en conditions réelles dans un entrepôt. Cette approche s'attaque directement à un angle mort classique de la robotique de flotte : la plupart des systèmes de planification multi-robots fonctionnent bien en simulation ou sur petits échantillons, mais s'effondrent dès que la densité de robots augmente ou que des retards de communication s'accumulent dans un entrepôt réel. En proposant un mécanisme réactif capable d'ajuster les priorités de passage à la volée plutôt que de recalculer un plan global, SCALE vise le compromis que cherchent les intégrateurs logistiques : maintenir un temps de cycle stable sans multiplier les arrêts et les blocages quand la flotte grossit ou se diversifie en types de robots (AMR, bras manipulateurs, etc.). Le sujet s'inscrit dans une littérature de recherche active sur la coordination multi-agents en environnement partagé, où les hypergraphes de précédence et les méthodes de résolution de conflits en ligne remplacent progressivement les approches de planification centralisée jugées trop rigides face aux flottes hétérogènes en croissance rapide dans l'e-commerce et l'industrie manufacturière. Le passage d'une validation en laboratoire à un déploiement réel de plusieurs jours en entrepôt reste l'étape la plus significative de ce travail, même si l'abstract ne détaille pas encore les métriques précises de réduction des temps d'attente obtenues sur site.

IndustrielPaper
1 source
Décision séquentielle par apprentissage multi-échelle pour la préparation de commandes en robotique de manutention
4arXiv cs.RO 

Décision séquentielle par apprentissage multi-échelle pour la préparation de commandes en robotique de manutention

Des chercheurs ont publié en mai 2026 sur arXiv (référence 2605.08758) un framework de décision séquentielle baptisé OLSF-TRS, pour Omni-scale Learning-based Sequential Decision Framework for Tote-handling Robotic Systems. Ce système combine optimisation combinatoire structurée et apprentissage par renforcement multi-agent (MARL) pour coordonner simultanément les décisions liées aux commandes, aux bacs de manutention (totes) et aux robots dans les centres de préparation automatisés. En configuration petite échelle, OLSF-TRS affiche un écart d'optimalité moyen inférieur à 3,5% sur deux architectures système distinctes. En configuration grande échelle, il réduit les mouvements de bacs de 8 à 12% par rapport aux baselines heuristiques classiques, et de plus de 30% par rapport aux approches règle-based de l'état de l'art, tout en maintenant une réactivité en temps réel. L'enjeu concret pour les intégrateurs intralogistiques est significatif : la quasi-totalité des frameworks existants sont conçus sur mesure pour un type de système spécifique, tri-sorter, mini-load AS/RS ou AMR grid-based, ce qui rend tout transfert à un autre contexte laborieux. OLSF-TRS propose une couche de pilotage unifiée et scalable, potentiellement applicable à des architectures hétérogènes. La réduction de plus de 30% des mouvements de bacs se traduit directement en gains énergétiques, réduction de l'usure mécanique et meilleure stabilité du throughput, des KPIs centraux pour les COOs industriels. À noter cependant que les résultats reposent sur des simulations et benchmarks comparatifs sans déploiement terrain documenté, ce qui laisse entière la question du sim-to-real gap en production réelle. Ce travail s'inscrit dans une tendance structurelle de fond : la substitution des palettes par les bacs comme unité logistique primaire, portée par l'explosion du e-commerce et la fragmentation des commandes en petites séries. Des acteurs comme Exotec (France, système Skypod), AutoStore (Norvège) ou Geek+ (Chine) opèrent des déploiements massifs en grid-based robotics confrontés exactement à ces problèmes de coordination ordres-bacs-robots à grande échelle. La convergence entre optimisation combinatoire de type VRP et MARL est un champ de recherche en pleine effervescence, porté par des laboratoires industriels en Europe et en Asie. L'article ne mentionne ni partenariat industriel ni timeline de commercialisation, le positionnant comme une contribution académique précompétitive.

UEExotec (France, Skypod) et AutoStore (Norvège) opèrent des déploiements massifs confrontés exactement aux problèmes de coordination ordres-bacs-robots adressés par ce framework, en faisant une piste de R&D directement pertinente pour l'intralogistique européenne.

IndustrielPaper
1 source