
Combiner des modèles de langage et le raisonnement symbolique pour la planification temporelle multi-robots via des bases de connaissances explicables
Un groupe de chercheurs propose PLANTOR, un framework qui transforme une description en langage naturel d'une tâche multi-robots en un plan d'exécution complet, en s'appuyant sur un grand modèle de langage pour construire une base de connaissances structurée au format Prolog. Le pipeline enchaîne plusieurs étapes : le LLM génère la base de connaissances, des vérifications de cohérence détectent et corrigent les erreurs de modélisation, un planificateur symbolique produit un plan de haut niveau, celui-ci est raffiné en actions robotiques de bas niveau, puis un ordonnancement temporel optimisé est calculé et converti en arbre de comportement (behavior tree) exécutable. Les auteurs ont testé l'approche sur des scénarios inspirés des benchmarks classiques Blocks World et Grippers, avec plusieurs modèles de langage différents, en mesurant la qualité des bases de connaissances générées et le temps d'exécution du pipeline. Ils démontrent aussi une exécution de bout en bout sur un scénario réel d'assemblage impliquant plusieurs bras robotiques.
L'intérêt de PLANTOR tient à sa position hybride : plutôt que de confier au LLM la totalité du raisonnement de planification, ce qui pose des problèmes de fiabilité et de traçabilité bien documentés, le framework cantonne le modèle de langage à la synthèse d'artefacts structurés, tandis que le calcul du plan et de l'ordonnancement reste entièrement symbolique et inspectable. Pour des intégrateurs ou des équipes de recherche en robotique multi-agents, cela répond à une critique récurrente des approches purement génératives : l'impossibilité de vérifier pourquoi un plan a été choisi ou de garantir sa correction avant exécution. Les résultats montrent que la génération automatique de bases de connaissances réduit sensiblement l'effort de modélisation manuelle, un goulot d'étranglement classique en planification symbolique, mais les auteurs reconnaissent que les sorties du LLM nécessitent encore, dans certains cas, une correction humaine.
Ce travail s'inscrit dans une tendance de recherche plus large qui cherche à combiner l'interprétation du langage naturel des LLM avec la rigueur de la planification symbolique classique, plutôt que de miser sur des architectures VLA de bout en bout ou sur des LLM utilisés seuls comme planificateurs. Contrairement aux démonstrations qui misent sur des vidéos sélectionnées, PLANTOR est évalué sur des benchmarks reproductibles et sur un cas d'usage d'assemblage réel avec plusieurs bras robotiques, ce qui donne une mesure plus concrète de sa robustesse. La publication, une version révisée d'un article initialement soumis en février 2025 sur arXiv, ouvre la voie à des travaux futurs sur l'automatisation complète de la correction des bases de connaissances et sur l'extension à des flottes robotiques plus hétérogènes.
Dans nos dossiers




