
Toute maison, toute tâche : planification évolutive à long terme pour des tâches humaines abstraites
Le laboratoire à l'origine de ce papier arXiv (identifiant 2602.12244, version révisée) présente AHAT, pour Any House Any Task, un planificateur de tâches ménagères conçu pour la planification à long horizon dans des environnements domestiques de grande taille et face à des consignes humaines ambiguës. Le système s'appuie sur un grand modèle de langage entraîné à convertir une instruction et un graphe de scène textuel (une représentation symbolique de la maison et des objets qu'elle contient) en sous-objectifs formalisés dans le langage PDDL, le standard académique pour décrire des problèmes de planification. Ces sous-objectifs sont ensuite résolus par un solveur symbolique explicite, qui produit un plan d'exécution complet et jugé optimal. Pour améliorer la capacité du modèle à décomposer des intentions complexes et floues, les auteurs introduisent TGPO, un nouvel algorithme d'apprentissage par renforcement qui intègre une correction externe des traces de raisonnement intermédiaires dans le cadre de GRPO, la méthode de renforcement popularisée par les modèles de raisonnement de type DeepSeek.
L'enjeu identifié par les auteurs est central pour la robotique de service : les planificateurs purement basés sur du prompting LLM voient leurs performances chuter fortement dès que l'environnement grandit, que le plan s'allonge, ou que l'instruction devient ambiguë. En combinant génération de sous-objectifs par LLM et résolution symbolique rigoureuse, AHAT vise à conserver la flexibilité du langage naturel tout en garantissant la faisabilité formelle du plan produit, un compromis recherché par tous les acteurs qui veulent faire sortir les agents domestiques du laboratoire. Les auteurs rapportent des gains significatifs face aux méthodes de référence par prompting, planification classique et apprentissage, notamment sur des tâches formulées de façon brève mais nécessitant une exécution complexe, le scénario le plus proche d'un usage domestique réel.
Il s'agit ici d'un travail de recherche publié sur arXiv, sans lien annoncé avec un produit commercial ou un déploiement matériel : ni robot humanoïde, ni intégrateur, ni date de mise en service ne sont mentionnés. AHAT se positionne dans la lignée des travaux récents cherchant à hybrider LLM et planification symbolique PDDL pour la robotique domestique, une piste alternative aux approches VLA de bout en bout, et son intérêt réel pour l'industrie dépendra de sa reproductibilité et de son passage, ou non, à des essais sur robot physique.
Dans nos dossiers




