
EvoNav-Bench : évaluer la navigation continue dans des environnements évolutifs
Des chercheurs présentent EvoNav-Bench, un banc d'essai conçu pour évaluer la navigation "lifelong" (LN) des agents robotiques dans des environnements qui changent au fil du temps, détaillé dans une version révisée déposée sur arXiv (identifiant 2609.08292v2). Construit sur le framework de génération procédurale ProcTHOR et étendant le format GOAT-Bench devenu la référence pour ce type de tâche, ce benchmark introduit des modifications de l'environnement entre les sous-tâches de navigation qu'un même agent doit résoudre séquentiellement dans un lieu donné. Les auteurs y testent trois méthodes récentes qui construisent et réutilisent des représentations persistantes de scène, comme des graphes de scène ou des captures visuelles, pour éviter de ré-explorer un lieu déjà visité. Ils comparent aussi trois stratégies heuristiques de gestion du changement : Frontier-Update, Fail-then-Update et Stage-Reset. Résultat principal : les méthodes existantes se révèlent fragiles dès que l'environnement évolue entre deux tâches.
L'enjeu dépasse le simple exercice académique. La plupart des systèmes de navigation "lifelong" actuels supposent un environnement statique, alors que dans un entrepôt, un hôpital ou un domicile, des objets sont déplacés, des portes ouvertes ou fermées, des meubles réarrangés par l'activité humaine. Les benchmarks existants ne révélaient pas ce mode de défaillance : un agent peut fusionner sans discernement des observations obsolètes avec de nouvelles données, dégradant sa fiabilité sans que rien ne l'alerte. Pour les intégrateurs travaillant sur des robots de service ou de logistique s'appuyant sur des mémoires de scène persistantes, ce travail suggère que la simple accumulation d'expérience ne suffit pas : il faut des mécanismes explicites de détection et de mise à jour des changements, sous peine de dégrader la navigation au lieu de l'améliorer.
Ce banc d'essai s'inscrit dans la continuité des travaux sur la navigation "goal-oriented" en environnements intérieurs simulés, où ProcTHOR et GOAT-Bench servent de fondations standards à la communauté de recherche en robotique embarquée. Aucun acteur commercial ni robot physique n'est impliqué ici : il s'agit d'un outil d'évaluation destiné aux laboratoires développant des agents de navigation. Les stratégies heuristiques proposées, plutôt que des solutions abouties, offrent une base de comparaison pour de futurs agents dotés de mécanismes d'adaptation plus sophistiqués aux changements de scène.
Dans nos dossiers




