Path Planning Informative basée sur l'Énergie Libre Attendue pour l'Exploration Martienne Robotique
Des chercheurs publient sur arXiv, sous la référence 2608.14466v1, une nouvelle méthode de planification de trajectoire pour l'exploration robotique de Mars, en particulier la recherche de sources d'eau. Baptisée Expected Free Energy (EFE) et issue du cadre théorique de l'inférence active, la méthode fait naviguer en continu un robot autonome dans un environnement inconnu, en maintenant via un processus gaussien une croyance probabiliste sur la carte d'information du terrain. Le robot calcule des trajectoires qui minimisent l'énergie libre attendue tout en respectant une contrainte stricte de longueur de parcours, donc de temps et de coût de déplacement. Sur plusieurs simulations, les auteurs rapportent que cette approche produit des cartes postérieures précises tout en localisant simultanément les zones de plus forte valeur informative, et surpasse les méthodes information-théoriques classiques testées dans les mêmes conditions.
L'apport principal tient à l'unification de deux objectifs habituellement traités séparément: la recherche d'information pure, qui vise à réduire l'incertitude sur l'environnement, et la recherche de récompense, qui vise à atteindre rapidement les zones jugées les plus intéressantes. Les critères classiques de planification optimisent en général l'un ou l'autre, rarement les deux sous une même fonction objectif. Pour un rover martien ou tout robot mobile à autonomie énergétique limitée, un critère unique et présenté comme facile à régler pourrait simplifier le déploiement autonome tout en garantissant le respect des contraintes de ressources. Les résultats reposent toutefois uniquement sur des simulations numériques, sans essai sur rover physique ni calendrier de mission mentionné.
L'inférence active et le principe d'énergie libre proviennent des neurosciences computationnelles, où ils décrivent comment un système biologique minimise la surprise face à son environnement, un cadre de plus en plus repris en robotique pour unifier perception et prise de décision. Jusqu'ici, la planification de trajectoire informative reposait sur des critères information-théoriques distincts, comme la réduction d'entropie, opposés aux stratégies de recherche de récompense héritées de l'apprentissage par renforcement. En proposant l'EFE comme objectif unique sous contrainte de budget, les auteurs cherchent à combler cet écart méthodologique plutôt qu'à annoncer un produit ou une mission martienne concrète. Publié en tant que prépublication arXiv, l'article ne mentionne ni collaboration industrielle ni suite opérationnelle: la validation reste pour l'instant cantonnée à la simulation.
Dans nos dossiers




