AquaCap : un agent incarné sous-marin sans entraînement, piloté par du code comme politique
AquaCap est un agent robotique sous-marin capable de naviguer et de manipuler des objets de façon autonome sans aucun entraînement préalable ni mise à jour de paramètres, selon le principe dit "Code-as-Policy" décrit dans un article mis en ligne sur arXiv en septembre 2026 (référence 2609.23133). Le système repose sur une architecture à deux niveaux qui traduit les instructions de tâche et les observations de l'environnement en plans adaptés aux conditions rencontrées et en programmes de contrôle directement exécutables. Une couche de perception structurée lui fournit des informations sémantiques, géométriques et évaluées en fiabilité malgré la dégradation typique des images sous l'eau, tandis qu'une mémoire sensible aux échecs diagnostique les actions ratées et déclenche une replanification en boucle fermée avec révision du code généré. En simulation, AquaCap atteint un taux de réussite de 66,43%. Des essais réels avec un véhicule télé-opéré (ROV) ont démontré des saisies et transports d'objets autonomes, y compris la récupération de cibles déplacées par des courants hydrodynamiques.
Cette approche cible un verrou spécifique du secteur : contrairement à la robotique terrestre, qui alimente ses modèles vision-langage-action avec des volumes massifs de données de téléopération, la robotique sous-marine ne peut pas répliquer cette stratégie, chaque campagne de collecte en mer ou en bassin restant coûteuse et rare. En s'appuyant sur la génération de code plutôt que sur l'apprentissage de bout en bout, AquaCap s'adapte en ligne sans réentraînement, ce qui intéresse directement les intégrateurs d'AUV et de ROV pour l'inspection offshore, l'aquaculture ou la maintenance sous-marine. Le taux de succès de 66,43% en simulation, nettement en dessous des standards affichés par les meilleurs systèmes VLA terrestres, rappelle toutefois que l'écart entre démonstration et fiabilité opérationnelle reste large sous l'eau.
AquaCap prolonge les architectures "Code-as-Policy", qui font générer par des modèles de langage du code de contrôle exécutable plutôt que des politiques apprises par renforcement, une piste déjà explorée en robotique terrestre mais encore rare en milieu marin. Le résumé ne mentionne aucune affiliation industrielle ni partenaire commercial, ce qui situe le projet comme une recherche académique et non comme un produit prêt à déployer. Les démonstrations réelles se limitent pour l'instant à un seul ROV et à des tâches de préhension et de transport, sans calendrier de déploiement annoncé. La prochaine étape attendue pour ce type de système serait une validation sur davantage de plateformes et en conditions océaniques réelles, au-delà des bassins contrôlés, avant toute adoption par des opérateurs d'inspection sous-marine ou de robotique offshore.
Dans nos dossiers




