FoldBack : politique générative masquée auto-correctrice pour le pliage de vêtements à long horizon
FoldBack, une politique générative masquée à auto-correction dédiée au pliage de vêtements sur de longs horizons, est décrite dans un preprint arXiv (2610.10462). Les auteurs partent d'un défaut courant des politiques à longue trajectoire : après une saisie manquée ou un glissement, elles poursuivent la séquence même si le vêtement n'a pas atteint la configuration voulue. FoldBack structure sa récupération autour de trois décisions prises à l'inférence : quand raffiner et vérifier, comment revenir en arrière, et où et comment réessayer. Le raffinement et la vérification de saisie sont alignés sur les événements de pick-and-place. Le robot revient à une configuration de pré-saisie permettant un nouvel essai, en conservant les saisies réussies. Le segment défaillant et une sélection d'actions futures sont ensuite régénérés, en évitant les emplacements de saisie déjà en échec. Selon les auteurs, c'est la première politique de trajectoire complète éditable à unifier ces décisions. Elle n'exige ni démonstrations de récupération ni réentraînement de la politique de base. Sur 33 vêtements réels répartis en six catégories, FoldBack atteint 75,2 % de réussite finale de pliage et un IoU de masque final de 0,837, contre 45,7 % et 0,689 pour la meilleure référence antérieure.
L'intérêt tient à la méthode. La majorité des politiques de manipulation déformable actuelles, y compris les VLA, fonctionnent en boucle quasi ouverte sur les longues séquences : une erreur précoce, comme un pli mal saisi, se propage et ruine le résultat final. Obtenir près de 30 points de réussite supplémentaires sans nouvelle donnée de récupération ni réentraînement suggère qu'une part importante de l'écart entre démonstration et fiabilité se joue dans la logique d'inférence (détection, annulation, nouvel essai) plutôt que dans la quantité de données. Pour un intégrateur visant la logistique textile, la blanchisserie industrielle ou le tri de retours e-commerce, c'est un argument en faveur de couches de supervision ajoutées à une politique existante. Des réserves s'imposent toutefois : 75,2 % reste loin des taux exigés en production, le protocole ne précise pas dans l'extrait la durée des essais ni le nombre de répétitions par vêtement, et le résultat provient d'un laboratoire, non d'un déploiement.
Le pliage de linge est devenu un banc d'essai emblématique de la manipulation déformable, popularisé par les démonstrations de politiques par diffusion et de modèles VLA généralistes comme Pi-0, capables de plier des vêtements mais sans garantie de récupération sur échec. Les approches génératives masquées, qui permettent de réécrire une partie seulement d'une trajectoire, offrent ici le levier technique de l'édition ciblée. Le texte disponible ne nomme ni la plateforme robotique ni les baselines précises, ce qui limite la comparaison directe avec d'autres travaux. La suite probable est une validation sur davantage de catégories et de conditions, puis une intégration à des modèles fondation. Il s'agit pour l'instant d'une recherche académique, sans produit ni calendrier commercial annoncé.
Pas d\'impact direct sur la France/UE
Dans nos dossiers




