Aller au contenu principal
SpikeATac : un doigt tactile multimodal à détection dynamique taxélisée pour la manipulation dextérique
RecherchearXiv cs.RO 

SpikeATac : un doigt tactile multimodal à détection dynamique taxélisée pour la manipulation dextérique

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Le ROAM Lab présente SpikeATac, un doigt tactile multimodal pour la manipulation robotique dextre, dans une révision (v3) d'un article initialement publié sur arXiv en octobre 2025. Le capteur combine un film PVDF taxelisé, découpé en 16 zones de détection et échantillonné à 4 kHz, qui capte les signaux dynamiques dès l'amorce et la rupture du contact, avec une couche capacitive assurant la mesure statique de la pression, d'où sa réponse en "pics" qui lui donne son nom. Les chercheurs ont caractérisé la sensibilité de chaque modalité et montré que SpikeATac permet d'arrêter une préhension rapidement et délicatement sur des objets fragiles ou déformables. Au-delà de la pince parallèle, l'équipe a intégré le capteur à une main robotique multidoigts dextre, pilotée par une politique affinée via apprentissage par renforcement à partir de retour humain (RLHF) pour moduler la force appliquée. Résultat revendiqué: une manipulation en main d'objets fragiles jamais démontrée jusque-là sur ce type de plateforme. Des vidéos sont disponibles sur roamlab.github.io/spikeatac.

Ce travail cible un angle mort connu des mains robotiques: la plupart des capteurs tactiles privilégient soit la résolution statique, soit la réactivité dynamique, rarement les deux, ce qui limite la détection de l'instant où un objet commence à glisser ou se déformer sous la pince. Un retour tactile à 4 kHz couplé à une lecture statique fiable vise directement les cas d'usage où les pinces industrielles classiques échouent ou abîment la charge (fruits, verre, colis, composants électroniques). Le choix du RLHF plutôt qu'une simple fonction de récompense simulée suggère que le réglage fin de la force reste difficile à spécifier automatiquement, un signal utile pour les intégrateurs évaluant des politiques apprises en conditions réelles.

SpikeATac se distingue des capteurs à caméra interne comme GelSight ou DIGIT, plus coûteux en calcul et moins réactifs aux événements de contact rapides. L'article, purement académique, ne mentionne ni partenariat industriel ni déploiement hors laboratoire: c'est une preuve de faisabilité, pas un produit commercialisé. Aucun acteur français ou européen n'y figure. Les auteurs évoquent comme suites possibles la miniaturisation du capteur pour des mains commerciales et l'extension du pipeline RLHF à d'autres tâches de manipulation en contact riche.

À lire aussi

Un bout dextérique tactile durable pour la manipulation robotique
1arXiv cs.RO 

Un bout dextérique tactile durable pour la manipulation robotique

Une équipe de chercheurs décrit, dans une prépublication arXiv du 26 août 2026, un embout de doigt tactile robotique à vision conçu pour résister à l'usure, point faible connu des capteurs commerciaux. Il associe un gel de silicone souple, un film protecteur en polyuréthane thermoplastique (TPU) texturé et non pigmenté, et une cartouche de détection remplaçable. Deux tests accélérés ont mesuré sa durabilité : un ponçage sur tambour rotatif, et une sonde répétitive appliquant 39,2 N (4,0 kgf) à 45 cycles par minute. Le film protecteur du nouveau capteur a cédé après 2 à 3 heures de ponçage, tandis que les neuf exemplaires testés sous charge répétitive restaient tous fonctionnels à l'arrêt des essais : sept après 5 jours, un après 6 jours, un après 8 jours. Les capteurs commerciaux GelSight Mini et DIGIT, eux, ont vu leur film se rompre après seulement 24 à 30 secondes de ponçage et 25 à 35 minutes de charge répétitive. La dégradation du nouveau capteur restait progressive, sans gêner l'imagerie tactile. Cette amélioration de plus de deux ordres de grandeur, obtenue dans des conditions de vieillissement accéléré définies par les auteurs eux-mêmes, vise un angle mort de la manipulation robotique : les capteurs tactiles à vision comme GelSight ou DIGIT livrent une image de contact riche mais s'usent vite sous charges concentrées et frottements répétés, ce qui freine leur usage hors laboratoire. Pour les intégrateurs qui veulent faire passer la préhension robotisée de la démonstration au déploiement industriel, une cartouche remplaçable plutôt qu'un capteur à jeter pèse autant sur le coût total de possession que la résolution du signal tactile. Ces chiffres restent toutefois issus de protocoles de laboratoire propres à l'étude, et non d'une validation en usage prolongé sur un bras ou une main robotique en production. GelSight, issu de recherches du MIT, et DIGIT, le capteur tactile ouvert développé par Meta AI, sont devenus des références de facto pour la recherche en préhension et en manipulation fine ; l'usure rapide de leur film de silicone freine depuis longtemps leur adoption au-delà des bancs d'essai académiques, notamment pour des tâches répétitives de tri ou d'assemblage visées par les mains robotiques humanoïdes actuellement en développement. La prépublication ne mentionne aucun partenariat industriel ni calendrier de commercialisation : il s'agit à ce stade d'une validation en laboratoire, dont la suite logique serait un essai en conditions réelles sur un bras ou une main robotique en fonctionnement continu, avant toute intégration dans un produit commercial.

RecherchePaper
1 source
DexTacWAM : un modèle visuo-tactile du monde et de l'action pour la manipulation dextérique
2arXiv cs.RO 

DexTacWAM : un modèle visuo-tactile du monde et de l'action pour la manipulation dextérique

Un article déposé sur arXiv en septembre 2026 (arXiv:2609.24976v1) présente DexTacWAM, un World-Action Model (WAM) visuo-tactile pour la manipulation dextre, qui encode indépendamment chaque bout de doigt et injecte l'information tactile, via un compresseur sensible au doigt et à sa pose, dans un modèle du monde fondé sur la diffusion vidéo. Testé sur six tâches de manipulation à fort contact sur une plateforme bimanuelle à 22 degrés de liberté, DexTacWAM obtient le meilleur score sur toutes, avec une moyenne de 70,6 points contre 38,0 pour le meilleur système de référence, sur une échelle non précisée par les auteurs. Une étude d'ablation montre que retirer la modélisation tactile du monde, tout en gardant les mêmes caractéristiques tactiles et le même module d'action, fait chuter la moyenne sur quatre tâches de 74,7 à 26,6 points. Avec un encodeur vidéo pré-entraîné gelé, quatre heures d'adaptation de l'encodeur tactile et une centaine de démonstrations par tâche suffisent pour une qualité de prédiction visuelle à moins de 0,5 dB du niveau purement visuel, un rappel de contact conservé à 89,4% après compression, un entraînement 2,26 fois plus rapide et une inférence 1,29 fois plus rapide. Ce résultat cible une limite connue des WAM actuels, généralement centrés sur la vision et donc incapables de modéliser directement la dynamique de contact, pourtant déterminante en manipulation fine. L'étude montre que le gain provient surtout du fait de traiter l'évolution du contact comme une composante de l'état du monde prédit, plutôt que d'un simple conditionnement des actions sur des données tactiles. Pour les intégrateurs et les équipes de recherche en robotique dextre, l'intérêt pratique tient à l'efficacité: étendre un grand modèle vidéo déjà entraîné au sens du toucher avec un budget de données et de calcul réduit, sans tout ré-entraîner. Le travail s'inscrit dans la lignée des World-Action Models, qui couplent modélisation vidéo prédictive et génération d'action pour anticiper les effets des mouvements d'un robot, jusqu'ici presque exclusivement visuels. Il s'agit à ce stade d'un article de recherche, sans identification des auteurs ni annonce de partenariat industriel, de plateforme commerciale ou de calendrier de déploiement. La suite logique, non détaillée dans l'article, consisterait à valider l'approche sur davantage de tâches et de plateformes, voire sur des mains dextres commerciales, avant toute intégration dans des systèmes de manipulation opérationnels.

RechercheActu
1 source
Une main à cinq doigts actionnée par tendons, dotée d'une perception tactile distribuée pour la manipulation dextérique
3arXiv cs.RO 

Une main à cinq doigts actionnée par tendons, dotée d'une perception tactile distribuée pour la manipulation dextérique

Des chercheurs ont publié en août 2026 sur arXiv (référence 2608.25547v1) une nouvelle conception de main robotique à cinq doigts actionnée par tendons, dotée d'une perception tactile distribuée. La structure adopte une architecture hybride souple-rigide, pensée pour combiner compliance mécanique et force opérationnelle suffisante pour manipuler des objets. Des capteurs tactiles à double modalité sont répartis sur les phalanges distales et médianes des cinq doigts, permettant de détecter simultanément le contact statique et les variations de force dynamique lors d'une prise. Les auteurs ont validé le système par une série de manipulations : gestes de comptage sur les doigts, pincement pouce-index, saisie d'objets variés, et un enregistrement tactile lors de la préhension d'une bouteille. Ces expériences visent à démontrer la faisabilité d'un couplage étroit entre actionnement et perception au sein d'une même main robotique. Pour l'industrie robotique, la main reste le goulot d'étranglement le plus critique des robots humanoïdes : la dextérité fine et le retour tactile conditionnent la capacité d'un système à manipuler des objets imprévus, un prérequis pour toute application logistique ou domestique au-delà des démonstrations scénarisées. En couvrant l'ensemble des cinq doigts avec des capteurs tactiles doubles plutôt que quelques points de contact isolés, cette approche répond à une limite souvent pointée par les intégrateurs : la plupart des mains commerciales actuelles restent tactilement pauvres, ce qui cantonne des modèles vision-langage-action comme Pi-0 ou Helix à une perception essentiellement visuelle. Un retour de force distribué et fiable est une brique nécessaire pour fermer la boucle entre perception et contrôle fin, condition souvent citée pour réduire l'écart persistant entre démonstrations vidéo soignées et manipulation réelle robuste. La course aux mains dextres s'est intensifiée ces deux dernières années à mesure que les plateformes humanoïdes elles-mêmes progressaient : Tesla travaille sur la main d'Optimus, Figure a itéré sur ses propres designs entre Figure 02 et Figure 03, tandis que des acteurs spécialisés comme Shadow Robot, PSYONIC ou Sanctuary AI développent depuis plusieurs années des mains à forte densité de capteurs. Ce travail reste à ce stade une publication de recherche académique, sans nom d'entreprise ni de produit associé, et sans partenariat industriel ou calendrier de déploiement annoncé : il s'agit d'une preuve de concept en laboratoire, pas d'un système prêt à l'intégration commerciale. Sa contribution s'inscrit néanmoins dans une tendance de fond du secteur, où la perception tactile distribuée devient un axe de différenciation aussi disputé que la dextérité mécanique elle-même, avec pour prochaine étape probable l'intégration de ce type de main sur un bras ou un torse humanoïde complet pour des essais de manipulation en conditions réelles.

RecherchePaper
1 source
TacSushi : modélisation monde-action ancrée dans le tactile pour la manipulation dextérique de sushis
4arXiv cs.RO 

TacSushi : modélisation monde-action ancrée dans le tactile pour la manipulation dextérique de sushis

Une équipe de recherche présente TacSushi, une politique robotique world-action ancrée dans le toucher, bâtie sur un modèle de monde Cosmos3, destinée à la manipulation dextre d'aliments déformables comme le sushi. Le système encode l'image RGB courante, une consigne en langage naturel et l'état de la main, puis fusionne par un mécanisme de gating feature-wise les signaux tactiles des bouts de doigts dans la représentation d'action ; pendant l'entraînement seulement, un décodeur conditionné par les segments d'action démontrés prédit les observations visuelles futures, la progression de la tâche et le risque de contact, avant d'être retiré au déploiement. Entraîné sur 340 essais réussis et 50 essais échoués sur robot réel, TacSushi a été testé sur 600 rollouts couvrant trois tâches en distribution et deux variantes d'ingrédients hors distribution, la qualité du plat final étant jugée par un protocole mêlant à parts égales cinq notations humaines et trois notations de modèles vision-langage. Résultat : 68,3% de réussite moyenne en distribution et 37,5% hors distribution, contre 36,7%/10,0% sans la supervision par conséquences futures et 25,0%/17,5% avec une simple concaténation tactile au lieu de la fusion gated. Ces chiffres valident surtout deux choix d'architecture plutôt qu'une performance spectaculaire : la fusion tactile gated par caractéristique apporte un gain net face à une concaténation brute, et la supervision prédictive, entraînée mais jamais exécutée en production, améliore la généralisation sans coût au déploiement. Pour les équipes de manipulation dextre et les intégrateurs, l'écart entre réussite en distribution et hors distribution illustre une nouvelle fois le fossé persistant entre démonstration contrôlée et généralisation réelle des politiques vision-langage-action, un problème que le secteur peine encore à résoudre malgré les annonces. Évaluer la qualité perçue de l'aliment via des juges humains et des modèles vision-langage, plutôt qu'un seuil géométrique binaire, répond aussi à une limite méthodologique connue des benchmarks de manipulation alimentaire, où texture et présentation comptent autant que le succès du geste. TacSushi s'inscrit dans la lignée des politiques robotiques bâties sur des backbones de modèles de monde ou vision-langage-action, comme Pi-0 de Physical Intelligence ou GR00T N2 de NVIDIA, mais cible un terrain nettement moins couvert, la manipulation d'aliments fragiles, plutôt que la préhension d'objets rigides. Publié en prépublication sur arXiv sans affiliation industrielle mentionnée, le travail reste une évaluation de laboratoire sur rollouts contrôlés, sans partenaire commercial ni calendrier de déploiement annoncés, et son jeu d'entraînement de 340 démonstrations réussies pour seulement 50 échecs demeure modeste au regard des efforts de VLA à grande échelle menés par les grands laboratoires. La suite logique, non précisée par les auteurs, consisterait à élargir les tâches culinaires et les variantes d'ingrédients testées pour vérifier si les gains observés hors distribution résistent à une variabilité alimentaire encore plus large.

RecherchePaper
1 source