Aller au contenu principal
Étude de cas sur l'acceptation d'une tête robotique humanoïde utilisée dans trois espaces publics
RecherchearXiv cs.RO 

Étude de cas sur l'acceptation d'une tête robotique humanoïde utilisée dans trois espaces publics

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Une équipe de recherche a testé en conditions réelles une tête robotique humanoïde interactive dans trois lieux publics allemands : un office de tourisme, une bibliothèque municipale et l'accueil d'une administration du bâtiment (Bauamt). Le robot y a fonctionné en continu pendant plusieurs jours, engageant la conversation avec les visiteurs dans leur propre langue grâce à un pipeline de traitement du langage naturel couplé à un moteur de simulation émotionnelle, qui génère des réponses verbales multimodales enrichies d'expressions faciales. Les chercheurs ont mesuré l'acceptation des usagers via le questionnaire TAM2 (Technology Acceptance Model), un outil standard évaluant l'utilité perçue et la facilité d'usage. Résultat global : les utilisateurs se sont montrés motivés à interagir avec le robot et l'ont jugé plutôt utile et facile à prendre en main, quel que soit le site. Mais un usager sur cinq a trouvé le temps de réponse du système trop lent, ce qui nuisait à la fluidité du dialogue.

L'enseignement principal dépasse la simple démonstration technique : l'acceptation d'un robot humanoïde conversationnel dépend fortement du contexte d'usage, pas seulement de ses capacités. L'office de tourisme et la bibliothèque, lieux où l'interaction est perçue comme légitime et sans enjeu, se sont révélés bien plus favorables que l'accueil administratif, où la volonté d'engager la conversation était nettement plus faible. Pour les intégrateurs et décideurs qui envisagent de déployer des robots d'accueil ou d'assistance multilingue, ce résultat suggère de prioriser les environnements à faible friction sociale plutôt que les guichets administratifs, et de traiter la latence de réponse comme un frein d'adoption aussi critique que la précision linguistique elle-même.

Ce travail s'inscrit dans la lignée des recherches en interaction homme-robot social, où l'acceptation en conditions réelles reste plus rarement documentée que les démonstrations en laboratoire. Contrairement aux plateformes humanoïdes orientées tâches industrielles ou logistiques, ce projet cible l'accueil du public et la médiation linguistique. Les auteurs identifient la réduction du temps de réponse comme priorité pour les développements futurs, condition jugée nécessaire avant d'envisager un déploiement plus large de ce type de tête robotique interactive dans d'autres services publics.

Impact France/UE

L'étude a été menée dans des lieux publics allemands (office de tourisme, bibliothèque, administration du bâtiment), fournissant des enseignements directement applicables au déploiement de robots d'accueil dans les services publics européens.

À lire aussi

Musée : étude sur l'acceptation du robot Android Andrea, avec et sans simulation d'émotions
1arXiv cs.RO 

Musée : étude sur l'acceptation du robot Android Andrea, avec et sans simulation d'émotions

Pendant six jours consécutifs, le robot androïde Andrea a de nouveau été installé dans un musée public en Allemagne pour converser en autonomie complète avec les visiteurs, une deuxième expérience après un premier déploiement qui avait déjà livré des résultats qualitatifs. Cette fois, le robot disposait d'informations contextuelles sur le musée et les expositions environnantes, et pouvait échanger en plusieurs langues avec le public. Sa voix, légèrement synthétique, avait été jugée cohérente avec son apparence très humaine et son genre volontairement ambigu. Trois conditions expérimentales ont été comparées: aucune simulation d'émotion, une émotion pilotée par ChatGPT 4.1, ou l'architecture WASABI dédiée à la dynamique émotionnelle des robots. Au total, 73 visiteurs ont rempli une version étendue du questionnaire TAM2 pour évaluer leur expérience avec Andrea. Les résultats montrent que ni l'émotion générée par ChatGPT 4.1 ni celle simulée par WASABI n'ont amélioré l'acceptation du robot par rapport à l'absence totale de simulation émotionnelle, et ces différences sont restées indétectables consciemment par les visiteurs. Ce constat va à l'encontre d'une hypothèse répandue en interaction homme-robot: que doter un androïde d'émotions simulées, y compris via un grand modèle de langage généraliste, renforce automatiquement la confiance et l'engagement des utilisateurs. Pour les concepteurs de robots sociaux destinés aux espaces publics, musées, accueil ou commerce, le signal est net: brancher un LLM conversationnel sur un moteur d'émotions ne suffit pas à produire un bénéfice perceptible, et l'architecture spécialisée WASABI n'a pas fait mieux dans ce contexte précis. Andrea appartient à la famille des androïdes hyperréalistes utilisés en recherche HRI pour étudier l'acceptation sociale des robots humanoïdes en conditions réelles, hors laboratoire. Ce déploiement fait suite à une première étude qualitative menée dans le même musée, dont les enseignements ont orienté cette nouvelle expérimentation quantitative testant trois architectures émotionnelles distinctes sur un échantillon de visiteurs réels. Les auteurs suggèrent que ces résultats négatifs invitent à revoir soit la conception des architectures émotionnelles évaluées, soit les métriques utilisées pour en mesurer l'effet, avant d'envisager de nouvelles itérations avec Andrea ou des androïdes comparables dans des environnements publics.

UEEtude menée par une équipe de recherche allemande dans un musée public en Allemagne, fournissant des données concrètes utiles aux concepteurs européens de robots sociaux.

RecherchePaper
1 source
Apprentissage d'une politique de suivi de trajectoire asynchrone dans l'espace des tâches du haut du corps pour robots humanoïdes
2arXiv cs.RO 

Apprentissage d'une politique de suivi de trajectoire asynchrone dans l'espace des tâches du haut du corps pour robots humanoïdes

Des chercheurs ont publié le 25 juin 2026 sur arXiv (preprint 2606.25706) un cadre de contrôle baptisé "asynchronous upper body task-space tracking" pour robots humanoïdes. Le problème qu'ils adressent est architectural : les planificateurs de haut niveau génèrent des trajectoires dans l'espace des tâches à faible fréquence (quelques Hz), alors que les contrôleurs de corps entier tournent à haute fréquence (typiquement plusieurs centaines de Hz). Cette désynchronisation temporelle entre planification et exécution produit des dérives de référentiel et des incohérences dans le contrôle. Pour y remédier, l'équipe propose une politique étudiante initialisée par distillation enseignant-étudiant, conditionnée sur la trajectoire future complète mise en cache et un index d'exécution temporel, puis entraînée avec une récompense globale à fenêtre glissante. Un module MPC (Model Predictive Control) complète les références creuses en guidage corps flottant et membre supérieur, tandis que des contraintes au niveau des actions et de la cinématique directe (FK) limitent la dérive de la politique. Les expériences ont été conduites en simulation et sur le robot Unitree G1, un humanoïde commercial à 23 degrés de liberté. Ce travail touche un goulot d'étranglement concret qui freine la commercialisation des humanoïdes : la chaîne planification-exécution reste fragmentée dans la quasi-totalité des architectures actuelles, forçant des compromis entre réactivité et cohérence de mouvement. Le fait que la politique obtienne de meilleures performances que les baselines synchrones et découplées, et qu'elle s'adapte plus sûrement aux mouvements hors distribution, suggère une progression vers un déploiement robuste en environnement non contrôlé. L'approche sans estimation explicite de référentiel réduit aussi la charge computationnelle, ce qui est pertinent pour les intégrateurs industriels cherchant à embarquer le traitement. Toutefois, il s'agit d'un preprint non encore évalué par les pairs, et les métriques de suivi de trajectoire présentées restent contextualisées à des scénarios de laboratoire ; la généralisabilité à des tâches industrielles réelles reste à démontrer. Unitree Robotics, fabricant chinois fondé en 2016, s'est imposé comme fournisseur de plateformes de recherche abordables avec des robots quadrupèdes puis le G1 humanoïde. Ce contexte explique le choix du matériel : le G1 est accessible à de nombreux labos académiques, ce qui élargit la portée reproductible des résultats. Sur le fond, la course à la maîtrise du pipeline planification-exécution pour les humanoïdes mobilise simultanément Figure (02 et bientôt 03), Tesla Optimus, Agility Robotics, 1X Technologies et les laboratoires académiques liés à Physical Intelligence (Pi-0) et à NVIDIA (GR00T N2). La distillation enseignant-étudiant couplée au MPC comme module de complétion de trajectoire s'inscrit dans une tendance plus large : combler le sim-to-real gap par des architectures hybrides apprises/optimisées plutôt que par du RL pur. Les prochaines étapes naturelles seraient une validation sur des cycles de manipulation répétitifs en cadence industrielle et une intégration avec des VLA (Vision-Language-Action models) pour fermer la boucle perception-planification-exécution.

RecherchePaper
1 source
Épisode oublié : mise en œuvre et évaluation d'une mémoire épisodique personnalisée pour la tête du robot humanoïde Kim
3arXiv cs.RO 

Épisode oublié : mise en œuvre et évaluation d'une mémoire épisodique personnalisée pour la tête du robot humanoïde Kim

Des chercheurs ont développé et testé un module de mémoire épisodique pour Kim, une tête de robot humanoïde social, afin de résoudre un problème classique des agents conversationnels basés sur des grands modèles de langage : l'absence de mémoire persistante entre les sessions. Le système combine une récupération sémantique par vecteurs avec un modèle de dialogue piloté par LLM, en utilisant une fonction de score hybride qui associe similarité cosinus et une métrique de "force mémorielle" pour sélectionner les interactions passées les plus pertinentes et les injecter dans le prompt de génération. L'équipe a évalué l'approche via une étude en ligne à base de vidéos, en intra-sujets, auprès de 43 participants, à l'aide de l'échelle HRIES (Human-Robot Interaction Evaluation Scale). Les résultats montrent une augmentation significative de la sociabilité perçue (d = 0,60, p < .001), avec des effets particulièrement marqués sur la confiance perçue (d = 0,62) et la chaleur perçue (d = 0,56), tandis que le niveau de gêne ressenti par les participants est resté strictement inchangé (d = 0,00). Ce dernier point est le résultat le plus significatif pour l'industrie : ajouter de la mémoire personnalisée à un robot social améliore la qualité relationnelle perçue sans déclencher de malaise lié à la vie privée ni d'effet de vallée dérangeante, deux risques souvent redoutés par les concepteurs de robots compagnons. Pour les équipes qui développent des agents conversationnels embarqués, ces travaux apportent une validation empirique concrète à une intuition répandue mais peu testée : la mémoire à long terme agit comme un "lubrifiant social" qui renforce la relation humain-robot, sans compromis apparent sur l'acceptabilité. C'est un signal utile alors que la majorité des déploiements actuels de robots conversationnels restent limités à des interactions sans continuité d'une session à l'autre. Le travail s'inscrit dans la lignée des systèmes de récupération augmentée (RAG) appliqués à l'interaction humain-robot, un domaine où la plupart des architectures LLM conversationnelles butent encore sur la gestion du contexte long terme. Contrairement aux approches propriétaires opaques des grands robots commerciaux, cette étude fournit une méthodologie reproductible et une mesure quantifiée de l'impact social de la mémoire, ouvrant la voie à des évaluations comparables sur d'autres plateformes robotiques et à une intégration plus large de mécanismes de mémoire persistante dans les futurs robots compagnons ou d'assistance.

RecherchePaper
1 source
Robots humanoïdes : une étude utilisateur compare perception et métriques techniques en interaction homme-robot multimodale
4arXiv cs.RO 

Robots humanoïdes : une étude utilisateur compare perception et métriques techniques en interaction homme-robot multimodale

Une étude universitaire portant sur 24 participants montre qu'un gain de 15 points de pourcentage en taux de réussite d'une tâche de préhension d'objets, de 75% à 90%, est perceptible par les utilisateurs lors d'une interaction directe avec un robot. Le système de référence combine Whisper pour la reconnaissance vocale, Florence-2 pour la détection d'objets en vocabulaire ouvert, LLaMA 3.1 pour l'extraction d'actions, et un contrôleur logique flou de type 2 intervalle pour l'exécution des mouvements. La configuration améliorée conserve le même contrôleur mais remplace les modules de perception et de langage par Grounding DINO couplé à SAM et par Qwen 3.5 9B. Dans une étude en sujets répétés, où chaque participant a testé les deux configurations sur la même tâche de saisie d'objets sur table, 17 personnes sur 24 (70,83%) ont préféré le système amélioré, un résultat statistiquement significatif (test binomial exact, p = 0,043). Les trois critères perceptuels évalués sur une échelle de Likert à 7 points, la vitesse ressentie, la fiabilité et la compétence globale, ont tous été notés significativement plus haut pour la version améliorée, avec des tailles d'effet allant de grandes à très grandes après correction de Holm (p < 0,001). L'intérêt de ces travaux dépasse le simple constat qu'un meilleur système est mieux perçu. Ils répondent à une question moins triviale qu'il n'y paraît pour l'industrie robotique: un gain mesuré sur des benchmarks techniques se traduit-il réellement en une différence que l'utilisateur final ressent au contact du robot? Pour les intégrateurs et décideurs qui arbitrent entre plusieurs piles perception-langage-contrôle, souvent sur la seule foi de métriques de laboratoire, cette étude fournit une preuve empirique que l'amélioration des modules de vision et de compréhension du langage a un effet direct sur la confiance et l'acceptabilité perçues, indépendamment du contrôleur moteur qui reste inchangé. Le travail s'inscrit dans une lignée de recherches en interaction homme-robot qui cherche à combler l'écart entre évaluation par benchmark et évaluation centrée utilisateur, un point de friction classique entre recherche en robotique et déploiement réel. L'architecture testée illustre aussi l'évolution rapide des briques génériques mobilisées dans les pipelines de manipulation, passant de Florence-2 et LLaMA 3.1 à des modules plus récents comme Grounding DINO, SAM et Qwen 3.5 9B, sans toucher à la couche de contrôle bas niveau. Les auteurs appellent à systématiser ce type d'évaluation utilisateur en complément des ablations techniques classiques pour tout futur pipeline de manipulation robotique.

RecherchePaper
1 source