Aller au contenu principal
L'année la plus effervescente pour l'IA incarnée, mais l'évolution des robots reste imperceptible à l'œil nu
Chine/AsiePandaily 

L'année la plus effervescente pour l'IA incarnée, mais l'évolution des robots reste imperceptible à l'œil nu

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

En août 2026, la World Robot Conference (WRC) a de nouveau réuni des dizaines d'humanoïdes dansant, combattant, saisissant des objets et triant des pièces, aux côtés de bras robotiques manipulant des lignes simulées. Selon Counterpoint Research, les livraisons mondiales d'humanoïdes ont dépassé 22 000 unités au premier semestre 2026, en hausse de près de 300%, avec une projection annuelle supérieure à 50 000 unités. AgiBot a livré environ 9 700 robots, Unitree plus de 7 000 (soit 31% du marché), et Galaxy General plus de 1 100, les cinq premiers acteurs captant 86% du marché. Par usage, le divertissement représente 33,6% des déploiements et la production de données/recherche 27%, soit plus de 60% à eux deux, contre seulement 12,8% pour la fabrication industrielle et 4,9% pour la logistique d'entrepôt. Unitree a présenté un robot atteignant 12,65 mètres par seconde, tandis que Galaxy General a entraîné son humanoïde bipède ET1 à partir d'environ 100 000 heures de données de mouvement humain, avec un système nommé WAM-TTT permettant à un robot d'apprendre une nouvelle tâche en observant des opérateurs sur site ; l'entreprise revendique un déploiement dans plusieurs dizaines d'usines du fabricant de batteries CATL, au-delà du simple test à une machine.

Ces chiffres masquent un constat plus inconfortable pour le secteur : les tâches démontrées (saisir une tasse, plier du linge) restent quasiment identiques d'une édition à l'autre du salon, malgré l'explosion du nombre de robots présentés. Le fondateur d'Unitree, Wang Xingxing, résume le vrai obstacle : dans un environnement fixe et avec assez de données, un robot peut approcher 100% de réussite, mais un simple changement d'objet fait chuter la performance, preuve que la généralisation, et non la motricité, reste le goulot d'étranglement. Il fixe le seuil décisif à 80% de réussite sur des tâches inédites, données par instruction en langage naturel dans un environnement jamais vu, comme condition d'une véritable explosion commerciale. Wang He, fondateur de Galaxy General, compare l'état actuel des modèles incarnés à GPT-2 et anticipe un niveau proche de GPT-3.5 à GPT-4 d'ici 2028, ce qui questionne directement la promesse d'un modèle générique déployable sans réentraînement massif par site.

Sur le plan concurrentiel, Unitree mise sur le contrôle moteur, l'ingénierie mécanique, les coûts et les volumes, mais ses robots restent surtout vendus à la recherche et à l'éducation, poussant l'entreprise à réorienter ses investissements vers les modèles d'IA. Galaxy General, positionné sur les modèles fondation incarnés, cherche à prouver que l'apprentissage d'une tâche peut se répliquer sur des centaines de sites, comme l'illustre son déploiement multi-usines chez CATL, un test de passage à l'échelle que le secteur observe de près avant tout pari sur une adoption industrielle massive d'ici 2028.

À lire aussi

Xiaomi présente Xiaomi-Robotics-U0 pour l'IA incarnée et la génération de robots
1TechNode 

Xiaomi présente Xiaomi-Robotics-U0 pour l'IA incarnée et la génération de robots

Xiaomi a dévoilé mercredi Xiaomi-Robotics-U0, un modèle de fondation multimodal autorégressif de 38 milliards de paramètres conçu pour l'IA incarnée (embodied AI). L'entreprise affirme que ce modèle unifie quatre capacités au sein d'un même framework : la génération de scènes pour robots, le transfert de comportements robotiques, la génération de vidéos d'interaction robot-environnement, et la génération et l'édition d'images à usage général. Concrètement, le système peut créer des environnements exploitables par des robots à partir de simples prompts textuels, adapter des trajectoires robotiques existantes à de nouvelles scènes tout en préservant le mouvement d'origine, produire des vidéos d'interaction à partir d'instructions de tâches, et exploiter des connaissances visuelles à l'échelle d'internet pour des applications d'IA incarnée. L'annonce a été rapportée par TechNode. Cette annonce s'inscrit dans une tendance de fond du secteur robotique : l'utilisation de modèles génératifs pour produire des données d'entraînement synthétiques et combler l'écart entre simulation et réalité, un problème central pour les acteurs du VLA (vision-language-action) comme Pi-0 de Physical Intelligence ou GR00T N2 de Nvidia. Si la promesse de générer des environnements et trajectoires synthétiques à la demande tient ses promesses, elle pourrait réduire le coût de collecte de données réelles, un goulot d'étranglement majeur pour l'entraînement des robots humanoïdes et bras manipulateurs. Toutefois, à ce stade, il s'agit d'une annonce de capacités techniques, sans démonstration publique détaillée ni benchmark comparatif, ni précision sur un déploiement matériel réel. Xiaomi investit depuis plusieurs années dans la robotique, avec son robot quadrupède CyberDog et des incursions dans les véhicules autonomes et l'IA embarquée. Ce modèle de 38 milliards de paramètres le positionne face aux laboratoires spécialisés en IA incarnée tels que Physical Intelligence, Figure AI ou Nvidia, ainsi que face aux géants chinois de la tech comme Baidu ou Alibaba, également actifs sur les modèles fondation pour la robotique. Aucune date de disponibilité, de partenariat industriel ou de déploiement pilote n'a été précisée à ce stade.

Chine/AsieActu
1 source
Alibaba et ByteDance redoublent d'efforts sur l'IA incarnée : l'apport des géants d'internet à la robotique
2Pandaily 

Alibaba et ByteDance redoublent d'efforts sur l'IA incarnée : l'apport des géants d'internet à la robotique

Le 16 juin 2026, Alibaba a lancé Qwen-Robot, sa première famille complète de modèles d'IA incarnée intégrée à la série Qwen. Elle regroupe trois composants distincts : Qwen-RobotManip pour la manipulation physique, Qwen-RobotNav pour la navigation autonome, et Qwen-RobotWorld comme modèle de monde, c'est-à-dire un moteur de raisonnement contextuel sur l'environnement physique. Ces modules peuvent être déployés séparément ou en coordination, selon le type de robot ciblé. Le positionnement d'Alibaba est explicitement logiciel : l'entreprise ne vise pas à construire des corps robotiques, mais à fournir le "cerveau intelligent" à des fabricants tiers. Simultanément, ByteDance a réorganisé ses efforts en robotique incarnée en élevant Seed Robotics au rang de division stratégique principale, désormais sous la supervision de Zhou Chang, responsable multi-modal du groupe. ByteDance a déjà produit plus de 1 000 robots, majoritairement des robots mobiles à roues pour la logistique en entrepôt et en usine, et compte parmi ses clients externes SF Express et BYD Electronics. Ce double mouvement illustre un changement structurel dans la course aux humanoïdes et à la robotique généraliste : les géants de l'internet entrent dans le secteur non par la mécanique, mais par la donnée et l'intelligence. La valeur qu'ils apportent repose sur trois piliers. D'abord, leurs grands modèles de langage compressent le temps d'adaptation à de nouvelles tâches : là où un ingénieur robotique traditionnel passerait plusieurs semaines à reprogrammer un bras ou un AGV pour un nouveau scénario, une approche VLA (vision-language-action) peut réduire cette itération à quelques jours. Ensuite, leur infrastructure opérationnelle génère des données d'entraînement à une échelle inaccessible aux startups : le réseau de livraison instantanée de Meituan, les entrepôts de JD Logistics, les chaînes d'approvisionnement e-commerce de ByteDance accumulent chaque jour des millions d'interactions physiques réelles. Enfin, et c'est peut-être le facteur le plus sous-estimé, ces entreprises sont leurs propres premiers clients. JD a validé ses robots logistiques dans ses propres entrepôts "Asia No.1" avant de les commercialiser. ByteDance fait circuler ses AMR sur de vraies routes opérationnelles avant de les vendre. Ce raccourci entre laboratoire et déploiement à l'échelle est ce qui manque le plus aux startups hardware-first. Pour autant, les analystes du secteur rappellent que l'avantage logiciel ne dissout pas les contraintes physiques. Les composants critiques comme les actionneurs, les capteurs de force ou les joints à haute précision restent des goulots d'étranglement de supply chain qui ne s'effacent pas parce qu'un géant tech entre dans la pièce. Alibaba et ByteDance font face à une concurrence à deux niveaux : d'un côté les acteurs hardware-first américains comme Figure AI, 1X, Boston Dynamics ou Agility Robotics qui avancent en parallèle sur la couche IA ; de l'autre les constructeurs chinois comme Unitree ou Fourier Intelligence qui maîtrisent déjà la chaîne de fabrication. La prochaine étape pour évaluer ces annonces sera de mesurer si les modèles Qwen-Robot passent l'épreuve du déploiement industriel répété en dehors des environnements contrôlés d'Alibaba, ce qui reste à ce stade une démonstration en cours, pas un produit livré.

Chine/AsieOpinion
1 source
Baisse des collisions contre le verre ? La division IA incarnée d'Ant Group revendique une avancée en perception robotique
3SCMP Tech 

Baisse des collisions contre le verre ? La division IA incarnée d'Ant Group revendique une avancée en perception robotique

Ant Group a présenté mardi, via sa filiale d'IA incarnée Robbyant, basée à Hangzhou, deux nouveaux modèles de perception visuelle pour robots : LingBot-Depth 2.0, un modèle de perception spatiale de nouvelle génération, et LingBot-Vision, un modèle visuel fondationnel. L'entreprise affirme que ces modèles permettent de résoudre un problème persistant en robotique : la détection fiable du verre, des miroirs et des objets transparents, des surfaces qui perturbent traditionnellement les capteurs de profondeur (LiDAR, stéréovision, temps de vol). Aucune métrique de précision, benchmark ou comparaison chiffrée n'a toutefois été communiquée dans l'annonce, ce qui invite à la prudence sur l'ampleur réelle de l'avancée revendiquée. La perception des matériaux transparents et réfléchissants reste un angle mort connu des systèmes de navigation robotique : portes vitrées, baies, miroirs faussent les mesures de distance et provoquent collisions ou arrêts d'urgence intempestifs. Un progrès réel sur ce point intéresserait directement les opérateurs d'AMR en entrepôt comme les concepteurs de robots humanoïdes destinés à évoluer en environnement de bureau, hôpital ou magasin. L'annonce confirme surtout l'entrée d'un nouvel acteur chinois, non spécialisé matériel, sur la brique logicielle de perception de la pile robotique, aux côtés d'entreprises déjà positionnées comme Unitree ou UBTech. Ant Group, connu pour Alipay et ses activités fintech, diversifie ainsi son portefeuille IA vers la robotique incarnée, dans la continuité du mouvement engagé par plusieurs géants technologiques chinois depuis 2024-2025. À l'international, la course reste dominée par des modèles vision-langage-action comme Pi-0 de Physical Intelligence, GR00T N2 de Nvidia, ou les plateformes propriétaires de Figure AI (Figure 03) et Tesla (Optimus Gen 3). Robbyant n'a pas précisé si LingBot-Depth 2.0 et LingBot-Vision seront ouverts, licenciés à des fabricants tiers, ou réservés à des projets internes, ni communiqué de calendrier de déploiement.

UEAucun acteur ou réglementation européenne n'est concerne directement, mais une percée réelle sur la détection du verre et des surfaces réfléchissantes intéresserait indirectement les opérateurs européens d'AMR en entrepôt et les concepteurs de robots humanoïdes destines aux environnements de bureau ou de santé.

Chine/AsieActu
1 source
74 yuans pour 3 heures : des robots à IA incarnée entrent dans les foyers chinois pour les tâches ménagères
4Pandaily 

74 yuans pour 3 heures : des robots à IA incarnée entrent dans les foyers chinois pour les tâches ménagères

En Chine, les robots à intelligence artificielle incarnée sortent des usines pour entrer dans les foyers, sous forme de location à l'heure pour des tâches ménagères. Plusieurs plateformes à la demande proposent désormais des robots humanoïdes ou à roues capables de nettoyer les sols, essuyer les surfaces, récupérer des objets ou effectuer de petites tâches de rangement, pour un tarif de départ de 74 yuans les trois heures, soit environ 25 yuans de l'heure (un peu plus de 3 euros). Ces machines s'appuient sur des modèles vision-langage-action pour naviguer de façon autonome dans un environnement domestique, éviter les obstacles, reconnaître des objets et répondre à des commandes vocales simples. C'est l'un des premiers déploiements commerciaux réels de l'IA incarnée en dehors du cadre industriel, après des investissements en R&D chiffrés en milliards de yuans. Ce tarif rend la main-d'œuvre robotique moins chère que le personnel de ménage humain dans les grandes villes chinoises, mais l'écart de capacités reste net : les retours d'utilisateurs montrent que ces robots gèrent correctement les tâches de nettoyage simples, tout en peinant face aux objets de forme irrégulière, aux instructions à plusieurs étapes et aux espaces exigus typiques des appartements chinois. Le compromis est assumé, fonctionnalités limitées contre accessibilité tarifaire, et il interroge la trajectoire des investissements massifs consacrés à l'IA incarnée en Chine. Des entreprises comme Unitree, AgiBot, Star Dynasty ou X Square Robot ont levé des fonds considérables pour des robots humanoïdes généralistes, alors que le premier vrai marché de masse concerne des robots de service bien plus spécialisés et modestes. Les défenseurs de l'approche avancent toutefois que ce déploiement réel, même limité, génère des données précieuses pour entraîner les modèles de nouvelle génération, des données que la simulation en laboratoire ne peut reproduire : agencements imprévus, objets variés, comportements d'utilisateurs divers. Cette stratégie rappelle celle des entreprises chinoises de conduite autonome, qui ont déployé des fonctions de conduite partiellement automatisée des années avant d'atteindre une autonomie complète, misant sur l'accumulation de données réelles plutôt que sur l'attente d'une technologie parfaite. Les analystes du secteur anticipent une expansion rapide du marché de la location de robots domestiques à mesure que les coûts baissent et que les capacités progressent, plusieurs acteurs chinois développant déjà des modèles de nouvelle génération optimisés pour l'environnement du foyer, avec une meilleure dextérité pour manipuler de petits objets et une compréhension plus fine des instructions complexes. Reste une question ouverte : ce modèle de facturation à la tâche, encore marginal, pourra-t-il générer des revenus suffisants pour justifier l'ampleur des investissements déjà engagés dans l'infrastructure de l'IA incarnée.

Chine/AsieActu
1 source