Aller au contenu principal
RecherchearXiv cs.RO 

Assemblage robotique à la demande par réparation géométrique différentiable de pièces

1 source couvre ce sujet·Source originale ↗·
Résumé IASource uniqueImpact UE

Des chercheurs décrivent un pipeline autonome de bout en bout, de la conception numérique à la construction physique d'assemblages en bois sur mesure. Un agent d'IA générative convertit une requête en langage naturel en une géométrie 3D initiale, en arbitrant entre fidélité visuelle et quelques contraintes physiques. Une étape de réparation par descente de gradient ajuste ensuite les composants: elle rétropropage à travers un réseau d'attention sur graphe (graph attention network) qui sert de modèle de substitution différentiable de l'assemblabilité. Elle corrige les pièces disjointes ou qui se chevauchent, et intègre des corrections propres au matériel, ici la géométrie des pièces pour permettre le vissage robotisé. Sur 60 requêtes inédites, 86,7 % des conceptions deviennent vissables par robot, soit un facteur dix par rapport aux travaux antérieurs. Dix structures ont été assemblées physiquement avec deux bras UR5e.

L'enjeu est le passage du modèle numérique à l'assemblage robotisé, qui exige aujourd'hui, selon les auteurs, des mois de réglage manuel par des experts pour réconcilier la géométrie des pièces avec les contraintes du robot. Intégrer ces contraintes dans la boucle d'optimisation, plutôt que de les traiter après coup, ouvre la voie à une production à la demande de biens personnalisés en petite série, là où l'automatisation classique n'est pas rentable. Pour les intégrateurs, l'intérêt tient à la réduction du travail d'ingénierie par pièce, qui freine les séries courtes. Il faut toutefois relativiser: 86,7 % porte sur la faisabilité du vissage dans une évaluation de conception, tandis que la preuve physique ne couvre que 10 structures sur 60, soit environ un sixième. L'article ne chiffre pas, dans ce résumé, les temps de cycle, les taux de réussite à l'assemblage réel ni les coûts. La complexité des pièces et la diversité des matériaux restent à démontrer.

Ce travail, publié sur arXiv (2610.09777, v1), s'inscrit dans la convergence entre génération 3D par IA et fabrication robotisée. Les modèles génératifs produisent des formes visuellement plausibles mais rarement fabricables, et la littérature sur l'assemblage robotisé suppose généralement une conception déjà adaptée. Le recours à un substitut neuronal différentiable pour faire passer des contraintes de fabrication dans l'optimisation répond à ce décalage. Le choix de deux UR5e, bras collaboratifs répandus en laboratoire et en atelier, rend la configuration reproductible. Les prochaines étapes probables sont des assemblages plus complexes, des matériaux et fixations variés, une évaluation sur des cellules de production réelles et une mesure des temps et des coûts face à la fabrication manuelle. Il s'agit d'une preuve de concept académique, sans déploiement industriel annoncé.

Impact France/UE

Pas d\'impact direct sur la France/UE

Dans nos dossiers

À lire aussi

Apprentissage des relations CAO et planification géométrico-symbolique pour l'assemblage robotique
1arXiv cs.RO 

Apprentissage des relations CAO et planification géométrico-symbolique pour l'assemblage robotique

Un article publié sur arXiv (2609.17263v1) présente un cadre hybride de planification de séquences d'assemblage robotique combinant apprentissage automatique et raisonnement géométrique-symbolique, pensé pour des modèles CAO imparfaits, souvent dépourvus d'informations de contact fiables. Un réseau de neurones prédit les relations géométriques entre pièces à partir de nuages de points, corrigées si besoin par une supervision humaine, puis converties en graphe d'assemblage symbolique exploité par un planificateur qui calcule des primitives de manipulation robotique, guidé par un ray-casting basé sur la visibilité pour trouver les directions de désassemblage sans recherche combinatoire exhaustive. Sur le benchmark ASAP, le système atteint 85,83% de réussite en réduisant le temps médian de planification d'un ordre de grandeur, et jusqu'à 50 fois pour les assemblages de plus de 30 composants. La planification d'assemblage est un problème combinatoire dont le coût explose avec le nombre de pièces, rendant les méthodes exhaustives inutilisables sur des assemblages industriels complexes. Le frein pratique majeur reste les données: la plupart des CAO industrielles manquent des métadonnées de contact nécessaires, imposant un étiquetage manuel coûteux avant tout déploiement. En combinant extraction de relations apprise et vérification humaine ciblée, le framework réduit cette dépendance, un point concret pour les intégrateurs travaillant sur des données réelles plutôt que des maquettes idéalisées. Le gain de vitesse, jusqu'à 50 fois sur les cas complexes, intéresse les lignes reconfigurables où chaque changement de produit exige une replanification rapide, même si 85,83% de réussite laisse une marge d'échec non négligeable sur un résultat encore expérimental. Le travail s'inscrit dans un champ de recherche actif sur la planification d'assemblage et de désassemblage robotique, où le jeu de données ASAP sert de référence pour comparer les méthodes; les auteurs y opposent leur approche à une méthode combinatoire classique, nettement plus lente. Publié comme nouvelle soumission arXiv sans affiliation industrielle ni calendrier commercial précisé, ce document reste une contribution académique, pensée comme fondation pour des systèmes de planification plus adaptables. Sa portée pratique dépendra de validations futures sur des cellules robotiques réelles et des catalogues de pièces plus larges, étape annoncée mais non détaillée.

RecherchePaper
1 source
GenVid2Robot : de la génération vidéo à la manipulation robotique par cohérence rigide-géométrique
2arXiv cs.RO 

GenVid2Robot : de la génération vidéo à la manipulation robotique par cohérence rigide-géométrique

Des chercheurs ont publié le 13 juillet 2026 sur arXiv (2607.09191v1) GenVid2Robot, un système qui transforme des vidéos générées par IA en trajectoires exécutables sur un robot manipulateur réel. Le problème de départ: une vidéo générée peut sembler visuellement plausible sans être physiquement exécutable, faute de géométrie métrique, d'ancrage de préhension, de faisabilité cinématique ou de retour d'exécution. GenVid2Robot part d'une observation RGB-D initiale et d'une instruction de tâche, échantillonne des ancres sémantiques pertinentes sur la première image réelle, puis suit ces ancres à travers les candidats vidéo générés. Un modèle SE(3) relatif et épars vérifie si le mouvement 2D observé est cohérent avec la géométrie 3D des ancres; seul le mouvement validé géométriquement est transféré au robot. Ce mouvement est ensuite appliqué à la pose réelle de l'organe terminal (TCP) au moment de la saisie, déterminée par une préhension contrainte par masque, et un module de compensation de profondeur borné corrige les erreurs locales dues au bruit RGB-D ou aux déplacements de contact. L'enjeu dépasse la démonstration technique isolée: les modèles de génération vidéo (type Sora, Veo ou Genie) sont de plus en plus présentés comme des sources de "priors" de mouvement pour la robotique, mais l'écart entre vidéo plausible et action exécutable reste l'un des obstacles majeurs à leur usage réel, aux côtés du problème classique du sim-to-real. En filtrant les hypothèses de mouvement par cohérence géométrique plutôt qu'en rejouant directement une trajectoire, GenVid2Robot répond directement au risque d'échec en conditions réelles que redoutent intégrateurs et équipes R&D travaillant sur les architectures vision-langage-action (VLA). Le travail s'inscrit dans la lignée des approches combinant modèles génératifs et politiques robotiques, aux côtés d'efforts comme Pi-0, GR00T N2 ou Helix qui cherchent à exploiter des priors visuels ou vidéo à grande échelle. À ce stade, il s'agit d'une publication de recherche avec expériences sur robot réel, non d'un produit commercialisé; les auteurs ne précisent pas de calendrier de déploiement industriel.

RecherchePaper
1 source
Assemblage robotique à contacts multiples dans la construction par politique de diffusion
3arXiv cs.RO 

Assemblage robotique à contacts multiples dans la construction par politique de diffusion

Des chercheurs ont publié sur arXiv (arXiv:2511.17774, version 3) une étude portant sur l'application de l'apprentissage par diffusion à l'assemblage robotique dans le secteur de la construction. Le cas d'usage retenu est l'assemblage tenon-mortaise en bois, une jonction à contact riche soumise à des contraintes de friction et de géométrie strictes, avec des jeux inférieurs au millimètre. Les politiques de diffusion sensori-motrices ont été entraînées à partir de démonstrations téléopérées collectées sur un poste de travail robotique industriel équipé de capteurs force/couple. L'évaluation s'est déroulée en deux phases : une baseline en conditions nominales et un test de robustesse avec des perturbations positionnelles aléatoires allant jusqu'à 10 mm, soit un ordre de grandeur au-delà de la tolérance d'assemblage. La politique la plus performante atteint 100 % de taux de succès en conditions nominales et 75 % en moyenne sous perturbation. Ce résultat est notable car il adresse directement un verrou industriel structurel : l'accumulation de tolérances dans la construction empêche depuis longtemps l'automatisation fiable des tâches d'assemblage à contact. Le fait qu'une politique diffusion parvienne à compenser des désalignements de 10 mm pour des jeux sub-millimétriques suggère que ces architectures apprennent implicitement une stratégie de compliance active via le retour d'effort, sans modélisation géométrique explicite. Pour un intégrateur industriel ou un bureau de méthodes, cela signifie que le sim-to-real gap sur des tâches de précision en construction pourrait être en partie résorbé par l'apprentissage par imitation couplé à la force/couple, sans recalibration manuelle systématique. L'assemblage tenon-mortaise n'est pas un choix anodin : cette technique millénaire est revenue en force dans la construction bois massive (CLT, charpente lamellée-croisée), un segment en forte croissance en Europe avec des acteurs comme Sœur Bois ou Blumer-Lehmann. Les politiques de diffusion appliquées à la robotique manipulatrice ont été popularisées par des travaux comme le Diffusion Policy de Chi et al. (2023, Columbia/Toyota) et sont désormais explorées par des labos comme Physical Intelligence (pi) avec Pi-0, ou par Boston Dynamics Research. Cette étude se distingue en ciblant explicitement la construction industrielle plutôt que la cuisine ou la logistique. La prochaine étape logique serait un déploiement en conditions chantier réelles, avec variation de matériaux et de géométries, ce que les auteurs n'ont pas encore testé.

UELe segment construction bois massive (CLT, charpente lamellée-croisée) est en forte croissance en Europe avec des acteurs comme Sœur Bois ou Blumer-Lehmann ; une automatisation fiable des assemblages à contact ouvrirait une voie d'industrialisation directement applicable sur les chantiers européens.

RecherchePaper
1 source
Deux par deux : apprentissage multi-tâches de l'assemblage d'objets appariés pour une manipulation robotique généralisable
4arXiv cs.RO 

Deux par deux : apprentissage multi-tâches de l'assemblage d'objets appariés pour une manipulation robotique généralisable

Des chercheurs publient 2BY2, un jeu de données annoté à grande échelle pour l'assemblage d'objets appariés du quotidien, décrit dans une version révisée d'un article arXiv (2504.06961v2). Il couvre 18 tâches fines inspirées de gestes réels comme brancher une prise, disposer des fleurs dans un vase ou insérer du pain dans un grille-pain, avec 1034 instances et 517 paires d'objets annotées en pose et en symétrie. Les auteurs proposent une méthode d'estimation de pose SE(3) en deux étapes, basée sur des caractéristiques équivariantes, qui atteint des performances état de l'art sur les 18 tâches du benchmark. Des expériences robotiques réelles confirment la fiabilité et la capacité de généralisation de cette méthode sur des tâches d'assemblage 3D complexes. Ce travail comble un vide méthodologique pour la robotique domestique : la plupart des benchmarks d'assemblage existants portent sur des fragments géométriques abstraits ou des pièces industrielles standardisées, loin des interactions fonctionnelles et asymétriques des objets du quotidien. En ciblant explicitement les futurs robots d'assistance à domicile, 2BY2 offre un terrain d'évaluation plus représentatif que les jeux de données orientés usine. Le transfert réussi de la méthode du benchmark simulé vers des essais robotiques physiques est un signal notable, suggérant que les approches de pose SE(3) équivariante peuvent réduire l'écart simulation-réel sur des tâches de manipulation fine, un problème persistant pour les politiques de manipulation généralistes. Les résultats « état de l'art » restent toutefois mesurés sur le benchmark propre des auteurs, une limite à garder en tête avant toute extrapolation. L'article, référencé 2504.06961 sur arXiv et republié en version 2, s'inscrit dans la lignée des travaux de « shape assembly » qui se concentraient jusqu'ici sur des fragments cassés ou des composants industriels aux formes régulières. 2BY2 étend le problème à des objets paires à forte composante fonctionnelle, des gestes triviaux pour un humain mais qui exigent une compréhension conjointe de la géométrie et de l'usage. Les auteurs comparent leur méthode aux approches antérieures de shape assembly sur l'ensemble des 18 tâches et revendiquent une supériorité systématique. La publication de ce dataset annoté pose une base de comparaison pour de futurs travaux, sans qu'un calendrier de mise à disposition du code ou de partenariat industriel ne soit précisé à ce stade.

RecherchePaper
1 source