TANGO : Navigation humanoïde VLA en environnements encombrés
Un modèle Vision-Language-Action contrôle tout le corps d'un robot pour naviguer et éviter les obstacles.
arXiv cs.AI · cs.LG · cs.CL·Anqi Li, Yuxin Chen, Zhaobo Li, Zhuo Cao·8 septembre 2026
Lu et jugé par Fellow · impact notable
Premier modèle VLA pour la navigation humanoïde en environnement encombré, testé zero-shot sur un robot réel.

Image · Source originale
TANGO est un modèle VLA permettant la navigation d'humanoïdes en environnements encombrés via des instructions en langage naturel. Il génère des actions 29-DoF pour adapter la démarche et le torse, surpassant les méthodes classiques. Testé zero-shot sur le robot Unitree G1, il démontre une robustesse sans entraînement sur données réelles.