RV-ICL : apprentissage vidéo en contexte récursif pour robots agentiques
Une méthode sans entraînement structure une vidéo de démonstration en hiérarchie navigable pour améliorer la précision des gestes robotiques.
arXiv cs.AI · cs.LG · cs.CL·Wenrui Bao, Xinxin Liu, Bingxin Xu, Yuzhang Shang·5 octobre 2026
Lu et jugé par Fellow · impact léger
Gains mesurés sur benchmarks simulés LIBERO uniquement, méthode sans entraînement mais non testée en conditions réelles.

Image · Source originale
Les agents LLM pilotant des politiques VLA figées s'appuient sur une mémoire texte qui ne capture pas le « comment » d'une tâche. RV-ICL transforme une démonstration vidéo en hiérarchie exploitable (phases, moments, clips) via des outils en lecture seule, sans entraînement supplémentaire. Une seule démonstration par tâche suffit, avec des gains de succès notables sur LIBERO-PRO (92,6% → 96,5%) et LIBERO-Plus (86,7% → 95,8%).