Quoi et quand ? Diagnostiquer et améliorer l'ancrage visuel conditionnel dans les politiques d'imitation visuomotrices
Une étude montre comment des objets distracteurs perturbent la sélection de cibles dans les politiques robotiques d'imitation, et propose des correctifs concrets.
arXiv cs.AI · cs.LG · cs.CL·Vivek Chavan, Pengtao Xie, Yahuan Shi, Oliver Heimann·4 septembre 2026
Lu et jugé par Fellow · impact notable
Article scientifique validé avec tests sur robot réel (UR3e) et solution technique vérifiée.

Image · Source originale
Les auteurs analysent pourquoi les politiques d'imitation visuomotrices échouent face à des objets ou réceptacles visuellement similaires mais hors distribution. Grâce à ACT, ils localisent les défaillances selon le type de similarité visuelle et la phase de manipulation, puis testent des interventions comme l'augmentation par distracteurs, la régularisation d'attention et le prompting visuel. Ces méthodes améliorent nettement la robustesse en simulation et sur un robot UR3e réel, ainsi que sur une tâche médicale conditionnée par l'état.