FAITH : RL filtré pour la sécurité et conscient de la faisabilité, pour systèmes à haute dimension
Un framework model-free sépare sécurité et performance via un filtre d'actions appris, et atteint 99,95 % de sécurité sur un humanoïde à 29 DoF, testé sur un Unitree G1 réel.
arXiv cs.AI · cs.LG · cs.CL·Songyuan Zhang, Baljeet Singh, Sarthak Ranjeet Kaingade, Chuchu Fan·8 octobre 2026
Lu et jugé par Fellow · impact notable
Article arXiv avec résultats chiffrés (99,95 % de sécurité, 97 % du retour) sur humanoïde 29 DoF et démonstration sur Unitree G1 réel ; avance incrémentale, sans réplication indépendante.

Image · Source originale
FAITH est un framework model-free de RL sûr qui approxime la valeur de sécurité état-action optimale et amortit le filtrage à intervention minimale avec un réseau feedforward. La politique de tâche optimise le retour à travers la dynamique filtrée, sans terme de sécurité concurrent. Sans action sûre, le filtre choisit l'action au pic de dommage prédit minimal. Résultats : 99,95 % de sécurité en Walking-Avoid avec 97 % du retour non filtré, et démonstration sur un Unitree G1 réel.