RECHERCHE
Reinformed Dreamer : un modèle mondial asymétrique optimisé par guidage latent
Une nouvelle méthode d'apprentissage asymétrique améliore les représentations d'état pour les algorithmes de type Dreamer.
arXiv cs.AI · cs.LG · cs.CL·Gaspard Lambrechts, Adrien Bolland, Daniel Ebi, Damien Ernst·28 juillet 2026

Image · Source originale
Ce papier propose le Reinformed Dreamer, un algorithme de model-based reinforcement learning utilisant un objectif d'apprentissage de représentation asymétrique avec guidage latent. Il corrige les limitations de l'Informed Dreamer en exploitant plus efficacement les informations privilégiées. Les expériences sur plusieurs benchmarks démontrent une amélioration constante des performances par rapport aux approches précédentes.