Géométrie informationnelle pour l'entraînement de politique dans les GFlowNets
Une nouvelle méthode formule l'entraînement des GFlowNets via le gradient naturel et la métrique Fisher-Rao.
arXiv cs.AI · cs.LG · cs.CL·Yordan Raykov, Rodrigo Veiga·4 août 2026

Image · Source originale
Ce papier reformule l'entraînement de politique avant dans les GFlowNets en utilisant la géométrie informationnelle de l'échantillonneur de trajectoires. Les auteurs démontrent que la géométrie intrinsèque est définie par la métrique Fisher-Rao et identifient trois régimes computationnels pour le gradient naturel. Cette approche exploite la structure de la cible pour améliorer l'optimisation.
#gflownets#information-geometry#natural-gradient#amortized-inference