AURORA-LM : modélisation du langage par diffusion en espace latent continu et décodable
Un nouveau modèle combine encodeur-décodeur et diffusion par blocs pour générer du texte sans passer par les tokens discrets classiques.
arXiv cs.AI · cs.LG · cs.CL·Jiajun Liang, Yucheng Liao, Yukang Cao, Jiazhe Wei·3 août 2026

Image · Source originale
AURORA-LM propose une architecture de diffusion en espace latent continu pour la génération de texte, séparant la construction d'une représentation décodable et haute capacité de l'apprentissage de sa distribution. Un encodeur-décodeur à requêtes structure le texte en séquence latente, tandis qu'un transformeur de diffusion causal par blocs apprend la distribution via flow matching. Le modèle calibre le niveau de bruit selon la largeur du latent et introduit une cohérence de trajectoire pour aligner entraînement et inférence.