DARTree : speculative decoding par diffusion et arbres
Cette méthode sans entraînement accélère les LLM via des arbres de candidats parallèles, dépassant les vitesses des approches classiques.
arXiv cs.AI · cs.LG · cs.CL·Tianyi Li, Yaxin Luo, Xinyi Shang, Zhiqiang Shen·13 août 2026

Image · Source originale
DARTree est une méthode de speculative decoding sans entraînement qui étend la correction autoregressive aux structures arborescentes. Elle construit un arbre de candidats à largeur fixe via la diffusion, optimisant le traitement parallèle et l'élagage pour maximiser l'acceptation de tokens. Les tests montrent un gain de vitesse significatif et une longueur d'acceptation moyenne supérieure aux solutions existantes comme DFlash.