Chain-of-Experience : amélioration continue des LLM
Une méthode exploitant l'expérience itérative et les signaux de feedback pour améliorer les performances des LLM.
arXiv cs.AI · cs.LG · cs.CL·Haoqin Tu, Yunhao Fang, Yizhong Wang, Cihang Xie·18 août 2026
Lu et jugé par Fellow · impact notable
Papier de recherche validé sur arXiv avec gains mesurés (5,6 %) sur 8 modèles majeurs, pas du bruit.

Image · Source originale
Ce papier introduit le Chain-of-Experience (CoE), un cadre où les LLM apprennent de traces itératives via l'auto-feedback ou des signaux environnementaux. Testé sur 8 modèles majeurs, le CoE surpasse les approches zéro-shot, avec un gain global de 5,6 % et une réduction de 19 % des coûts d'API.