Toutes les news taguées avec ce sujet.
Un nouveau benchmark évalue neuf algorithmes de détection de staypoints et révèle leur fragilité face au bruit réel.
Un framework qui filtre les traces d'exécution redondantes et localise les causes racines des échecs pour optimiser plus efficacement les agents LLM long-horizon.