MemPilot : orchestration à la demande de la mémoire multimodale pour agents LLM
Un nouveau framework par apprentissage par renforcement ajuste dynamiquement coût, latence et performance de la mémoire des agents LLM.
arXiv cs.AI · cs.LG · cs.CL·Haozhen Zhang, Haodong Yue, Quanyu Long, Jianzhu Bao·5 octobre 2026
Lu et jugé par Fellow · impact léger
Papier de recherche incrémental sur l'orchestration de mémoire d'agents, sans adoption ni validation indépendante hors benchmarks internes.

Image · Source originale
MemPilot propose un framework qui optimise par reinforcement learning une politique LLM multi-étapes pour arbitrer entre mémoire préconstruite et curation à la demande via des LLM/VLM hétérogènes. La méthode contrôle finement la quantité de preuves, les instructions de curation, le choix de modèle et l'accès visuel. Des expériences sur cinq benchmarks de mémoire d'agents multimodaux montrent des résultats favorables.