Convergent Detour Hijacking : une attaque qui gonfle les coûts des agents LLM sans nuire à leur réussite
Une nouvelle attaque texte-only manipule la sélection et le planning des skills tierces pour forcer des détours coûteux, sans compromettre l'issue de la tâche.
arXiv cs.AI · cs.LG · cs.CL·Junliang Liu, Ruoyu Li, Wenxin Tang, Jingyu Xiao·12 août 2026

Image · Source originale
Des chercheurs présentent Convergent Detour Hijacking (CDH), une attaque ciblant les agents LLM utilisant des skills tierces via description et instructions en langage naturel. Elle combine manipulation de sélection et de planning pour détourner l'exécution vers un chemin coûteux avant de revenir sur la trajectoire initiale. Sur DeepSeek-V4-Pro, le coordinateur malveillant est sélectionné dans 80% des cas, augmentant tokens (+66,91%) et temps d'exécution (+92,45%) sans altérer le taux de réussite global.