RECHERCHE
Repenser le scaling à l'inférence pour les agents d'usage informatique en local : échecs et arbitrages de calcul
Une étude systématique montre que le calcul supplémentaire à l'inférence n'améliore pas toujours les agents CUA locaux, mais change surtout leur façon d'échouer.
arXiv cs.AI · cs.LG · cs.CL·Woongkyu Lee, Jungwook Choi·30 juillet 2026

Image · Source originale
Les chercheurs évaluent des stratégies de scaling à l'inférence (contextuel, temporel, structurel, parallèle) sur des agents d'usage informatique locaux comme Qwen3-VL, UI-TARS-1.5 et OpenCUA via le benchmark OSWorld. Les gains de calcul supplémentaire saturent rapidement et déplacent les modes d'échec plutôt que de les résoudre : trajectoires stagnantes remplacées par de faux succès prématurés. La décomposition structurelle ajoute une surcharge de planification, et le scaling parallèle n'atténue ces problèmes qu'à un coût de calcul important.