ESPO : optimisation structurée des prompts par diagnostic, diversification et stabilisation
Une méthode en trois phases corrige le problème de gonflement des prompts des optimiseurs évolutionnaires comme GEPA, avec des gains de précision et des prompts plus courts.
arXiv cs.AI · cs.LG · cs.CL·Lihao Liu, Peng Tang, Kunwar Yashraj Singh, Shabnam Ghadar·3 septembre 2026
Lu et jugé par Fellow · impact léger
Amélioration incrémentale d'une technique d'optimisation de prompts, benchmarks propres à l'article, sans large adoption ni impact démontré au-delà du papier.

Image · Source originale
ESPO décompose l'optimisation de prompts en trois phases (diagnostic des erreurs, génération diversifiée de candidats, sélection par stabilité bootstrap) pour éviter le gonflement observé chez GEPA. Sur sept benchmarks NLP publics, ESPO améliore la précision moyenne de 3,76 points par rapport à GEPA tout en produisant des prompts 47% plus courts. Les tests croisés sur quatre modèles étudiants confirment sa supériorité constante, notamment un bond spectaculaire sur Qwen3 GSM8K.