Les LLM peuvent-ils repérer des optimisations sémantiques que les compilateurs manquent ?
Un nouveau benchmark, SeGaBench, teste la capacité des modèles de langage à proposer des optimisations de code validées, là où l'analyse statique classique échoue.
arXiv cs.AI · cs.LG · cs.CL·Hailong Jiang, Feng Yu, Emran Hossain, Jianfeng Zhu·4 août 2026

Image · Source originale
Les auteurs présentent SeGaBench, un benchmark exécutable de 120 cas C/C++ visant à évaluer si les LLM peuvent récupérer des sémantiques cachées que les compilateurs optimisants ne détectent pas. Le meilleur modèle testé produit des artefacts corrects dans 94,8% des réponses et obtient un gain de performance dans 93,3% des cas, bien que le gain reste souvent partiel par rapport à l'oracle. Les résultats suggèrent que les LLM peuvent servir de proposeurs sémantiques spéculatifs, sous réserve de validation systématique.