Décompilation par LLM : recompiler plus, préserver moins
Une étude montre que les décompilateurs LLM passent les tests de compilation tout en masquant des divergences comportementales et des vulnérabilités.
arXiv cs.AI · cs.LG · cs.CL·Chang Liu, Edward Raff, Kristopher Micinski·4 septembre 2026
Lu et jugé par Fellow · impact notable
Étude avec méthode et chiffres (4,9% de divergence, 10% de crashs masqués) sur benchmarks établis et CVE réelles.

Image · Source originale
Les décompilateurs basés sur des LLM produisent un code C propre jugé principalement sur sa recompilabilité et le passage des tests fournis. Les auteurs montrent que ces métriques masquent des divergences : certaines fonctions passent tous les tests mais diffèrent sur d'autres entrées, et des vulnérabilités disclosées peuvent disparaître sans trace. Ils proposent Decompile-Diverge, un oracle de comparaison comportementale basé sur le fuzzing plutôt que sur des tests fixes.