REPLICANT : des politiques d'apprentissage pour contourner et renforcer les détecteurs de malwares
Un framework de deep reinforcement learning en boîte noire surpasse l'état de l'art pour évader les détecteurs Android, et pour les rendre plus robustes.
arXiv cs.AI · cs.LG · cs.CL·Shae McFadden, Ilias Tsingenopoulos, Mario D'Onghia, Alexander Herzog·28 août 2026
Lu et jugé par Fellow · impact notable
Résultats chiffrés vérifiables (78,8% de succès, +20,9-39,2% vs état de l'art) sur benchmarks académiques, mais pas de déploiement réel.

Image · Source originale
Replicant est un framework de reinforcement learning qui apprend à modifier des malwares et à cibler ses requêtes sous un modèle de menace strict en label-only. Testé sur sept détecteurs Android et trois espaces de features, il atteint un taux de succès moyen de 78,8%, soit 20,9 à 39,2% de mieux que l'état de l'art. Utilisé en entraînement adversarial, il produit aussi des détecteurs plus robustes.