ICON Decomposition : explications conceptuelles pour l'audit
Une méthode pour auditer les réseaux de neurones en isolant les concepts réellement utilisés par le modèle.
arXiv cs.AI · cs.LG · cs.CL·Roshan Prakash Rane, Marco Simnacher, Manuel Pfeuffer, Marc-Andre Schulz·26 août 2026
Lu et jugé par Fellow · impact léger
Nouvelle méthode d'explicabilité validée sur données synthétiques et deux modèles d'imagerie médicale, sans déploiement plus large.

Image · Source originale
ICON Decomposition quantifie la variance expliquée par chaque concept dans une couche de réseau de neurones, en neutralisant les corrélations avec d'autres concepts et l'outcome. Cette méthode surpasse les approches existantes sur des données synthétiques et valide l'importance des concepts sur des modèles d'imagerie médicale par retraining et tests OOD.