Rendre les modèles de langage cliniques auditables via un fine-tuning guidé par concepts
CAST utilise des autoencodeurs épars pour détecter et supprimer les artefacts de notes médicales, rendant les prédictions de mortalité plus robustes et traçables.
arXiv cs.AI · cs.LG · cs.CL·Jin Mu, Guanhua Chen·27 août 2026
Lu et jugé par Fellow · impact léger
Méthode incrémentale sur un seul dataset (MIMIC-IV), sans validation externe ni déploiement clinique réel.

Image · Source originale
CAST est un cadre basé sur les Sparse Autoencoders qui expose des features interprétables issues des activations d'un Transformer clinique. Il identifie et supprime les artefacts liés au formatage des notes plutôt qu'à l'état réel du patient, tout en fournissant une traçabilité par concept. Sur MIMIC-IV, la méthode améliore les baselines d'encodeurs fine-tunés et reste compétitive face aux LLM.