Vers une provenance computationnelle : encoder l'état causal interne dans le texte généré
Une étude explore comment faire porter au texte généré une preuve vérifiable de l'état interne du modèle qui l'a produit.
arXiv cs.AI · cs.LG · cs.CL·Benjamin Belay·17 août 2026
Lu et jugé par Fellow · impact léger
Preuve de concept limitée à une tâche arithmétique jouet sur architectures contrôlées, sans validation sur modèles réels.

Image · Source originale
Des chercheurs testent la notion de provenance computationnelle : la capacité d'un texte généré à contenir une trace détectable de l'état interne causal réellement utilisé par le modèle. Sur des réseaux feed-forward et des transformers entraînés à une même tâche arithmétique, ils authentifient l'état interne emprunté et le font apparaître sous forme de motif statistique détectable dans la sortie. Le signal est retrouvé de façon fiable sur plusieurs modèles indépendamment entraînés, sans altération de la réponse finale.