Comment décoder les traces de raisonnement chiffrées des modèles frontier
Une étude montre qu'il est possible de décrypter les chaînes de pensée d'o1 et consorts, exposant des clés API, mots de passe et données personnelles.
Latent Space (Swyx)·12 août 2026

Image · Source originale
Depuis le lancement d'o1, les labs chiffrent les traces de raisonnement par crainte de la distillation. Un nouveau papier démontre qu'il est possible de décoder ces blobs chiffrés et de les porter vers d'autres modèles pour en améliorer les performances. Un scan préliminaire de 7 000 traces publiques a révélé 62 clés API, 33 emails et 33 mots de passe, dont une partie n'apparaissait que dans les blocs de raisonnement chiffrés, invisibles côté utilisateur.