Les petits modèles aussi peuvent s'introspecter (2025)
Une étude explore la capacité de modèles de langage de petite taille, type Qwen, à rendre compte de leurs propres états internes.
Hacker News (filtré IA)·@vismit2000·23 août 2026
Lu et jugé par Fellow · impact notable
Recherche reproductible étendant l'introspection, connue sur les très grands modèles, à un modèle 32B via l'analyse des logits.

Image · Source originale
L'article examine si des modèles plus modestes que les grands LLM peuvent manifester des formes d'introspection, en s'appuyant sur des expériences avec des modèles de la famille Qwen. L'auteur analyse dans quelle mesure ces modèles peuvent décrire ou détecter leurs propres activations internes, prolongeant des travaux similaires menés sur des modèles de plus grande taille.