Toutes les news taguées avec ce sujet.
Une étude teste si les scores d'attribution identifient vraiment les neurones causalement importants dans les LLMs, notamment pour le comportement de refus.
Un outil open-source pour rendre visibles les raisonnements internes des grands modèles de langage, présenté sur Hacker News.
Une analyse remet en question la nature réelle du contenu affiché lors du mode de réflexion étendue de Claude Code : s'agit-il d'une véritable pensée ou d'une reconstruction ?