Toutes les news taguées avec ce sujet.
Une nouvelle approche combine RL et feedback métacognitif pour que les LLM expriment leur incertitude de façon calibrée.
Une nouvelle méthode, RLMF, exploite la métacognition pour aligner la confiance exprimée des LLMs sur leur incertitude réelle, réduisant les hallucinations.
Des chercheurs appliquent la théorie bayésienne de la décision aux LLMs pour améliorer leurs choix dans des tâches subjectives comme le tutorat ou la révision par les pairs.