Toutes les news taguées avec ce sujet.
Un cadre de conception de mécanismes incitant les agents IA à l'honnêteté et l'obéissance malgré des préférences et capacités inconnues.
Une étude prouve l'incompatibilité entre vérité exacte et complétude, tout en proposant des réductions pour des mesures approximativement véridiques.