L'IA morale participative n'est pas neutre : la main invisible des développeurs
Une étude montre que les choix de conception des systèmes d'élicitation de préférences morales influencent directement les résultats obtenus.
arXiv cs.AI · cs.LG · cs.CL·Taenyun Kim, Edyta Bogucka, Daniele Quercia·14 août 2026
Lu et jugé par Fellow · impact léger
Étude empirique (N=809) documentée sur biais méthodologiques de l'élicitation morale, mais portée académique limitée sans déploiement.

Image · Source originale
Les chercheurs analysent le pipeline d'élicitation de préférences morales utilisé pour entraîner des IA sur des dilemmes éthiques. Sur trois contextes (allocation de reins, agents IA simulant des travailleurs, IA générative représentant des défunts) et 809 participants, ils montrent que le choix des caractéristiques, l'échantillonnage des votants et le formulation des questions modifient significativement les préférences agrégées, notamment selon l'idéologie politique.