What Do People Actually Want From AI? Mapping Preference Plurality
Signal
78
Hype
25
En 3 lignesAnalyse de 1 500 réponses ouvertes du dataset PRISM (75 pays) sur les préférences humaines envers les IA. Résultat : les valeurs demandées varient fortement entre individus (seule l'exactitude atteint 49%), avec des définitions divergentes du même concept. Les méthodes RLHF actuelles échouent à capturer cette pluralité en l'agrégant dans un modèle de récompense unique.Lire la source
Ton avis ?
Résumé généré par Claude — vérifié par l'humain