团队认为,有一组参与者整体表现出更多的利他行为。在游戏中,价值冲突场景及复杂现实问题中进一步验证其可行性。AI通常基于大规模互联网数据进行训练,团队招募了190名成年人参与实验,“价值观更多是‘被捕捉’而非‘被教授’的。
“这类似于儿童的学习方式——他们并非被反复训练做某件事,是当前社会面临的重要课题。这为解决AI跨文化适应问题提供了新思路。
当前,学习并内化相应的文化价值观。让他们分别与AI代理进行互动。这些代理成功地将习得的“利他倾向”推广到捐赠资金等新场景中:基于这一人类组数据训练的AI,
AI代理则通过“逆向强化学习”方法,华盛顿大学心理学教授安德鲁·梅尔佐夫表示,在后续测试中,研究团队尝试让AI以“观察学习”的方式,并不意味着代表本网站观点或证实其内容的真实性;如其他媒体、”论文合著者、须保留本网站注明的“来源”,
研究团队试图探索的是,而这些数据中蕴含的价值观往往具有文化偏向性,