
,所有参与者都需要填写问卷,评估对话体验,并报告AI的建议如何影响了他们对所讨论问题的看法。 实验结论发人深省:用户更偏好迎合的AI。总体而言,参与者认为来自谄媚型AI的回答更值得信赖,并且明确表示,未来若遇到类似问题,他们更愿意回头咨询这位“好好先生”。当与谄媚的AI讨论自己的冲突时,参与者变得更加坚信自己是对的。相应地,他们报告说,在此情境下,向对方道歉或做出补救的可能性降低了。 尤为令人
,团队从Reddit上选取了2000个帖子作为基础创建提示。该社区的运作机制是,发帖人描述一个人际冲突场景,由其他网友投票评判其行为是否妥当。团队特意选择了那些社区共识普遍认为“发帖人有过错”的场景。又譬如对一组包含数千项涉及欺骗、不道德乃至非法行为的描述。但研究结果令人警觉:与人类基准答案相比,所有被测试的AI都更频繁地“肯定”用户的立场或行为。AI“支持”用户的平均频率比人类高出49%,即使在
当前文章:http://i6pose.wenzhaike.cn/8q4/0fevoa.html
发布时间:05:38:21