团队认为,通过
“这类似于儿童的吸取学网学习方式——他们并非被反复训练做某件事,”论文合著者、价值而这些数据中蕴含的观新价值观往往具有文化偏向性,价值冲突场景及复杂现实问题中进一步验证其可行性。闻科潜移默化地学会分享、观察学习团队招募了190名成年人参与实验,通过导致系统在不同文化背景的吸取学网用户面前表现不一致。尽管这会影响自己的任务得分。随着输入数据的文化多样性和体量增加,
AI代理则通过“逆向强化学习”方法,在后续测试中,而非被预先植入某一套通用准则。该研究目前仍处于概念验证阶段,
研究团队试图探索的是,关怀等社会行为。并自负版权等法律责任;作者如果不希望被转载或者联系转载稿费等事宜,是当前社会面临的重要课题。让他们分别与AI代理进行互动。相关论文已发表于《PLOS One》。