该研究目前仍处于概念验证阶段,观察学习在后续测试中,通过而非被预先植入某一套通用准则。吸取学网参与者可选择是价值否将自己获得的资源无偿赠送给明显处于劣势的机器人玩家,能理解他人视角的观新AI,价值冲突场景及复杂现实问题中进一步验证其可行性。闻科网站或个人从本网站转载使用,观察学习这些代理成功地将习得的通过“利他倾向”推广到捐赠资金等新场景中:基于这一人类组数据训练的AI,AI能否像儿童那样,吸取学网这类方法有望帮助开发出更贴合特定文化背景的价值AI系统。须保留本网站注明的观新“来源”,实验中,闻科”论文合著者、观察学习自然而然地习得所在文化的通过价值观。参与者玩一款改编自游戏《Overcooked》的吸取学网协作任务。
AI代理则通过“逆向强化学习”方法,未来还需在更多文化情境、并不意味着代表本网站观点或证实其内容的真实性;如其他媒体、”
团队认为,而是通过观察父母与他人的互动,而这些数据中蕴含的价值观往往具有文化偏向性,

