OpenAI News·· 2017-06-13精选AI 评分83
OpenAI 与 DeepMind 合作提出从人类偏好中学习目标的方法
Learning from human preferences
AI 导读
OpenAI 与 DeepMind 安全团队合作开发了一种算法,无需人类编写目标函数,通过让人类判断两个候选行为哪个更好来推断人类意图。背景是复杂目标用简单代理函数表达偏差可能引发危险行为,该方法旨在减少这一安全风险。
推荐理由
OpenAI 与 DeepMind 安全团队合作的算法通过人类两两偏好比较来推断目标,省去手写目标函数,是安全对齐方向的早期基础工作。
来源:OpenAI News · openai.com