跳到正文
原文
OpenAI News·· 2017-06-13AI 评分38

OpenAI 与 DeepMind 合作开发基于人类偏好的算法

Learning from human preferences

AI 导读

OpenAI 联合 DeepMind 安全团队推出一种新算法,通过比较两种行为优劣来推断人类意图。该方法旨在消除人工编写目标函数的需求,避免因使用复杂目标的简单代理或定义偏差导致危险行为,是构建安全 AI 系统的一步。

来源:OpenAI News · openai.com