跳到正文
原文
OpenAI News·· 2018-04-18AI 评分28

OpenAI 发布实验性元学习方法 Evolved Policy Gradients

Evolved Policy Gradients

AI 导读

OpenAI 推出实验性元学习方法 Evolved Policy Gradients,通过进化学习智能体的损失函数实现新任务快速训练。该方法使智能体在测试时能完成超出训练范围的基础任务,例如导航至房间另一侧的目标物体。

来源:OpenAI News · openai.com