OpenAI News·2018-04-18 15:00· 2018-04-18AI 评分28OpenAI 发布实验性元学习方法 Evolved Policy GradientsEvolved Policy GradientsAI 导读OpenAI 推出实验性元学习方法 Evolved Policy Gradients,通过进化学习智能体的损失函数实现新任务快速训练。该方法使智能体在测试时能完成超出训练范围的基础任务,例如导航至房间另一侧的目标物体。来源:OpenAI News · openai.com#论文/研究#数据/训练#OpenAI