跳到正文
原文
OpenAI News·· 2017-07-20AI 评分52

OpenAI 发布 Proximal Policy Optimization (PPO) 算法

Proximal Policy Optimization

AI 导读

OpenAI 发布新型强化学习算法 Proximal Policy Optimization (PPO)。该算法在实现和调优上比现有最先进方法更简单,同时性能相当或更优,现已成为 OpenAI 的默认强化学习算法。

来源:OpenAI News · openai.com