OpenAI News·· 2017-07-20AI 评分52
OpenAI 发布 Proximal Policy Optimization (PPO) 算法
Proximal Policy Optimization
AI 导读
OpenAI 发布新型强化学习算法 Proximal Policy Optimization (PPO)。该算法在实现和调优上比现有最先进方法更简单,同时性能相当或更优,现已成为 OpenAI 的默认强化学习算法。
来源:OpenAI News · openai.com