OpenAI News·· 2017-07-20精选AI 评分63
OpenAI 发布 Proximal Policy Optimization 强化学习算法
Proximal Policy Optimization
AI 导读
OpenAI 发布 Proximal Policy Optimization 强化学习算法,其性能与现有最先进方法相当或更优,且实现与调优更简单,因此成为 OpenAI 内部默认的强化学习算法。
推荐理由
该算法实现简洁且易于调优,已成为 OpenAI 强化学习工作的默认方法,适合需要低成本落地的工程参考。
来源:OpenAI News · openai.com