跳到正文
原文
OpenAI News·· 2017-07-20精选AI 评分63

OpenAI 发布 Proximal Policy Optimization 强化学习算法

Proximal Policy Optimization

AI 导读

OpenAI 发布 Proximal Policy Optimization 强化学习算法,其性能与现有最先进方法相当或更优,且实现与调优更简单,因此成为 OpenAI 内部默认的强化学习算法。

推荐理由

该算法实现简洁且易于调优,已成为 OpenAI 强化学习工作的默认方法,适合需要低成本落地的工程参考。

来源:OpenAI News · openai.com