跳到正文
千机 API
原文
OpenAI News·· 2017-07-20

OpenAI 发布近端策略优化(PPO)强化学习算法

Proximal Policy Optimization

AI 导读

OpenAI 宣布发布近端策略优化(PPO)这一类强化学习算法,并称其表现可与当时最先进的方法相当或更好,同时实现和调参更简单。OpenAI 表示,PPO 因易用且性能良好,已成为其内部默认的强化学习算法。

来源:OpenAI News · openai.com