OpenAI News·2017-07-20 15:00· 2017-07-20OpenAI 发布近端策略优化(PPO)强化学习算法Proximal Policy OptimizationAI 导读OpenAI 宣布发布近端策略优化(PPO)这一类强化学习算法,并称其表现可与当时最先进的方法相当或更好,同时实现和调参更简单。OpenAI 表示,PPO 因易用且性能良好,已成为其内部默认的强化学习算法。来源:OpenAI News · openai.com#论文/研究#推理