Google DeepMind·· 2017-10-18
DeepMind 发布 AlphaGo Zero:从随机对弈中自我学习
AlphaGo Zero: Starting from scratch
AI 导读
DeepMind 于 2017 年介绍 AlphaGo Zero:该系统不使用人类棋谱,从随机对弈开始,通过自我对弈和强化学习学习围棋。文中称它迅速超越人类水平,并以 100 比 0 击败此前击败过人类世界冠军的 AlphaGo 版本;其输入仅为棋盘黑白子,并将策略与价值功能合并在一个神经网络中。
来源:Google DeepMind · deepmind.google