围棋世界第一的中国九段棋手柯洁,今年5月与人工智能程式AlphaGo对决,最终三战全败。而开发AlphaGo的公司DeepMind,周四(19日)发布一款新版本的AlphaGo程式“AlphaGo Zero”。经过大约40天的训练后,“AlphaGo Zero”击败曾战胜柯洁的版本AlphaGo Master。

柯洁得悉后亦不禁赞叹,并在网上留言称:“一个纯净、纯粹自我学习的AlphaGo是最强的...对于AlphaGo的自我进步来讲...人类太多馀了。”
据了解,AlphaGo的前几代版本,一开始都从人类棋手的棋谱开始,进行训练和学习围棋。而最新版本的AlphaGo Zero则跳过这个步骤,通过自我对弈学习下棋,完全从乱下开始,可说是“从一张白纸开始”。
经过三天、数百万盘的训练,AlphaGo Zero以100比0的必胜姿态击败AlphaGo Lee。AlphaGo Lee是去年击败了南韩选手李世石的版本。经过约40天的训练、约2900万场自我对弈,AlphaGo Zero击败AlphaGo Master。
评论 (0)