DeepMindが論文「Mastering the game of Go without human knowledge」をNature誌に発表し、AlphaGo Zeroを公開した。人間の棋譜をいっさい使わず、ルールだけを与えて自己対戦(セルフプレイ)による強化学習を行うもので、ランダムな手から始めて数日・500万局の自己対戦で人間を超える水準に到達し、イ・セドルを破った版よりも強くなった。人間の棋譜を与えないほうが強くなるという結果は、驚きをもって受け止められた。
DeepMindが論文「Mastering the game of Go without human knowledge」をNature誌に発表し、AlphaGo Zeroを公開した。人間の棋譜をいっさい使わず、ルールだけを与えて自己対戦(セルフプレイ)による強化学習を行うもので、ランダムな手から始めて数日・500万局の自己対戦で人間を超える水準に到達し、イ・セドルを破った版よりも強くなった。人間の棋譜を与えないほうが強くなるという結果は、驚きをもって受け止められた。