Re Reference AI

モデル

AlphaGoとは

アルファ碁

深層学習とモンテカルロ木探索を組み合わせ、囲碁で人間のトップ棋士に初めて勝利したGoogle DeepMindのAI

強化学習探索アルゴリズム

ひとことで言うと

囲碁で世界トップ棋士に初めて勝ったAI。「AIはまだ囲碁では人間に勝てない」という常識を覆し、AIブームの象徴になった。

概要

AlphaGoとは、Google DeepMindが開発した囲碁AIで、深層学習モンテカルロ木探索を組み合わせ、人間のトップ棋士に初めて勝利したシステムを指す。 盤面の評価と着手の選択をニューラルネットワークで行い、探索と組み合わせる構成で、長く人間優位が続くとされていた囲碁を攻略した。 2017年の後継AlphaGo Zeroは、人間の棋譜を使わず自己対戦のみで学習し、元のAlphaGoを上回った。 深層強化学習の可能性を広く示した節目として、AIの歴史で語られる。

歴史

2016年3月に李世乭(イ・セドル)九段との五番勝負に4勝1敗で勝利した。2017年には自己対戦のみで学習するAlphaGo Zeroが発表された。

関連用語

モンテカルロ木探索強化学習Q学習深層学習

関連Zenn記事