AlphaGo

AlphaGo

AlphaGoとは

AlphaGo(アルファ碁)は、Google DeepMindが開発した囲碁AIプログラムです。2016年3月に韓国のプロ棋士イ・セドル九段を4勝1敗で破り、AIが人間の最高レベルの知的ゲームで勝利できることを世界に証明しました。

表:AlphaGoの要点まとめ
ひとことで言うと2016年に囲碁のトップ棋士に勝利した、DeepMindの囲碁AI。
なぜ画期的だったか囲碁は選択肢が多すぎて、AIが人間に勝つのは何十年も先と言われていた。
注意点深層学習と探索を組み合わせたことが勝因。単独技術では到達できなかった。

技術的な革新

AlphaGoは、深層ニューラルネットワークとモンテカルロ木探索を組み合わせた革新的なアプローチを採用しました。ポリシーネットワーク(次の手を予測)とバリューネットワーク(局面の評価)という2つの深層学習モデルを使用し、さらに自己対局による強化学習で棋力を向上させました。

図:AlphaGoの勝利までの道のり
1囲碁は不可能と言われた選択肢が天文学的
▶
2棋譜から学習人間の手を模倣
▶
3自己対戦で強化何百万局も打つ
▶
4探索と組み合わせ有望な手だけ深く読む
▶
52016年 人間に勝利世界に衝撃

社会的インパクト

囲碁は局面数が宇宙の原子の数より多いとされ、AIが人間に勝つのはまだ数十年先と考えられていました。AlphaGoの勝利は世界的なニュースとなり、特にアジアでは大きな衝撃を与えました。中国はこの出来事をきっかけにAI国家戦略を加速させたとも言われています。

その後の進化

2017年にはAlphaGo Zeroが人間の棋譜を一切使わず、自己対局のみで旧AlphaGoを上回る強さを達成しました。さらにAlphaZeroはチェスや将棋にも適用され、汎用性を実証しました。AlphaGoの技術はその後、タンパク質構造予測のAlphaFoldなど、DeepMindの他の画期的な研究にも応用されています。