
Flip It
Googleは今月初めに歴史を作った。一部の人が人工知能の未来における画期的な瞬間だと主張する出来事である。Googleが達成したのは、AlphaGoが囲碁チャンピオンの李世乭を破り、機械に対する人間の排他性の最後の痕跡の一つを取り除いたことである。
競技者:
AlphaGoは、ロンドンを拠点とする人工知能企業Google DeepMindが、ボードゲームの囲碁をプレイするために開発したコンピュータープログラムである。2015年10月には、ハンディキャップなしでフルサイズの19×19盤でプロの囲碁棋士を打ち負かした初のコンピューター囲碁プログラムとなった。
李世乭(イ・セドル、1983年3月2日生まれ)は、9段の韓国のプロ囲碁棋士である。2016年2月現在、国際タイトルでは李昌鎬に次ぐ2位であり、過去10年間で世界最高の棋士と見なされている。
5番勝負で、イ・セドルはGoogleのプログラムに一度だけ勝利し、第4局で完全な敗北を阻止した。AlphaGoの勝利は、1994年に陥落したチェッカー、1997年のチェス、2011年のJeopardyの王座に加わることになる。さて、これを知らなかった人々のために、これが何を意味するのか、いくつかの文脈を説明しよう。2014年まで、専門家は、ほぼ無限の可能性のため、コンピューターが囲碁に勝つことは不可能だと考えていた。
このゲームは複雑で、あっという間に複雑になる。チェスでは最初のラウンドの後、約400通りの手があるが、囲碁ではなんと129,960通りもある。チェスでは各ターンで35通りの手があるが、囲碁では250通りである。専門家間の典型的なゲームは、約150手続く。つまり、各ゲームには208168199381979984699478633344862770286522453884530548425639456820927419612738015378525648451698
519643907259916015628128546089888314427129715319317557736620397247064840935通りの可能性がある。

驚くべきことに、観測可能な宇宙に含まれる原子の数よりも、囲碁のゲームにおける可能な組み合わせの数の方が少ないのである。これを理解しやすいように言うと、1年間には3200万秒あり、1秒間に1手打つとして、1日16時間プレイしても4700万手を打つのに2年以上かかる。これは1048のオーダーであり、勝利に必要なテラフロップス(もちろん数字である)の兆単位に近い計算ができるコンピューターはまだ存在しない。
この考え方は、AlphaGoのすべての先祖にとって問題の核心であった。すべての手の解決策を決定するのに十分なコンピューターの能力がなく、すべての手を処理するのにほぼ無限の時間がかかってしまう。世界クラスの人間プレイヤーに勝つためには、AlphaGoプログラムは実際にプレイ方法を学び、そして人間との対局で適応的にプレイする必要があった。これは、思考と問題解決にかなり似ている。
これを行うために、AlphaGoは2種類のAI技術を使用している。
- モンテカルロ木探索:これは、ランダムに手を選び、ゲームの最後までシミュレーションして、勝利戦略を見つけるものである。
- ディープニューラルネットワーク:ニューロンのような接続からなる12層のネットワークで、次の手を選択する「ポリシーネットワーク」と、ゲームの勝者を予測する「バリューネットワーク」で構成されている。

2500年前の古代中国で生まれた囲碁は、皇帝や将軍に愛された娯楽である。囲碁は当初は単純に見えた。単なる碁盤、2人のプレイヤー、2つの石だけである。プレイヤー1は黒石を使い、プレイヤー2は白石を使い、交互に陣地を奪い合う。チェスと同様に、決定論的な完全情報ゲームであり、最高のプレイヤーが常に勝利する。隠されたものや偶然の要素は一切ない。
AIがどれほど急速に発展したかを示すために、1994年にカスパロフがIBMのディープ・ブルーに敗れたとき、囲碁プログラムは堅実なアマチュアにすら勝てなかった。
AlphaGoは良い手と悪い手でプログラミングされたのではなく、オンライン囲碁対局のデータベースを研究することで、80年間ぶっ通しで囲碁を打ち続けたのと同等の経験を得た。
AlphaGoのエンジニアは、約3000万通りの組み合わせや手をプログラムに読み込ませ、その後、AlphaGo自身が何千もの対局を行った。これにより、AlphaGoは毎回何百万もの手を検討する必要がなくなり、最適な手を非常に迅速に絞り込むことができるようになった。
実際、第4局では、イ・セドルはこのことを利用し、「楔(くさび)」と呼ばれる奇妙な手を打った。これにより、多くの可能性が残り、AlphaGoを混乱させ、イ・セドルが勝利することができた。また、序盤のやり取りから、イ・セドルが第5局の最終局に勝利したかに見えたが、果敢に戦ったものの、最終的にはAlphaGoの優れた技術力に屈した。
このことは、DeepMindプログラムに興味深い未来があることも意味する。なぜなら、まだ完璧にはほど遠いからである。
囲碁のゲームはソリティアのようなものだ。