ディープマインド(DeepMind)の研究者ヴォロジーミル・ムニは、アタリ2600の50本近いビデオゲーム(ポン(Pong)やスペースインベーダーなどを含む)を、人間と同レベルでプレイできる初のシステムを作った人物である。強化学習によってプレイ方法を学び、深層学習を使って人間の学習プロセスを反映させることで上達していくという、2つのアプローチが初めて組み合わせた。人間がプレイ中に試行錯誤を重ねてテクニックを磨き、徐々にスコアアップを目指すように、システムがゲームを学んだのだ。
(サイモン・パーキン)
- 人気の記事ランキング
-
- Trump’s AI protectionism has come for robotics 中国製ロボットを締め出す米国、その研究は中国製で回っている
- How an overlooked geothermal plant got a second chance もっと深く掘れ——採算割れの地熱発電所を米新興企業が再生
- How lasers could help provide fuel for nuclear reactors 核廃棄物は「地上ウラン鉱山」、レーザー濃縮で再生を狙う
- A fundamental flaw leaves LLMs strikingly vulnerable to attack 「思考の連鎖」偽装でLLMを騙す新手法、訓練では防げない構造的欠陥