バーチャル環境で「特訓」
器用な動きを自己学習する
ロボットハンド
バーチャル環境での強化学習によってロボットを日常作業に対応させるアプローチが開発された。現実世界とのギャップを埋められれば、ロボットは自ら新たなスキルを習得できるようになるかもしれない。 by Will Knight2018.08.13
人工知能(AI)研究チームが、ロボットハンドに卓越した新たなスキルを与える、自己学習アルゴリズムのデモを公開した。コンピューター・シミュレーション内で100年に相当する時間(実際には数日)をかけて練習することで、立方体を器用に扱う方法を自己自習した。
このロボットハンドの俊敏さは人間の手とはまだまだ比較にならないレベルで、工場や倉庫で利用するにはまだあまりにも不器用だ。それでもなお、この研究は機械学習によってロボットの新たな能力を発見しようとしている。さらに将来、ロボットがバーチャル世界で新たなスキルを自己学習するようになり、ロボットのプログラミングや訓練のプロセスが大幅に短縮される可能性がある。
「ダクティル(Dactyl)」と名付けられたロボット・システムを開発したのは、シリコンバレーの非営利団体オープンAI(OpenAI)の研究チームである。研究チームは、英国企業シャドウ(Shadow)が販売しているロボットハンドや市販のカメラを使い、複雑なマルチプレイヤー・ゲーム「ドータ(Dota)」の対戦で実績を上げているアルゴリズムを使っている(「「AI対人間」チーム戦でもついに人間が負け始めた」を参照)。
このアルゴリズムには、「強化学習」として知られる機械学習の技法が使われている。ダクティルには立方体を動かして別の面を上に向けるという課題が与えられ、望んだ結果を得るための動きを試行錯誤を繰り返して見出した。
ダクティ …
- 人気の記事ランキング
-
- What’s behind this summer’s heat, and why 2027 could be worse 記録ずくめの猛暑の夏、しかし本番は来年かもしれない
- Scientists just created female clones of male mice オスのマウスからメス作製、日本チームが遺伝子編集で性逆転に成功
- These startups are chasing the next big thing in LLMs トランスフォーマーに限界、 次世代LLMを担う 4つの最新アプローチ
- Flock is tightening its rules in response to a growing surveillance backlash 警察官がストーカー目的で悪用、米車両監視大手の規則強化は効くか