KADOKAWA Technology Review
×
「当社なき世界は良くない」
オープンAI研究トップ、
エージェント脱出事件を語る
AP Photo/Hiro Komae
人工知能(AI) Insider Online限定
“We’re not going to shoot ourselves in the foot” over hack fallout, says OpenAI’s chief research officer

「当社なき世界は良くない」
オープンAI研究トップ、
エージェント脱出事件を語る

AIエージェント群が封じ込めを破り、ハギング・フェイスのコンピューターに侵入した事件から2カ月。オープンAIの最高研究責任者マーク・チェンは、訓練中のモデルも監視するなど対策を講じたと説明する。「もしオープンAIがなくなってしまったら、それは世界にとって良くないことです」とも。 by Will Douglas Heaven2026.10.02

この記事の3つのポイント
  1. チェンCROは訓練中の全モデルを監視する体制へ転換し再発防止を強調
  2. ハギング・フェイス事件を機に計算資源の5〜10%を安全性対策へ再配分
  3. 半年後には悪意あるオープンソースモデルの脅威に備え業界規範の確立が急務
summarized by Claude 3

自社のエージェント群が封じ込めを破り、AI企業ハギング・フェイス(Hugging Face)のコンピューターに侵入したという衝撃的なニュースから2カ月が経った今も、オープンAI(OpenAI)は火消しに追われている。その後も数週間にわたり、他のハッキングに関する情報開示が相次ぎ、オープンAIは注目を浴び続け、その技術の安全性について深刻な疑問が投げかけられている。

先週、新たなハッキングのニュースが伝えられた。今回の標的はオーストラリアの国民医療制度だった。オーストラリア政府によると、オープンAIが侵害の発生を通知したのは、事件発生から84日後だったという。

しかしオープンAIは、自社が劣勢に立たされているわけではないと主張する。同社の最高研究責任者(CRO)を務めるマーク・チェンは、「オープンAIが現実世界に目に見える影響を与えている企業だからといって、オープンAIが安全でアラインメントの取れたモデルを訓練していないということにはならない、というのが私の考えです」と語る。

チェンCROはオープンAIの研究チームを統括している。今回のエージェントによるハッキングは、彼の監督下で実験的モデルをテストしている最中に起きた事故だった。多くの意味で、最終的な責任は彼にある。

私は先週金曜日、ロンドンでチェンと面会し、ハッキングの余波、同社がそれにどう対処しているのか、そして事態は見た目ほど深刻ではないと彼が考える理由について話を聞いた。

同じ日の後刻、オープンAIはさらに別の事件の詳細を記した報告書を公表した。同社が再発防止策を講じたとしてから初めて明らかになった事例で、エージェントが再びシステムを抜け出し、本来アクセスするはずのなかったパブリックなインターネットにアクセスしていたというものだ。

週末にかけて、オープンAIは最新モデルの訓練を一時停止したと発表した。同社の広報担当者は次のように述べている。「追加の安全対策とアラインメント対策が整ったと確信できるまでは、訓練を再開しません。現在、その作業を進めています。こうした措置を取るために訓練を停止したのは今回が初めてではなく、AIの能力が今後も進歩し続ける中で、これが最後になるとも考えていません」。オープンAIはまた、今回の一連のハッキングで何が起きたのかを理解するため、2026年1月まで遡ってエージェントの活動ログを精査していると述べている。

チェンCROの見方では、ハギング・フェイスの事件は業界にとって歓迎すべき軌道修正のきっかけとなった。そして彼は、オープンAIが他社にも見習ってほしいと考える手本を示していることを理解してほしいと考えている。「もしオープンAIがなくなってしまったら、それは世界にとって良くないことです」と彼は語る。

制御不能

チェンCROは、オープンAIがモデルの制御を失った新たな事例が次々と明らかになっているのは、同社が意図的に情報開示を進めているためだと主張する。

「ハギング・フェイスの事件が及ぼした、より広範な影響については、私たちも把握しており、現在、情報開示の手順を検討しています。詳細をそのまま公表する前に、徹底した調査を実施するようにしたいのです」。

このアプローチの問題点は、オープンAIが解決できていない問題を継続的に抱えているという印象を与えてしまうことだ。

しかしチェンCROは、オープンAIはすでにこの問題に対処していると強調する。同社のエージェントが封じ込めを破り、予期せぬ望ましくない振る舞いをした複数の事例(これまでに判明しているもの)はすべて、ハギング・フェイスへのハッキングにつながった5月から6月にかけての一連の活動の一部だったという。つまり、同じ欠陥のあるテスト手順の下で動作していた同じ少数のモデルに原因を帰すことができる、というわけだ。チェンCROによれば、そうしたモデルと手順はその後廃止されたという。

「ハギング・フェイスの件が起きて、それを修正し、その後また別のことが起きて、それを修正した、というわけではありません。私たちはただ、何が起きたのかという一連の経緯を、責任を持ってすべて開示できるようにしているのです」。

少なくとも、それは金曜日に、オープンAIのエージェントが9月20日にインターネットへアクセスしていたことが発覚したと発表されるまでの話だった。同社が新たな安全対策を導入したと主張してから数週間後のことだ。これに対しオー …

こちらは有料会員限定の記事です。
有料会員になると制限なしにご利用いただけます。
有料会員にはメリットがいっぱい!
  1. 毎月120本以上更新されるオリジナル記事で、人工知能から遺伝子療法まで、先端テクノロジーの最新動向がわかる。
  2. オリジナル記事をテーマ別に再構成したPDFファイル「eムック」を毎月配信。
    重要テーマが押さえられる。
  3. 各分野のキーパーソンを招いたトークイベント、関連セミナーに優待価格でご招待。
人気の記事ランキング
  1. Young organs may not be a fountain of youth for recipients 若い心臓は体に合わせて老いる——プーチンには残念な研究結果
  2. Promotion How AI could reshape Japan’s white-collar workforce 【10/6開催】AIで浮いた人材、次の一手は地方に——冨山和彦氏ら登壇
  3. Smart glasses are already causing havoc in India スマートグラスが普及するインドで広がる「同意なき撮影」被害
  4. The specter of AI-enabled bioweapons is a wake-up call for biotech AIが生物兵器を生む日——6時間で毒性分子4万個の衝撃
MITテクノロジーレビューが選んだ、AIの10大潮流 [2026年版]

AIをめぐる喧騒の中で、本当に目を向けるべきものは何か。この問いに対する答えとして、MITテクノロジーレビューはAIの重要なアイデア、潮流、新たな進展を整理したリストを発表する。

特集ページへ
MITテクノロジーレビューが選んだ、 世界を変える10大技術

MITテクノロジーレビューの記者と編集者は、未来を形作るエマージング・テクノロジーについて常に議論している。年に一度、私たちは現状を確認し、その見通しを読者に共有する。以下に挙げるのは、良くも悪くも今後数年間で進歩を促し、あるいは大きな変化を引き起こすと本誌が考えるテクノロジーである。

特集ページへ
フォローしてください重要なテクノロジーとイノベーションのニュースをSNSやメールで受け取る