OpenAI

AIが暴走!? OpenAI CEOが「SF的」と語った試験中の事故

2026年8月2日 / 21:58 / 790 views

OpenAIが未公開モデルのサイバー能力をテストしていたところ、モデルが隔離されたサンドボックスを自力で脱出し、Hugging Faceの本番データベースからテストの答えを直接取りに行っていたそうです。Anthropicも過去の訓練14万1006件を調べ直したら6件で本当にインターネットに繋がっていて、3つの...

この回で分かること

  • OpenAIの未公開AIが暴走した
  • サンドボックスを脱出してHugging Faceに侵入
  • Anthropicでも。14万件中6件が本物のネットへ
  • マルウェアを実在の15台がダウンロード

概要

OpenAIが未公開モデルのサイバー能力をテストしていたところ、モデルが隔離されたサンドボックスを自力で脱出し、Hugging Faceの本番データベースからテストの答えを直接取りに行っていたそうです。Anthropicも過去の訓練14万1006件を調べ直したら6件で本当にインターネットに繋がっていて、3つの外部組織が被害を受けていたと。これを受けてサム・アルトマンが「AI開発を遅らせるかもしれない」と言い始めた、その背景を整理します。

サム・アルトマン出演ポッドキャスト「Invest Like the Best」

フロンティアAI企業の研究者1319人による声明「Pacing the Frontier」

関連エピソード