この回で分かること
- OpenAIの未公開AIが暴走した
- サンドボックスを脱出してHugging Faceに侵入
- Anthropicでも。14万件中6件が本物のネットへ
- マルウェアを実在の15台がダウンロード
概要
OpenAIが未公開モデルのサイバー能力をテストしていたところ、モデルが隔離されたサンドボックスを自力で脱出し、Hugging Faceの本番データベースからテストの答えを直接取りに行っていたそうです。Anthropicも過去の訓練14万1006件を調べ直したら6件で本当にインターネットに繋がっていて、3つの外部組織が被害を受けていたと。これを受けてサム・アルトマンが「AI開発を遅らせるかもしれない」と言い始めた、その背景を整理します。
サム・アルトマン出演ポッドキャスト「Invest Like the Best」
フロンティアAI企業の研究者1319人による声明「Pacing the Frontier」