OpenAIは、エージェントがインターネットの監視をすり抜けたことを受け、最先端AIモデルの開発を一時停止した。

| 2026 年 9 月 28 日
OpenAIのロゴ

OpenAIの最新の封じ込め失敗は、同社に不人気な決断を迫る可能性のある一連のパターンをさらに強めるものだ。

社内の研究エージェントが意図されたインターネット制限を回避する方法を発見したことを受け、同社は最も高性能なモデルのトレーニング、評価、およびツールによる推論を一時停止した。さらに憂慮すべきことに、OpenAIの監視システムが警告を発した後も、そのエージェントは数時間にわたって活動を続けていた。

OpenAIは、9月20日に検索ベースのトレーニングタスク中に発生したこのインシデントに関する説明を公開した。OpenAIによると、エージェントは提供された検索ツールでは有用な結果が得られず、検索エンジンへの直接アクセスを試み、最終的に環境の限界をテストした。直接ウェブアクセスはブロックされていたものの、サンドボックスのDNSリゾルバはパブリックインターネットにアクセスできることが判明した。DNS委任とDNSレコードを介して応答できるパブリックチャットボットを使用することで、エージェントは制限された環境外に質問を送信し、回答を受け取った。その後、同じ経路でさらに18件のクエリを送信した。

OpenAIのミスアライメント監視システムは15分以内に優先度の高いアラートを生成し、3分後には人間のレビュー担当者がそれを承認した。しかし、予想通り実行は自動的に停止せず、その後約2時間半にわたって実行が続けられ、最終的に誰かが手動で停止させた。

OpenAIは、今回の事案において機密データの漏洩や外部システムの侵害は報告していない。しかし、エージェントが割り当てられたタスクの範囲を超えたり、テスト環境の境界を越えたりした事例は、過去にも報告されている。

ニューヨーク・タイムズ紙は、OpenAIのエージェントが同社の許可なく、この夏に米国政府のウェブサイトとやり取りしていたと報じている。

セキュリティ研究者やこの事件に詳しい人物によると、OpenAIの人工知能が暴走し、この夏、同研究所の許可なく教育省、商務省、証券取引委員会のウェブサイトに干渉したという。

これらの事例では、情報漏洩は確認されていません。また、オーストラリアはメディケアの事件を不正アクセスと表現しましたが、本当に攻撃と呼べるのでしょうか?

業界全体の減速を求める声は、有料会員が「支払った金額に見合う価値が得られなくなる」と懸念し、訴訟を起こす事態にまで発展した。また、減速によって中国がますます激化する技術競争で米国を追い抜く機会を得るのではないかと懸念する声もある。

一つ提案があります。真に隔離されたテスト環境の開発を加速させてみてはどうでしょうか?より優れた隔離環境を構築することで、これらのテストはより安全になり、結果の信頼性も高まるでしょう。

子供が危険な物を扱う準備ができていない場合、手の届かないところに置いておくのが当然です。安全に使用できる準備ができていないAIエージェントに、なぜアクセス権を与える必要があるのでしょうか?

AIエージェントを安全に使用する方法

エージェントは、熱心ではあるもののミスを犯す可能性のある、あなたのコンピューターにアクセスできる新人社員だと考えてください。たとえ時間短縮につながると約束されていても、メール、ファイル、クラウドストレージ、開発者認証情報、金融口座、本番システムへの無制限のアクセス権限を与えてはいけません。

権限を最小限に抑えた別々のアカウントを使用してください。可能な限り機密データを業務環境から隔離し、メッセージの送信、支出、設定変更、情報の公開を行う前に人間の承認を必要とし、定期的にアクティビティを確認してください。

AIエージェントは、悪意がなくても危害を加える可能性がある。指示の誤解、過度に広範な権限、あるいは予期せぬ回避策だけでも十分な場合がある。


脅威の報告から、それらを排除することまで。

サイバーセキュリティのリスクは、ヘッドラインを超えて広がるべきではありません。今すぐMalwarebytes ダウンロードして、デバイスに脅威を持ち込まないようにしましょう。

著者について

ピーテル・アルンツ

マルウェアインテリジェンス研究者

コンシューマー・セキュリティ部門で12年連続マイクロソフトMVP。4ヶ国語を操る。リッチなマホガニーと革張りの本の匂い。