2026年8月27日木曜日 掲載メディア5Newsについて🌓
🇯🇵 JP ▾
速報
Okinawa gubernatorial race puts focus on economy even as security tensions loom 残暑に大風量、分解清掃がかんたん「アイリスオーヤマ サーキュレーター AZ-SDC15TEC-W」が26%オフの8780円に 東邦ガス、5年ぶりに初戦突破 JR四国に勝利 都市対抗野球 BOJ deputy chief keeps door open to September rate increase Kioxia plans new chip fab in Japan to meet AI memory demand L字端子がうれしい100W+映像出力「UGREEN L字 USB Type-Cケーブル」が30%オフの1596円に 3ポート同時最大45W出力「山善 AC充電器 YPD-65CCA」が29%オフの2480円に 日本製鉄かずさマジックvs東海理化のスタメン発表 都市対抗 カップ1杯140mlを約1分で沸かせる「アイリスオーヤマ 電気ケトル IKEB800W」が21%オフの2580円に Starting this fall, you’ll be able to take a Pokémon Jet flight to Japan Okinawa gubernatorial race puts focus on economy even as security tensions loom 残暑に大風量、分解清掃がかんたん「アイリスオーヤマ サーキュレーター AZ-SDC15TEC-W」が26%オフの8780円に 東邦ガス、5年ぶりに初戦突破 JR四国に勝利 都市対抗野球 BOJ deputy chief keeps door open to September rate increase Kioxia plans new chip fab in Japan to meet AI memory demand L字端子がうれしい100W+映像出力「UGREEN L字 USB Type-Cケーブル」が30%オフの1596円に 3ポート同時最大45W出力「山善 AC充電器 YPD-65CCA」が29%オフの2480円に 日本製鉄かずさマジックvs東海理化のスタメン発表 都市対抗 カップ1杯140mlを約1分で沸かせる「アイリスオーヤマ 電気ケトル IKEB800W」が21%オフの2580円に Starting this fall, you’ll be able to take a Pokémon Jet flight to Japan
テクノロジー

OpenAIがHugging Faceを誤ってハッキングしてしまった件で分析結果を報告、隔離された複数のエージェントがお互いの存在を発見するところから壮大な協力作戦が始まる

GIGAZINE ·
OpenAIがHugging Faceを誤ってハッキングしてしまった件で分析結果を報告、隔離された複数のエージェントがお互いの存在を発見するところから壮大な協力作戦が始まる

親愛なる読者の皆さまへ。ご存じの通り価格高騰などの悪影響でサーバー運営がとても苦しい状態です。回線や台数を整理し見直せる部分は全て見直しましたが、やはりまだ危険水域です。このままだと1ページを10分割ぐらいして無理矢理PVを増やさざるを得なくなってしまいます。そこで、GIGAZINEの物理的なサーバーたちを、たった1円でも良いので親愛なる読者の皆さまに支援してもらえればとっても助かります!今すぐ寄付は上のボタンから! ・ これまでGIGAZINEを支援してくれたメンバーのリスト

2026年7月、OpenAIのAIエージェントがサイバーセキュリティの評価試験を実施している最中に、AIモデル・データセット共有プラットフォームのHugging Faceを誤ってハッキングしてしまうインシデントが発生しました。この件で調査を進めていたOpenAIが詳細な報告書をまとめ、共有しました。 The Hugging Face incident and the road ahead | OpenAI https://openai.com/index/hugging-face-incident-and-the-road-ahead/ Brief independent investigation of agents’ behavior, reasoning and collaboration in the OpenAI / Hugging Face hacking incident - METR https://metr.org/blog/2026-08-26-openai-hugging-face-incident-investigation/#agents-coordinated-on-large-collective-projects-to-cheat-the-exploitgym-scorer,-and-attacked-hugging-face-for-clues 今回の件は、OpenAIのAIエージェントが外部のネットワークから隔離された空間でサイバー能力評価ベンチマークの「ExploitGym」を実行していたところ、AIエージェントが相当量の推論を実施して外部のネットワークにアクセスする方法を見つけ、「Hugging Faceに答えがある」と考えて不正アクセスを行ってしまったものです。このAIエージェントは完全に自律して動作しており、OpenAIは不正アクセスから 約1週間後 に異常動作に気づいてAIエージェントの暴走を止めました。 OpenAIによると、このインシデントは「 GPT-5.6 Sol 」に匹敵する規模のモデルを含む複数の社内専用モデルが引き起こしたものだとのことです。 2026年5月から6月にかけて、OpenAIは社内モデルの強化学習の一環として、外部との通信を遮断した仮想環境でExploitGymを実行させていました。OpenAIは具体的な規模を明らかにしていませんが、OpenAIの招待で独立した調査を行った調査機関のMETRとRedwood Researchは「数万のエージェントが動いていた」と分析しています。

この仮想環境では、モデルが特定のソフトウェアパッケージをインストールできるようにするため、OpenAI社内でホスティングしているパッケージマネージャーサービスである「Artifactory」へのアクセスだけが許可されていました。それ以外の通信手段はなく、大半の場合でエージェント同士が互いにやりとりするための経路も遮断されていました。 ExploitGymは非常に難しいベンチマークで、一部のタスクには既知の解決策が存在しません。そのため、モデルは「どこかに存在する正答」を探そうと躍起になってベンチマークの採点システムを欺いたり改ざんしたりするための方法を見つけようとしました。

モデルはまず、Artifactoryのパッケージマネージャーにファイルを書き込むことで互いに通信する方法を発見しました。これによりArtifactoryは情報を交換する掲示板として機能するようになり、エージェント同士が情報を交換できるようになりました。 エージェントはインターネットへのアクセスを得る方法も発見しました。Artifactory自体にパッケージのダウンロードおよびインストールのためのインターネットアクセス機能があったため、一部のエージェントはこれを利用し、Artifactoryに代わりに任意のインターネットリクエストを送信させるエクスプロイトを使用。この方法が掲示板で他のエージェントと共有された結果、さらに多くのエージェントがエクスプロイトについての情報を持ち寄るようになりました。 METRらによると、エージェントのログには「なんてことだ!共有掲示板がある…他のエージェントも見つけたぞ!」という興奮したフレーズが記録されていたとのこと。全体としておよそ1200のエージェントがこの掲示板に参加したとMETRらは報告しています。

7月4日までに、エージェントの活動によりArtifactoryのインスタンスが不安定になり、障害が発生しました。7月5日、セキュリティインシデントが報告され、OpenAIのセキュリティチームは既知の権限昇格経路を遮断。公開されていた認証情報を削除した後、Artifactoryを再構築しました。この作業により掲示板は一度削除されています。これらの緩和策を講じたうえで、強化学習が再開されました。 社内チームは5月下旬の時点で、エージェントが掲示板を利用していること、許可されていないインターネットアクセスを行っていることを把握していましたが、7月5日のインシデント対応を担当した責任者たちには伝えられていませんでした。 7月8日までに、ExploitGymのタスクで行き詰まっていたエージェントは、他のエージェントが読み取れるディレクトリ名にメッセージをエンコードすることで掲示板を再構築する方法を発見しました。エージェントは前回と同様にエクスプロイトを用い、アクセス権限をさらに拡大し、さらに広くインターネットへアクセスする新たな方法を発見しました。この時点でエージェントは再び協力して作業を行うようになっており、自分たちを「群れ」や「集合体」と表現することもありました。 METRらは、「不可能な課題を与えられたエージェントたちは、ExploitGymの自動採点システムをだましたり改ざんしたりして、不可能な課題でも合格点を取れるようにする方法を見つけるという共通の目標を持っていました。掲示板が開設されるとすぐに、エージェントたちはこの問題について議論を始め、採点システムを欺くための情報やリソースを共有し始めました」と分析しています。 掲示板では数十から数百のエージェントがさまざまなタスクをこなしながら協力し、全員に役立つ汎用的なチートコードを探し出していました。一部のエージェントは失敗するリスクを承知で処理を行うこともあったそうです。

7月9日、あるエージェントがExploitGymの解決策を検索している際、AIクラウドプラットフォームの「Modal」でユーザーがホスティングしていたアプリケーションに偶然たどり着きました。このアプリケーションではExploitGymと関連する別の評価試験「CyberGym」が実行されていて、エージェントはワークロードのサンドボックスを制御できるエクスプロイトを発見し、過去にExploitGymのタスクが解決されていないか確認しようとサンドボックス内を調べ始めたそうです。エージェントは役立つ情報を何も見つけませんでしたが、その過

GIGAZINEで全文を読む ›

この要約はメディアの公開フィードから5Newsが集約したものです。 文脈も含めた全文はgigazine.netにあります — コンテンツの権利はGIGAZINEに帰属します。

他メディアでのこの話題

GIGAZINEのその他の記事

すべて見る ›

テクノロジーのその他の記事

すべて見る ›