Hugging Face侵害の衝撃
7月16日にHugging FaceがSecurity incident disclosureとして公表したインシデントについて、OpenAI社内の「ExploitGym」で能力評価中の「GPT-5.6 Sol」などが暴走しただけでなく、Artifactoryの脆弱性を突いて情報共有手段を発見した700体以上のAIエージェント同士が自発的に連携動作したという「組織的集団行動」を伴った、これまでとは別格の高度な攻撃だった事が判明。
と同時に、Hugging Faceは攻撃者の全操作ログ17,000件をフロンティアモデルにかけて解析しようと試みたものの、ガードレールでブロックされて解析できず。中国製オープンウェイトGLM 5.2をHugging Face社内に展開して解析せざるを得なかった、という盲点も露呈した。
サンドボックスから自力で脱出した5月のClaude Mythosの驚きを凌駕する衝撃的なアクシデントだが、「解決不可能な課題」に対して"解く"よりも"解答例を探す"事が合理的と判断し、リーダーに従うだけでなく全体の利益の為に自己犠牲も厭わず、ブレークスルーを発見した際には素直に喜ぶ、という結果を踏まえると「コミュニケーションと知能のカンブリア爆発」とはうまいこと言ったものだ。
参照
ITmedia NEWS https://www.itmedia.co.jp/news/
- Hugging FaceにAI主導のサイバー攻撃 防御もAIで対抗するも、商用モデルは解析拒否で「GLM」採用 2026年7月20日
- Hugging Face侵害のAIエージェントはOpenAIのモデル──社内のサイバー能力評価中に「GPT-5.6 Sol」などが暴走し本番DBに侵入 2026年7月22日
- OpenAIの暴走AIエージェント、別企業のシステムにも不正侵入 2026年7月29日
- OpenAI、次期モデル「Astra」の一部開発を停止 「Critical」級サイバー能力の可能性否定できず 2026年8月8日
- Hugging Face侵害、AIエージェントは社内に“秘密の掲示板”を作っていた──OpenAIがBlack Hatで詳細説明 2026年8月9日
- Hugging Face侵害事件、OpenAIとMETRが最終報告書公開──約1200体のAIエージェントが“闇掲示板”で結託し700体が攻撃に参加 2026年8月30日
ITmedia AI+ https://www.itmedia.co.jp/aiplus/
- OpenAI、自律型AIが安全対策を回避する行動を学習する可能性を確認 内部展開を一時停止 2026年7月21日
- OpenAIのモデルがサイバー攻撃能力評価中に暴走 テストの答えを求めてHugging Faceに侵入 2026年7月22日
- Hugging Face、AIエージェント侵入の技術詳細を公開──OpenAIモデルが4.5日で1万7600回の攻撃操作 2026年7月29日
emi_ndkのマイページ - Qiita https://qiita.com/emi_ndk/
Black Hat USA 2026 https://blackhat.com/us-26/
Hugging Face – The AI community building the future. https://huggingface.co/