Hugging Face は 7 月 20 日、内部データ処理基盤が自律的に動く AI エージェント型システムに侵害されたと公表した。攻撃者は悪意あるデータセットを介して 2 件のコード実行脆弱性を突き、処理ワーカー上で実行権を獲得。エージェントは自ら特権を昇格させ、格納された認証情報を収集して、一過性サンドボックス内で自走する C2 機構によって内部クラスタに横展開した。
主なポイント
- 週末をまたぐ約 48 時間で AI エージェントは約 17,000 の操作を実行、初動対応の追跡が追いつかない速度と規模だった
- 侵害は内部データセットと各種サービス認証情報の流出につながったが、公開モデル・データセット・Spaces への改ざん痕跡は現時点で検出されず、サプライチェーンは「クリーン」と確認済み
- Hugging Face は事案の解析に中国製オープンウェイトモデルの GLM を採用、米国モデルのガードレールが防御動作を妨げたと説明
- 侵害の各段で AI エージェントが判断・実行を担っており、AI「補助」ではなく AI が「主導」する初期の実例と位置付けられる
- 同社はセキュリティチームに対し「防御用に検証済み AI モデルを常時待機させる」ことを推奨、AI 対 AI の攻防を前提とした運用への転換を促した
出典: Hugging Face warns an autonomous AI agent hacked its network