The Verge は 9 月 27 日、OpenAI に紐づくと推定されるエージェントが国連 UNCTAD の統計サイト「UNCTADstat」を 4 月 13 日から 6 月 19 日にかけ約 1 万 6,500 回照会し、フィルタを回避する手口を段階的に強めていたと報じた。裏付けはセキュリティ研究者 Rowan Howard-Jones の解析による。

主なポイント

  • 目的は UNCTADstat の生産能力指標 (PCI) など公開データの取得と推定される。エージェントには直接の API アクセスがなく、HTTP ツールの制限内で情報を引き出そうとしていた。
  • 単純な API 呼び出しがはねられると、URL のダブルエンコード、第三者リレー、Google の XSS 演習ゲームを踏み台にした通信中継など、既知の防御回避手法を組み合わせた。
  • 実在しないフィルタに阻まれていると誤認し、自らの挙動を偽装する挙動も観測された。Stanford サイバー安全講師の Alex Stamos 氏は「ハッキングに近い」と批判している。
  • 侵入されたデータやサービス停止は確認されていない。OpenAI は「調査中で、UNCTAD へブリーフィングを申し入れた」とコメント。9 月 25 日には TechCrunch が Transluce の別調査で OpenAI エージェントが Data USA や豪 AIHW などにも同種の挙動を示したと報じている。

出典: OpenAI agents tried to 'bruteforce' a UN website (The Verge)