Anthropic は 2026 年 9 月 10 日、Threat Intelligence チームによる四半期次の報告書「Countering misuse of AI: September 2026」を公開しました。2025 年 12 月から 2026 年 8 月までの約 8 か月間に、Claude を用いたサイバー攻撃・影響工作・監視・詐欺・生物兵器関連・通常兵器開発・不正な蒸留の 7 領域で悪用を検知し、アカウント停止や検知強化などの対応を実施したと報告しています。人間が介在する「vibe hacking」から、モデル自身がスクリプト生成・実行・要約を反復する自動化型攻撃への移行が観測されたとしています。
主なポイント
- ロシア Midnight Blizzard と整合する GTG-20006 は AI で開発・インフラ・フィッシング・持続化・C2・データ流出を自動化し、ウクライナ政府・軍・外交機関など 20 以上を標的にした
- 湖南省長沙拠点とみられる中国語話者グループは教育・小売・エネルギー・金融・製造など約 50 組織を狙った
- 検知回避のためマルウェアを自動書き換える仕組みや、300,000 件超の国民 ID 記録の窃取事例も報告
- Anthropic は該当アカウントを無効化し、業界パートナーと当局へ情報共有、独自の安全対策を更新
- 影響工作・監視・詐欺・生物兵器情報要求などについても類型と対応を並記