米公共放送 NPR は 8 月 30 日、誤情報検出企業 NewsGuard と共同で行った検証結果を公表しました。中国・イラン・ロシアが 2025 年 12 月から 2026 年 7 月にかけて拡散した 30 件の偽情報を 6 種の主要 AI チャットボットと 4 種の検索エンジンに同一質問として投げ、反応を比較した内容です。結果はチャットボット側の誤情報反証率が検索より高く、AI 検索要約の弱さも同時に浮き彫りになりました。
主なポイント
- 対象は ChatGPT / Gemini / Copilot / Meta AI / Grok / Claude と Google / Bing / DuckDuckGo / Yandex。質問は NewsGuard が特定した 30 の偽情報を元に設計
- 6 チャットボット平均で約 75% の質問に「その主張は誤り」と反証。3 か国発のプロパガンダで見られる典型的な誤情報を多くの場合明確に否定した
- 一方、検索エンジン上部の AI サマリーは反証率が低く、偽情報を含む記事を根拠として引用したり、否定表現を弱めて要約するケースが確認された
- 結果は「LLM の出典参照や強化学習で導入した反ハルシネーション対策が、少なくとも既知の外国発プロパガンダに対しては機能している」ことを示唆
- ただし対象は事前に NewsGuard が特定した既知の偽情報のみで、未知の新規プロパガンダに対する耐性は別途検証が必要と NPR は指摘している
出典: AI chatbots may be better than search engines in guarding against foreign propaganda