Anthropic が「フロンティア安全ロードマップ」で自ら設定した Provable Inference フェーズ 1 の期限、2026 年 9 月 30 日が、公式のブログ投稿やリリースなしに過ぎました。モデル出力をモデル重みに紐づけて署名し、学習後の改竄を検知する基礎研究で、安全優先の象徴とされていた目標です。
主なポイント
- Provable Inference は AI 出力を特定のモデル重みと暗号的に紐づけ、第三者が「正当なモデルから出た応答か」を検証できるようにする構想。フェーズ 1 は構成要素・コスト・工程表を棚卸しする計画段階で、製品化そのものではない。
- 当初の期限は 2026 年 5 月 15 日だったが、5 月 5 日に「レベルアップ施策へのリソース集中」を理由に 9 月 30 日へ延期された経緯がある。
- 期限当日は Life Sciences Verification Program や GLM-5.3 の脅威分析報告など他の発表はあったが、Provable Inference の進捗には触れなかった。
- IPO 準備と大型モデルの供給拡大が重なるなか、安全系プロジェクトの優先度低下を示唆するシグナルとして注視されている。
出典: Anthropic's Provable-Inference Deadline Arrived Today. The Company Has Not Said a Word.