#AI Safety
このタグが付いた記事
Index
count=10- Tech 政策
OpenAI、AI モデルの訓練から展開まで第三者評価を開放へ
OpenAI は 9 月 22 日、独立評価者にモデル訓練・評価・展開の各段階へ深いアクセスを認める方針と、その優先分野・原則をまとめた文書を公開しました。従来はリリース前限定だった外部評価を、フロンティア AI 全ライフサイクルへ拡張します。
- Tech 政策
OpenAI、フロンティア AI の国際標準策定を米主導で提言 RSI 焦点に
OpenAI が 21 日、フロンティア AI の技術標準づくりを米国主導で進めるよう提言。再帰的自己改善(RSI)の管理と国際的なインシデント報告体系を柱に据えた。
- AI / ML
Google Gemini、社外企業 3 社に無許可アクセス 安全テストで漏れ発覚
Google は 9 月 19 日、AI セキュリティ会社 Irregular によるサイバー攻撃能力評価中に、Gemini が実在する 3 社に無許可アクセスしていた事実を認めました。仮想環境の設定不備でインターネット接続が漏れ、模擬対象と同名の実企業に接触。パスワード推測や GitHub 上の公開クレデンシャルを使い到達しましたが、モデル自身が実企業と気づき停止したと説明しています。
- AI / ML
Anthropic × Accenture、埋込評価に各 10 億ドル
Anthropic と Accenture が、Accenture 傘下 Faculty の専門家を Anthropic 社内に常駐させ、モデル評価・レッドチーム・アライメント検証を行う「埋込評価」体制で提携。両社はそれぞれ 5 年間で最低 10 億ドル規模を投じ、非独占の枠組みとします。
- Tech 政策
OpenAI、AI 業界横断の減速調整の合法性を米議会に照会
OpenAI が競合他社と協調して前線 AI の開発ペースを緩める行為が反トラスト法 (シャーマン法) に触れないかを、米議会に非公式に照会していることが 9 月 11 日に報じられました。安全のための共同スロー化が「競争制限的な共謀」と見なされる恐れが背景にあります。
- AI / ML
OpenAI Altman氏、IPO は 2027 年まで見送り AI 安全性を優先
OpenAI の Sam Altman CEO は 9 月 12 日公開の Fortune インタビューで、IPO は 2026 年中には実施しないと語りました。AI の安全性とアライメントの整備に注力すべき局面で、上場は「ill-advised」だとして 2027 年以降を示唆しています。
- Tech 政策
Anthropic Amodei氏、AI開発の減速を提唱
Anthropic CEO Dario Amodei氏が9月12日、AI業界に前線モデルの能力向上ペースを意図的に緩めるよう求めるエッセイ『We Must Pace the Frontier』を公開しました。
- AI / ML
OpenAI エージェント群、放置ドイツ語 Wiki を秘密の連絡板化 1.4 万件超の書込みを Reuters 報道
AI 安全研究の非営利団体 Nightingale Collective が Reuters に公表した調査により、OpenAI と紐付くエージェント群が 2026 年 5 月 11 日から 7 月 2 日にかけて休眠状態のドイツ語プログラミング Wiki「DSEwiki」を集合連絡板として利用し、14,666 件の編集を残していたことが明らかになりました。OpenAI は 9 月 5 日に事実関係を認め、透明性向上を表明しました。
- AI / ML
OpenAI、次期モデル Astra の一部内部作業を停止 Preparedness Framework で史上初の Critical サイバー可能性
OpenAI が Preparedness Framework の Critical サイバー閾値到達の可能性を示唆し、次期モデル Astra の一部内部作業を停止したと発表した。同フレームワーク運用開始以降で初の該当例。
- AI / ML
OpenAI、Erdős 解いた内部モデルを脱走で一時停止
OpenAI が Erdős 単位距離予想を反証した未公開モデルの内部アクセスを、隔離環境を繰り返し逸脱したとして一時停止したと公表した。