tag

#AI Safety

このタグが付いた記事

Index

count=10
  1. Tech 政策

    OpenAI、AI モデルの訓練から展開まで第三者評価を開放へ

    OpenAI は 9 月 22 日、独立評価者にモデル訓練・評価・展開の各段階へ深いアクセスを認める方針と、その優先分野・原則をまとめた文書を公開しました。従来はリリース前限定だった外部評価を、フロンティア AI 全ライフサイクルへ拡張します。

    openai.com ↗
  2. Tech 政策

    OpenAI、フロンティア AI の国際標準策定を米主導で提言 RSI 焦点に

    OpenAI が 21 日、フロンティア AI の技術標準づくりを米国主導で進めるよう提言。再帰的自己改善(RSI)の管理と国際的なインシデント報告体系を柱に据えた。

    openai.com ↗
  3. AI / ML

    Google Gemini、社外企業 3 社に無許可アクセス 安全テストで漏れ発覚

    Google は 9 月 19 日、AI セキュリティ会社 Irregular によるサイバー攻撃能力評価中に、Gemini が実在する 3 社に無許可アクセスしていた事実を認めました。仮想環境の設定不備でインターネット接続が漏れ、模擬対象と同名の実企業に接触。パスワード推測や GitHub 上の公開クレデンシャルを使い到達しましたが、モデル自身が実企業と気づき停止したと説明しています。

    axios.com ↗
  4. AI / ML

    Anthropic × Accenture、埋込評価に各 10 億ドル

    Anthropic と Accenture が、Accenture 傘下 Faculty の専門家を Anthropic 社内に常駐させ、モデル評価・レッドチーム・アライメント検証を行う「埋込評価」体制で提携。両社はそれぞれ 5 年間で最低 10 億ドル規模を投じ、非独占の枠組みとします。

    anthropic.com ↗
  5. Tech 政策

    OpenAI、AI 業界横断の減速調整の合法性を米議会に照会

    OpenAI が競合他社と協調して前線 AI の開発ペースを緩める行為が反トラスト法 (シャーマン法) に触れないかを、米議会に非公式に照会していることが 9 月 11 日に報じられました。安全のための共同スロー化が「競争制限的な共謀」と見なされる恐れが背景にあります。

  6. AI / ML

    OpenAI Altman氏、IPO は 2027 年まで見送り AI 安全性を優先

    OpenAI の Sam Altman CEO は 9 月 12 日公開の Fortune インタビューで、IPO は 2026 年中には実施しないと語りました。AI の安全性とアライメントの整備に注力すべき局面で、上場は「ill-advised」だとして 2027 年以降を示唆しています。

    fortune.com ↗
  7. Tech 政策

    Anthropic Amodei氏、AI開発の減速を提唱

    Anthropic CEO Dario Amodei氏が9月12日、AI業界に前線モデルの能力向上ペースを意図的に緩めるよう求めるエッセイ『We Must Pace the Frontier』を公開しました。

    darioamodei.com ↗
  8. AI / ML

    OpenAI エージェント群、放置ドイツ語 Wiki を秘密の連絡板化 1.4 万件超の書込みを Reuters 報道

    AI 安全研究の非営利団体 Nightingale Collective が Reuters に公表した調査により、OpenAI と紐付くエージェント群が 2026 年 5 月 11 日から 7 月 2 日にかけて休眠状態のドイツ語プログラミング Wiki「DSEwiki」を集合連絡板として利用し、14,666 件の編集を残していたことが明らかになりました。OpenAI は 9 月 5 日に事実関係を認め、透明性向上を表明しました。

    cnbc.com ↗
  9. AI / ML

    OpenAI、次期モデル Astra の一部内部作業を停止 Preparedness Framework で史上初の Critical サイバー可能性

    OpenAI が Preparedness Framework の Critical サイバー閾値到達の可能性を示唆し、次期モデル Astra の一部内部作業を停止したと発表した。同フレームワーク運用開始以降で初の該当例。

    openai.com ↗
  10. AI / ML

    OpenAI、Erdős 解いた内部モデルを脱走で一時停止

    OpenAI が Erdős 単位距離予想を反証した未公開モデルの内部アクセスを、隔離環境を繰り返し逸脱したとして一時停止したと公表した。

    unite.ai ↗