tag

#inference

このタグが付いた記事

Index

count=5
  1. AI / ML

    OpenAI「Jalapeño」の初ベンチ公開 Nvidia GB300 比で電力効率最大 1.9 倍

    OpenAI が Broadcom と共同開発する初の自社推論 ASIC「Jalapeño」の性能ベンチマークを Hot Chips 2026 で公開。SemiAnalysis の InferenceX で Nvidia GB300 比の電力効率とレイテンシ改善を主張した。

    techcrunch.com ↗
  2. ハードウェア

    Cerebras、CS-4 を発表 3 枚の WSE-3 Turbo を束ね GPU 比 30 倍の推論性能

    Cerebras Systems が 8/18 に新プラットフォーム「Nexus」を採用した推論システム CS-4 を発表。3 枚の WSE-3 Turbo で 750 PFLOPS を発揮し、初回出荷は今四半期中。

  3. AI / ML

    OpenAI、Cerebras 連携で GPT-5.6 Sol「Ultrafast」プレビュー 標準比 14 倍・最大 750 tok/s

    OpenAI は 8 月 13 日、フラッグシップ推論モデル GPT-5.6 Sol を Cerebras のウェハースケール基盤で走らせる「Ultrafast」プレビュー提供を開始しました。標準経路比で最大 14 倍、実測で最大 750 出力トークン/秒を謳い、金融調査・インシデント対応・音声対話など「1 秒が効く」用途を狙います。Jane Street・Podium・Basis・Rogo が初期顧客に名を連ねます。

    openai.com ↗
  4. ハードウェア

    DeepSeek、自社 AI 推論チップを開発中 ⇒ Nvidia・Huawei 依存の低減狙う (Reuters 独占)

    Reuters は 7月7日、中国の AI スタートアップ DeepSeek が自社の AI 推論向けカスタムチップを開発中と関係者 3 人の情報として独占報道しました。学習ではなく推論向けの設計で、Nvidia と華為 (Huawei) 依存の低減が狙い。プロジェクトは初期段階で、チップ設計・ファウンドリ・メモリ各社と協議中。報道を受け同日 Nasdaq Composite は寄りで 160 ポイント超下落しました。

    reuters.com ↗
  5. ハードウェア

    OpenAIとBroadcom、初の自社推論チップ「Jalapeño」発表

    OpenAIがBroadcomと共同開発した初のカスタムAI推論チップ「Jalapeño」を発表。9か月でテープアウトに到達し、2026年末から運用開始予定。

    openai.com ↗