OpenAI は現地時間 8 月 25 日、スタンフォード大学で開催された Hot Chips 2026 で、Broadcom と共同開発する初のカスタム推論 ASIC「Jalapeño」の初回ベンチマークを公開しました。初報は 6 月 24 日の共同発表。今回は SemiAnalysis の推論ベンチ「InferenceX」で Nvidia GB200 / GB300 と比較した具体的な数値が示されました。

主なポイント

  • GPT-OSS 120B、DeepSeek R1、Kimi K2.5 1T の 3 モデルで、Nvidia GB200 / GB300 比で電力効率 1.5〜1.9 倍、レイテンシ 1.7〜3.6 倍改善を主張
  • ChatGPT のような対話型 (低レイテンシ) 用途では GB300 比で 2.1〜4.1 倍高速との数値も提示
  • チップ TDP は 700W。1,400W クラスの GB300 と比べても消費電力効率で優位と説明
  • 学習は行わない推論専用 ASIC で、既存の Nvidia GPU と併存する構成
  • 量産は 2026 年末から少量で開始、2027 年に本格立ち上げ

出典: OpenAI’s Jalapeño chip is built for fast inference at scale, benchmarks show