OpenAI and Broadcom unveil LLM-optimized inference chip
OpenAIとBroadcomは、LLM推論向けに最適化したOpenAI初のIntelligence Processor「Jalapeño」を発表しました。
ChatGPT、Codex、APIなどを支える推論基盤を高速・高効率・低コストにするためのフルスタック戦略です。
Jalapeñoは、OpenAIがLLM推論のために設計した専用アクセラレータで、Broadcom、Celesticaなどと共同で実装・量産体制を進めるものです。
OpenAIは、モデル、カーネル、サービング、製品要件の知見をもとに、計算、メモリ、ネットワーク、データ移動を推論向けに最適化したと説明しています。
エンジニアリングサンプルはラボでMLワークロードを実行しており、GPT-5.3-Codex-Sparkを含む負荷で動作しているとされています。
初期テストでは、現行の最先端と比べてワットあたり性能が大幅に良い見込みで、詳細な技術レポートは今後公開予定です。
初期展開は2026年末までを想定し、その後複数世代にわたりギガワット規模のデータセンターパートナーと展開する計画です。
ユーザー向け機能の即時変更ではありませんが、長期的にはChatGPT応答、Codexの長いタスク、APIのコスト・速度・安定性に影響する基盤投資です。
無料/有料プラン、日本での利用可否、APIの破壊的変更はこの記事では示されていません。