米OpenAIは、米半導体大手Broadcomとの共同開発による初の自社設計カスタム推論AIチップ「Jalapeño(ハラペーニョ)」の性能検証結果を公表しました。
本チップは大規模言語モデル(LLM)の推論処理に特化したASICであり、ベンチマークテストにおいてNVIDIAの最上位ラックシステム(GB200 / GB300)と比較して1.5〜1.9倍のワットあたり処理性能(電力効率)を達成。
応答遅延(レイテンシ)を1.7〜3.6倍削減することに成功しました。
AI設計自動化ツールを活用し約16ヶ月という異例の短期間でテープアウトを達成。
ChatGPTやCodexの爆発的な推論トラフィックを自社シリコンへ移行させることで、高騰する外部GPUインフラ依存からの脱却と推論コストの大幅低減を加速させます(一次ソース:OpenAI Technical Blog / SemiAnalysis報道)。
