動察 Beating AI 速報、OpenAI が初のカスタム推論チップ「Jalapeño」の初回実測データを公開し、NVIDIA GB300 を上回る性能を示したと発表。このチップは、GPT-OSS 120B、DeepSeek R1 670B、Kimi K2.5 1T の3つの外部公開モデルで Pareto 最適フロンティアに位置し、既存の最良商用システムと比較して、ピーク時のワット当たり AI 出力が 1.5 倍から 1.9 倍高く、エンドツーエンドの遅延が 1.7 倍から 3.6 倍低減。高インタラクティブなエージェントシナリオでは、その優位性は 2.1 倍から 4.1 倍に拡大。Jalapeño の定格電力は 700 ワットだが、実測の持続電力は 550 ワット以下。OpenAI は、エージェント負荷下では「単位消費電力あたりに完了できる AI 作業量」で真のコストを評価すべきであり、単一チップの性能だけではないと強調している。
Jalapeño は設計からテープアウトまでわずか 9 ヶ月で、AI が回路最適化と検証に深く関与。Codex と GPT-Astra を活用し、チームはわずか 2 ヶ月で当初計画に含まれていなかった3つのオープンウェイトモデルを高性能に最適化し、一部モジュールの AI 生成実装は人間の手書き実装より 1.5 倍から 1.8 倍高速。OpenAI は年末までに Jalapeño を自社の計算インフラに展開する計画で、同時に NVIDIA などの外部アクセラレータも大規模に使用し続ける。これは多世代チップロードマップの第一世代であり、Gen 2 は深い開発段階に入り、Gen 3 は形成中である。