8月25日,Hot Chips 2026大會上,OpenAI正式公開首款自研推理專用ASIC Jalapeño 的實測測試結果。在限定推理場景基準測試之下,這款與博通聯合開發的專用晶片,單位功耗吞吐量、端到端延遲指標優於輝達GB200/GB300系統。
但需要明確:該晶片定位純推理加速器,不承擔模型訓練任務,且僅供OpenAI內部部署,不會對外銷售;OpenAI同時強調,輝達依舊是核心算力合作夥伴,並非簡單的“替代關係”。
當大模型行業的重心,逐步從昂貴的預訓練,轉向海量使用者請求構成的推理側,算力成本、響應延遲,已經成為頭部AI企業最棘手的現實瓶頸。OpenAI交出的解法,不再只是採購更多高端GPU,而是下場自研專用推理晶片。
根據OpenAI官方部落格與Hot Chips大會披露資訊,Jalapeño由OpenAI硬體團隊聯合博通共同開發,台積電3nm工藝製造,採用脈動陣列架構,搭載HBM4高頻寬記憶體,晶片定位純粹面向大語言模型推理,不支援大模型訓練工作負載。