據The Information報導,輝達公司計畫於今年年底前開始向中國客戶小批次交付一款全新定製的人工智慧晶片。消息公佈後,這家半導體巨頭的股價一度上漲,但隨後漲幅縮小,最終下跌0.5%。
這款新產品是輝達語言處理單元 (LPU) 的改進版,採用 Groq 的授權技術開發而成,可與主圖形處理器協同工作,加速 AI 模型的響應速度。由於輝達的下一代 Vera Rubin 架構受美國法規限制無法出口到中國,工程師們修改了 LPU 的軟體,使其能夠與中國市場上其他可用的處理器配合使用。多家中國企業已訂購了這款裝置,這將使其與華為即將推出的 Ascend 950DT 等國產推理硬體直接競爭。然而,最終能否獲得北京方面的監管批准仍存在風險,因為中國此前曾限制進口外國晶片,以扶持國內半導體巨頭。
輝達的這一戰略舉措旨在解決中國人工智慧領域嚴重的晶片供應短缺問題。近期,嚴重的計算瓶頸迫使 Moonshot AI 暫停註冊,DeepSeek 也提高了開發者費用。由於中國最大的科技集團已將國內晶片產能鎖定至 2027 年,持續的晶片短缺為輝達提供了一個關鍵的契機,使其能夠在客戶永久轉向國產架構之前重新吸引他們。
儘管華盛頓方面實施了嚴格的出口管制,且輝達首席執行長黃仁勳此前曾表示公司已基本將中國市場拱手讓給華為,但此舉仍凸顯了輝達維護其中國市場份額的決心。報告顯示,除了LPU之外,輝達還在擴大其已獲批准的H200處理器的出貨量,其封裝合作夥伴安靠科技在第二季度完成了超過100萬顆處理器的生產,同時還在獨立開發兩款針對中國市場的低功耗遊戲晶片。
隨後,輝達發佈公開更正聲明,針對 The Information 的一篇報導。輝達表示,該報導包含有關 Groq 3 語言處理單元及其戰略方向的不精準說法。
Groq 3 LPU 究竟是什麼
輝達的GPU擅長高吞吐量訓練和批次推理,能夠同時處理海量資料。而Groq 3 LPU的目標則有所不同:它專注於低延遲、高並行的推理工作負載,也就是使用者需要即時等待AI響應的任務。
Groq 3 LPU 於 2026 年 3 月 16 日在輝達 GTC 2026 大會上正式發佈,是該公司 Vera Rubin AI 平台的一部分。每顆晶片配備 500 MB 片上 SRAM,並提供 150 TB/s 的推理頻寬。在機架級部署中,LPX 系統每個機架整合 256 顆 Groq 3 LPU,專為滿足大規模超低延遲需求而設計。
輝達已明確表示,LPU 的設計初衷是與 GPU 產品線協同工作,而非取代它們。GPU 負責繁重的訓練和批次推理任務,而 LPU 則負責處理互動式和智能體 AI 應用,在這些應用中,可預測的單次token延遲至關重要。(半導體芯聞)
