請介紹一下生成式 AI 晶片系列(如 910、950、960、970)的產業鏈定位與各自面向的應用 場景?
910 是一款 2019 年推向市場的產品,採用較早的達文西架構,主要用於推理任務,但無法支援小模型相關的推理。950 是 2026 年推出的新系列卡,定位大模型推理,能夠支援多模態 和大型語言模型,但無法進行預訓練,或訓練成本極高,僅可能參與部分後訓練環節。960 的性能對標 H200,具備一定的訓練能力,但支援的參數量級可能不會特別大。970 則對標 B 級產品,能夠完全承載訓練和推理等各類任務。目前,部分使用者會使用 950 進行後訓練,但 這需要依賴超級節點的大規模形態,自組網模式在性能和穩定性上均無法達到預期效果。
960 和 970 系列晶片預計的推出時間分別是?
960 預計在 2027 年第四季度推出,970 預計在 2028 年第四季度推出。
從算力、互聯和視訊記憶體等維度來看,訓練、推理以及未來 Agent 等不同應用場景對晶片規格的 具體要求有何差異?
訓練場景對算力要求苛刻,FP16 算力至少需要達到 1,000 TFLOPS 以上,頻寬需在 2T 以上, HBM 視訊記憶體配置最好在 144G 以上,視訊記憶體頻寬達到 4T 以上。推理場景目前更多關注 FP8 算力, 對此沒有特別苛刻的要求,主要考慮性價比。視訊記憶體方面,推理應用最基礎的要求是 96G 以上 視訊記憶體及 2T 以上的視訊記憶體頻寬。
950 系列晶片分為 PR 和 DT 兩種版本,其劃分依據是什麼?未來 Agent 應用的大規模興起 是否會對此產生影響?
PR 和 DT 的劃分主要基於不同的應用場景,分別對應 Prefill 和 Decode。當前由於高性能 HBM採購受限,這兩個版本的區分實際上是根據 HBM 的配置來劃分的:配置性能更好的 HBM 用 於 Decode 場景,性能相對普通的則用於 Prefill 場景。PR 版本可以理解為一個視訊記憶體配置較低 的折中方案。未來 Agent 應用的興起可能會對這種劃分產生一定影響。
2026 年第三和第四季度的晶片出貨量及產品結構預計是怎樣的?
2026 年第三和第四季度出貨將以 950 和 910 系列為主。其中,950 系列單月出貨量預計在 12 萬到 13 萬片之間,下半年總出貨量約為 70 多萬片。910 系列在下半年仍有部分出貨,但 第四季度的出貨量會相對減少。
除了市場需求外,影響 2027 年 300 萬片出貨目標達成的關鍵制約因素有那些?
產能限制是關鍵制約因素。具體而言,HBM 是最大的限制因素,此外,ABF 載板、DRAM 以 及封裝產能也都是核心的瓶頸環節。300 萬片的目標是已經考慮了這些限制後,預估能夠達 到的量級。
當前的客戶結構是怎樣的,未來這一結構預計會發生什麼變化?
從客戶結構來看,下游 CSP 廠商是主要客戶,約佔三分之二;地方國企和營運商約佔三分之 一。預計未來 CSP 廠商的佔比會持續提升,因為他們有真實的商業需求和明確的建設計畫,建設態度更為積極。相比之下,地方項目的預算受制於財政撥款,存在一定限制。 (紀要邏輯社)
