豪擲25.6億美元,DeepSeek大量採購華為晶片?

AI速讀
DeepSeek 擬豪擲 25.6 億美元採購 16 萬顆華為昇騰 950DT 晶片,於內蒙古打造超大型智算中心。此舉是在美國 AI 晶片禁令下,由口號轉為實際行動的戰略選擇。華為採取「拼系統而非拼單卡」的策略,利用超高頻寬互聯將萬卡級叢集黏合成超級電腦,以系統級優勢補足製程差距。儘管量產數據尚待驗證,但此舉象徵中國正試圖建立一套從晶片設計到伺服器的完全自主 AI 算力閉環,挑戰美國科技巨頭的算力領先地位。

16萬顆,DeepSeek被曝將採購大量華為晶片!

彭博社扔出一顆重磅炸彈,DeepSeek計畫豪擲25.6億美元,向華為訂購至少16萬顆下一代昇騰950DT晶片,全部部署到內蒙古烏蘭察布一座吉瓦級的超大型智算中心。

什麼概念呢?AI圈常說的“萬卡叢集”,已經是國內一線大廠實力的象徵,今年3月26日,深圳剛點亮全國首個萬卡級昇騰叢集,DeepSeek這一單,直接是它的16倍。

放到全球,美國科技巨頭這幾年瘋狂堆卡,微軟、Meta、Google、xAI動輒十萬卡級。這一單真按計畫落地,中國將第一次在單叢集規模上,拿出一個能跟美國頂級超算掰手腕的全國產晶片叢集。

DeepSeek為什麼選昇騰950DT?

先看現實情況,美國對華AI晶片出口管制層層加碼,輝達最先進的卡,根本買不到,就算是H20這種“特供閹割版”,也是今天能買、明天可能就斷供,脖子隨時被人掐著。

國產替代這四個字,到了DeepSeek這個量級,已經不是喊口號,而是不得不做的戰略選擇。

昇騰950DT什麼來頭呢?它是華為昇騰系列,規劃在2026年第四季度推出的下一代旗艦,早在2025年9月的華為全聯接大會上,徐直軍就第一次亮出了三年路線圖。

這顆卡,專門為超大規模AI的訓練和推理解碼階段而生。

先上硬參數,新一代達文西架構、微架構升級到SIMD/SIMT,配上144GB的自研HBM高頻寬記憶體,訪存頻寬高達每秒4TB,晶片間互聯頻寬每秒2TB,單顆晶片FP8算力就達到1 PFLOPS。

但話說回來,論單卡硬碰單卡,它跟輝達最旗艦的產品,仍有差距。這一點,徐直軍自己都不迴避:受制裁,華為沒法去台積電投片,先進製程受制於人,CUDA那套軟體生態,更是人家幾十年壘起來的護城河。

單顆晶片想一口吃成胖子,不現實!

那華為怎麼破局?思路特別清晰,不跟你拼單卡,拼系統、拼叢集。單卡製程差一點,那就用超高頻寬互聯,把成千上萬張卡“黏”成一台超級電腦,用系統級優勢,去補單卡的差距。

Atlas 950超節點,就是這套打法的集大成者。一個計算櫃裝64張卡,16個櫃子、1024張卡組成一個超節點,FP8總算力達到1 EFLOPS,還擁有256TB全域統一記憶體、3微秒級超低時延。

什麼概念?按理論峰值粗略折算,這麼一個超節點,頂上三千張上下的上代A100。而且,按照華為滿配規劃,這套架構最大還能擴到8192卡。

當然,冷水也得潑。截至目前,昇騰950DT既沒有量產實測資料,也沒有同口徑的第三方對比,包括“誰代工、幾奈米”,華為官方也從沒松過口。是騾子是馬,得等真量產、跑起來才知道。

但有一條是確定的,從晶片設計,到CANN軟體棧,再到伺服器、超節點,華為端出來的,是一套完全自主可控的全端方案,這才是最關鍵的地方。

這套“中國閉環”的份量,怎麼強調都不過分。 (牲產隊)