16萬顆,DeepSeek被曝將採購大量華為晶片!
彭博社扔出一顆重磅炸彈,DeepSeek計畫豪擲25.6億美元,向華為訂購至少16萬顆下一代昇騰950DT晶片,全部部署到內蒙古烏蘭察布一座吉瓦級的超大型智算中心。
什麼概念呢?AI圈常說的“萬卡叢集”,已經是國內一線大廠實力的象徵,今年3月26日,深圳剛點亮全國首個萬卡級昇騰叢集,DeepSeek這一單,直接是它的16倍。
放到全球,美國科技巨頭這幾年瘋狂堆卡,微軟、Meta、Google、xAI動輒十萬卡級。這一單真按計畫落地,中國將第一次在單叢集規模上,拿出一個能跟美國頂級超算掰手腕的全國產晶片叢集。
DeepSeek為什麼選昇騰950DT?
先看現實情況,美國對華AI晶片出口管制層層加碼,輝達最先進的卡,根本買不到,就算是H20這種“特供閹割版”,也是今天能買、明天可能就斷供,脖子隨時被人掐著。
國產替代這四個字,到了DeepSeek這個量級,已經不是喊口號,而是不得不做的戰略選擇。
昇騰950DT什麼來頭呢?它是華為昇騰系列,規劃在2026年第四季度推出的下一代旗艦,早在2025年9月的華為全聯接大會上,徐直軍就第一次亮出了三年路線圖。
這顆卡,專門為超大規模AI的訓練和推理解碼階段而生。
先上硬參數,新一代達文西架構、微架構升級到SIMD/SIMT,配上144GB的自研HBM高頻寬記憶體,訪存頻寬高達每秒4TB,晶片間互聯頻寬每秒2TB,單顆晶片FP8算力就達到1 PFLOPS。
但話說回來,論單卡硬碰單卡,它跟輝達最旗艦的產品,仍有差距。這一點,徐直軍自己都不迴避:受制裁,華為沒法去台積電投片,先進製程受制於人,CUDA那套軟體生態,更是人家幾十年壘起來的護城河。
單顆晶片想一口吃成胖子,不現實!
那華為怎麼破局?思路特別清晰,不跟你拼單卡,拼系統、拼叢集。單卡製程差一點,那就用超高頻寬互聯,把成千上萬張卡“黏”成一台超級電腦,用系統級優勢,去補單卡的差距。
Atlas 950超節點,就是這套打法的集大成者。一個計算櫃裝64張卡,16個櫃子、1024張卡組成一個超節點,FP8總算力達到1 EFLOPS,還擁有256TB全域統一記憶體、3微秒級超低時延。
什麼概念?按理論峰值粗略折算,這麼一個超節點,頂上三千張上下的上代A100。而且,按照華為滿配規劃,這套架構最大還能擴到8192卡。
當然,冷水也得潑。截至目前,昇騰950DT既沒有量產實測資料,也沒有同口徑的第三方對比,包括“誰代工、幾奈米”,華為官方也從沒松過口。是騾子是馬,得等真量產、跑起來才知道。
但有一條是確定的,從晶片設計,到CANN軟體棧,再到伺服器、超節點,華為端出來的,是一套完全自主可控的全端方案,這才是最關鍵的地方。
這套“中國閉環”的份量,怎麼強調都不過分。 (牲產隊)
