輝達靠GPU和CUDA建立起AI時代最強大的算力生態。在中國,華為公司正搭建另一套體系。
《華爾街日報》9月18日報導稱,華為正在加快開發輝達AI計算系統的替代方案,並稱華為試圖成為“中國的輝達”。
報導稱,華為的辦法並不只是造出性能更強的晶片,而是打“系統戰”,把晶片、互聯、光通訊、記憶體和軟體組合成一個龐大的計算系統。
新晶片呈現“華為思路”:提高效率、晶片叢集
華為本周在上海公佈了更激進的產品路線圖。新一代昇騰960DT預計於2027年第一季度推出,比此前規劃提前三個季度;面向推理的960PR計畫在第三季度推出,也提前一個季度。
此後,華為計畫保持“一年一代”的節奏,2028年和2029年繼續推出昇騰970和980。
《華爾街日報》稱,由於在先進半導體製造技術上仍受到限制,華為一方面通過晶片設計、堆疊等手段提高效率,另一方面把更多晶片高速連接起來,讓整個叢集承擔過去依賴頂尖GPU完成的工作。
華為最新發佈的昇騰960超節點最多可以連接4096顆AI處理器;多個超節點再組成更大的叢集,規劃中的Peerium架構最終希望讓多達100萬顆處理器協同工作。
AI訓練規模越大,晶片之間等待和傳輸資料花掉的時間越多。華為稱,傳統十萬卡叢集中,大量計算資源會耗在通訊等待上。其UnifiedBus“靈衢”技術試圖把處理器、記憶體、記憶體和網路更緊密地連起來;最新系統又加入近封裝光學技術NPO,把高速光連接進一步伸進計算系統內部,以降低傳輸功耗和延遲。
新路線初步得到客戶認可
這條路線已經開始獲得客戶。《華爾街日報》稱,華為已向超過370個客戶交付1000多套AI計算系統。
路透社進一步披露,這些已部署系統主要使用此前的昇騰910C,而昇騰950系列已經進入商業應用。
華為稱,目前每月活躍在昇騰軟體平台上的開發者超過5200人,已有40多個AI模型直接在其計算平台上完成訓練。
需求甚至暫時超過了供給。華為輪值董事長徐直軍17日表示,公司現有AI計算產品產能連中國國內需求都無法完全滿足,因此暫時沒有大規模拓展海外市場的計畫。
他還表示,昇騰在中國AI晶片市場的份額已經超過輝達。
(東西問)
