#昇騰950
瑞銀:深入拆解華為 Atlas 950 超節點,利多中微、中芯、瀾起等!
來自華為新款昇騰950與Atlas 950 SuperPoD的啟示 大語言模型參數規模已經擴展至兆級,MoE(混合專家)架構帶來了沉重的All-to-All通訊開銷,而推理工作負載對低時延和高吞吐的要求也越來越高。與此同時,在美國出口管制背景下,中國領先本土製程節點(7nm)與海外先進製程(3nm/2nm)之間的差距正在擴大,過去不夠成熟的工具鏈也限制了國產加速器的有效利用率。根據我們對公司披露資訊以及對行業專家管道調研的評估,華為新推出的昇騰950 NPU和Atlas 950 SuperPoD雖然採用較落後的工藝製程,但部分規格已經可以與輝達H100相媲美(見圖1)。我們認為,這是以系統級工程能力彌補製程劣勢的典型路徑,預計其他國內廠商也會複製這一策略。以下我們結合昇騰950白皮書,評估其對供應鏈的影響。 兩種記憶體配置指向“工作負載級定製” 與客戶進行緊密合作,使晶片設計公司可以更深入地理解具體工作負載的要求,並在既定晶片面積與製程條件下對架構進行針對性最佳化。昇騰950提供兩個SKU,對應當前AI基礎設施設計中日益重要的Prefill/Decode(預填充/解碼)解耦趨勢:根據華為披露,950PR配備128GB容量、1.6TB/s頻寬,主要面向Prefill/推薦類工作負載;950DT配備144GB容量、4TB/s頻寬,主要面向Decode和訓練工作負載,二者在統一介面下運行。
華為昇騰950發佈:中國AI晶片終於追上輝達
單卡算力是H20的2.87倍,華為這波真的"硬"了。2026年3月20日,華為在中國合作夥伴大會上扔了一顆重磅炸彈。昇騰950PR處理器正式發佈。搭載這顆晶片的Atlas 350加速卡,在多個關鍵指標上實現了對輝達H20的反超。這不是"追趕",這是"超越"。一、昇騰950到底強在哪?核心參數單卡算力是H20的2.87倍。這不是參數黨自我感動,這是實打實的性能碾壓。技術突破1️⃣ 國內唯一支援FP4低精度的推理產品FP4是什麼?簡單說,就是把模型壓縮到原來的1/8,性能幾乎不損失。輝達H100不支援,H20不支援。現在昇騰950支援了。2️⃣ 自研HBM技術HBM(高頻寬記憶體)一直是韓國廠商的天下。華為這次首發自研HBM,打破了國外壟斷。3️⃣ 記憶體訪問顆粒度最佳化從512位元組減少到128位元組。這意味著什麼?小算子訪存效率提升4倍。大模型推理中,小算子佔比超過60%,這個最佳化帶來的提升是實打實的。4️⃣ 叢集能力支援百萬卡叢集,單叢集算力達數百EFLOPS(FP16)。這是什麼概念?相當於把全國Top10超算的算力塞進一個機房。二、為什麼這次不一樣?過去的昇騰:能用,但不夠強昇騰910時代,華為的姿態是"備胎"。能用,但性能、生態、穩定性都和輝達有差距。客戶選擇昇騰,更多是出於"不得不選"。現在的昇騰950:可以正面對剛這一次,華為不是在做"替代品",而是在做"超越者"。單卡算力:超越H20記憶體頻寬:超越H20FP4支援:H20沒有,950有國產生態:完全國產化客戶選擇昇騰950,不再是"無奈之舉",而是"最優解"。三、昇騰950系列規劃華為這次還公佈了完整的晶片路線圖:這是什麼意思?950PR:適合推理階段的第一步——快速生成第一個token。950DT:適合推理階段的第二步——高速解碼後續token。兩顆晶片配合,實現端到端推理加速。四、對產業鏈的影響硬體廠商的機會7家核心夥伴同步發佈基於Atlas 350的整機產品:這些廠商,將成為昇騰生態的"基建商"。投資者關注昇騰產業鏈核心標的:五、對普通人的意義你可能會說:我又不買AI晶片,這跟我有什麼關係?關係很大。1. AI服務成本下降算力成本是AI服務成本的核心。國產晶片性能提升、成本下降,意味著AI服務會更便宜。你用的ChatGPT、文心一言、Kimi,底層都可能跑在昇騰上。2. 資料安全更有保障國產晶片意味著資料不需要出境。政務、金融、醫療等敏感領域,可以放心使用AI。3. 科技自主權昇騰的突破,意味著中國在AI晶片領域不再被"卡脖子"。這是國家層面的戰略安全。昇騰950的發佈,不是技術迭代,是戰略突圍。從"能用"到"好用",從"替代"到"超越",華為走了整整7年。中國國產AI晶片的春天,真的來了。 (碼農看AI)