在AMD “Advancing AI 2026大會”前夕,輝達搶先公佈了資料中心CPU產品Vera的更多技術細節。
這不僅是輝達繼Grace之後在CPU領域的又一重磅落子,更是其從“賣顯示卡”向“賣AI工廠”垂直整合戰略的徹底攤牌——
Vera是全球首款從核心層面專為代理式AI(Agentic AI)量身定製的處理器。
輝達還透露,Vera Rubin NVL72已進入量產爬坡階段,該平台的供應鏈覆蓋了全球350多個工廠、30個國家,超過300家合作夥伴參與其中。
Olympus架構細節全公開
當地時間7月21日,輝達發佈博文,從技術角度詳細介紹了Vera CPU。
文中指出,智能體AI(Agentic AI)將更多關鍵執行路徑轉移到了CPU上。
智能體(Agents)在沙箱中運行程式碼、呼叫工具、檢索上下文、與資料庫互動並分析結果,然後再將資訊返回給模型。
這一過程意味著,CPU不再只是“輔助加速器”,而是成為了AI工廠中控制密集型循環的核心執行者。
智能體AI工作負載主要依賴於:
即使插槽滿載,單線程性能依然強勁;
每個核心擁有足夠的記憶體頻寬,以保證多個活躍執行上下文的資料;
並行下延遲可預測,以便智能體能夠穩定完成預定步驟;
高效處理不規則控制流、長依賴鏈和指針密集的資料結構。
輝達強調,Vera CPU圍繞智能體AI負載設計,重點提升滿負載條件下的單線程表現,設計核心是Olympus核心。
為了應對智能體複雜的分支預測挑戰,Olympus核心引入了一個關鍵的黑科技:神經分支預測器(Neural Branch Predictor)。
配合10-wide的解碼引擎,它能高效處理智能體執行階段的複雜邏輯。
單顆Vera整合了88個這樣的核心,支援176個線程,但設計重心明顯偏向“寬發射、深流水線”。
此外,Vera也是首款在CPU核心中支援FP8精度的處理器,進一步打通了與GPU之間的數值計算壁壘。
除了算力,記憶體頻寬往往是智能體並行執行的隱形殺手。
Vera採用了創新的SOCAMM2 LPDDR5X記憶體方案,實現了1.2TB/s的驚人頻寬。
這是傳統DDR5伺服器的兩倍,而功耗卻不到後者的一半。
在測試中,Vera能維持90%的峰值頻寬,確保了即便在數千個智能體並行時,資料供給也不會掉隊。
根據輝達公佈的基準測試,Vera針對智能體負載的最佳化效果顯著:
單線程性能:在滿載情況下,Vera的單核性能可達傳統x86 CPU的1.8倍
任務效率:AI智能體任務綜合性能提升約50%,沙箱環境運行速度提升顯著。
並行能力:支援多達1.6倍的並行智能體運行,編排速度提升高達2.2倍。
編譯速度:單顆Vera編譯Linux核心僅需約20秒,每核編譯效率約為128核頂級x86伺服器的2倍。
輝達新的增長曲線
長期以來,輝達被市場牢牢貼上“GPU巨頭”的標籤,但翻開最新的財報與產品路線圖,另一個新的訊號已經釋放——
它正在系統性地擺脫對單一GPU銷售的依賴,圍繞AI基礎設施的全端化佈局,打開了多條GPU之外的新收入曲線。
其中,網路互聯業務是增長最迅猛的一條曲線。
2027財年第一季度,輝達資料中心網路收入創下148億美元的紀錄,同比暴增199%。
隨著AI叢集從千卡邁向十萬卡規模,NVLink、InfiniBand與Spectrum-X已成為建構“AI工廠”的剛需。
網路業務佔資料中心總收入的比重已攀升至約20%,這標誌著輝達已不僅僅是賣算力的公司,更是賣“連接”的公司,用物理層面的互聯壁壘鎖死了系統級競爭力。
緊隨其後的是自研CPU業務。隨著專為智能體AI設計的Vera CPU於2026年6月交付OpenAI、Anthropic等頭部客戶,輝達正式殺入了由英特爾與AMD長期統治的伺服器CPU腹地。
黃仁勳曾表示:“Vera打開了一個全新的市場,CPU讓智能體等待的每一刻,都是整棟建築裡最昂貴的東西GPU處於閒置狀態的一刻。”
輝達從零開始打造了一顆全新的、面向智能體的CPU。
這是一個新市場,智能體CPU要求超快響應,未來會有數十億個智能體,它們需要為自己而打造的CPU。
輝達副總裁兼CFO科萊特·克雷斯曾透露,預計輝達2027財年CPU總收入有望接近200億美元,這使輝達有機會成為全球領先的CPU供應商。
在未來的增長敘事中,Vera CPU與Rubin GPU的放量是最主要的增長動力。 (格隆匯APP)
