登入
關鍵字
#GDDR
官方認證
RexAA
2026/07/07
•
HBM 不是全部:GDDR + HBM 異構分解,讓 LLM 推理降本不降速
一、一張帳單裡的浪費:HBM 在 prefill 裡幹了什麼 一台 NVIDIA A100 伺服器,光是 HBM 的成本就佔到整塊卡製造費用的18%;到了 B200 上,這個數字攀升到45%。你花了近一半的錢買了高頻寬記憶體——然後在 prefill 階段,讓它空轉。 HMA-Serve 論文(arXiv:2606.29986)裡有一組測量資料:在 4K token 長度的 prefill 任務上,A100 的 HBM 頻寬利用率不足3%。16K token 時,這個數字跌到1% 以下。換句話說,你有一條八車道高速,但卡車只開了半條。 下圖展示了不同晶片在 prefill(高算術強度)和 decode(低算術強度)下的天花板差異:
科技
#HBM
#GDDR
#LLM
讚
留言
分享
官方認證
RexAA
2026/07/06
•
DDR、LPDDR、GDDR、HBM 有什麼區別?
前面幾篇我們一直在講 DRAM。我們聊了電腦為什麼需要記憶體,也講了 DRAM 怎麼用電容存 0 和 1,還講了為什麼它需要不斷刷新。但如果你平時看電腦、手機、顯示卡、AI 伺服器的參數,會發現一個很容易讓人迷糊的現象:電腦記憶體叫 DDR、手機記憶體叫 LPDDR、顯示卡視訊記憶體叫 GDDR、現在 AI 伺服器又天天在搶 HBM。 它們名字都不一樣,看起來像是幾類完全不同的晶片。但從大方向上看,它們其實都屬於 DRAM 這個大家族。那既然都是 DRAM: 為什麼還要分出這麼多名字? 為什麼電腦不用 LPDDR?
科技
#DDR
#LPDDR
#GDDR
1 則留言
讚
留言
分享
vaisang
簡明
2026/07/07
讚
回覆
官方認證
RexAA
2024/07/11
•
巨頭搶奪戰,HBM被徹底引爆
在輝達一步步站穩萬億市值腳根的道路上,少不了兩項關鍵技術支援,其中之一是由台積電主導的CoWoS先進封裝,另一個便是席捲當下的HBM(高頻寬儲存)。 輝達H200是首次採用HBM3E儲存器規格的AI加速卡。借助記憶體速度更快、容量更大的HBM3e,輝達H200以每秒4.8TB的速度提供141GB的記憶體,與A100相比,容量幾乎是其兩倍,頻寬也提升了43%,從而加速生成式AI和大語言模型,提高高性能計算(HPC)的工作負載。 隨著人工智慧的興起,HBM成為巨頭們搶佔的高地。三星、SK海力士、美光等儲存巨頭紛紛將HBM視為重點生產產品之一。 HBM的火熱,給市場掀起巨大波瀾。一起看看HBM這股熱潮給市場帶來了哪些轉折?
科技
#HBM
#輝達
#高頻寬儲存
讚
留言
分享
官方認證
RexAA
2024/06/09
•
爭霸GDDR 7
引言 儲存器是人工智慧的驅動力。HBM戰火還在愈演愈烈,另一邊伴隨著美光GDDR 7的送樣,GDDR 7大戰正在悄然打響。 GDDR是Graphics Double Data Rate的縮寫,全稱為雙圖像倍資料速率。它是一種專為圖形處理單元(GPU)設計的同步雙資料速率動態隨機存取儲存器(SDRAM)。1998年,三星電子推出了首款16 Mb GDDR記憶體晶片。自此拉開了GPU和CPU在記憶體道路上的分道揚鑣。起初,顯示卡記憶體相容CPU記憶體,主要使用DDR記憶體,然而鑑於圖像處理需求逐年攀升,顯示卡逐漸轉向採用專門為圖形處理器(GPU)設計GDDR。由於GDDR具有更高的資料傳輸速率和頻寬,在推動GPU的發展過程中起到了很關鍵的作用。 GDDR技術發展歷程
科技
#GDDR 7
#人工智慧
#HBM
讚
留言
分享