登入
關鍵字
#FlashMLA
官方認證
北風窗
2025/02/25
•
【DeepSeek】DeepSeek目標是AGI,不是做空輝達...
上午第一時間發在星球: 大家更關心的事情,下一個是什麼?其實參考這次的FlashMLA,猜測方向大概就是過去已發表論文中的程式碼實現。不複雜,核心思想大概就是:“論文你們都學不會,ok,程式碼直接扔你們...” V3/r1中的招太多了,MTP多token預測、混合精度FP8訓練、Dualpipe雙重流水線訓練、Long CoT長思維鏈、還有一些底層通訊算子的最佳化。這些原始“手稿”或程式碼,可能就是後面4天的內容之一。 轉頭一想,這分明是為輝達GPU、CUDA庫繼續增添成功實踐範本......進一步鞏固和加強了N卡壁壘。這不就是人盡皆知的所謂“CUDA護城河”的完美案例嗎?
科技
#DeepSeek
#FlashMLA
#程式碼
讚
留言
分享
官方認證
北風窗
2025/02/25
•
【DeepSeek】開源第一彈!DeepSeek重磅發佈
2月24日,DeepSeek啟動“開源周”,開源了首個程式碼庫FlashMLA。 據介紹,這是DeepSeek針對Hopper GPU最佳化的高效MLA解碼核心,專為處理可變長度序列而設計,現在已經投入生產使用。“在H800上能實現3000 GB/s的記憶體頻寬&580 TFLOPS的計算性能。”DeepSeek說。 簡單來說,FlashMLA 是一個能讓大語言模型在 H800這樣的GPU上跑得更快、更高效的最佳化方案,尤其適用於高性能AI任務。這一程式碼能夠加速大語言模型的解碼過程,從而提高模型的響應速度和吞吐量,這對於即時生成任務(如聊天機器人、文字生成等)尤為重要。 MLA (Multi-Layer Attention,多層注意力機制)是一種改進的注意力機制,旨在提高Transformer模型在處理長序列時的效率和性能。MLA通過多個頭(head)的平行計算,讓模型能夠同時關注文字中不同位置和不同語義層面的資訊,從而更全面、更深入地捕捉長距離依賴關係和複雜語義結構。
科技
#DeepSeek
#開源
#程式碼
讚
留言
分享
官方認證
北風窗
2025/02/25
•
【DeepSeek】剛剛!DeepSeek,重磅發佈!
【導讀】市場震盪,DeepSeek開源FlashMLA 大家好啊,今天,A股、港股都陷入了震盪調整,一起看看發生了什麼。 小幅震盪調整 2月24日,A股市場全天震盪調整,創業板指領跌。截至收盤,滬指跌0.18%,深成指跌0.08%,創業板指跌0.67%。
科技
#DeepSeek
#FlashMLA
讚
留言
分享
官方認證
RexAA
2025/02/25
•
【DeepSeek】一文看懂 DeepSeek 剛剛開放原始碼的 FlashMLA,這些細節值得注意
今天開始,我們正式進入 DeepSeek 開源周。 DeepSeek 開放原始碼專案第一彈 FlashMLA,已經在極短的時間內發酵到全網了,短短幾個小時,該項目就已經收穫了超過 3.5K Star,且還在不斷飆升。 雖然 FlashMLA 裡的每個字母都認識,連在一起就看不懂了。別急,我們整理了一份 FlashMLA 速通指南。 由 Grok 3 整理,APPSO 核實
科技
#DeepSeek
#原始碼
#FlashMLA
讚
留言
分享