登入
關鍵字
#架構
官方認證
RexAA
昨天 11:21
•
端側AI,GPU重新崛起!
在邊緣計算與大模型融合的浪潮下,晶片行業正經歷一場深刻的架構變革。長期以來,為了應對圖像渲染、語音識別、電腦視覺及神經網路推理等多元化任務,晶片廠商往往傾向於在SoC中不斷疊加專用的加速模組——CPU、GPU、DSP與NPU各司其職。 但問題也由此產生。“每一個加速器都能很好地解決一個問題,但每一個加速器也會創造一個依賴。” 在Imagination Technologies日前舉行的媒體開放日活動上,公司CEO Markus Mosen將這種代價形象地稱為一筆“邊境稅”:不同計算單元像一座座孤島,資料要不斷經過外部記憶體在GPU、NPU、DSP、CPU之間搬運,每跨過一次邊界,都要同時付出三種成本——能耗、時延,以及工程師的開發和維護時間。 Imagination CEO Markus Mose
科技
#端側AI
#GPU
#晶片架構
77人
讚
留言
分享
官方認證
北風窗
2026/09/22
•
Agent時代的AI計算架構挑戰與創新!2026
從AICC2026看智能體如何重構算力底座 當智能體(Agent)從“回答問題”走向“解決問題”,當單次推理變成持續互動,支撐AI運行的算力正在從“技術資源”升級為“國家戰略基礎設施”。 9月21日,AICC2026人工智慧計算大會在北京中關村國際創新中心舉行,浪潮資訊首席AI戰略官劉軍在主論壇發表《Agent時代的AI計算架構挑戰和創新》演講,核心判斷只有一個: Agent不是模型能力的簡單疊加,而是對AI計算架構的系統性挑戰。 它要求基礎設施同時支撐更高水平的智能能力突破,以及更大規模、更低成本的智能供給。 資料錨點:IDC與浪潮資訊聯合發佈的《2026中國人工智慧計算力發展評估報告》顯示,2026年中國智能算力規模預計達2576.5 EFLOPS,同比+87.9%;全球活躍智能體數量將從2026年的7940萬增長至2030年的22.16億,年複合增長率129.8%,而同期全球Token消耗量複合增長率高達4822.6%——約為智能體數量增速的37倍。 一、開篇:Agent正在重構AI計算的需求範式
科技
#2026年
#AICC
#AI Agent
227人
讚
留言
分享
官方認證
RexAA
2026/09/19
•
HBM之後,HBF來了:3D NAND+TSV+UCIe,512GiB與3.072TB/s重構AI記憶體架構!
🔷不取代HBM,而是擴展HBM:高頻寬Flash將TB級容量進一步推向xPU身邊 🔷模型權重、KV Cache與MoE成為關鍵場景,AI記憶體層級迎來重新劃分 隨著大模型參數規模持續膨脹、Context Length不斷拉長,AI晶片面臨的挑戰已經不只是“算力夠不夠”,Memory Wall正在成為制約GPU/TPU/xPU繼續擴展的重要瓶頸。HBM雖然擁有極高頻寬,但容量擴展壓力越來越突出;傳統NAND容量足夠大,卻又很難滿足AI計算對近端高頻寬資料訪問的需求。正是在這樣的背景下,High Bandwidth Flash(HBF)開始走向台前——它試圖把Flash從傳統記憶體層直接搬到xPU身邊,在HBM與SSD之間建立一個全新的高頻寬、大容量Memory Tier。 這次,小編就帶大家詳細看看這份HBF High-Level Base Die Specification。從3D NAND Stack、Base Die、TSV,到16通道Wide-I/O、UCIe/AXI互連,再到512GiB+容量與最高3.072TB/s目標有效頻寬,HBF正在嘗試用“高平行NAND+先進封裝+Chiplet互連”重新定義Flash的性能邊界。
科技
#HBM
#HBF
#3D NAND
199人
讚
留言
分享
官方認證
RexAA
2026/09/03
•
OpenAI Astra核心架構爆出:大模型第三條Scaling法則誕生
除了A廠的fable5.1發佈以外,“recurrent depth”(中文常譯為“循環深度”或“循環Transformer”)技術爆火出圈。這是一個極其強大的技術但是也是LLM徹底走向黑盒危險的技術! 導火線是The Information記者Stephanie Palazzolo的爆料:OpenAI即將推出的Astra模型採用了名為“recurrent depth”的新推理方法。該技術有助於降低成本、提升性能,但會讓模型的思考過程更難被監控,從而引發AI安全與可觀測性擔憂。 OpenAI尚未公開確認架構細節。其首席科學家Jakub Pachocki隨後發帖澄清,試圖避免“因混亂報導引發不可監控競賽”,並強調當前前沿模型(包括Astra)的計算圖深度最多約為GPT-4的兩倍,鏈式思維(Chain-of-Thought, CoT)監控仍是核心研究重點。儘管如此,討論已覆蓋技術原理、效率優勢與安全風險。 很巧的是字節和清華竟然今天也上線了一篇相關論文:
科技
#OpenAI
#Astra
#核心架構
249人
讚
留言
分享
官方認證
北風窗
2026/08/21
•
小紅書悄悄開源發佈了自己的大模型,內容平台也要造底座
長期依賴外部模型,不是最好的選擇。 前幾天,我們注意小紅書在海外發佈了一款大模型 dots3-note preview。 這款模型採用 MoE 架構,總參數 280B、啟動參數 16B,支援 512K 上下文,並具備文字、視覺、語音的多模態理解能力。它屬於 dots3 系列,後續還將有 jazz、aria 等不同定位的版本。作為先行發佈的 note 版本,它更像是小紅書將模型能力推向實際業務和開發者生態的第一步。 模型上線後,海外開發者社區很快開始討論,Hugging Face 下載量破百,華為昇騰也在當天宣佈完成適配;但在國內,這次發佈暫時還沒有掀起太大水花。
科技
#小紅書
#dots3-note preview
#MoE架構
248人
讚
留言
分享
官方認證
RexAA
2026/08/18
•
誠心滿滿嗎?英特爾總經理直言:我們Nova Lake將率先登陸桌面平台
言盡於此 在AMD於不久前宣佈將Zen 6架構優先推向資料中心EPYC Venice處理器、打破多年來從消費級開路的慣例後,英特爾副總裁兼發燒友管道業務總經理Robert Hallock在接受Tom's Hardware採訪時給出了一個意味深長的回應。他確認,英特爾下一代CPU核心架構Nova Lake將率先登陸桌面平台,而非資料中心。 Hallock的原話頗具挑釁意味:“我覺得這是他們很自然的選擇,完全說得通。但我想說的是,看看我們自己的路線圖,我手裡有一個新核心,它會先上桌面。希望發燒友們自己算算這筆帳,我能說的就這麼多。” 雖然他沒有直接點名Nova Lake,但毫無疑問他指的就是這一即將發佈的桌面處理器系列。
科技
#CPU架構
#英特爾
#AMD
264人
讚
留言
分享
官方認證
RexAA
2026/08/18
•
Intel下一代桌面CPU放出重磅訊號:將是史上最重要發佈!但普通人別想了
前不久AMD正式發佈了Zen 6處理器,打破了十多年的慣例,選擇先把Zen 6架構先推向資料中心EPYC Venice,而非像以往那樣從消費級開路。 對此Intel副總裁兼發燒友管道業務總經理Robert Hallock在接受Tom's Hardware採訪時確認,Nova Lake的新核心架構將首發桌面平台而非資料中心。 Hallock的回應頗為意味深長:“我覺得這是他們很自然的選擇,完全說得通。但我想說的是,看看我們自己的路線圖,我手裡有一個新核心,它會先上桌面。希望發燒友們自己算算這筆帳,我能說的就這麼多。” 言下之意,AMD把新架構先給資料中心賺錢,Intel則要把新核心先給桌面玩家。
科技
#CPU架構
#Intel
#AMD
244人
讚
留言
分享
官方認證
美股艾大叔
2026/08/18
•
Zen架構發佈10周年 股價猛漲70倍:AMD靠兩條龍翻身
10年前的2016年8月份,AMD蹭著Intel IDF大會的東風宣佈了Zen架構處理器,如果當天買入AMD股票,現在能賺70多倍。 那時候AMD的股價不到7美元,如今超過了500美元,漲了70多倍,當年買入1萬美元現在就是70多萬美元了。 當然,如果膽子更大的話,在2015年底埋伏AMD股票,那時候不到2美元,現在能賺250多倍。 即便是錯過了這波大漲的機會,2022年AMD股價也經歷過暴跌,也跌到過70美元以下,現在依然能漲七八倍。
科技
#Zen架構
#AMD
#顯示卡
257人
讚
留言
分享