登入
關鍵字
#GPU很
官方認證
美股艾大叔
昨天 19:35
•
博通的人工智慧收入增長221%,為何定製晶片可能比GPU更具商業價值
博通第三季度的人工智慧半導體收入同比增長221%,第四季度的增長勢頭可能進一步加快。管理層預計,與人工智慧相關的收入將達到217億美元,較去年同期增長236%。 這一收入增長背後有一個明確的驅動力——定製化的人工智慧加速器,即管理層所稱的“XPU”。這些晶片是與超大規模雲端運算公司(包括Google母公司Alphabet、Meta Platforms、Anthropic和OpenAI)合作設計的。儘管輝達及其GPU在人工智慧訓練和推理方面一直是主力,但定製化半導體晶片最終可能成為更大的業務領域。 以下是原因以及這對博通及其客戶意味著什麼。 人工智慧部署中的最大瓶頸
美股
#博通
#財報分析
#XPU
讚
留言
分享
官方認證
美股艾大叔
昨天 19:17
•
馬斯克募資2680億,搶購輝達GPU
伊隆·馬斯克的 SpaceX 公司正尋求通過阿波羅全球管理公司牽頭的融資計畫籌集 400 億美元,用於購買輝達晶片。這家人工智慧和火箭公司正在加大對這家晶片製造商先進技術的投入。
美股
#馬斯克
#募資
#AI 算力
讚
留言
分享
官方認證
美股艾大叔
昨天 18:38
•
僅4.5%的美國消費者為AI付費,GPU的價格還在不斷上漲,a16z兩份報告揭開AI真實落差
在美國消費者裡,竟然只有 4.5% 為 ChatGPT、Gemini 或 Claude 付過個人訂閱費。這是近期 a16z 第七版消費級 AI 應用報告裡面給出的資料。消費級 AI 的使用已經非常廣泛,將近一半美國消費者說自己在用 AI,每天都使用的只有四分之一。付費的這 4.5% 的使用者裡,支出又高度集中在極少數使用者身上。前 1% 的付費者每月平均花 903 美元,比後 50% 所有使用者加起來還多。 a16z 近期還發佈了第二版《State of Markets》,把兩份報告放在一起,能夠看到一個有點矛盾的局面。算力側已經熱得發燙,GPU 的租賃價格不降反升,A100 甚至比 2026 年初還貴。但在需求側卻仍然很淺,企業裡只有 2% 左右報告了可跟蹤的 AI 指標,消費側付費滲透率也才剛超過 2%。 a16z 合夥人 Olivia Moore 在一檔播客裡表示:“大多數人並不是為了節省時間,而是想找到打發時間的方式。我們在消費級 AI 領域所見到的幾乎所有產品,都是以節省時間為賣點。而那些真正能‘花時間’的公司,往往最終會成為行業中的巨頭,甚至是最頂尖的企業。” (來源:資料圖)
科技
#GPU價格
#AI滲透率
#AI商業模式
讚
留言
分享
官方認證
RexAA
前天 18:12
•
存力接棒算力—AI智能體把記憶體推上主戰場
KV Cache從"臨時變數"變成"持久資產"——記憶體容量和訪問速度,正在直接決定智能體的記憶能力。 開篇:那個越寫越厚的"草稿本" 一個AI智能體正在處理百萬級token的對話歷史。它要反覆回放上下文、呼叫工具、多步推理——每走一步,都要把已經"記住"的內容再讀一遍。 這個"記住"的載體,叫KV Cache。它像一個越寫越厚的草稿本:對話越長,草稿越厚,轉眼就佔滿了昂貴稀缺的GPU視訊記憶體。據中信證券測算,上下文從8K激增到1M tokens時,單使用者FP16精度下的KV Cache視訊記憶體佔用會從約5GB飆升至640GB以上——而一張頂級GPU的HBM視訊記憶體,不過百GB量級。
科技
#AI智能體
#token
#KV Cache
讚
留言
分享
官方認證
RexAA
2026/10/06
•
Hinton發了首篇RSI論文
當AI開始參與研發下一代AI,人類可能已經站到「智能爆炸」前夜。 虧賊!最近超超超超火的遞迴自我改進(RSI),連AI教父辛頓都親自下場了?? 咱諾貝爾物理學獎、圖靈獎得主Hinton的首篇RSI的論文,上來就研究一個相當炸裂的問題: 如果AI開始大規模參與造下一代AI。
科技
#RSI
#算力
#GPU
讚
留言
分享
官方認證
美股艾大叔
2026/10/06
•
蘋果史上最強晶片
蘋果最強大的Mac晶片已經上市六周,它帶來的實際改變也逐漸清晰起來。該公司於2026年8月25日發佈了M5 Ultra,這款晶片將36核CPU、80核GPU以及最高512GB的統一記憶體整合到全新升級的Mac Studio中。蘋果稱其為“有史以來最強大的晶片”,而從紙面參數來看,也確實如此。 更有趣的是,這款晶片預示著蘋果的AI戰略走向。這是Ultra級晶片首次配備專用神經網路加速器,記憶體頻寬也提升至1.2TB/s。蘋果押注Mac Studio使用者希望完全在本地運行大型語言模型,無需支付API費用,資料也不會外洩。然而,在2026年10月,這一策略與一年前相比,顯得截然不同。如今,開發者們通常會權衡託管推理的成本與一次性購買硬體並在本地運行模型的成本。 蘋果確認M5 Ultra的最終規格 蘋果公司在8月25日公佈了當前Mac Studio系列產品的規格,該系列產品將於2026年9月22日上市。頂配機型搭載36核CPU(分為12個“超級核心”和24個性能核心)、80核GPU以及32核神經網路引擎。蘋果官方技術規格頁面顯示,統一記憶體頻寬為1.2TB/s,最高配置可達512GB統一記憶體。
科技
#蘋果
#GPU架構
#晶片性能
讚
留言
分享
官方認證
RexAA
2026/10/05
•
從GPU主導到CPU反超:智能體推理改寫算力結構
從GPU主導到CPU反超:智能體推理改寫算力結構 當每塊GPU需要80個CPU核心來伺候,記憶體行業的遊戲規則正在被改寫。 80個CPU核心,伺候一塊GPU。這是瑞銀2026年5月一份報告裡最刺眼的數字。傳統AI訓練,一塊GPU配置8到12個CPU核心就夠了;到了智能體(Agentic AI)推理,這個數字變成80到120個——增長5到10倍。 更顛覆的是算力分配方向。瑞銀援引的專家訪談給出判斷:傳統AI工作負載裡,70%到80%的算力消耗在推理本身(GPU)上;而在智能體推理中,這個比例反轉了——70%到80%的工作量轉移到了CPU上。
科技
#GPU
#AMD
#蘇姿豐
讚
留言
分享
江國中
2026/10/05
•
🎯做夢行情啓動!聯亞、台達電、聯發科領銜四族群衝鋒! Line@連結: https://lin.ee/mua8YUP 🔥台股第四季大行情正式啟動
台股
#趨勢分析
#3081聯亞
#2308台達電
讚
留言
分享