就在剛剛,Meta發力了!
首先,Meta超級智能實驗室正式發佈全新30B大模型 —— Muse Glimmer,而且重磅開源。
這個智能體模型,專為本地裝置量身定製。它性能強大,卻被塞進不到20GB的記憶體裡,只要一塊消費級 GPU(比如 RTX 5090)或者一台 M4/M5 Max 的 MacBook 就能流暢運行!
而且,Meta這次採用的是最良心的 Apache 2.0 協議,允許免費商用,隨便造。
另一方面,Meta CEO 小扎親自下場,發表了一篇萬字重磅宣言——《未來屬於每個人》。
這個長篇檄文中,他沒有點名,卻處處都在暗諷OpenAI 和 Anthropic。
他開炮說:有些人天天炒作AI末日論,試圖把超級智能集中在少數幾家公司和少數精英手裡,這才是人類面臨的最大危險!
Muse Glimmer:塞進你背包裡的「超級智能」
雖然如今的開源AI很多,但真正能幹活的模型,普通人的電腦跑不動;能跑得動的模型,又彷彿智障。
Muse Glimmer 的誕生,就是為了打破這個僵局。
Meta的野心是:讓這個30B 模型能「完全離線、本地運行」!
這意味著,你可以在沒有網的飛機、高鐵上隨時呼叫這個超級大腦,而且還能保障隱私安全,本地檔案、私人程式碼不必上傳遠端。
30B模型,怎樣塞進個人電腦裡?Meta有以下幾大黑魔法。
極限壓縮:20GB 以內的完美瘦身
按照常規精度,30B模型無論怎樣都得吃掉 55GB 以上的視訊記憶體,這遠遠超出了消費級顯示卡的極限。
為此,Meta 團隊使用了4-bit 量化壓縮技術,硬生生將模型權重壓縮到 20GB 以下。
更驚人的是,這種極致的壓縮「對智能體任務的性能表現幾乎沒有造成任何衰減」。
從此,在 24GB 視訊記憶體(如 RTX 3090/4090)或 32GB 記憶體(如 Mac 統一記憶體)的裝置上,我們不僅能跑這個模型,還能留出足夠空間,給它的「視覺感知編碼器」和上下文快取。
DFlash 投機解碼:讓生成速度起飛
本地運行大模型最怕什麼?就是慢。
模型一個字一個字地擠牙膏,極其破壞工作流。
為瞭解決這個問題,Muse Glimmer 自帶了一個基於 DFlash 技術的輕量級「草稿模型」。
這個小模型會一次性「猜」出一大段 Token,然後交給主模型進行平行驗證。對了就保留,錯了就修改。
這種「投機解碼」技術,在不犧牲任何輸出質量的前提下,讓 Muse Glimmer 在 RTX 5090 上的生成速度直接飆升了 3.1 倍!
在 MacBook M4-Max 和 M5-Max 上,它同樣快得飛起,撐得起流暢的即時對話和複雜的程式碼生成。
真正的「智能體」
而且,Muse Glimmer 的定位不僅僅是一個LLM,它是專為智能體工作流最佳化的。
它是由 Meta 最頂級的閉源大模型 Muse Spark 經過「邏輯蒸餾」訓練,繼承了這個頂級模型的靈魂。
它具備五大核心超能力。
- 端到端任務完成: 在 DeepSearch QA、SWE-Bench 等極難的測試中表現優異,能從頭到尾幫你寫程式碼、DeBug、查資料。
- 可靠的工具呼叫: 能精準識別什麼時候該呼叫計算器,什麼時候該搜尋本地檔案,什麼時候該運行程式碼。
- 失敗恢復能力: 這是智能體最關鍵的能力。當程式碼報錯或工具呼叫失敗時,它不會直接當機罷工,而是會像人類程式設計師一樣,自動診斷錯誤、修改參數並重新嘗試!
- 長程多步推理: 能夠制定長期的連貫計畫,不會做著做著就「失憶」。
- 多模態理解: 能夠直接看懂你的螢幕截圖、圖表和文件,實現圖文穿插推理。
在各項基準測試中,Muse Glimmer 在同體量模型中與 Gemma4-31B 和 Qwen3.6-27B 不相上下,並且在「智能體操作」上表現驚人。
最重要的是,它採用了 Apache 2.0 協議!
這意味著無論是個人開發者還是企業,都可以免費商用。
目前權重已經上線 Hugging Face,並且很快就會全面接入 Ollama、LM Studio 等主流本地運行工具。
https://huggingface.co/meta-models/Muse-Glimmer-30B
前Meta超能實驗室評估負責人Zengyi Qin分析稱,Muse Spark將對全球開源模型形成降維打擊。
原因在於,Meta今年的基礎設施預算高達1450億美元,因此Meta擁有更多算力;他們還有合規的優勢。
最關鍵的,Meta為什麼要開源?因為他們根本不需要靠賣API賺錢!
30B免費模型,Apache 2.0協議,將對讓開源實驗室的商業邏輯形成巨大衝擊。
小扎萬字檄文,
徹底撕下矽谷「AI安全」的假面
同時,小扎發佈了一篇萬字長文,可以說是Meta向整個閉源陣營下的戰書!
這篇文章,讓所有人都驚了:很少看到攻擊性這麼強的小扎。
文章的核心思想就是:超級智能必須屬於每個人,把超級智能集中在少數人手裡,才是人類最大的危險!
猛烈抨擊「AI 末日論」與權力集中
我們都知道,矽谷有那麼兩家公司,特別喜歡玩這套敘事:AI太危險了,隨時會毀滅人類,所以必須鎖在幾個精英公司手裡。
小扎對此發出猛烈抨擊:
認為 AI 如此危險,以至於唯一的安全途徑就是權力的極端集中,這種觀念本身就存在著固有的問題。縱觀歷史,指望一個絕對的權力如果足夠開明就能仁慈地養活人類,從來沒有帶來過安全或積極的結果。
他舉例說,如果世上只有一個人擁有「超級智能律師」,那他在法庭上將擁有絕對優勢,讓社會倒退。但如果每個人都有一個這樣的律師,世界反而會更公平。
同理,少數人掌握超級駭客AI是災難,但如果每個人都有超級AI在做防禦,整個世界的數字基礎設施將堅不可摧。
「真正的安全,來源於權力的制衡,而不是權力的壟斷。」
顛覆性的「AI 對齊」觀:AI 應該聽誰的?
關於 AI 對齊,祖克柏爆出金句:
人類不是單一的文化……不存在一種技術解決方案,可以同時滿足所有人相互衝突的利益。因此,沒有任何一個單一的超級智能可以對所有人都是仁慈的。
他嚴厲批評了競品的做法:某家領先的模型,僅僅因為其公司內部認為「標準化考試是不道德的」,就拒絕幫使用者起草一封寫給學校的信!
這根本不是對齊,這叫「把公司的教條強加給使用者」!
Meta 提出:AI 必須與使用者個人的目標和價值觀對齊,而不是與 Meta 公司的價值觀對齊。
為此,小扎承諾,Meta 將為個人 Agent 提供「完全私密模式」,如同 WhatsApp 的端到端加密一樣。
開源生態的生死存亡,直指美國監管政策
在文章後半段,小扎對美國目前的AI監管政策表達強烈不滿。
他說,這種過度嚴苛的限制,是在「給競爭對手送大禮」。
而且,小扎居然選擇公開站台蒸餾!
他指出,從其他模型中學習,是開源生態系統運作的重要原則。「任何 AI 模型都源於人類知識……你應該可以從任何你能觀察到的事物中學習,這就是世界運轉的方式。」
而且,Muse Glimmer 就是從 Meta 自己的 Muse Spark 中蒸餾出來的。小扎呼籲,美國政策必須放寬對訓練資料和蒸餾技術的限制,否則美國開源AI將失去競爭力。
而且他認為,限制美國開源模型並不能解決任何問題,反而會削弱美國在 AI 生態上的話語權。
他警告,如果主動設限,其他國家的開源新星會迅速填補空白,讓美國失去定義全球AI標準的機會。
同時,他提出一個折中方案:不去卡開源模型的發佈,而是讓實驗室提前向政府分享「中間訓練檢查點」。
今天,讓我們記住小扎,記住Meta。
他們用Muse Glimmer本地模型,向所有人證明:超級智能不必高高在上,它完全可以放在每一個人的包裡。(新智元)
