祖克柏,跟DeepSeek拼了

低價換資料,Meta的算盤能打響嗎?

智東西8月6日報導,今日,Meta推出其首款程式設計Agent——Muse Code(測試版),以及該Agent搭載的新一代模型Muse Spark 1.2。

模型一經面世便引發海外熱議,核心關注點直指定價策略:比DeepSeek-V4-Flash更便宜。如果使用者允許Meta用他們的資料訓練模型,就能享受95折優惠。

有趣的是,就在同日,DeepSeek發佈公告宣佈:“計畫近期整體上調API服務定價,預計漲幅較大。”國內其他頭部模型也有價格戰鬆動跡象,比如,智譜GLM模型在優惠結束後價格也將明顯上調。

當海外巨頭OpenAI、Meta紛紛殺入價格戰,DeepSeek等國產模型似乎不按套路出牌,這場全球大模型混戰變得越來越有意思了。

01. 最高降價75倍Meta盯上使用者資料

祖克柏在推文中稱:“(這款模型)定位入門簡單且成本低廉,(使用者)只需一行程式碼即可安裝,開始使用‘貢獻者套餐’。”

所謂“貢獻者套餐”,是指Meta提供兩個API版本:一個版本允許資料共享,另一個版本則不允許。前者輸入價格為0.10美元/百萬Tokens,比後者便宜12.5倍; 快取輸入0.002美元/百萬Tokens,便宜75倍;輸出0.20美元/百萬Tokens,便宜21倍以上。

有網友調侃:“笑死,Muse Spark輸入、輸出成本都比DeepSeek-V4-Flash低,還擁有獨特最佳化的快取命中率。他們不在乎利潤,只想要資料。

此前7月31日,DeepSeek-V4-Flash正式上線API,該模型在未命中輸入快取時價格為1元/百萬tokens,輸入命中快取價格為0.2元/百萬tokens,輸出價格為2元/百萬tokens。

02. DeepSeek“強得不像Flash”Meta跟得動嗎?

當下正值DeepSeek-V4-Flash在全球引起新一輪熱潮。自上線API以來,其超高性價比的口碑持續攀升。

拉美頭部線上教育平台Platzi聯創兼CEO今日剛剛發文感嘆:“我完全不明白DeepSeek-V4-Flash是如何達到這種速度和質量的,太厲害了。”

更有網友直言:“Claude死了。世界沒有理由繼續受制於一家價格高出百倍、性能卻與競爭對手不相上下的供應商。”

但DeepSeek-V4-Flash的口碑不僅源於低價,更在於性能表現。

這款模型基準測試遠超4月上線的自家“大哥”DeepSeek-V4-Pro-Preview。直到今天,還有不少海外網友仍在興奮讚歎:“它現在完全不像一個Flash模型。”在Almanbench測試中,DeepSeek-V4-Flash 0731版本超越Kimi K3,得分幾乎媲美GPT-5.6 Sol xhigh。

那麼試圖與DeepSeek打價格戰的Meta,其最新的Muse Spark 1.2和Muse Code測試版性能如何?

03. 程式設計測評僅次於Opus5 Muse Spark 1.2與前沿模型仍有距離

從模型性能來看,Muse Spark 1.2比自己前代模型提升較大,但與前沿模型仍有一定距離

Muse Spark 1.2是專為程式設計最佳化的更新版本。在Terminal‑Bench 2.1、DeepSWE 1.1等程式碼能力基準測試中,整體成績僅次於Claude Opus5,強於GPT‑5.6、Grok4.5和Gemini3.6。

在複雜推理GDPVal‑AA V2測試中,Muse Spark 1.2僅次於Opus5;在Agent工具呼叫MCP Atlas基準上,Muse Spark 1.2登頂榜首。

Meta測試了該模型在超過1000次工具呼叫(長達24小時)內迭代最佳化GPU核心的能力。借助Muse Code的智能體編碼環境,該模型表現優於Gemini 3.6 Flash、GPT-5.6 Terra,但遜於GPT-5.6 Sol、Opus5。

Muse Code定位終端編碼Agent,能夠處理大型程式碼庫中的完整軟體工程任務,包括規劃變更、編寫程式碼、驗證結果。Meta公佈了系列案例,但其實際能否與Claude Code、Codex一較高下,仍有待開發者真實場景的檢驗。

如下圖案例所示,Muse Code採用簡單的Agent循環,並輔以一組非同步後台Agent來增強主Agent的功能。它們的持續運行降低了延遲,並降低複雜多步驟任務下的人工干預需求。

▲Muse Spark 1.2生成的光子球模擬
▲Muse Spark 1.2生成的遊戲射擊介面
▲Muse Spark 1.2生成的酪梨草坪遊戲

下圖為使用者將房屋的漫遊視訊以MP4檔案的形式輸入到終端。Muse Code會解析該視訊,並生成一個視覺效果豐富的度假屋行銷和預訂頁面。

此外,Muse Spark 1.2人工智慧分析指數 (AII) 中獲得54分,相比之前的版本,其智能體知識工作能力顯著提升,使Meta與SpaceXAI並列美國實驗室第三名。

04. 結語:Meta降價搶客 DeepSeek漲價備戰 AI價格戰背後是Agent硬仗

緊隨OpenAI降價,Meta也在美國AI圈打起價格戰。Meta試圖以此在OpenAI、Anthropic的統治下分一杯羹;並首次入局終端程式設計Agent市場,試圖重新上桌。而GoogleDeepMind近期內部的大調整,恰好為Meta提供了機會窗口。

低價或許是不錯的引流手段,但打開局面還需要更高的模型性能和Token質量。這也是DeepSeek-V4-Flash再次爆火海外的原因。

值得注意的是,就在今日,DeepSeek發佈公告計畫近期整體上調API服務定價。可見,DeepSeek並未將競爭侷限於價格戰,而是繼續聚焦模型質量的比拚。近期,DeepSeek正大力招聘Agent Harness人才、積極招攬優秀開放原始碼專案,其Agent Harness產品(或命名為DeepSeek Code)正在緊鑼密鼓推進中。

可以預見,價格戰只是序章,圍繞Agent的算力、性能、價格、應用、生態等全維度的競爭,將愈演愈烈。 (智東西)