2026 年 8 月 12 日,DeepSeek V4 Pro 正式版上線。目前 DeepSeek 沒有發佈公眾號文章、也沒有技術部落格、更沒有推文。唯一跡像是官網 API 定價頁面上的一行字變了,“deepseek-v4-pro”後面的版本號從預覽版變為了 DeepSeek-V4-Pro-0813。
這也意味著從 2026 年 4 月就開始以預覽版身份運行的旗艦模型終於正式轉正。
據瞭解,DeepSeek V4 Pro 是一個混合專家(MOE)模型,總參數量達到 1.6 兆,每一個 token 啟動 490 億參數,上下文窗口為 100 萬 token,最大可以輸出 38.4 萬 token,這個規模放在全世界 AI 模型裡位居第一梯隊。此前所有第三方測試跑的都是預覽版本,預覽版在 Hugging Face 上已經被下載多大 140 萬多次。
正式版上線之後的價格與非高峰時段價格保持了一致,這一價格其實就是 2026 年 5 月份已經永久降價為原價四分之一後的標準價格,具體來說每百萬輸入 token 的收費為 0.435 美元,輸出收費為 0.87 美元,快取命中的輸入收費只需要 0.003625 美元。
相比之下,Anthropic 的 Claude Fable 5 每百萬輸入收費為 10 美元,輸出收費為 50 美元,它倆整整差了兩個數量級。按照 DeepSeek 目前的定價,算下來還不到 Claude Fable 5 的 2%。
要是按完成單個任務的成本來算,差距就更加明顯。有機構測試過,使用 Claude Fable 5 完成一個基準任務花費 3.15 美元,使用 DeepSeek V4 Flash 只需花費 3 美分,兩者差了 100 倍。DeepSeek-V4-Pro-0813 版本的單任務成本目前還沒人測過,但是價格體系沒變,情況應該大致類似。
之所以價格差距能拉這麼大,主要和架構設計有關。DeepSeek V4 Pro 使用了兩種注意力變體,第一種叫做壓縮稀疏注意力,另一種叫做重度壓縮注意力。
按照 DeepSeek 的說法,這套架構能夠把單 token 推理計算量降到 V3.2 代的 27%,KV 快取降到了原來的 10%。這對於 100 萬 token 的上下文窗口來說,能夠節省的成本非常可觀,因為推理效率高了,定價空間自然也就出來了。
DeepSeek 自己也開展了基準測試,即在 10 個智能體評測上和 Claude Fable 5 對比。去掉一個差距最大的之後(Humanity's Last Exam,DeepSeek V4 Pro 落後 10.6 個百分點),剩下 9 項之中 DeepSeek 平均落後 2.8%,有 2 項 DeepSeek 還贏了。
但是這些資料是 DeepSeek 自己測的,使用的是自家還沒對外開放的評測框架,至於這兩個內部測試集也沒有公開榜單可以驗證,也就是說 DeepSeek-V4-Pro-0813 版本的真實表現,得等第三方評測跑過才知道。
DeepSeek V4 Pro 在 API 裡開放了三個模式:分別是普通模式、高推理模式和最高推理模式。其中,最高模式會推高模型推理能力的邊界,API 能夠同時支援 OpenAI 和 Anthropic 兩種格式的介面,之前已經在這兩個生態裡開發的開發者無需改程式碼就能切過來,同時支援工具呼叫、結構化 JSON 輸出這些能力。
DeepSeek V4 Pro 正式版上線之後,DeepSeek V4 系列的產品結構變得更加清晰:一方面,Flash 版本做高頻、高並行的流量,主打一個價格便宜;Pro 版本負責把算力集中在更複雜的推理、長上下文編碼和智能體任務上。一些在 AI 開發的國內公司,很多都已經在進行搭配使用。
但是 DeepSeek 的定價頁面上還掛了這樣一句話:那就是近期會有一次“顯著的價格調整”。至於具體漲多少以及什麼時候漲,目前還沒有公佈,眼前這種低價窗口到底還能夠開多久也不太好說。
與此同時,多家聚合平台的資料顯示,2026 年 7 月 DeepSeek 模型 Token 呼叫規模位居全世界 AI 模型第一梯隊,在部分榜單中僅次於 Anthropic 的模型,DeepSeek 的業務增長依託真實的開發者呼叫,迄今為止沒有舉辦過任何的大型媒體發佈會,主要是在公眾號官宣,有時附帶髮一發技術部落格。
眾所周知,DeepSeek 的算力儲備不算大,其創始人梁文鋒親自披露過這個資料。他在 2026 年 7 月的一次投資人交流會上提到,當時 DeepSeek 擁有大約 2 萬張 H100 等效算力。這個數字跟海外 AI 頭部大廠動輒幾十萬甚至上百萬卡叢集相比,的確不在一個量級。
但是梁文鋒也說這個數字是動態的,他們一直在努力採購更多算力,打算“在合理價格內能買多少卡就買多少卡”。與此同時,DeepSeek 還計畫建設 GW 等級(相當於數十萬張卡規模)的自建算力中心,前不久其為內蒙資料中心招聘人員正是這一跡象的顯露。
DeepSeek 還與華為合作,拿到了 16000 張昇騰 950 算力卡,用於軟體生態驗證與落地。並且第三方機構已經在國產算力叢集(昇騰 910C)上完成了 DeepSeek V4 Pro 的全參數後訓練,這都說明國產算力正在逐步承擔更重的任務。
目前 DeepSeek 的權重依然是 MIT 許可證,正式版的權重什麼時候放出來還不一定。但是按照 V4 Flash“API 先跑、權重隨後跟上”的節奏,估計應該只是時間問題。第三方評測機構目前正在排隊測 DeepSeek-V4-Pro-0813 版本,等到資料出來就能看清 DeepSeek 這次到底提了多少。 (DeepTech深科技)
