7月AI大亂鬥:國外GPT-5.6、Grok4.5、Gemini 3 Pro輪流登場,中國DeepSeek V4正式版也來了!

OpenAI旗艦GPT-5.6 Sol明日上線,定價每百萬Token輸入5美元;馬斯克Grok 4.5同步公開,宣稱性價比碾壓Opus級對手;GoogleGemini 3.5 Pro押注全新底座於17日亮相;DeepSeek V4同步引入峰谷定價並推理提速逾60%。一場橫跨性能、成本與生態的全面角力,正式打響。

7月全球AI大模型競賽進入密集發佈窗口期,中國外頭部玩家幾乎同步亮出新牌。

OpenAI旗艦模型GPT-5.6 Sol定於本周四正式發佈,馬斯克旗下SpaceX AI宣佈Grok 4.5也將於明日向公眾開放,GoogleGemini 3.5 Pro據悉將於7月17日上線,中國DeepSeek V4正式版同樣鎖定7月中旬。

短短數周內,多款頂級大模型密集落地,直接加劇了AI行業的競爭烈度,並對相關企業的商業化路徑與定價策略產生深遠影響。

對市場而言,此輪集中發佈不僅是技術能力的比拚,更是各方在API定價、推理效率與生態整合上的全面角力。投資者需關注的核心問題在於:誰能在性能與成本之間找到最優解,並率先將技術優勢轉化為商業壁壘。

01 GPT-5.6 Sol:旗艦定位,分階段開放

OpenAI首席執行長Sam Altman周三在社交媒體宣佈,GPT-5.6 Sol將於本周四正式發佈。這是GPT-5.6系列中的旗艦產品,搭載全新ultra多智能體模式與max推理強度,在編碼、生物學和網路安全等核心基準測試中均刷新最佳紀錄。

定價方面,Sol採用每百萬Token輸入5美元、輸出30美元的收費標準,位居GPT-5.6系列三款產品的最高端。OpenAI同時宣佈,將於7月在Cerebras硬體上推出Sol,推理速度最高可達每秒750個Token。

發佈策略上,OpenAI採取分階段推進路線,初期僅向部分可信合作夥伴開放API和Codex存取權,計畫在未來數周內向更廣泛使用者普及GPT-5.6全系列。這一策略在控制服務壓力的同時,也為競爭對手留出了一定的響應窗口。

02 Grok 4.5:馬斯克加速整合AI版圖

馬斯克在社交媒體上宣佈,基於beta測試階段客戶的強烈正面反饋,SpaceX AI將於明日向公眾開放Grok 4.5。馬斯克稱,該模型屬於Opus等級,但速度更快、Token效率更高、成本更低。

據此前披露的資訊,Grok 4.5基於1.5兆參數的V9基礎模型打造,並在補充訓練中特別加入了AI程式設計工具Cursor的資料。早期評測結果顯示,該模型性能已接近甚至可能超越Anthropic旗艦模型Claude Opus,強化學習仍在持續最佳化該模型。

值得關注的是,SpaceX AI還與程式設計工具公司Cursor計畫聯合發佈首款共同研發的AI模型,直接向Anthropic和OpenAI發起挑戰。據The Information獲得的一份內部備忘錄,該模型此前曾因兩家公司希望進一步提升運行效率而推遲發佈,預計在某些指標上可與Anthropic的Opus 4.8及OpenAI的GPT-5.5相抗衡。

上述進展發生在SpaceX以600億美元全股票收購Cursor的交易推進之際,標誌著馬斯克旗下AI版圖的加速整合。馬斯克還表示,SpaceX在今年接下來的時間裡,每月都將發佈完全從頭開始訓練的新模型。

03 Gemini 3.5 Pro:重構底座,押注質量優先

Google方面,據洩露資訊,Gemini 3.5 Pro將於7月17日正式發佈。據科技媒體Geeky Gadgets報導,GoogleDeepMind放棄了原有的2.5 Pro基座,轉而對Gemini 3.5 Pro進行全新預訓練,發佈時間也因此從原定的2026年6月推遲至7月17日。

從能力表現來看,Gemini 3.5 Pro的前端與視覺程式碼生成能力據稱出現跨越式躍升,在多項測試中壓制Anthropic的Fable 5,但在硬核推理與複雜工程任務上仍落後於對手。這一決策被外界解讀為Google在質量與速度之間主動選擇前者,以應對OpenAI GPT-5.6和Anthropic Fable 5的雙重壓力。

此外,Google同時被曝正基於這套新底座開發圖像模型Nano Banana Pro,劍指OpenAI的GPT-Image 2,意味著Google試圖在文字程式碼與圖像生成兩條戰線同步發力。

04 DeepSeek V4:峰谷定價落地,推理提速平行

中國方面,DeepSeek團隊於6月29日宣佈,V4正式版計畫於7月中旬上線,並同步引入峰谷定價策略。根據公佈的價格表,高峰時段API價格為平時價格的兩倍,平時價格與現行V4 API定價持平。高峰時段界定為每日上午9時至12時及下午2時至6時,官方表示此舉旨在更合理地配置資源、提升服務穩定性。

技術層面,DeepSeek於6月27日聯合北京大學發佈推理加速框架DSpark,並同步開源全端推測性解碼工具鏈DeepSpec,論文由公司創始人梁文鋒本人署名。實測顯示,DSpark部署後V4-Flash單使用者生成速度提升60%至85%,V4-Pro提升57%至78%,效果已線上上服務全量驗證。這也是DeepSeek完成500億元融資後首次對外發佈的開源技術成果。

對API使用者而言,峰谷定價將直接推高工作時段使用成本;對開發者而言,推理速度的顯著提升或可在高並行場景下部分抵消成本壓力,並進一步降低推理最佳化的落地門檻。 (硬AI)