Google又發新模型了,不是大家苦等的3.5 Pro。
Google一口氣甩出三款新模型:Gemini3.6 Flash、Gemini3.5 Flash-Lite,外加一版叫Cyber的網路安全特供。
清一色Flash系,主打一個便宜、快、能規模化地跑Agent。
但是!兩個月前在Google I/O大會的台上,劈柴哥當著一屋子開發者的面拍胸脯:
再給我們一個月,就把3.5 Pro交給你們。
現在兩個月過去了,3.5 Pro依舊沒影。
開發者等來的是3.6 Flash的發佈公告,以及藏在部落格末尾的一句:
Gemini 4已經啟動了史上最激進的預訓練。
意思是要憋更大的了??
Flash三連發
先不說Pro到底怎麼了,咱先把剛發這三個新面孔盤一盤。
3.6 Flash,是這三款裡最能打的,程式碼、AI科研、多模態能力均有提升。
編碼基準DeepSWE從37%抬到了49%,多模態的OSWorld從78.4%幹到83.0%,知識截止時間也一路推到了2026年3月。
按照官方給的資料,3.6 Flash的輸出token消耗比上一代3.5 Flash少了17%。
在一些編碼場景裡這個數字能拉到65%。
也就是說同等任務下推理步驟更少、工具呼叫更省,而且還降價了。
價格上每百萬token輸入$1.5,輸出$7.5,比3.5 Flash更便宜。
3.5 Flash-Lite,是3.5系列中速度最快、性價比最高的模型。
雙A指數顯示其每秒可輸出350個 token,讀一篇上萬字的長文可能不到半分鐘。
在Agent工作流場景下,性能相較前代Flash-Lite模型實現大幅提升。
成本也是白菜價,輸入$0.3/M,輸出$2.5/M。
但就這麼個低配版,在不少編碼和Agent任務上甚至超越了3 Flash(不是Lite)。
至於第三個Cyber,它基於Flash微調,專門干找漏洞、補漏洞的活兒。
而且不向普通人開放,只面向政府和可信夥伴搞限量試點。
“很猛,但我不敢隨便給你用”——
怎麼有一股熟悉的Anthropic味兒…
但官方資料歸官方資料,新模型一出來評價卻是一般。
有網友反饋,在真實使用場景裡,3.6 Flash的使用成本比GPT-5.6 Sol medium還要高,但智力表現反而更低。
3.5 Pro去那了
儘管Google一次性更新多款Flash中端模型試圖補齊產品線,但開發者真正期待的旗艦Pro依舊缺席。
把時間線捋一下,5月19號的I/O大會上,Pichai拍胸脯說一個月交付。
結果6月到了,鴿了。
彭博社當時爆過內幕,採訪了10名現任和前任員工,說是3.5 Pro因為coding能力不達標被內部壓住了。
於是團隊緊急在6月底更新訓練資料試圖補救,結果“令人失望”。
還有傳聞是,Google一度推翻基座重頭訓練,目標7月17號上線,但在最新的公告中,3.5 Pro目前仍然停留在partner testing的狀態——
問就是ready了就發。
如果只是Pro在延期,那頂多是個項目管理問題。
但Google卻宣佈Gemini 4的預訓練已經跑起來了??
而且還被官方定性為史上最雄心勃勃的一次。
外界普遍猜測,這背後可能涉及全新的訓練架構、更大規模的資料飛輪、甚至多模態能力的代際躍遷。
Gemini 4是不是真的開工咱不知道,只能說Google的命名體系已經徹底亂了。
Nano、Flash、Flash-Lite、Pro、Ultra、Cyber六條產品線同時維護,版本號還各跑各的,Flash幹到了3.6,Pro卻卡在3.5。
而就在Google還很混亂的這兩個月裡,Anthropic發了Fable 5,xAI發了Grok 4.5,OpenAI迭代了GPT-5.6三個小版本。
Google現役能打的旗艦還是今年2月那款3.1 Pro,旗艦這條線等於斷檔了大半年。
那麼問題來了,3.5 Pro如果再拖幾個月,會不會一出生就過時了…… (量子位)
