Gemini旗艦模型發佈延期,編程能力提升不及預期

據媒體報導,Google旗艦最強模型Gemini 3.5 Pro的發佈已較原定計劃推遲數月,主因在於Google正試圖提升模型的編程能力,但進展不如預期。許多工程師和管理層擔憂Google正在失去市場先機。部分研究人員的挫敗感已演變為離職潮,Anthropic等成為主要去向。消息落地,Google股價當日重挫5%。

Google在AI競速中正面臨日益嚴峻的內部壓力。其最強旗艦模型Gemini 3.5 Pro的發佈已較原定計劃推遲數月,與此同時,競爭對手在編程能力上接連超越,令Google的市場地位愈加被動。

據彭博援引知情人士透露,延遲的主因在於Google正試圖提升模型的編程能力,但進展不如預期。上月底Google曾更新訓練數據以改善這一短板,然而結果令人失望。

OpenAI與Meta近期相繼發佈的新模型,在AI代碼生成能力上已進一步超越Google現有產品。

這一局面在Google內部引發廣泛不滿。據10名現任及前任員工表示,許多工程師、AI研究人員和管理層人士擔憂,Google正在失去市場先機。部分研究人員的挫敗感已演變為離職潮,Anthropic等頂尖實驗室成為主要去向。

消息發佈後,$Google-A (GOOGL.US)$盤中跳水,截至收盤,日內下跌4.4%。

組織複雜性拖累發佈節奏

Google在AI模型發佈上的延誤,與其龐大產品矩陣帶來的內部協調難度密切相關。據知情人士表示,Google在模型發佈流程中涉及多層利益相關方,需將AI能力整合至搜尋、地圖、YouTube等眾多產品線,這本身便會造成時間損耗。

前員工將這種協調困境比作"燒開一片海洋"。當各部門方向不一致、任務在多個團隊重複推進時,維持統一的產品戰略愈發困難,任何單一產品也都難以獲得足夠資源在市場上取得突破。

Google發言人就此回應稱,公司"正在快速推進多個模型系列,同時保持對客戶的高性價比",並表示目前正與合作夥伴測試3.5 Pro、升級版Flash及其他模型,同時與美國政府就模型測試及更廣泛的行業規範框架展開積極溝通。

編程能力之爭折射內部分歧

AI代碼生成能力已成為本輪模型競爭的核心戰場,而Google在這一領域的佈局卻受到內部掣肘。據前員工表示,Google聯合創始人Sergey Brin等人曾積極推動公司加速佈局AI編程,但相關努力因內部派系角力而受阻。

目前,Google Cloud、Google DeepMind以及Android團隊均在獨立開發面向開發者的AI編程工具,部分消費產品團隊亦有參與,多線並進進一步分散了資源。

內部阻力同樣不容忽視。部分工程師秉持"代碼應由人類編寫"的原則立場,對AI代碼生成持保留態度。早期推廣階段,出於對專有代碼洩露至訓練數據的安全顧慮,Google一度限制員工使用Gemini編寫或分析代碼,這一政策雖已鬆綁,但已錯過大量內部實驗機會。

Google方面表示,在最近一屆Cloud大會上,公司宣佈其內部75%的代碼目前已由AI生成,且經過審核後成功進入生產環境,符合Google標準。

為減少內部協調混亂,Google首席AI架構師Koray Kavukcuoglu正與主工程團隊合作,推動內部AI編程工具整合;DeepMind內部也於今年早些時候組建了專攻AI編程的新團隊,由研究工程師Sebastian Borgeaud領銜。

目前Gemini 3.5 Flash口碑參差不齊

在3.5 Pro正式發佈之前,Google現有的Gemini 3.5 Flash已在市場上留下參差不齊的口碑。設計平台Figma的產品經理Rodrigo Davies表示,Figma已將3.5 Flash接入其新推出的AI助手"Figma agent",認為該模型在速度與質量之間實現了良好平衡。

然而,拉丁美洲在線教育平台Platzi的創始人兼CEO Freddy Vega給出了截然不同的評價。他指出,3.5 Flash定位尷尬:價格高於上一代3.1 Flash,速度卻更慢,與競爭對手的旗艦產品相比能力差距依然明顯,且在處理結構化數據時表現欠佳。

他表示,其團隊在需要兼顧速度與推理能力的任務上,已從Google轉向Anthropic的中端模型Claude 3.5 Sonnet。

AI研究人員普遍認為,Gemini目前最大的競爭優勢在於對Google搜尋數據的調用能力,而在構建最強模型這一維度上,Anthropic與OpenAI已居於領先位置。Google表示,公司在多模態輸入處理及AI世界模型等領域仍具備差異化優勢,但能否將這些優勢轉化為市場份額,仍有待觀察。 (華爾街見聞)