#Gemini 3.0
重磅!DeepSeek V3.2 特別版發佈:性能超越GPT-5,硬剛Gemini 3.0「IOI/IMO金牌」
DeepSeek-V3.2系列模型正式上線作為“為Agent建構的推理優先模型”,DeepSeek-V3.2包含兩個版本:DeepSeek-V3.2:V3.2-Exp的官方繼任者,平衡了推理能力與生成長度,性能對標GPT-5,現已上線App、Web端及APIDeepSeek-V3.2-Speciale:專攻深度推理能力的極限版本,性能超越GPT-5,比肩Gemini-3.0-Pro,目前僅通過API提供技術報告顯示,DeepSeek-V3.2-Speciale在2025年國際數學奧林匹克(IMO)、國際資訊學奧林匹克(IOI)、ICPC世界總決賽及CMO中均取得了金牌級成績官方已公開上述競賽的最終提交結果,社區可通過assets/olympiad_cases進行二次驗證技術報告:https://huggingface.co/deepseek-ai/DeepSeek-V3.2/blob/main/assets/paper.pdf以下是詳細資訊核心能力與技術突破DeepSeek-V3.2基於三大技術突破,實現了高計算效率與卓越推理、Agent性能的統一:1.DeepSeek Sparse Attention (DSA):引入高效注意力機制,大幅降低計算複雜度,並針對長上下文場景進行了最佳化2.可擴展強化學習框架:通過穩健的RL協議與後訓練(post-training)算力擴展,實現了高性能表現3.大規模Agent任務合成管線:涵蓋1800+環境及8.5萬+複雜指令這一合成管線不僅提升了模型在複雜互動環境中的遵循度和泛化能力,更讓DeepSeek-V3.2將“思考”直接整合進工具使用(Tool-Use)的模型,同時支援在思考和非思考模式下使用工具API更新與Speciale版限制DeepSeek-V3.2:API使用模式與V3.2-Exp保持一致,作為日常主力模型(Daily Driver),提供GPT-5等級的性能DeepSeek-V3.2-Speciale:該版本專為解決複雜任務設計,消耗更多Token,目前僅作為API提供,具體限制如下:臨時端點:需使用base_url="https://api.deepseek.com/v3.2_speciale_expires_on_20251215"服務期限:該端點服務至2025年12月15日 15:59 (UTC) 截止功能限制:不支援工具呼叫(Tool Calls),僅用於支援社區評估與研究。定價:與DeepSeek-V3.2保持一致聊天範本重大調整DeepSeek-V3.2不再提供Jinja格式範本,並引入了“帶工具思考”及新角色設定。Python指令碼編碼:官方提供了encoding資料夾,包含Python指令碼(encoding_dsv32.py),用於將OpenAI相容格式消息編碼為模型輸入字串及解析輸出Developer角色:範本新增developer角色,專門用於搜尋Agent場景,官方API不接受分配給該角色的消息輸出解析注意:提供的解析函數僅處理格式良好的字串,生產環境需自行增加穩健的錯誤處理機制。程式碼示例如下:import transformersfrom encoding_dsv32 import encode_messagestokenizer = transformers.AutoTokenizer.from_pretrained("deepseek-ai/DeepSeek-V3.2")messages = [    {"role": "user", "content": "hello"},    {"role": "assistant", "content": "Hello! I am DeepSeek.", "reasoning_content": "thinking..."},    {"role": "user", "content": "1+1=?"}]# 思考模式配置encode_config = dict(thinking_mode="thinking", drop_thinking=True, add_default_bos_token=True)prompt = encode_messages(messages, **encode_config)tokens = tokenizer.encode(prompt)本地部署建議模型結構與DeepSeek-V3.2-Exp相同。採樣參數:建議設定 temperature = 1.0,top_p = 0.95。Speciale版提示:本地部署Speciale版本時,同樣不支援工具呼叫功能開源與協議倉庫及模型權重均採用 MIT License 授權。 (AI寒武紀)
一個重大里程碑。。。
大模型領域正在迎來重大改變,可能是顛覆性的改變。。。上周Google的Gemini 3.0發佈,市場反應驚豔,達到了chatGPT 5.0計畫達到的水平,因此可以說,Gemini 3.0是全世界目前最好的大模型。。。最好就最好嘛,為什麼是重大的里程碑?要知道,Google的大模型可不是用輝達GPU訓練的,Google一直用自己的TPU訓練。。。於是圈內大佬慌了。。。最好的大模型,竟然可以不用GPU訓練出來!原來大家一直看好並且All in 的Nvida+OpenAi,微軟、特斯拉、Meta、蘋果、亞馬遜。。。已經真金白銀投入幾千億美元,把輝達市值都推上了5兆美元,這是要被截胡?如果GPU失去了壟斷性,甚至於被掀了桌子,資本如何重新佈局?這個慘烈程度。。。我們這邊的寒王、摩王。。。要是點錯科技樹,代價是很大的。有幾個在等著IPO。。。GPU的架構是從圖形化渲染計算出發,做超級多核的通用平行計算,輝達在此基礎上做了驅動庫,可以把大規模的矩陣運算從CPU遷移到GPU上,GPU上有成千上萬個核;而TPU是一個相對封閉並且專用的處理器,專門為神經網路計算而設計的,在大規模矩陣運算摺積運算時速度遠超GPU。如果用萬兆超級節點的大模型,基於GPU訓練,有人計算過,真要訓練出具有人類智慧的大模型,可能要耗盡太陽系的所有能源。那麼在我們這邊,有誰可以站起來與Google對標呢?看戲吧。反正這一輪美股被推升在高位,達鏈首功,最近大跌啊。。。對全球資本市場會是一次血洗。 (金信融息)
GoogleGemini 3.0「全家桶」年度壓軸,前端不再需要人類!下周王者降臨
【新智元導讀】Gemini 3.0更近了!網友爆料稱,Google下一代旗艦模型將在10月22日發佈。一些拿到內測資格的開發者,放出了最全面的demo,Gemini 3.0能做到一次性直出網頁、遊戲、原創音樂等。前端開發,再也不需要人類。Sora 2之後,全網都在等待下一個G點的到來!本月AI大事紀,當屬GoogleDeepMind下一代旗艦模型Gemini 3.0「全家桶」的登場。傳聞稱,預計10月22日,Gemini 3.0就要出世了!內部實習生洩露在此之前,許多開發者紛紛拿到了內測資格,已經放出了一波驚豔demo。Gemini 3.0在前端開發上,實力驚人,可以一鍵直出網頁。六邊形小球物理測試已不算什麼,Gemini 3.0可以在3D六邊形測試中,小球運動也能遵循物理定律。前端編碼,或許真的不再需要人類了。更驚豔的是,網友@ʟᴇɢɪᴛ一句話,就能讓Gemini 3.0可以原創鋼琴音樂,旋律激昂澎湃。前端開發,被Gemini 3.0攻陷了前段時間,內部程式碼流出,Gemini 3.0「家族」目前有Gemini 3.0 Pro、Gemini 3.0 Flash兩個版本。根據網友實測的模型顯示,還有Gemini 3.0 Ultra。目前,gemini-beta-3.0-pro已在最新的Gemini-CLI提交中被引用。關於模型更多爆料,Gemini 3.0同樣採用了MoE架構,超兆參數,每次查詢啟動參數為150-200億參數。同時,上下文從100萬躍升至數百萬個token,可以處理整本書、程式碼庫。網頁、遊戲,一鍵直出從目前內測人士放出的Demo來看,Gemini 3的前端表現能力又得到了巨大提升。以下是一大波實測案例。比如生成一張包含第一代起始寶可夢的圖鑑SVG。生成複雜的分形動畫。網友還將同一個提示扔給Gemini 2.5 Pro和Gemini 3.0,後者一次嘗試就完成了「太空侵略者」的遊戲。Gemini 3.0在「城堡防禦」遊戲測試的表現同樣出色。為古代藝術博物館設計一個網頁,Gemini 3.0一次就做到了。鵜鶘騎自行車3D版還有人說Gemini 3 Pro建立了這座堡壘!但沒有透露具體的Prompts。測試前端能力最有梗的鵜鶘騎自行車,Gemini 3的表現也是斷檔的領先。眾多內測人士表示,Gemini 3.0 Pro太神了!唯一的要求是發佈時不要削弱它。「騎自行車的鵜鶘」,是在舊金山 AI 工程師世博會(AI Engineer World’s Fair)上,Simon Willison自創的圖像生成測試,作為回顧過去六個月LLM演進的幽默演講素材。在早期的模型表現效果如下所示。而Gemini 3 Pro甚至可以將「騎自行車的鵜鶘」做成3D版本的像素體藝術。眾多網友表示,3D很難,很難想像模型是怎麼做到的。同一個提示——生成Xbox 360手把的SVG圖像,Gemini 3.0更貼近真實效果。還有人內測了Gemini 3 Ultra。使用Gemini 3 Ultra生成了Minecraft風格版本的建築。說實話,這真的很難讓人相信!Gemini 3.0 Pro生成的另一個城堡。Gemini 3.0「發燒夢」2025年9月,Gemini的環比增長率為46.24%。遠高於其他產品,比如ChatGPT、Claude和Grok。如果本月Gemini 3全家桶正式發佈,並且效果遠好於預期的話,或許還能讓Gemini更上一層樓!還有網友透露了Gemini 3 Pro的訓練細節。Gemini 3 Pro在今年4月就已經開始訓練,預訓練在7月左右結束。然後用了大約2~3個月進行後訓練。還有網友表示,Gemini 2.5已經很老了,今年3月25日以「Experimental」(實驗)版本形式首次推出。在6月17日,Gemini 2.5的Pro和Flash版本進入正式狀態。目前來看,內測洩露的結果可以初步得出,Gemini的視覺能力非常強。有網友認為,這將對前端開發和UI/UX設計產生較大的影響。不知,這是不是所有人關於Gemini 3.0的「發燒夢」。 (新智元)