Ilya交卷!黃仁勳砸50億押注SSI,首個模型疑本周發佈

AI速讀
由 Ilya Sutskever 創立的 SSI 實驗室傳出將於本週發佈首個顛覆性大模型。輝達(NVIDIA)已投入 50 億美元並開放最新 Vera Rubin 系統存取權以支持其研發。該模型核心在於導入「測試時訓練(TTT)」架構,使 AI 具備在執行任務時「邊想邊學」並即時改變大腦結構的能力,打破了現有模型依賴預訓練與擴大上下文窗口的限制。此舉被視為 AI 發展從「規模擴展」轉向「深層研究」的關鍵轉折,將挑戰現有 AI 巨頭的算力護城河。

Ilya Sutskever創立的「安全超級智能」實驗室(Safe Superintelligence,簡稱SSI),可能就在本周,甩出首個重磅模型!

圈內大佬瘋狂暗示,SSI將發佈首個顛覆性的大模型。

矽谷大佬瘋狂劇透:「AI將被徹底顛覆!」

知名投資人、a16z合夥人Martin Casado激動不已,直接暗示他最近接觸到了「今年最重磅的新模型」。


圈內立刻炸開了鍋,目光瞬間鎖定了Ilya的SSI。

原因很簡單:a16z正是SSI背後的核心投資方之一。 儘管也有人猜測Casado看到的可能是OpenAI下一代Astra模型。

但「非主流大廠」的突破傳聞甚囂塵上。


知名科技觀察者Andrew Curran更是激動地指出,這次的重大突破竟然不是來自主流大廠(比如OpenAI或Google),而是來自一家獨立實驗室,這讓人感覺「非常真實」。

最誇張的是AI觀察家Dan McAteer,他直接放話:「Ilya真正創造了超級智能,遊戲規則已經被改變了!」


月初投資者Gavin Baker就在播客裡直言:

SSI說他們將在8月發佈他們的模型。

如果你覺得這只是紙上談兵,不妨看看真金白銀的流向。

今年7月27日,輝達(NVIDIA)突然宣佈與這家沒有收入、沒有產品的神秘公司達成長期戰略合作,並將SSI的算力規模在未來12個月內瘋狂提升10倍

更有猛料爆出:這筆投資高達50億美元,而且輝達向SSI開放了下一代Vera Rubin系統的獨家存取權!


為什麼黃仁勳願意砸下如此重金?

在新聞稿中,輝達表示,他們是在「獲得了對其嚴密保護的研究成果的罕見訪問權(rare access)」 之後,才決定重金押注。

黃仁勳看到了什麼?結合今天的爆料,答案呼之慾出。

顛覆常識:AI學會了「邊想邊學」

要理解SSI這個新模型有多震撼,我們必須先明白現在的AI(比如ChatGPT、Claude)是怎麼工作的。

現階段的AI模型,無論參數多大,本質上都是在「預訓練」階段把知識固化在了權重裡。一旦訓練完成,它的「大腦」就被凍結了。

為了讓模型處理新資訊,各大廠瘋狂捲「上下文窗口」(Context Window),從100k捲到百萬等級。

這就好比開卷考試——模型的大腦沒有變聰明,只是你允許它帶進考場的「小抄」(上下文)越來越厚了。


即便是像OpenAI的o1這樣主打「測試時計算」(Test-time Compute)的推理模型,本質上也只是在草稿紙上多花點時間思考(消耗更多Token),它神經網路裡的連接、它的「腦細胞」依然是靜止的。

但SSI這次曝光的,是基於測試時訓練(Test-Time Training, 簡稱TTT) 的全新架構。

這意味著什麼?

當這個模型閱讀你給的一份長文件時,它不是把文件塞進「小抄」裡,而是真正地去「學習」它,產生梯度更新,改變自己大腦的結構。

閱讀完畢後,它已經變成了一個極其細微但全新進化的AI。

它不再需要巨大的上下文窗口,因為它把讀到的東西變成了自己真正的「內化知識」。

它不再受限於預訓練時的算力壟斷,一個小而精的、能在崗位上不斷適應進化的模型,足以吊打那些用海量算力堆出來卻不知變通的龐然大物。

行業裡目前競爭的是「模型能思考多久」,而Ilya下注的,是「模型能不能改變自己」

Ilya的瘋狂遠見

回看過去兩年,SSI的「零產品、零論文」狀態,一度讓外界懷疑他們是不是陷入了困境。

但如果把時間線連起來,你會發現,Ilya一直在下一盤大棋。

Ilya曾無數次向公眾傳達一個核心理念:我們所熟知的預訓練(Pretraining)時代,即將結束。

在2024年的NeurIPS大會上,他就做出了這個驚人預言。


到了2025年11月,在Dwarkesh Patel的播客中,他更進一步點破:「我們正在從Scaling的時代,邁向研究Research的時代。」


Ilya認為,整個行業被「AGI」和「預訓練」這兩個詞帶偏了。 人類從不是生而知之。

他心中真正的超級智能,不是一個在出廠時就背下了全網資料的龐大機器;而是一個「極其聰明、充滿無限好奇心的15歲天才」

這個15歲的孩子起初可能什麼都不懂,但只要你把他放在任何一個崗位上,通過不斷的試錯、學習,他能迅速掌握程式設計、醫學、法律,甚至任何未知的技能。


他進一步解釋:人類本身就不是「出廠即全能」的AGI,而是依賴持續學習(continual learning)。

真正的超級智能也應如此:部署本身就是學習過程,通過現實反饋不斷進化,而不是一次性預訓練完成後就「完成」。

這一理念直接決定了SSI的戰略:不追求短期產品,不發佈中間模型,只做「straight shot to safe superintelligence」(直奔安全超級智能),把研究重心放在高效持續學習與對齊上。


要實現這個目標,「元學習」(Meta-learning)是唯一解——模型不僅要掌握技能,更要掌握「獲取技能的方法」

這完美解釋了SSI為何異常低調。如果你正在建造一個徹底顛覆現有範式的新物種,你絕不會在範式還在搭建時就到處發部落格炫耀。

而紙包不住火,線索早已埋下。

2024年7月,學者Yu Sun等人發表了原始的TTT論文。

最關鍵的是,Stellar的聯合創始人、SSI的投資人Jed McCaleb,合著了一篇論文,直言

長上下文語言建模根本不是一個架構問題,而是一個連續學習問題!


研究方向一致、投資人親自下場聯名論文,再到如今的爆料,一切線索都指向了同一個事實:SSI把TTT從實驗室裡的學術概念,變成了真正的商業武器。

結語:AI的下半場,剛剛開始

現在,所有的目光都聚焦在這個8月。

無論是只有一小批極客能拿到的測試版,還是面向公眾的震撼發佈,SSI的首個模型一旦真的具備「測試時訓練」和「即時更新權重」的能力,整個AI行業的邏輯將被全部推翻。

各大廠堆積在資料中心的算力護城河、按百萬Token計費的商業模式、甚至開源權重的爭論,都將面臨降維打擊。

這證明了一件事:AI的競賽,根本沒有到「拼財力和算力就能贏」的收官階段。真正的技術飛躍,依然藏在那些敢於打破常識的頂級大腦裡。

這一次,Ilya Sutskever再次站在了歷史的十字路口。當年,是他的一句程式碼讓深度學習重見天日;如今,或許又是他,將親手終結大模型的「預訓練時代」。

你覺得Ilya這次能再次封神嗎?如果AI真的能「邊用邊進化」,人類離徹底失控還有多遠?(新智元)