登入
關鍵字
#RSI
官方認證
RexAA
前天 18:11
•
當AI開始“自己教自己”:Opus 5.5是首個RSI訓練出的大模型?
Google工程師Patrick推測,Opus 5.5模型可能由Anthropic內部更強的"教師模型"Model 2通過知識蒸餾訓練而成,並可能是首個體現"遞迴自我改進"路徑的產品模型。目前無公開證據證實,但Anthropic已確認Model 2存在,且其程式碼庫中逾80%程式碼由Claude撰寫。該趨勢表明模型能力提升與推理成本下降有望同時實現。 Anthropic最新發佈的Claude Opus 5.5,在性能大幅躍升的同時將運行成本壓低40%,這一反常規的組合引發了業界對其訓練方式的密切關注。 社交平台X上,Google工程師Patrick C Toulme據此提出一個推測:Opus 5.5可能經由Anthropic內部更強大的"教師模型"Model 2蒸餾而來,並可能是首個體現"遞迴自我改進"(RSI)路徑的產品模型。 目前沒有公開證據直接證實這一推斷,但Anthropic已公開確認Model 2的存在,且該公司發佈的RSI相關文章顯示,AI參與AI研發的程度正在快速深化,這使得上述猜測具備一定背景。
科技
#AI模型
#Anthropic
#Opus 5.5
61人
讚
留言
分享
官方認證
北風窗
前天 14:28
•
梁文鋒用沙盒開啟RSI
DeepSeek聯合清華大學發表了一篇文章,署名的最後一人是梁文鋒。 文章表面上是說DeepSeek訓練Agent所使用的沙盒,但是論文第6節越看越不對勁。字裡行間寫了三個英文字母:RSI。 通過這個沙盒,Agent能建立自己需要的環境,這個環境會再次訓練Agent,被訓練的更強的Agent會創造更好的環境。 由此形成了一個小型的RSI閉環。
科技
#梁文鋒
#DeepSeek
#清華大學
69人
讚
留言
分享
官方認證
RexAA
2026/09/20
•
已編輯
這是一篇把"RSI"講明白的科普級綜述!
如果你是第一次聽說 RSI,這篇文章可以當作一份入門指南。我們會帶大家把 RSI 從 0 理一遍,從最早嘗試自我改進的 AI 講起,聊到今天能改程式碼、造訓練資料、參與模型研發的 Agent,看看 AI 如何一步步學著改進自己的。 2026 年 7 月,OpenAI 發佈 GPT-5.6。它的成績單裡,第一次出現了一門有些反常的新科目:AI 能不能參與改進 AI 本身。 OpenAI 把這項能力列為自我改進(Self-improvement)。GPT-5.6 Sol 得到 57.9%,GPT-5.5 是 41.7%,兩代模型相差 16.2 個百分點。它考的不是模型又會做多少道常規題,而是它能不能走進 AI 研發現場:排查研究系統、最佳化 GPU 核心程序(GPU kernel)和訓練配方、運行機器學習實驗,甚至幫助改進另一個模型。 這不是一條孤立的新聞。同一個夏天,OpenAI 開始把智能體(Agent)稱為“自動化研究實習生”。快手 AgentX 已經讓智能體參與提出方案、寫程式碼和線上新舊版本對照(A/B 測試)。Google 表示,長期運行的智能體循環參與了下一版模型的精煉。Motus2 則把預測、評估和策略更新帶進了真實機器人。
科技
#RSI
#遞迴增益
#遞迴自我改進
263人
讚
留言
分享
官方認證
美股艾大叔
2026/09/18
•
剛剛,Gemini 4 Pro偷跑上線!碾壓Astra和Fable
真是深藏不漏! 這一次,Google終於把底牌扔出來了。 就在這兩天,大模型競技場Arena悄然殺入一款新模型,名字竟掛著「gemini-3.8-flash」。 上手實測的AI大佬和開發者交手幾輪後,幾乎倒吸一口氣——
科技
#Gemini 4 Pro
#Astra
#Fable
190人
讚
留言
分享
官方認證
RexAA
2026/09/15
•
突發!Opus 5.2深夜上線,RSI真來了?
今天清晨,Opus 5.2悄悄上線了。 許多開發者發現,新一代神級模型Claude Opus 5.2,已經在 Claude Code 中開啟灰度測試! 而且,此前一份內部風險報告顯示,Anthropic正在動用「核武器等級」的未發佈模型Model 2。它接管了公司大部分程式碼編寫,將替代85%研究團隊。 傳說中的RSI,真的來了。
科技
#Anthropic
#Opus 5.2
#AI模型
284人
讚
留言
分享
官方認證
RexAA
2026/09/14
•
AI開始改進“改進自己的方法”,RSI進入平方時代
讓模型自己生成訓練資料、自己改寫提示詞、自己修復程式碼,這條路線被稱為: 遞迴自我改進(Recursive Self-Improvement,RSI)。 但幾乎所有RSI系統都是同一套結構:一個固定不變的改處理程序序,反覆作用於模型。並往往只從Harness、Data或Model RSI的單一視角切入。 為了回應這一難題,CosmosMind聯合史丹佛、伯克利、MIT、清華、北大等十余家海內外高校發佈MetaRSI-v1。
科技
#遞迴自我改進
#RSI
#AI自進化
233人
讚
留言
分享
官方認證
RexAA
2026/09/07
•
OpenAI首席科學家:我們已造出異星心智!全人類都要剎車了
破天荒,OpenAI同一天都在宣告:RSI真的來了! 就在剛剛,首席科學家Jakub Pachocki發佈了一篇萬字重磅長文——An Alien Mind(一個異星心智)。 一打開字裡行間,全是極度冷靜後的悚然: 我們創造不是人類智力的延伸,而是一個人類根本無法完全理解的「異星心智」!
科技
#OpenAI
#RSI
#Jakub Pachocki
238人
讚
留言
分享
官方認證
美股艾大叔
2026/08/10
•
AGI之後,矽谷又為資本開支找了一個新理由
①GoogleDeepMind首席戰略官表示,RSI正成為AI資本開支的核心投資邏輯。②OpenAI、Anthropic都已押注這一方向。③「RSI的到來,可能比大多數機構的預期時間要更早。」 市場對AI資本開支的疑慮尚未散去,Google已經在為後續的投資「囤積糧草」。 日前,Google母公司Alphabet正計劃通過發行債券再籌資250億美元,此次發債最高認購金額約1150億美元,為發行規模的逾四倍,也是今年投資級債券發行中認購規模第三大的交易。 在這次業績期中,Google的超大規模資本開支早已引發過市場憂慮:「燒錢」能取得回報嗎,到底是為了什麼?而如今,這家巨頭似乎找到了新的理由。
美股
#AI資本開支
#RSI
#投資邏輯
229人
讚
留言
分享