登入
關鍵字
#遞迴自我改進
官方認證
RexAA
2026/09/20
•
已編輯
這是一篇把"RSI"講明白的科普級綜述!
如果你是第一次聽說 RSI,這篇文章可以當作一份入門指南。我們會帶大家把 RSI 從 0 理一遍,從最早嘗試自我改進的 AI 講起,聊到今天能改程式碼、造訓練資料、參與模型研發的 Agent,看看 AI 如何一步步學著改進自己的。 2026 年 7 月,OpenAI 發佈 GPT-5.6。它的成績單裡,第一次出現了一門有些反常的新科目:AI 能不能參與改進 AI 本身。 OpenAI 把這項能力列為自我改進(Self-improvement)。GPT-5.6 Sol 得到 57.9%,GPT-5.5 是 41.7%,兩代模型相差 16.2 個百分點。它考的不是模型又會做多少道常規題,而是它能不能走進 AI 研發現場:排查研究系統、最佳化 GPU 核心程序(GPU kernel)和訓練配方、運行機器學習實驗,甚至幫助改進另一個模型。 這不是一條孤立的新聞。同一個夏天,OpenAI 開始把智能體(Agent)稱為“自動化研究實習生”。快手 AgentX 已經讓智能體參與提出方案、寫程式碼和線上新舊版本對照(A/B 測試)。Google 表示,長期運行的智能體循環參與了下一版模型的精煉。Motus2 則把預測、評估和策略更新帶進了真實機器人。
科技
#RSI
#遞迴增益
#遞迴自我改進
讚
留言
分享
官方認證
RexAA
2026/09/14
•
AI開始改進“改進自己的方法”,RSI進入平方時代
讓模型自己生成訓練資料、自己改寫提示詞、自己修復程式碼,這條路線被稱為: 遞迴自我改進(Recursive Self-Improvement,RSI)。 但幾乎所有RSI系統都是同一套結構:一個固定不變的改處理程序序,反覆作用於模型。並往往只從Harness、Data或Model RSI的單一視角切入。 為了回應這一難題,CosmosMind聯合史丹佛、伯克利、MIT、清華、北大等十余家海內外高校發佈MetaRSI-v1。
科技
#遞迴自我改進
#RSI
#AI自進化
讚
留言
分享
官方認證
RexAA
2026/08/25
•
Tibo 最新訪談:Codex 之後,OpenAI 真正想做什麼?
Matthew Berman 最近採訪了 OpenAI Codex 負責人 Tibo Sottiaux,整期大概 44 分鐘。 如果你經常關注 Codex,應該對 Tibo 不陌生。他應該是 OpenAI Codex 的核心營運人員。 他在 X 上還有一個很出圈的外號: Reset Lord。
科技
#Tibo
#OpenAI
#遞迴自我改進
讚
留言
分享