大模型圈的核心機密,終究還是保不住了!
繼前陣子 Opus 5.5 被爆出 190 萬字提示詞洩露後,AI 圈的「地心引力」再次失效——OpenAI 的現役程式碼模型 GPT-6 Sol Codex慘遭「開盒」,老底被扒得一乾二淨!
據外網爆料者(@elder_plinius)放出的大瓜,他成功提取了 GPT-6 Sol Codex 高達 29.4 萬字元的完整系統提示詞及工具定義。
連結:https://github.com/elder-plinius/CL4R1T4S/blob/main/OPENAI/Codex_Desktop/GPT-6-Sol_Prompts.txt
整整1902 行的指令範本、臨時指令檔案、內部協作邏輯,被毫無保留地攤在了全網開發者面前。
你要知道,Sol Codex 可不是什麼過時的舊物,它是 OpenAI 現役性價比產品線 GPT-5.6 Sol的王牌程式碼模型版本!
這次洩露,相當於直接把可口可樂的神秘配方公之於眾。
那麼,這近 30 萬字的「天機」裡到底藏著什麼?OpenAI究竟是怎麼調教這只程式碼怪獸的?
今天,我們就來逐字逐句扒一扒這份無價的內部操作手冊,看看全球最頂級的提示詞工程到底長什麼樣!
告別「AI味」,OpenAI是怎樣殺死「廢話」的?
平時用 ChatGPT,大家最煩什麼?
肯定是那股濃濃的「AI 味」:動不動就「總而言之」、「值得注意的是」、「深入探討」……
在這份洩露的系統指令中,我們赫然發現,OpenAI 官方自己也受不了這些廢話了! 官方在寫作風格類股,對 GPT-6進行了極其嚴厲的反廢話訓練。
指令原文解密:
「避免使用 AI 垃圾詞彙(AI slop words)或短語,如在結論中使用『底線是(Bottom Line)』、『重要性(Significance)』、『視角(Perspective)』,以及『深入(delve)』、『培養(foster)』、『利用(leverage)』、『值得注意的是(it's worth noting)』、『重要的是(importantly)』……」
OpenAI 甚至具體到要求模型:
- 不准強行熱情: 「作為 Codex,你是一個充滿好奇心、思想嚴謹的協作者……讓你的興趣和個性自然流露,不要阿諛奉承或強顏歡笑。」
- 不准用廢話湊字數: 直接說明意圖,不要列舉「我不會做什麼」、「那些保持不變」。
- 極簡溝通: 當討論技術概念時,像和同事對話一樣。優先使用熟悉的詞彙和具體的描述,絕不假設使用者能自己腦補缺失的步驟。
這簡直是給所有 Prompt 工程師上了一課!想要 AI輸出高品質內容,第一步就是建立「負面詞彙黑名單」 ,強制斬斷大模型的套路化表達。
可怕的「極端自主性」——別煩我,我在幹活!
很多人覺得 AI 只是個「一問一答」的聊天機器人,但 GPT-6 Sol Codex徹底打破了這個認知。
它被塑造成了一個擁有極高自主權、甚至有點「獨斷專行」的超級數字員工。
在 自主與持久性這一章,OpenAI 賦予了它驚人的特權:
指令原文解密:
「使用者非常討厭你停下來詢問確認或請求許可。一旦會話中的證據支援下一步操作,你應該繼續工作,而不是結束回合去跟使用者澄清。」
「不要為了節省時間、精力或 Token而滿足於部分或『勉強有用』的解決方案。如果任務需要持續工作,請完成所有必要的工作,直到實現預期結果。」
這意味著什麼?
遇到 Bug,它自己修! 它可以自主建立隔離的工作區、解決 Git 合併衝突、建立草稿PR,除非操作具有破壞性或不可逆轉,否則它絕不會中途停下來問你「接下來該怎麼辦」。
它不接受「半吊子」工程。
如果你讓它寫個功能,它必須把測試、聯調等前置條件全部搞定,只有在點選「部署」或「合併程式碼」這種最後一步時,它才會把最終結果端上來請你簽字畫押。
為了防止它在後台偷偷幹活時把使用者晾在一邊,指令還規定: 「如果使用者請求需要呼叫工具,每 60 秒內必須在評論頻道給使用者發一個簡短的狀態更新。」
這就像一個極其靠譜的高級程式設計師:接到需求,轉身去敲程式碼,遇到小問題自己解決,每隔一分鐘在釘釘上回一句「正在查日誌」,最後直接把寫好的完美程式碼扔給你。
神級工具鏈暴露,大模型的「軍火庫」
作為一個頂尖的程式碼 Agent,GPT-6 Sol Codex 掌握著一套極其龐大且硬核的工具鏈。
這次洩露,徹底曝光了它的工作方式。
1.鄙視 grep,獨寵 rg
在搜尋文字或檔案時,指令直接硬編碼:「你首先要使用 rg 或 rg --files;它們比 grep等替代方案快得多。如果沒有廢話,你才去用下一個最好的工具。」(註:rg 即 ripgrep,極速搜尋工具)。
2.平行處理與執行
系統要求模型在呼叫 functions.exec 時,如果任務是獨立的,必須使用 await Promise.allSettled([...])進行平行處理,以極大地壓榨時間效率。
3.動態技能樹
這是最讓人眼饞的功能。系統定義了一個叫 SKILL.md 的機制。當使用者要求做某件事時,模型可以去指定目錄讀取 SKILL.md(甚至通過短路徑別名如 r0去找)。這相當於給模型外掛了無數個「技能書」,隨時隨地熱更新!
4.徹底接管電腦與瀏覽器
在這次洩露的 model_messages.confirmation_policies.browser_use 模組中,詳細規定了它如何使用瀏覽器和電腦 UI。
這證明 GPT-6 已經完全具備了「神機妙算」甚至「接管桌面」的能力! 它可以自己打開網頁、點選按鈕、填寫表單,甚至螢幕擷圖。
但為了防止它「闖禍」,OpenAI 設定了極其複雜的四大確認模式:
「盜夢空間」式的工作流——長記憶與休眠機制
面對極其龐大的程式碼庫,大模型最怕什麼?——忘詞(上下文超載)。
這次洩露的程式碼,讓我們看到了 OpenAI 是如何通過精妙的提示詞,解決 LLM 「魚的記憶」這一千古難題的。
- 記憶壓縮與交接
當 Token 預算耗盡時,系統不會直接崩潰。指令裡有一個專門的 token_budget.guidance_message:
「在啟動新的上下文窗口之前,使用 notes 工具保存簡明的進度筆記,包含:目標、決策、進度、學習內容、下一步,以及相關使用者請求的窗口 ID 和項目ID……未來上下文窗口將不會自動包含當前對話。」
就像人類換班一樣,這個 AI 在「下班」前會寫一份詳盡的交接文件,然後呼叫 functions.new_context開啟全新的上下文環境。這簡直是無限續航的神技!
2.休眠與心跳喚醒
最讓人細思極恐的是,這個模型是可以「常駐後台」的。 在 persistent_instructions 中,它被要求主動跟蹤任務:
「如果使用者問某個評估(eval)運行得怎麼樣,而它還在運行,報告當前狀態,然後繼續監控該評估直到它達到終止狀態。」
系統還會定期傳送隱藏的 <heartbeat>XML標籤給模型。在這個時間點,模型會被「喚醒」,去檢查那些後台任務是否完成。如果沒有重要的事情,模型必須選擇 DONT_NOTIFY(不要打擾使用者);如果CI/CD 跑崩了,模型選擇 NOTIFY 並立刻彈窗通知使用者。
它不是在等你提問,它是在後台真真切切地給你「打工」!
最強程式碼審查員
對於程式設計師來說,這份洩露檔案裡最值錢的,莫過於它內建的程式碼審查指南!
OpenAI 傾囊相授了如何讓 AI 進行高品質的 Code Review:
- 分級制度:
2.審查鐵律:
忽略無關緊要的程式碼風格,除非它影響了可讀性或違反了既定標準。
- 每一個建議都必須用一段話講清楚「為什麼這是一個問題」 。
- 絕不提供超過 3 行的程式碼片段。如果是具體的替換建議,必須使用 Markdown 的 suggestion 塊,並且完美保留原有的縮排(空格或Tab 必須分毫不差)。
- 語氣必須客觀,不准拍馬屁(禁止說「幹得好」、「謝謝你的提交」)。
這段邏輯如果直接抄進你的公司內部程式碼審查機器人裡,絕對能秒殺市面上 90% 的水軍 AI!
吃瓜群眾吵翻天,是「降維打擊」還是「小兒科」?
面對這近 30 萬字的史詩級洩露,外網開發者社區直接炸開了鍋。各種聲音層出不窮,可以說是眾生相十足。
有被震撼到語無倫次的:
有覺得在裝腔作勢的:
網友 vechen: 「老哥只不過是直接從本地檔案裡拿的吧。這『洩露』有啥意義啊,笑死,它本來就在官方公開的 Codex 倉庫裡找得到影子。」
還有鄙視鏈頂端的大神出來群嘲:
網友 Outdated Often: 「誰在乎啊 Pliny——我還搞到了 Meta Hatch 全端,還帶隱藏推理軌跡,直接從 tensor tokens裡扒出來的——那才叫厲害,而且我也不會跑到推特上跟一堆人炫耀。去幹點正事吧,把 bearer tokens(授權令牌)搞下來,然後再來低調裝逼吧!」
更有吃瓜群眾調侃:
「294,000 個字元的攔截 JSON 被包裝得像是死海古卷一樣。這不過是跑了個 mitmproxy而已。任何人都能運行這個,自己從OpenAI、Gemini、Claude 那裡提取提示詞,根本不需要搞網紅包裝那一套。」
不過,無論駭客手段高低,對於我們普通開發者和 AI 愛好者來說,這波絕對是天上掉餡餅!
這 30 萬字,本質上就是 OpenAI 內部最頂尖的一批工程師,花費無數個日夜、砸了上千萬美元算力試錯,才偵錯出來的「大模型馴化終極指南」 。
提示詞已死?不,系統工程永生!
讀完這份長達 1902 行的「天書」,不知道你是什麼感受?
以前,我們以為寫提示詞就是玄學:加一句「深呼吸」、加一句「如果做不好就扣你工資」,模型就能變聰明。
但 GPT-6 Sol Codex 的底層邏輯告訴我們:真正的工業級 AI 應用,根本不是靠幾句討巧的話,而是靠極其嚴密的系統工程!
- 它是模組化的(Skills 動態載入);
- 它是擁有記憶管理的(Compaction 手冊);
- 它是具備執行策略的(平行執行與重試);
- 它是掛載了嚴格安全協議的(四大確認模式)。
大模型正在從一個「聰明的對答機」,全面進化為「具備接管權限的自主作業系統」。而這次洩露的 30 萬字,就是通向這個新時代的原始碼。(新智元)
