凌晨一點,準時蹲在OpenAI DevDay的直播間。
直播大概一個小時,更新恨不得有20多個,一場直播下來,震驚到椅子爆炸,癱坐在地,久久不能平息(doge)。
OpenAI先端出24小時線上的Dot,又給人和Agent蓋了一間共同工作的Space,GPT-6.1 Sol登場,Ultrafast模式、Pro 500接踵而至。
這篇文章,我將用最直白、最簡單、最不繞彎子的方式,快速帶你們看懂這次DevDay到底發了什麼,有那些真的能改變生活、那些只是補課。
以及,狠狠地給OpenAI抓點漏洞,看看他們這次迴避了那些問題。
一、Dot
放在最前面的當然是這次最重要的新產品。
這是一個你不用一直盯著、也不用每次重新交代背景的常駐Agent。
你可以把它簡單理解成Muse和Cue的中間形態。
它首先像Muse,是一個24小時線上的個人Agent;但它又比普通的個人助理更“實體化”——每個Dot都有自己的身份和權限體系,有一台獨立的雲端電腦和瀏覽器,可以連接4000多個應用,同時處理多個項目。
你可以給Dot自訂名字、形象和角色。
你隨時可以到它的雲電腦裡看看它正在幹什麼,也可以授權它連接你的筆記本,直接把它帶到真實工作環境。
一個Dot可以同時接手多個項目,自主往前推進。你想到新任務直接丟過去就行,不需要不停開新對話,也不用一步一步教它怎麼做。
平時,你可以在網頁版、桌面端和手機端給它發消息或直接打電話;它也會主動聯絡你,匯報進度、提問題,或者等你做決定。同一個Dot會在不同管道間保持上下文——ChatGPT之外,目前已經支援Slack和Teams,後續還會接入簡訊。
OpenAI明確說,未來會讓多個Dot組成團隊,一起替使用者工作。
目前,Dot正在符合條件的市場逐步開放給Pro、Business Premium和Enterprise使用者。OpenAI還在少量企業中測試一種更“正式員工化”的專職Dot,它們會在組織內部擁有獨立身份和明確職責。
第一個Dot包含在Pro和Business Premium訂閱裡,本身聊天不消耗ChatGPT用量;但如果讓它替你啟動Codex或Work任務,還是會正常扣額度。
二、ChatGPT Space
既然Agent有了身份和電腦,OpenAI把工作台也一起搭上了。
ChatGPT Space,簡單來講就是一個人和Agent的共享工作空間。它取代了原本的Library,“倉庫”爆改“辦公室”。
你可以把檔案、頁面、簡報、表格和項目資料放進同一個Space裡,再隨時@ChatGPT、Codex或者Dot,讓它們基於這些共享內容繼續工作。
它最核心的部分叫Page,是一種可以多人即時編輯的文件……就形態上,有點像飛書或者WPS的線上文件。
你可以往裡面放文字、圖片、圖表和互動工具,讓ChatGPT或Dot直接修改內容、整理清單、補圖表、繼續研究。Pages還可以從已經連接的工具裡持續獲取資訊,甚至設定自動更新。
目前Space面向Pro、Business和Enterprise開放,網頁端和桌面端可以建立、編輯、協作;移動端首發階段只能尋找、閱讀和分享,暫時不能建立或編輯。協作版Slides和Spreadsheets還在路上。
三、GPT 6.1 Sol
看到這裡就不得不感嘆,GPT 6 Sol才發佈了幾天?
6.1 Sol是6 Sol的升級版,根據OpenAI給它的定位,它在複雜程式設計、電腦操作和專業工作上能做到接近GPT-6 Astra的水平,但價格仍然維持在Sol檔(僅為Astra的五分之一)。
GPT-6.1 Sol API輸入依然是2美元/百萬Token,輸出10美元/百萬Token,快取輸入0.1美元。
發佈會現場展示了幾項Agent相關Benchmark:在程式設計評測DeepSWE v1.1上,GPT-6.1 Sol達到75.22%,略高於Astra的73.23%;電腦操作評測OSWorld 2.0上,6.1 Sol約71.42%,Astra為73.49%;但在科學任務Terminal-Bench Science上,Astra仍明顯領先,68.10%對57.02%。
OpenAI已經把它開放給Plus、Pro、Business、Enterprise和Edu使用者,可在ChatGPT Work和Codex使用,暫時還不進入普通Chat。
四、Ultrafast
接下來是現場呼聲非常大的一項,Ultrafast模式。
事實上OpenAI早在8月就預覽過Ultrafast,當時跑的是GPT-5.6 Sol,最高可達到標準模式約14倍速度,最初只面向少量API客戶開放。
這一次Ultrafast被帶到了GPT-6 Astra,並正式進入ChatGPT Work和Codex。
根據官方描述,該模式在Codex裡Token生成速度最高可提升到8倍,約300 tokens/s;在API裡最高可提升到6倍。
不過,目前首發只開放給Pro 500,以及符合條件的Enterprise和Edu工作區,其他訂閱那怕額外買credits也不行——除非直接用API。在Work或Codex裡使用時,可以直接選擇GPT-6 Astra的Ultrafast模式。
OpenAI還預告,GPT-6.1 Sol的Ultrafast模式也將在未來幾天上線。
五、Pro 500
這是一個更高檔的Pro訂閱,月費500美元,所以叫Pro 500。
核心賣點主要有兩個:給你最多的可用額度(Plus的25倍),以及GPT-6 Astra的Ultrafast模式。
與此同時,Pro 200也重新開放購買了。
六、Codex更新合集
這次DevDay給Codex補了一大堆能力,請容許我放在一起講。
首先是Codex Cloud。現在Codex的雲端開發環境可以直接復用,不用每次重新建一個乾淨沙箱。你可以在電腦上啟動任務、用手機遠端操作,或者直接從其他裝置繼續;團隊還能共享已經配置好的環境、權限和依賴。
Codex CLI也升級了,現在可以直接用語音和Codex對話,並且加入了一個新的/agents檢視,可以把工作分給多個Agent,同時看不同任務做到那了。另外,Prompt現在可以直接編輯,會話也可以恢復,還加入了內建worktree支援——不同Agent可以在彼此隔離的Git工作樹裡分別修改程式碼,減少多工同時推進時互相打架的情況。
Codex還補上了更完整的程式碼審查功能。你可以先看摘要和diff,再追問潛在問題;也可以讓Codex在你不線上的時候自己去雲端跑初審。目前支援GitHub Pull Request和GitLab Merge Request。
Codex Security Cloud這次也迎來了一次大升級:它現在默認接入Daybreak Blue,可以呼叫更強的網路安全模型。除了按需掃描,它還可以直接掃描整個GitHub倉庫,持續檢查新提交,調查並去重安全問題,再把修複方案整理好交給你審查。即使電腦已經合上,這些任務也會繼續在雲端運行。
Agents API這邊也補上了computer use。現在OpenAI直接託管底層Codex執行框架,多Agent、工具搜尋、工具呼叫、上下文壓縮和computer use都能一起用,開發者只需要定義任務、工具和資料。如果對這部分比較陌生,可以看我們之前的文章。
七、Plugins
外掛這邊,分發、自動化和企業整合都往前走了一步。
OpenAI重做了外掛的建立、提交和發現流程。開發者現在可以更完整地打包和提交外掛,使用者則通過統一目錄去發現和安裝它們。目錄裡的排序和推薦也會繼續最佳化。
外掛還新增了基於MCP的事件觸發能力。連接的應用一旦發生指定變化,就可以主動喚起ChatGPT繼續工作——這也是前面Pages能夠持續更新的重要底層能力之一。
另外,企業現在可以把受支援的ChatGPT外掛直接接進自己搭的網站。同一個工作空間裡的成員可以用各自身份和權限登錄同一應用,並呼叫各自連接的資料;OpenAI還簡化了自動化流程的加入和管理,讓站點裡的共享資訊可以持續更新。這項能力目前面向Business、Enterprise、醫療保健版和Education開放。
八、剩下的更新,一口氣補完
剩下的更新感覺比較零散,就放到一起來說吧。
先是幾個偏使用者和平台側的。
ChatGPT現在可以直接進Slack和Microsoft Teams;新的會議外掛可以錄音、生成紀要,再把結果存進Space;Slides(做PPT的那個功能)也繼續升級,支援多人和ChatGPT一起協作編輯。
OpenAI還推出了“使用ChatGPT帳號登錄第三方產品”,類似於Google登錄,默認只共享姓名、信箱和頭像,不會把聊天記錄和記憶一起交出去;同時新增了可分享個人資料頁,可以集中展示自己做的站點和外掛。
然後是幾個偏開發者的能力。
新的Decisions API可以讓Luna在一組預設選項裡快速做即時判斷,用來做分類、路由,或者決定Agent下一步該做什麼,目前還是限量預覽。
Amazon Bedrock也接入了基於Agents API的託管Agent,加入AWS自己的整合和客戶控制的計算資源,主要方便本來就在AWS體系裡的團隊直接使用。
最後是企業側。
OpenAI推出了新的隱私智能能力,把帶隱私安全處理的零資料保留、離線自動安全審查和隱私推理整合到了一起,同時承諾不會保留客戶內容。
另外,還有一個新的OpenAI軟體市場。符合條件的企業可以直接拿已經承諾給OpenAI的消費額度,去購買Adobe、Figma、Salesforce、ServiceNow、CrowdStrike等合作夥伴的軟體。
整場DevDay看得人眼花繚亂,不過,大體看來,很多更新都在往同一個方向使力:
OpenAI正在把ChatGPT從一個“響應需求”的產品,改造成一套可以長期承擔工作的Agent系統。
Dot是這套系統最明顯的入口,或者說,它是Agent的主體。
Dot會一直線上,有自己的電腦和瀏覽器,手上可以同時掛著幾個項目。它能記住你,能在不同的裝置裡繼續工作,任務有進展它會回來找你,需要拍板也會回來問你……這些功能加在一起,已經很接近“一個人在幫你做事”了。
而且OpenAI還在給它補齊整個工作環境。
它得有地方放檔案,有地方保存項目進度,有軟體可以用,最好電腦關了以後工作也別停。於是有了ChatGPT Space、可復用的Codex雲端環境、Agents API,以及Plugins那一大堆更新。
雖然這次推出了GPT-6.1 Sol,但模型能力已經不是這場發佈會的中心。一個Agent最後好不好用、能不能穩定工作,越來越取決於模型之外的東西。
Harness、Infra,以及Context。
Harness負責組織Agent的行為,Infra負責提供穩定的執行條件;至於Context,那是另外一層,決定Agent能不能認識“你”。
9月簡直可以說是個人Agent的井噴時刻,不同公司的產品形態可能有所不同,但最後都在解決同一個問題:怎麼讓Agent長期留在你的生活裡。
Muse把重點放在長期記憶,Rabbit OS3把Agent繼續往裝置和跨應用執行上推,Manus開始給Agent補身份、工具和協作能力。現在,OpenAI一口氣補上了它能給的全部能力。
與此同時,AI的收費方式也開始改變。
這次OpenAI一邊把GPT-6.1 Sol繼續往低價推,一邊把Ultrafast、Pro 500這種更昂貴的高速算力單獨分層。
另一邊,Dot這種24小時線上的Agent,又被直接裝進訂閱裡。
某種意義上,一份ChatGPT訂閱買到的,正在從“多少次模型呼叫”,慢慢變成一整套Agent服務。
說來有趣,這會讓我想到AaaS(Agent as a Service)。AI看似開闢了新的時代,到頭來還是重走了SaaS的老路。
前面說了一堆好話,接下來該給OpenAI挑點刺了。
首先是最近爭議很大的,錢的問題。
9月10日,OpenAI突然暫停了Pro 200的新訂閱和升級;到這次DevDay,Pro 200重新開放了,但規則發生了變化。
Tibo在發佈會前其實已經提前打了預防針:新版Pro 200會改變用量的計算方式。如果按照API標價折算,新版套餐對應的API消費金額大約只有舊版的一半。
但OpenAI認為這不代表使用者能做的工作減半,理由是Sol和Luna剛剛降價50%,模型還會繼續變便宜、變高效,而且新版訂閱裡還加入了Dot。
但問題是,Astra可沒降價。
所以如果你原本就是衝著最強模型去買的Pro 200,現在是同樣200美元,能用的量明顯減少了。
然後OpenAI又在上面新加了一個500美元的Pro 500,最高的額度、最快Astra都往這裡放,而且只往這裡放。
現在,你要麼多付錢,上Pro 500;要麼留在200美元檔,接受更少的Astra,或者去用便宜的Sol和Luna。
說得難聽一點,留給原來Pro 20X(現在Pro 200)使用者的就兩條路:要麼加錢,要麼降智。
費用之外,OpenAI開放給Agent的能力也是非常值得吐槽的一環。
在Dot上線之前,Reddit上其實就有人擔憂Muse的隱私問題。畢竟背後是Meta,有人直接表示:“如果OpenAI能推出類似Muse的使用者介面,我肯定會立刻解除安裝Muse,轉而使用OpenAI的產品。”
現在OpenAI真的做出來了。
但問題是,Muse之所以讓人覺得好用,很大程度上是因為它足夠大膽。而OpenAI在這裡明顯踩著剎車。
發佈會之後,有網友直接點出了這個矛盾:如果Agent不能碰錢、不能交易,到了關鍵步驟還要使用者不停回來確認,那它到底算多自主?
話說得很糙,但道理是沒錯的。
Dot現在可以有自己的電腦、瀏覽器,可以24小時工作,也能接入4000多個應用。但到了錢和現實決策這裡,OpenAI直接沒給。
一個剛被Agent能力嚇到暫緩了最強模型發佈的公司,確實很難直接把支付、交易這類現實世界的權力交給一個24小時線上的Agent。
更何況OpenAI現在還沒上市。
但就像網友所說的那樣,除非OpenAI敢於解決這些問題,真正向“使用者只需要提需求,剩下的全部接手”靠近,不然它可能永遠也比不上Meta和Grok,以及那些足夠“有勇氣”的Agent產品。(字母AI)
