OpenAI真的是一日一更啊!
就在剛剛,OpenAI「義父」Tibo亮出Day 5更新:「24小時線上Agent」dots,現在用手機就能建立了。
他直呼驚喜:此前已有那麼多人通過網頁和桌面端建立dot,現在,是時候把規模做大了!
已獲得dots使用權限的使用者,打開iOS或Android版ChatGPT,就能直接建立自己的dot。
更驚喜的是,dots給Codex派活,也更順手了。
啟動新任務、跟進舊線程、尋找相關背景,再加上管理定時任務,這個私人助理越來越像個「派活大管家」。
掏出手機捏個Agent,再讓它指揮Codex幹活,這件事又少了一道門檻。
不用每次都切進Codex,你也能把工作交代下去。
01. 手機捏個dot 開口就能派活
9月29日,OpenAI發佈了「全天候個人AI智能體」dots。
它背後的模型,是GPT-6 Astra。
它和普通的ChatGPT對話完全不是一個概念。
dot有自己的雲電腦和瀏覽器,可通過外掛連接4000多個應用。
在授權範圍內,它能持續推進任務,並主動匯報進展。
按OpenAI的說法,可以把dot看作自己的分身。
它會學習你的工作方式,發現需要關注的事項,並用自己的電腦推進你的項目。
但此前,要建立和配置dot,還得先用桌面App或網頁。
想從零捏一個?那得先坐回電腦前。
而這一次,OpenAI直接把這個門檻給拆了。
現在,打開手機上的ChatGPT App,就能從建立開始,一路完成配置。
起名字、選外形、連接應用,全流程都能在手機上完成。
而這只是第一步。
02. dots指揮Codex「派活大管家」來了
手機端只是入口變化,更關鍵的,是dot與Codex之間的配合又進了一步。
Codex負責具體的程式設計工作,dot則更像一個幫你組織任務的私人助理。
dot此前已經能向Codex派活。
這次補強的,是它們之間的銜接。
該沿用舊線程,還是另開一個?那些背景需要帶過去?dot能更好地判斷。
之前討論過的開發需求,可以接著已有線程繼續做,相關背景也更容易找回來。
具體變化,可以拆成三件事:
尋找相關背景
dot可以搜尋ChatGPT對話,並呼叫已有Codex線程和自動化任務中的上下文。
之前講過的需求、做過的嘗試,能接著用,就少重複一遍背景。
更順手的線程管理
另一個改進,是對新舊任務關係的判斷。
它更擅長判斷什麼時候繼續舊線程,什麼時候另開一個,減少相關工作被拆散的情況。
跟進結果,管理定時任務
除了跟進程式設計任務,dot還能查看和編輯ChatGPT Work裡的定時任務。想瞭解接下來的安排,或者調整周期性工作,都可以告訴它。
演示裡,dot還會在Codex完成修改後繼續發消息,要求開PR,再把待審查的結果彙總給使用者。
這樣一來,dot就像幫你統籌全域的「項目經理」,Codex則是負責具體程式設計工作的「工程師」。
而你,是發號施令的CEO。
流程也很直觀:打開ChatGPT App,建立dot、交代目標,再由它把程式設計任務交給Codex。
你可以在手機上查看進度、處理需要批准的操作,也能隨時補充要求。
想到一件要做的事,掏出手機,就能先把任務交代出去。
不僅如此,OpenAI還扔出了一批dots細節修復,其中包括:
瀏覽更快,滾動更流暢,少一些多餘通知;程式碼塊和附件的顯示也更清楚了。
Outlook設定、套餐說明和失敗後的重試也做了改進,網頁端及語音通話中的企業版訪問更可靠。
03. Codex秒猜下一句 真·讀心術
比這條dots推文早92秒,Tibo還亮出了另一項Day 5更新:Composer Predictions(對話輸入預測)。
簡單來說,Codex有了「讀心術」,能猜到你下一步想說什麼了。
OpenAI放出的15秒短片,專挑開發者熟悉的瞬間。
讓Codex做完一款遊戲,輸入框裡就出現了下一步建議:「去把遊戲裝到我的Chromatic上。」
換到調整頁面的場景,一句大寫的「CENTER THE DIV」冒了出來,也就是把那個div居中。
還有開發者熟悉的收尾動作:「好,清理一下,再開個PR」。這些話都由Codex提前擬好,碼農可以直接採用。
畫面裡還有兩種建議:把論文講得簡短、通俗一點;保留當前設計,讓它也能在手機上正常使用。
下一步可以是解釋材料,也可以是繼續改產品。
Codex根據對話預填下一條消息;按Tab接受後,仍由使用者決定是否傳送
還是熟悉的Tab鍵,現在連人給AI下的指令也能補全了。
Codex回答完一輪後,會根據當前對話,猜測你接下來可能傳送的完整消息。
按下Tab,建議進入編輯框。你可以修改,再決定是否傳送;覺得不對,也可以照常輸入自己的話。那個替你說話的AI,仍得等你點頭。
這裡最有趣的變化,是輸入框突然變得很像一個接得上話的同事。事情聊到那裡,下一步通常該做什麼,甚至你平時怎麼說話,都成了它預測的線索。
OpenAI員工Sharif Shameem給出了一個很抓人的說法。按他自己的使用感受,Codex能猜中他接下來要發的大約四分之一的消息。
他還轉述一位共事研究者的評價,稱預測「精準得嚇人」。這裡的四分之一是個人自述,沒有公佈樣本量,不能當作產品精準率。
外部使用者Ivan Ciraj也說,自己當天已經用了很多次,感覺像回到了按Tab補程式碼的年代,只不過體驗被大幅加強了。
他最意外的是,之前根本沒想過還能這樣工作,甚至想向OpenAI裡提出這個點子的人致敬。
Thomas Ricouard更直接:他大概接受了90%的建議。這是他的個人使用反饋。
目前,這項Beta功能面向符合條件、年滿18歲的個人Pro使用者,支援Codex桌面端的本地和SSH線程,以及GPT-6 Astra、GPT-6.1 Sol。
Tibo特意強調了另一個細節:預測包含在Pro套餐裡,不消耗用量。
精準地說,免費的是生成建議這一步;把消息發出去,讓Codex繼續幹活,仍按正常方式計量。
少敲幾個字當然舒服。更微妙的變化是,AI還會建議下一步做什麼。遇到熟悉的收尾操作,人只需確認;碰到方向性的選擇,還是得自己拿主意。
04. OpenAI爭的,是你開工的第一步
把兩項更新放在一起,OpenAI想搶的位置就更清楚了。
dots接住目標、組織背景、委派任務;Codex則在一輪工作結束後,提前給出下一步建議。
OpenAI想佔住的,是使用者剛有一個目標、還沒決定打開那個工具的那一刻。
在不同工具之間找背景、分任務、接反饋,原本都要人來回奔忙。
如果這條鏈路能穩定跑通,從交代目標到檢查結果,人就能少花些時間在工具之間來回切換。
到那時,開工的第一步,可能就變成一句:「這件事,交給我的dot。」 (新智元)
