突發!OpenAI立下28天軍令狀:不上新就全員重設額度

RexAA
•
AI速讀
OpenAI Codex 負責人 Tibo 於 X 平台宣布 28 天挑戰,若每日無法推出有效改進則重設使用者額度。此舉被視為 OpenAI 在 AI 競賽中陷入被動的應對措施。目前使用者對 GPT-6.1 Sol 的額度消耗與推理能力表示不滿,轉而傾向於效率更高、能力更強的 Claude Opus 5.5。儘管 OpenAI 試圖透過價格戰與頻繁更新挽回,但市場反饋顯示,使用者更在意模型核心能力的突破而非表面功能或額度補償。

OpenAI給自己下了一道軍令狀,28天,天天交作業,交不出就拿額度來賠。

聽著像搞福利,細看是被逼急了。

就在剛剛, Codex負責人Tibo在X上甩出一條帖子,直接炸了:

未來28天,每天要麼交出一項對大多數Codex和Work使用者明顯有用的改進,要麼做一次完整的額度重設。改進之旅正式開啟。

也就是說,交得出作業,使用者享受改進;交不出,就白送你一輪額度。跟外賣遲到賠優惠券一個邏輯,連失約的善後方案都提前替你想好了。

就在軍令狀發出的十幾個小時前,Tibo先發了一條定調帖。

他說團隊要收心了,接下來只做四類事:簡化產品、提高效率換更多用量、突破性功能、新模型。

他同時承認:「使用者反饋已經很明確了,大家想要東西變得更簡單。」

更有意思的是帖子發出前後的火藥味。

就在Tibo發出軍令狀後,Grok Bot團隊的Lauren Tan調侃道:「期待很快再見,來自The Ship Company的更多發佈。」

輕飄飄一句話。Grok那邊上新正忙,順手往對面撒了把鹽。

Tibo不幹了。他引用自己的28天承諾,轉頭向@Lauren喊話:「我挑戰你也這樣做。」

Lauren的回覆只有一句:「only you can win this battle。」

這哥們,是真急了。

大家給他的外號很有辨識度:重設哥。也有人叫他「義父」。

過去幾個月,Codex的額度重設,十回裡有九回是他發帖宣佈的。

所以這次28天承諾一點也不用擔心。交不出改進怎麼辦?

重設一下嘛,他最熟了。


你的額度到底花到那去了?

使用者為什麼對額度這麼敏感?因為Codex的額度問題,已經是「花到那去了都不知道」。

極端情況下,一個跑飛的任務就能吃掉你一周70%的額度。

到了十月初,問題又來了。9月29日DevDay發佈GPT-6.1 Sol之後,伺服器端負載過高、速度驟降。

Tibo 10月2日出來道歉,宣佈第二天給所有付費ChatGPT帳號做全域重設。10月3日,他還在追查Pro 500檔有人沒吃到這次重設的問題。

這些事串在一起,OpenAI這陣子一直在補同一個窟窿:使用者付了錢,總覺得不夠用,也搞不清到底用到那去了。

這個窟窿是Agent時代特有的。你在Codex裡敲一行需求,後台可能啟動一整條流水線——模型寫程式碼要花Token,讀上下文要花,維護記憶、生成摘要、調度子Agent統統要花。

如果只是自家產品有Bug,修就是了,不至於急到立軍令狀。

真正讓OpenAI坐不住的,是隔壁。

9月22日,Anthropic的Opus 5.5發佈,大約90分鐘後,OpenAI緊跟著發了GPT-6 Sol。兩家幾乎同一夜掀桌子,捲到了秒級。

一周後的DevDay,OpenAI又推出GPT-6.1 Sol,價格打到Astra的五分之一,試圖從性價比上扳回一城。

但使用者的反饋讓OpenAI有點尷尬。

GPT-6.1 Sol雖然縮小了差距,但在最大推理等級下,Opus 5.5依然守住了天花板。

更讓Codex使用者心態失衡的是體感:不少人100美元檔的Pro,一周撐不滿;而用Claude的人紛紛表示,Opus 5.5效率更高,額度明顯更耐用。

一個又智能又省額度的對手,就這麼杵在隔壁。每天都在提醒你的使用者:換一家試試?

在Tibo那條定調帖下面,已經有高贊回覆直說:「功能我不在乎,只要一個能打過Opus 5.5的模型。」也有人更乾脆:「我準備轉去Claude和Grok了。」

Lauren那句「only you can win this battle」之所以扎心,不是因為她嘴硬。是因為Grok Bot那邊確實在悶頭髮貨。

Lauren上個月交了2500個PR,還做了72小時直播挑戰,用Grok Bot從零搭了一家公司。

在Tibo忙著按重設按鈕的時候,隔壁兩家都在用產品本身說話。

網友Token Gremlin說得最直接:28個改進裡如果沒有一個模型真正打過Opus 5.5,對在乎能力的使用者來說意義不大。

吐槽黨們則已經替 Tibo寫好了作業清單。

按鈕放大,字型換換,讓使用者養個寵物,給Dots換個新顏色——這些當然也算「改進」嘛。


28天之後,使用者會記住什麼?

什麼叫「對大多數使用者有明顯幫助」,Tibo沒給定義。

按鈕變大算不算?用量面板最佳化算不算?那些檔位能吃到重設?原帖都沒說。

對OpenAI來說,有改進就請你回來體驗,沒改進就送額度讓你繼續用。最壞的結果,也不過是Tibo再按一次他最熟的按鈕。

只不過,額度可以反覆送,能力上的欠帳,得靠模型來補。

28天後,準備轉去Claude的使用者,大概會得出結論——OpenAI到底有沒有拿出一個值得自己留下來的模型。 (新智元)