Kimi逼得兩大巨頭改變定價?奧特曼罕見認錯,Claude額度重設

17日凌晨,Kimi K3發佈,全網刷屏,開源AI迎來第二次「DeepSeek時刻」。

外媒Axios稱,K3定價遠低於它所挑戰的高端模型,美國AI公司的高價策略還能維持多久?巧的是,就在最近,兩大巨頭正在打客戶爭奪戰。此前,特曼在X上發帖,不提新模型,開頭就是一句認錯:

過去12個月裡,我們的表現並不理想,這主要是我的過錯。

一直帶領OpenAI與Anthropic貼身肉搏的他,公開把過去一年定性為「不夠好」,還主動把鍋往自己身上攬,這本身就夠反常。

真正讓全網炸裂的,是後半句。

奧特曼緊接著話鋒一轉,說道,OpenAI即將迎來「有史以來最出色的12個月」,團隊表現也很出色,「正在迎來讓他們滿意的結果」。

奧特曼口中,「有史以來最出色的12個月」,到底押的是什麼?

全網第一反應幾乎是同一個:GPT-6是不是要來了?

01. 幾天內新增了300萬活躍使用者

「關掉推特,趕快去忙正事」!

與奧特曼的推文遙相呼應的,是OpenAI的Codex負責人Tibo,在16日甩出的一個900萬活躍使用者的新數字。

把活躍使用者數摞在一起看:2月,Codex還不到100萬;7月12日600萬,14日800萬,到16日,Codex和ChatGPT Work合計突破900萬。

四天,多了300萬人。

Tibo在推文裡說,本來想早點把額度調回來,結果被團隊為保系統不崩、穩定運行而忙的「數以百萬計的任務」給絆住了。

帖子結尾他還提醒大家額度再過幾分鐘就恢復了,多去忙自己的正事,別總刷推特了。

說白了,就是使用者漲得太猛,工程團隊正連軸轉著堵窟窿。

這讓人想起幾個月前,Anthropic CEO達里歐的「凡爾賽」。

今年5月,達里歐在開發者大會上說,公司原本按每年10倍增長做規劃,結果一季度的收入和使用量按年化算,暴漲了80倍:算力緊張就是這麼來的。

他半開玩笑地抱怨:真希望80倍別再繼續了,太難扛,盼著回到正常一點的數字,「區區10倍」就好。

兩個AI巨頭,一個連軸轉堵窟窿,一個嫌自己漲太快。智能體的火,燒得比誰的規劃都快。

02. 同一周兩家搶著給你送額度

奧特曼這條認錯推文,恰好落在OpenAI與Anthropic正打得火熱的一場消耗戰裡。

ChatGPT Work發佈後沒幾天,OpenAI臨時取消了Plus、Pro、Business的5小時使用限制,還一輪接一輪重設使用者額度:先給約50萬使用者,再鋪到700萬使用者,人人補一次。

Anthropic也毫不示弱。

它把Claude Fable 5的付費訪問又延長了一次,同時把Claude Code的周額度上調50%,兩項都續到7月19日。

一邊取消限制、瘋狂送額度,一邊增加訪問額度、提高上限。

表面上,兩家都在寵使用者,實際上是在搶使用者。

往深一層看,這是智能體時代的一場軍備競賽:誰能在這波狂熱裡把使用者留住,誰就能攥住更多真實的長任務資料。

最值錢的東西,就是智能體替你幹上幾個小時活、產生的真實使用資料。誰的額度更鬆,誰的使用者和使用量就更多,誰收到的資料也就更多。

而OpenAI的首席財務官,已經把這套演算法用到了對手身上。

按OpenAI給出的口徑,在長周期工程任務基準DeepSWE v1.1上,開到最高推理檔的GPT-5.6 Sol拿到72.7%,壓過Claude Fable 5的69.9%;而估算API成本,比對方低36.2%。

更能得分,還更便宜——這正是「每塊錢買到多少活」想證明的東西。同時輸出token減少54%,預估API成本降低36.2%。

有意思的是,被點名的Anthropic幾乎在同一時間做了另一件事:把Fable 5的付費訪問再延一次,Claude Code周額度上調50%,都續到7月19日。

一個用圖表證明自己更划算,一個直接把閘門開大讓你自己試。

這也解釋了,為什麼兩家寧可扛住系統壓力,也要拚命把使用量往上推。高強度的真實使用本身,就是護城河。

不過,也有人從這波狂飆裡嗅出了別的味道。

經濟學者Jeremy Nguyen評論「Codex和Claude Code同一天重設額度」時說,也許多年以後,我們會跟年輕人講起早期這場「智能體token大戰」,講token當年被補貼得有多瘋。

他翻出了網際網路泡沫的舊帳:那時候,有創業公司為了讓你在電腦上掛個廣告條,每月倒貼你幾百美元。

他的問題很實在:如果這樣的窗口只有一次,該怎麼趁現在,把Codex和Claude Code用到值回票價?

而這條賽道上,Anthropic的Claude Code同期的動作不斷,面向金融、工程的企業智能體早已落地。

兩家的智能體之戰,才剛剛打響。

03. 認錯幾小時後CFO遞上一張帳本

巧的是,就在奧特曼發帖的同一天,OpenAI官網上線了另一篇文章。

作者不是奧特曼,是CFO Sarah Friar。

Friar開篇就說,她在各處聽到CFO們問的是同一個問題:怎麼讓AI這筆錢花得更值。她給出的答案是一把新尺子——Useful Intelligence per Dollar,每塊錢買到多少有用的智能。

過去衡量軟體成功,看的是採納率:買了多少個席位、多少人活躍、續費了多少。Friar說,AI要換個更狠的口徑:看幹成了多少活。

她甚至直接點破了「token單價」這個幻覺:最低token價格 ≠ 最低結果成本

便宜的模型token是便宜,但可能要試更多次、耗更多時間、讓人多審幾遍;貴的模型一次過。真正該算的,是每完成一個合格任務的總成本,真正該計算的是

全成本公式 =(模型呼叫費用 + 計算資源 + 人工審查時間 + 重試次數 + 返工成本)÷ 成功達標任務數。

真正決定性價比的,從來不是單次token價格,而是一次成功任務的完整成本。

GPT-5.6家族(Sol旗艦、Terra平衡、Luna高速低價)正是為此而生。

一個支援團隊的「完成」,是客戶問題被解決;工程團隊的「完成」,是程式碼改動通過測試;法務團隊的「完成」,是合同審完且沒出錯。

讀到這兒,回頭看前面那場額度大戰,味道就變了。

OpenAI取消5小時限制、一輪輪重設額度,Anthropic上調Claude Code周額度50%——這不只是補貼使用者搶資料。當計價單位從「席位」和「token」變成「完成的工作」,送額度就不是讓利,是換口徑。

誰先讓所有人習慣用「幹成多少活」來算帳,誰就重新定義了這個市場怎麼比。

能力贏得首次使用,可靠性讓AI成為工作方式本身。

隨著使用量增長,每一美元AI是否在為你創造更多價值?

答案藏在計算基礎設施飛輪裡:更好基礎設施 → 更強模型 → 更好產品 → 更高採用 → 更多收入 → 持續投入下一代研究與算力。

當同一工作流隨時間推移,成功任務數增長速度超過總成本,且質量不降反升時,「每美元有用智能」就實現了正向複利。

04. 雙雄爭的是誰當上你的AI同事

如果將視角放遠,看得更清楚。

年初先出手的是Anthropic。Claude Code在開發者裡一戰封神,緊接著的Cowork把智能體從程式設計師推向普通知識工作者,在「AI辦公」這塊搶下先手。

OpenAI在7月9日發佈的ChatGPT Work,幾乎是貼著Cowork的賣點打,內建Codex,還捎帶上線了當天同步發佈的最新模型GPT-5.6 Sol。

一句「幫我建個項目追蹤表」,它就交出一張18個項目、29個待辦事項的甘特圖:這不是聊天,是交活。

這次變的不是參數,是形態。

過去用ChatGPT是你提問、它回答;現在你只給一個目標,剩下的它自己來:拆任務、調工具、翻你的檔案和應用,一口氣幹上幾個小時,直到把活兒真做出來。

官方一句話說透了定位:ChatGPT不再只是回答問題的機器,而是你攻堅複雜工作的夥伴。

OpenAI也拿整個公司做了實驗:如今內部幾乎100%的團隊,從財務到銷售,都在用ChatGPT Work和Codex幹活。

此外,和Anthropic相比,OpenAI手裡還多一張短期無解的牌:分發。

Cowork得讓使用者主動下載一個桌面端;而把智能體揉進ChatGPT,意味著超9億周活使用者打開那個最熟悉的App,就已經在用智能體了。

奧特曼自己的說法是,agentic產品的使用量一周環比漲了2.5倍。這條曲線,正是撐起他「下一年最強」的底氣之一。

回到奧特曼那句預告。

他押注的大機率不是一款叫GPT-6的新模型,而是一次更徹底的形態切換:讓AI從「回答問題」,正式變成「替你幹活」。而Friar那把尺子,正是為這次切換準備的——當AI開始幹活,衡量它的就不再是參數,而是幹成了多少活、花了多少錢。

一個在前台喊話,一個在後台改帳本。

這場競爭最後的勝負,或許不取決於誰的模型更強,而取決於誰先真正住進每個人的工作流裡,成為你的AI「同事」。 (新智元)