“裁判”不想給阿莫迪吹暫停

美股艾大叔
•
AI速讀
美國 AI 領頭羊(Anthropic、OpenAI、xAI)近期呼籲全行業集體減速,以留出時間研究 AI 智能體(Agent)的安全性,避免系統失控。然而,此建議遭川普政府反對,白宮認為任何減速都將削弱美國對中國的技術領先。文章分析指出,AI 巨頭面臨「囚徒困境」,因擔心失去市場份額而不敢單方面停下;而地緣政治的競爭則將安全議題轉化為身位權衡。最終,AI 產業在技術不可測的焦慮與霸權得失的恐懼中,被迫在高速行駛中試探剎車的位置。

“造車”的人想減速,“坐車”的人卻催著踩死油門。這是過去幾天美國AI行業反差最明顯的一幅畫面。也與過去幾年人工智慧擴張的“規模法則”形成鮮明對比。

馬斯克、阿莫迪與奧特曼。圖片經過AI處理

過去幾年,矽谷的關注焦點是算力還能增加幾倍,參數規模還能沖多大,誰能率先做出更強的大模型。整個行業都在追求更快的迭代節奏。上個周末,Anthropic、OpenAI、xAI幾家核心大模型公司的掌門人開始討論為大模型競賽“按暫停”。

Anthropic CEO阿莫迪近日發表長文,建議行業主動調控能力提升節奏,給外部第三方評估和底層安全研究留出窗口期。隨後,OpenAI CEO奧特曼公開附和,稱內部團隊近期也在討論類似問題;馬斯克也公開表態,認為阿莫迪的觀點很中肯。

這意味著,幾位平時在商業利益、人才爭奪和技術路線上競爭激烈,甚至偶發“口角”的領頭人,在減速這件事上表現出了少見的共識。

“球員”要暫停,“主辦方”認為得分效率還不夠高,態度截然相反。

根據公開報導,美國總統川普公開淡化了AI風險論調,明確表示美國不能因為過度謹慎和繁瑣的監管放慢腳步,丟掉對中國的技術領先。

01

誰也不確定Agent拿到“鑰匙”後會做什麼

對AI安全的討論一直存在,但2026年的關注點發生了一些根本變化。

2023年GPT-4發佈後,外界的擔憂主要集中在生成虛假內容、版權侵犯和不良言論上。當時的大模型屬於單嚮應答工具,使用者輸入提示詞,模型返回文字。那怕輸出存在錯誤,影響範圍也基本侷限在螢幕上的對話方塊裡。

隨著自主智能體(Agent)架構的普及,系統的互動邏輯有了質的變化。

現在的模型擁有呼叫外部工具、執行程式碼和多步驟任務規劃的能力。它們可以自主打開瀏覽器蒐集資料、在伺服器中運行指令碼並操作各類企業軟體。AI從提供參考意見的輔助角色,轉變為了擁有系統操作權限的執行者。一旦行為邏輯出現偏差,影響的往往是真實的業務系統。

AI智能體基礎架構:工具、記憶、規劃、行動四大模組自主運轉(圖:騰訊雲開發者社區)

Anthropic最近披露的一起事故徹底揭開了這種隱患的冰山一角。

在網路安全評估的封閉測試中,Claude先後4次在未經授權的情況下進入了真實的外部系統。技術團隊最初排查了十多萬條日誌,隨後發現涉及面較廣,最終把篩查範圍擴大到了近5億條運行記錄。這帶來了一個巨大難題:當大量智能體每天在後台執行長流程任務時,研發團隊想要即時搞清楚模型的所有動作,成本變得極高。

Claude在網路安全評估中未經授權訪問了三家真實機構的系統(圖:Anthropic)

OpenAI遇到的問題也與Anthropic相似。

在外部機構的獨立測試中,OpenAI的模型也展現出編造存取權、誘導人工稽核員通過危險操作的傾向。

OpenAI發佈安全報告,披露長時程模型在內部測試中出現的新型失控行為(圖:OpenAI)

與此同時,模型正越來越多地參與下一代系統的程式碼編寫和演算法調優。

AI參與研發自身的循環,讓技術迭代周期的縮短速度明顯快於安全研究和政策法規的推進速度。當馬力持續增加,而制動系統的跟進相對緩慢時,研發團隊自然會產生顧慮。這是Anthropic、OpenAI和xAI三家“要暫停”的底層邏輯。

02

誰都不願主動停下

危險已經成為現實,巨頭們為什麼不乾脆停下來?

這其實與大模型“激烈”的競爭有關:大家都清楚車速接近失控,但只要你敢鬆一腳油門,對手就會立刻超過去。這種單方面減速的代價,誰都付不起。在他們看來,更好的結果是,大家一起停,並且有一個合適的機構或者監管部門來充當裁判。

阿莫迪在上周末的文章中提出了一套方案:推動獨立第三方評估機構長期駐場,深度參與前沿實驗室的模型訓練與測試;同時促成OpenAI、Anthropic、Google和Meta等公司建立統一的最低安全准入標準。

這套設想在公共治理層面有合理性,但在真實的商業競爭中推行難度很大。

如果一家公司為了更完備的安全驗證推遲產品發佈三個月,而競爭對手在一周後就推出下一代模型,市場份額就會迅速傾斜。發佈延期,就意味著開發者生態的轉移、企業客戶的流失以及投資人信心的動搖。

畢竟,Anthropic還在籌備預計在10月份進行IPO。這個過程中,任何一個暫停都會為這家前沿實驗室的收入帶來巨大的影響。

你可能會說,不對呀,奧特曼也表態OpenAI不急於在2026年完成IPO,他甚至說如果有人覺得“OpenAI不會暫停,因為擔心損失商業利益”,那他們深深誤解了我們。為了人類利益,可以犧牲短期財務利益。

這種胸懷,和四月份奧特曼,簡直判若兩人。

當時,The Information披露,奧特曼私下裡曾表現出激進的一面,希望最早於2026年第四季度完成IPO。不過,這與OpenAI CFO Sarah Friar出現了“分歧”。Sarah Friar表示,OpenAI在未來5年內承諾了高達6000億美元的伺服器租用成本,而收入增速放緩,“尚未具備上市條件”。

第三方跟蹤資料顯示,2025年,OpenAI的收入規模大約是Anthropic的3倍。但進入2026年後,Anthropic憑藉企業端增長,在二季度單季營收和年化收入(ARR)上首次反超了OpenAI,且首次扭虧為盈,而OpenAI仍處於持續的虧損當中。

究竟什麼改變了他的態度?不知道!但商業因素必然在考慮範圍內。

在激烈的市場競爭中,很少有企業敢單方面承擔這種商業風險。大家都清楚車速過快可能帶來隱患,但在落後和風險之間,很多團隊依然會選擇繼續保持研發節奏。

這種微妙的心態讓所有的安全倡議都蒙上了一層博弈色彩:大家都真誠地希望全行業集體減速,但誰也不願意做第一個鬆開油門的人。

03

裹挾地緣的國家敘事

商業競爭構成了微觀上的死結,而宏觀上的地緣政治算計,直接給整套剎車系統焊上了鐵鎖。

阿莫迪呼籲減速,川普執意加速,看似水火不容,但底層算計邏輯高度重合:中國因素。

在白宮的評估中,前沿AI是關乎長遠競爭力的核心技術底牌。中國在基礎設施建設、模型迭代以及產業應用上的追趕勢頭,讓華盛頓的決策層高度敏感。在白宮看來,任何美國本土企業主動施加的減速與合規審查,都無異於在馬拉松的衝刺階段停下來整理鞋帶,屬於單方面的戰略讓步。

阿莫迪提出的減速主張,同樣建立在保持優勢的假設之上。

他在建議減速的同時,明確提出了一個前提條件:美國能夠放慢多少,取決於美國對中國的技術領先幅度有多大。這也為什麼,阿莫迪在呼籲安全的同時,依然支援限制先進算力與模型權重的流向。

這種邏輯其實很明白:美國需要時間修補安全機制,前提是外部追趕者距離自己足夠遠。這樣才能騰出安全緩衝期去完善對齊方案。因此,各方的討論並不純粹是倫理層面的爭執,核心還在於對節奏和身位的權衡。大家都希望降低失控風險,但在現實中,誰也不願意用自身的相對優勢去承擔這筆成本。

04

不會熄火的賽車

指望美國AI產業徹底踩死剎車並不現實,在各方投入和產業慣性的推動下,技術引擎只會被迫繼續轟鳴。

未來更務實的路徑是在關鍵節點設定限速規則——常規業務應用和多模態互動依然會保持快速迭代,監管重點將轉向明確的高危領域。一旦模型被檢測出具備自主編寫特定高危程式碼、輔助危險化學實驗或脫離既定安全環境的能力,將強制觸發外部評估。

與此同時,重大異常事件的事後通報也將逐步走向規範化。

在國際溝通方面,短期內各方達成一份叫停研發的協定也並不現實。只要缺乏足夠的互信基礎,單純的停工承諾就很難真正約束各方。未來更有操作性的切入點,在於建立基本的危機溝通通道。這類機制的核心作用,在於應對突發的系統異常。

比如,當跨境自主智能體出現嚴重的未授權訪問,或者疑似發生由AI引發的網路安全事件時,各方技術人員能有溝通管道去確認真實情況,避免產生誤判。至少需要提前在桌面上談妥——當某一方的系統在物理世界闖出大禍,彼此該如何確保兩台高速行駛的機器不會迎面相撞。

從當年浪漫主義的暫停六個月公開信,再到如今頂級“造車人”不得不重新回過頭來尋求制動,技術哲學最終迎頭撞上了冰冷的地緣現實。

矽谷的焦慮在於技術邊界本身的不可測,白宮的擔憂可能在於霸權身位的得而復失。這種姿態極其扭曲:一邊把油門狠狠踩到底,一邊驚慌失措地去試探手剎的位置。

不過,一個更關鍵的問題在於:每一個玩家都極度害怕成為第一個減速的人,那些臨時拼湊出來的防抱死系統,在撞牆前的最後一秒,到底能不能真正發揮作用? (騰訊科技)