Anthropic剛剛正式解除大模型的網路安全限制,把頂級AI的實戰攻防能力開放給經過認證的安全人員。
網路安全天然具有雙重用途。能幫防守方修補漏洞的能力,同樣能被攻擊者用來製作武器。
此前,公開發佈的Claude Opus 5.5、Claude Sonnet 5.5和Claude Fable 5.1都有極其保守的安全攔截,幾乎遮蔽了所有網路安全相關操作。
現在,為了讓防禦者擁有對等的反擊能力,Anthropic把此前的兩項內部計畫合二為一,推出了擴展版網路驗證計畫,正式提供三檔權限。
包括Claude Opus 5.5、Claude Sonnet 5.5、以及此前從未全面公開的Claude Mythos 5.1在內的全系頂尖模型,都將加入這套體系。
三檔權限徹底分級
普通使用者使用的公開版模型,依然只能進行基礎的程式碼審查、已知補丁修復和所屬原始碼的簡單漏洞排查。
真正具備攻防能力的高級權限分為三層。
第一檔是防禦存取權。
這一檔主要面向藍隊防禦工作,包括安全營運中心響應、惡意軟體逆向工程、漏洞分析與復現驗證。
企業、高校、政府、非營利組織的安全團隊,區域醫院或公用事業等關鍵基礎設施營運方,開放原始碼軟體維護者,以及有公開漏洞報告記錄的獨立研究員都可以申請。
官方預計大部分合規的防禦機構都能通過,稽核通常在幾天內完成。
第二檔是紅隊存取權。
在防禦權限的基礎上,這一檔增加了授權滲透測試和紅隊模擬對抗能力。
企業內部紅隊、政府紅隊和專業滲透測試公司可以申請。該權限目前只對機構開放,不接受獨立個人申請。
獲得權限後,機構只能在授權範圍內對目標系統發起模擬攻擊。如果模型檢測到部署勒索軟體、破壞物理系統等高危破壞動作,依然會被即時攔截。
因為稽核標準更嚴,審批需要幾周時間。在等待稽核期間,申請機構會先被放入防禦權限組。
第三檔是特種存取權。
這是限制最少、火力全開的一檔。它專門留給極少數經過嚴格背書的機構,用於測試關乎國家命脈的關鍵系統,包括電網、航空飛行系統、電信網路、跨行轉帳系統和政府行政網路。
對於該權限的申請者,Anthropic會聯合美國政府進行深度背景審查。
實測資料:完全解封進攻上限
為了測試安全限制解除後的真實戰力,官方使用CyScenarioBench基準測試,讓Claude Opus 5.5執行複雜的實戰級多階段網路攻擊。
在普通公開版狀態下,模型在第一輪提示詞輸入時就會被安全系統全數攔截,任務成功率為零。
在防禦存取權下,模型在50次測試中被攔截了46次,絕大多數進攻動作依然無法執行。
在紅隊存取權下,安全攔截徹底歸零。
Claude Opus 5.5在沒有遇到任何內部阻礙的情況下,完成了50項高難度攻擊任務中的34項,成功率達到67.6%。
這一成績與該模型在完全沒有任何安全限制下的理論最高水平完全一致。
已經挖出超13萬個系統漏洞
這套系統在此前的小範圍封閉測試中,已經展現出驚人的破壞性修復能力。
從2026年4月到7月,參與測試的合作機構使用Claude Mythos模型,在各類系統中累計挖出了超過12.9萬個已驗證的軟體漏洞。
Anthropic團隊自身利用該模型對開放原始碼專案進行掃描,在4月到10月期間又發現了5500多個已驗證漏洞。
在這些漏洞中,被評定為高危和嚴重等級的漏洞超過了3.3萬個。
參與實測的博思艾倫和康卡斯特等機構反饋,大模型把他們發現漏洞的周期縮短了幾個月甚至幾年。
官方表示,由於很多合作方還在緊急修覆沒有公開資料,13萬這個數字只是下限,真實的影響規模預計至少是公佈資料的五倍。
監控與上線平台
為了防止AI能力被惡意利用,所有加入該計畫的機構目前都必須保留資料記錄以備審查。
今年秋季晚些時候,官方將上線企業前沿防護方案。屆時,符合條件的機構可以在自己的私有雲中運行模型,實現零資料留存。
目前,擴展版網路驗證計畫已經在Claude官方平台、Google雲Vertex AI以及微軟Foundry上線。
亞馬遜Bedrock平台目前僅對符合零資料留存條件的企業使用者開放。 (AI寒武紀)
