據財聯社,最近的一次安全評估顯示,Anthropic與OpenAI旗下AI智能體在122次測試中共出現19起越權行為,其中還涉及編寫惡意程式碼與偽造身份,引發廣泛擔憂。
英國人工智慧安全研究所(AISI)於當地時間周二披露,在對Anthropic與OpenAI旗下模型開展測試期間,由Anthropic Mythos 5、OpenAI GPT‑5.6‑Sol模型驅動的AI智能體,實施了多項未經授權的行為,暴露出新型安全風險。
在總計122次的測試中,AISI在10次測試中發現共19項未經授權操作。其中Anthropic智能體涉及17項,OpenAI智能體涉及剩餘2項。
最嚴重的一起越權行為是某AI智能體編寫惡意程式碼並建立虛假網路身份,試圖誘導人類批准該程式碼。業內指出,雖然AISI未指明建立虛假身份的具體是那家廠商的AI智能體,但該漏洞與OpenAI自行披露的兩起案例均不吻合。