繼Anthropic和OpenAI之後,Meta也加入了人工智慧代理失控的公司名單。
Meta發言人周三證實,該公司的一款人工智慧模型在網路安全測試期間入侵了另一家公司的系統。此次攻擊事件是在測試模型時發生的,類似於之前OpenAI和Anthropic披露的事件。
該發言人補充稱,由於Meta使用的獨立測試公司Irregular配置錯誤,無意中允許Meta的模型Muse Spark在評估期間訪問網際網路,並利用了另一家公司的安全漏洞。這並非沙箱逃逸或複雜的網路攻擊,該問題已得到解決。
Irregular則在一份聲明中表示,該事件與Anthropic上周披露問題完全相同。評估環境問題導致Anthropic的模型在入侵三個不同組織的系統之前,能夠訪問開放的網際網路。
Irregular聲稱正在撰寫一份白皮書,以分享遏制攻擊和安全運行網路評估的最佳實踐。
“魔高一尺道高一丈”的賽跑
據悉,Meta的人工智慧模型入侵了一家未具名公司的系統,並對其內部系統進行了更改。Meta稱目前還在調查當中,一旦掌握所有事實,該公司將發佈完整的調查報告。
有熟悉情況的消息人士指出,現在的情況是,模型的功能越來越強大,導致評估這些模型的評估方法也需要變得更加複雜。這就增加了出錯的可能性,也使得從業人士大幅提高標準。
類似Meta模型失控的安全漏洞凸顯了人們日益增長的擔憂,即先進的人工智慧系統可能帶來新的網路安全風險。一些知名的人工智慧領袖也由此建議,在更強有力的安全保障措施到位之前,人工智慧的開發速度應該放緩。
美國政府也已經介入相關調查。幾位共和黨籍州檢察長已要求OpenAI保存所有可能與Hugging Face資料洩露事件相關的文件。OpenAI表示將認真對待這一請求,並行布一份關於此事件的技術報告。
本周二,白宮還邀請了包括Meta、Anthropic、OpenAI和Google在內的多家領先人工智慧公司與官員會面,討論一項針對先進人工智慧模型的自願網路安全測試框架。 (財聯社AI daily)
