當地時間28日,輝達發佈名為“Open Agent Safety Platform”的AI安全平台。該系統由OpenShell開放原始碼軟體和Sentry參考系統設計組成,能為AI智能體設定更安全的運行邊界。輝達表示,該平台本可以阻止今年7月OpenAI模型攻擊抱抱臉。
OpenShell可以在智能體執行階段提供安全邊界,AI代理一旦試圖訪問未授權檔案、發起異常網路連線或執行危險命令,就會被拒絕、記錄,甚至被隔離。該軟體既可部署在輝達硬體上,也可拓展至安謀、英特爾等第三方平台。Sentry運行於輝達硬體上,獨立於智能體的軟體運行環境,持續監控智能體行為,AI代理如果試圖越界,能以毫秒級的速度隔離異常代理。
輝達AI副總裁賈斯汀·博伊塔諾表示,僅靠模型層面的保障措施無法管控智能體可訪問資源與執行動作,近期多起智能體失控事件更是凸顯這一點。分析認為,輝達正嘗試將AI安全能力進一步嵌入AI基礎設施,通過權限控制和異常隔離降低自主代理的安全風險。這也意味著,輝達的業務觸角正從AI晶片進一步延伸至軟體及安全基礎設施領域。(央視財經)
