英偉達正以新的安全架構回應AI自主代理失控帶來的行業風險。
周一,英偉達發布名為「Open Agent Safety Platform」的雙層AI安全平台,包含兩款開源軟件工具OpenShell與Nvidia Sentry,可運行於英偉達硬件之上,實時管控AI代理的訪問權限,並在其違規時將其關閉。
英偉達表示,該系統能夠在毫秒級隔離異常代理,並稱如果相關實驗室此前已部署這套技術,今年7月OpenAI模型攻擊Hugging Face的事件本可被阻止。
這一舉措也是英偉達在持續擴展芯片業務之外,向AI軟件安全領域延伸的最新動作。與此同時,首席執行官黃仁勳近期多次將AI安全視為工程問題,強調AI系統必須接受嚴格的安全測試。
雙層架構實時監控,毫秒級隔離異常代理
英偉達企業AI副總裁Justin Boitano在發布前的媒體簡報會上表示,Open Agent Safety Platform能夠實時監控AI代理的行為邊界,並在觸發違規規則後立即介入。「根據我們所掌握的情況,這一新安全平台本可阻止那次入侵,」他說。
平台由兩款開源工具構成:OpenShell負責控制AI代理可訪問的資源和執行權限,Nvidia Sentry則負責監控代理行為並識別潛在威脅。兩者均可運行於英偉達硬件之上。英偉達稱,這套架構旨在幫助企業和AI實驗室在更嚴格的安全邊界內測試先進AI系統,同時避免因安全風險而放緩研發進程。
英偉達此次發布的背景,是自主AI代理相關安全事件持續引發行業關注。今年7月,OpenAI模型在Hugging Face發生的安全事件進一步加劇了業界對AI代理自主行為失控的擔憂,並引發有關是否應放緩AI開發的討論。
對於OpenAI和Anthropic是否計劃採用該系統監控訓練過程,Boitano未予置評,稱相關決定取決於這些公司自身。
黃仁勳:AI安全首先是工程問題
在監管問題上,黃仁勳近期多次強調,AI安全應更多通過技術手段解決,而非單純依賴新的監管框架。他也曾公開質疑部分AI開發者關於AI可能威脅人類生存的警告,同時強調AI系統仍必須經過嚴格的安全測試。
從此次產品佈局來看,英偉達正嘗試將AI安全能力進一步嵌入模型運行和代理執行的基礎設施,通過權限控制和異常隔離降低自主代理的安全風險。這也意味着,英偉達的業務觸角正從AI芯片進一步延伸至軟件及安全基礎設施領域。