
黃仁勳
鳳凰網科技訊 北京時間9月28日,據彭博社報道,英偉達公司推出了一套新的雙層AI安全系統。該公司表示,如果近期OpenAI的AI模型對Hugging Face入侵發生時該系統已部署,那麼該事件本可以避免。
英偉達一直在迅速擴充其芯片以外的產品線,目前正在推出兩款可在其硬件上運行的開源軟件安全工具。它們旨在實時控制AI智能體可以訪問的內容,並在其違反規則時將其關閉。
這一新系統被稱為「開放智能體安全平台」,旨在提供一種無需放緩AI開發就能防範入侵的方法。
英偉達企業AI副總裁賈斯汀·博伊塔諾(Justin Boitan)在周一宣佈這一系統前與記者舉行的簡報會上表示,如果頂尖AI實驗室從早期開始就使用這項技術對其AI模型進行評估,就可能阻止Hugging Face遭到的這次攻擊。
「根據我們目前掌握的信息,這一新的安全平台本可以阻止那次入侵。」他表示。目前,自主AI智能體的不當行為已經在AI行業引發震動,並導致一些人呼籲放慢AI技術的開發進程。
對於OpenAI或競爭對手Anthropic是否計劃利用這套新系統監控模型訓練過程,博伊塔諾沒有發表評論,而是讓記者去問這些公司。
此前,英偉達CEO黃仁勳(Jensen Huang)一直淡化AI失去人類控制的風險。近幾天,黃仁勳將AI安全問題描述為一項工程挑戰,而不是需要加強監管或開展全球協調的問題。他與美國總統特朗普一道,反駁了一些AI開發者關於這項技術可能導致人類滅絕的說法,但同時也強調,AI必須接受嚴格的安全測試。
黃仁勳針對AI安全問題的工程解決方案包含兩部分。首先,OpenShell是一款英偉達已在3月其標誌性技術大會上預覽過的軟件產品,可在英偉達的Vera中央處理器上運行。它使得用戶能夠為AI智能體可以訪問的內容設定規則,並實時執行這些規則。該軟件是開源的,意味着它可以被自由使用和改編。
與此同時,Nvidia Sentry是一款新產品,可以運行在英偉達的BlueField數據處理單元上。英偉達表示,該產品旨在提供額外一層AI監控機制,對AI智能體的行為進行監管,並在發現智能體行為可疑時介入,將其隔離。(作者/簫雨)
更多一手新聞,歡迎下載鳳凰新聞客戶端訂閱鳳凰網科技。想看深度報道,請微信搜索「鳳凰網科技」。