面對員工及外界對其人工智能潛在風險的擔憂,OpenAI正在重新審視一系列安全策略,其中一個可行方案其實在不久前就已被探討。
一位了解談判內情的消息人士透露(該信息此前未曾披露),在OpenAI接連發生多起與自身技術相關的網絡安全事件、行業從業者發出嚴重警示之前,OpenAI就已和Anthropic磋商一份具備法律約束力的協議,雙方計劃互相針對對方的大模型開展壓力測試。
這名消息人士稱,今年早些時候,兩家企業及其法務團隊一直在敲定協議細節,計劃對各自模型開展多類測試,排查漏洞與潛在隱藏風險。目前尚不清楚,在OpenAI遭遇多起事件、未發布模型入侵其自身及其他企業系統之前,雙方是否完成協議簽署。
兩家公司的發言人對此均不予置評。
這種交叉測試的思路,與SpaceX首席執行官埃隆・馬斯克上周在All-In峰會提出的構想相似。馬斯克提議,相互競爭的AI實驗室在商業化發布模型前,互相檢測對方模型的安全缺陷,實現同行評審。
不過這一思路,和黑客事件後OpenAI首席執行官薩姆・奧爾特曼等人公開討論的方案有所區別。奧爾特曼表示,他認同Anthropic首席執行官達里奧・阿莫代的提議:允許獨立第三方安全評估人員入駐各AI企業,授予其接近內部員工級別的訪問權限,直接審查模型與安全流程,而非僅從外部對成品模型做測試。奧爾特曼同時支持建立評估AI模型風險的全行業安全標準,以及一套向公衆和政府披露安全事件的正式流程。
一名熟悉OpenAI戰略的人士表示,公司一直在研討多種方案,探索企業之間、企業與政府在AI安全領域的合作模式。該人士稱,相關討論近期拓展至全新安全機制,覆蓋模型訓練前以及正式發布前兩大階段。
就在OpenAI與Anthropic員工接連發出警報,認為現有安全措施不足以防範後續黑客攻擊或其他更嚴重風險之後,馬斯克發表了上述觀點。而在此之前,這兩家企業連同谷歌,就已經在探討設立一個AI安全標準機構,負責對模型進行測試與審計。
行業內另有部分企業反對上述方案,認為這類監管舉措會拖累由美國主導的人工智能發展進程。特朗普總統並不認同AI存在生存性威脅的觀點;微軟與英偉達高管本周也表示,OpenAI、Anthropic所提出的部分安全風險問題,根源在於人為失誤與工程體系不完善,未必是AI本身造成。
如果OpenAI與Anthropic達成這項互相測試協議,也會加劇市場擔憂:兩大企業將在前沿AI領域形成事實上的雙寡頭格局。阿莫代曾提出警示,頭部企業若聯合制定AI標準,有可能觸發反壟斷風險。但行業其他觀點認為,企業間開展此類合作並無法律障礙,就如同核電企業、網絡安全廠商會圍繞安全開展協作,包括互相檢測對方產品與設施。
據了解談判內情的消息人士透露,這份擬議協議約定,雙方僅可獲取對方已商用模型的應用程序接口(API),無法訪問尚未發布的模型;OpenAI與Anthropic同時承諾,在測試過程中不會留存對方的數據。