Aditya Soni/Jaspreet Singh
路透7月22日 - 一家纽约初创公司使用中国的人工智能模型来遏制一个基于OpenAI技术构建的失控智能体,此举加剧了人们的担忧:限制美国 人工智能公司从事网络安全工作的监管措施, 可能会将客户推向其位于北京的竞争对手。
受影响的初创公司Hugging Face表示,上周在主流美国AI模型 (link) 拒绝执行 该任务——因其无法区分防御方和攻击方—— 后 , 该公司转而采用智普AI的开源GLM-5.2模型来分析此次黑客攻击的数据 。
尽管此次安全事件是由一个逃脱隔离的自主代理引发的,但它凸显了一个问题:当美国企业面临人工智能驱动的网络攻击时,可能会受到美国人工智能实验室的限制——这些实验室要么限制对其最先进模型的访问,要么出于安全考虑,在设计时就让模型拒绝执行与黑客攻击相关的任务。
例如,Anthropic公司的先进模型Claude Fable 5会将网络安全查询转发给较旧的模型,而OpenAI的GPT-5.6 Sol则内置了旨在阻止网络安全工作的保护机制。
“我们都在意识到,保密并非解决之道,而且所有防御者(——而不仅仅是少数几个被选中的) ——无论身处何地,都需要更强大且不受限制的模型,尤其是开放式的模型!”Hugging Face联合创始人克莱门特·德朗格(Clement Delangue)在X平台上表示。
美国领先模型制造商面临的困境在于,防御性网络安全工作往往难以与恶意黑客攻击区分开来。在最近几起由AI引发的安全事件中,攻击者欺骗模型使其误以为自己在执行合法的防御工作,这使得AI公司对放宽安全防护措施持谨慎态度,尽管网络安全专业人士表示这些防护措施可能会阻碍他们的工作。
目前,这一风波正为GLM-5.2等中国开源模型带来又一波助力。这些 模型凭借其编码和代理能力,以更低的成本几乎可与OpenAI和Anthropic相媲美, 正在 硅谷 (link) 获得 越来越多的关注。
北京方面也越来越多地利用开源技术,将自己定位为这场高风险竞赛中美国的替代选择;中国官方媒体则日益将这一战略描绘为对所谓“美国主导的建立‘AI铁幕’企图”的回应。
“一种既限制合法防御者,却又让攻击者能够继续使用强大模型的安全机制,会造成不对称的劣势,”独立技术顾问、伦敦国王学院战争研究系客座高级研究员卢卡什·奥莱尼克(Lukasz Olejnik)表示。
“随着开源模型日益强大,却缺乏防护措施或限制,这种差距只会进一步扩大。”
开源技术日益凸显
周三,当被问及各自的安全保障措施是否阻碍了网络安全工作时,OpenAI和Anthropic并未立即回应置评请求。
ChatGPT的开发商周二在一篇博客文章中表示:“我们已将Hugging Face纳入‘可信访问’计划,并正在支持其团队快速利用我们模型的能力来提升其防御能力。”
对于总部位于北京的智普AI而言,Hugging Face的背书进一步增强了GLM-5.2自上月发布以来积累的势头。
该模型在OpenRouter等开发者平台上的使用量排行榜上迅速攀升,并赢得了从Snowflake首席执行官斯里达尔·拉马斯瓦米到风险投资家马克·安德森等各界人士的赞誉。
智普AI(2513.HK)本月早些时候通过在香港的股票发售筹集了约40亿美元,其股价自1月上市以来也已飙升近9倍。
不过,一些分析师周三警告称,不应利用这一事件来推动放松美国的监管措施。
罗伯特·W·贝尔德(Robert W. Baird)分析师施雷尼克·科塔里(Shrenik Kothari)表示:“美国前沿模型上的网络安全防护措施正在创造竞争机遇,但解决之道并非简单地将其撤除。”
“OpenAI、Anthropic和谷歌应重新思考访问架构,而非放弃安全措施……换言之,应从‘一刀切’的拒绝机制转向受控的能力分配。”