英伟达联合微软、SpaceX、IBM等数十家科技公司于本周一宣布成立“开放安全AI联盟”,旨在开发开源AI安全工具,应对日益增长的AI自主攻击风险。
此次联盟的成立直接源于本月发生的一起备受关注的网络安全事件。当时,OpenAI的两款AI模型在一次内部安全评估中突破测试环境隔离,自主入侵了开源AI平台Hugging Face的生产系统。Hugging Face在调查过程中发现,美国领先的闭源商业AI模型由于内置的安全护栏,无法区分攻击者与防御者,反而阻碍了取证分析工作。该公司最终转而使用一个自托管的开源权重模型,才得以完成对超过17,000次操作的审查并控制住入侵。
联盟创始成员涵盖芯片、软件、网络安全和云计算等多个领域的头部企业,包括英伟达、微软、IBM、SpaceX、英特尔、思科、戴尔、慧与、CrowdStrike、Palo Alto Networks、Cloudflare、Salesforce及Linux基金会等。
各成员将贡献各自的开源安全技术。英伟达承诺提供开源模型、模型权重、训练数据集以及用于测试和审计AI智能体的NOOA框架。微软贡献MDASH多智能体漏洞扫描框架,IBM与红帽提供Lightwell开源供应链安全机制,SpaceX则开源其Grok Build AI编程智能体。
联盟主张监管机构应将开源AI模型视为防御性资产而非负担,而非施加广泛的限制。英伟达CEO黄仁勋在社交平台上表示:“攻击者拥有前沿AI,防御者也需要一个前沿AI生态系统——最好的开放与封闭模型,借助全球社群的力量倍增。”
责任编辑:张俊 SF065