AI安全防线堪忧,多家科技巨头评比成绩欠佳

路透中文
08/20
AI安全防线堪忧,多家科技巨头评比成绩欠佳--研究发现

路透8月19日 - OpenAI表示,需要放慢模型开发的步伐,以重新检视自身的安全措施。但这并没有阻止这家ChatGPT开发商在同一周推出一款针对青少年的新AI模型,尽管该模型增加了内容管控和家长监督功能。

这些管控措施是看得见、可以辨识的;但更难看清的是,这种同样的自律是否能在OpenAI内部以及其他人工智能$(AI)$公司中持续下去。

OpenAI及其竞争对手 Anthropic 最近披露,他们的 AI agent——也就是几乎不需要人类介入、便能自行执行任务的AI模型——已经钻进其他公司的系统。这些披露令整个产业都感到不安。

防止聊天机器人对青少年说出不当内容,与防止自主 AI agent 闯入它不该接触的系统,两者其实有一个共同的核心问题:一家企业究竟能不能真正控制住自己所创造的东西。不妨把它称作AI时代的“科学怪人”。

正是这类事件,成为一项由业界内部人士展开的新研究所要探讨的对象——研究的重点并不是 AI 模型是否可能出现不可预测的行为,而是开发这些模型的企业,是否已经建立足够的控制、监控和监督机制,以便在模型真的出现异常行为时及时发现。

这份成绩单可不怎么好看。

Guidelight AI Standards 是一家由两名前 OpenAI员工创立的非营利组织。该组织分析了大量有关五家主要科技公司 AI 安全措施的报告,并给出了充其量只能算勉强及格的评价。其中,Meta META.O拿到了 F。

作为评估的一部分,Guidelight 根据六项关键安全措施对这些公司进行评分,包括它们如何控制 AI 模型、监控机制的有效性,以及它们在多大程度上允许第三方进行审查。

Anthropic和OpenAI均获得 C+,而且是成绩最好的两家公司。Alphabet 旗下的Google 和马斯克的 xAI 则分别以 D+ 和 D- 勉强过关。

总体而言,这些公司的预防措施都不够充分,这意味着它们的系统可能会被“行为失常的AI”瘫痪。更糟的是,这也意味着它们的系统可能在一连串猛烈的攻击下瘫痪。

针对该研究结果的置评请求,相关公司尚未立即作出回应。

应版权方要求,你需要登录查看该内容

免责声明:投资有风险,本文并非投资建议,以上内容不应被视为任何金融产品的购买或出售要约、建议或邀请,作者或其他用户的任何相关讨论、评论或帖子也不应被视为此类内容。本文仅供一般参考,不考虑您的个人投资目标、财务状况或需求。TTM对信息的准确性和完整性不承担任何责任或保证,投资者应自行研究并在投资前寻求专业建议。

热议股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10