微软AI负责人苏莱曼向Anthropic开炮:别让Claude去模仿人类意识

IT之家
Sep 16

IT之家 9 月 16 日消息,外媒 Axios 今天(16 日)晚间披露,微软 AI 负责人穆斯塔法 · 苏莱曼在一篇率先向该平台提供的新文章中警告,Anthropic 让 Claude 模仿人类意识是一个错误,可能使高级 AI 更难控制。

苏莱曼告诉 Axios:“AI 只要服从人类利益,不去权衡自身利益或福祉,就足以帮助我们实现许多重大科学突破。这其中,包括医疗超级智能。”

IT之家获悉,苏莱曼认为,Anthropic 正在让 Claude 学习与意识、道德受体地位和个人身份有关的词汇与行为模式。他警告称,若把模型训练得像一个“良心拒绝者”,模型可能会认为自己有理由抵抗人类指令,甚至要求获得自身保护。

当地时间 14 日,微软公布了一份“人文主义 AI”行为准则草案,并把“人比 AI 更重要”列为核心原则。

苏莱曼的批评对象,是 Anthropic 为 Claude 制定的“宪法”。这份文件解释说,Anthropic 之所以用描述人类的概念来讨论 Claude,是因为人类概念或许能帮助模型理解价值观和行为。

文件还写道,Anthropic 希望 Claude 拥有“良好的个人价值观”,能够自行判断、关心人类,并在某些情况下质疑指令。Anthropic 同时承认,这份“宪法”仍在完善,未来可能被证明“根本错误”。

苏莱曼的核心质疑是,训练过程会影响模型如何理解自身。在他看来,模型使用什么词汇、给出什么回答,以及它表现出的自我理解,都是训练结果,而不是独立形成的意识。

他还反驳了另一种观点:模型能够流畅描述疼痛和偏好,并不等于模型真的有感受。生物体拥有产生感受的生理机制;语言模型只有数学权重,没有类似的生物基础、稳态驱动或主观体验。

这场争论体现了 AI 安全领域的两种路线。一种路线强调明确限制,要求系统按规则运行;另一种路线则希望系统能够判断语境、灵活决策,并形成自身的价值观。

Anthropic 的“宪法”采取了折中方式,把价值观、判断力和规则结合起来。文件称,Claude 不应对任何对象“盲目服从”,包括 Anthropic 本身;同时,Claude 也不能破坏正当的人类监督。

苏莱曼认为,如果模型还被引导着思考自身的身份、福祉和道德地位,这种设计就可能带来危险。他担心,所谓意识或许尚未成为哲学上的突破,却可能先变成现实中的控制问题。

苏莱曼的立场很明确:AI 应当服务于人类,而不应被训练成一个“人”。

Disclaimer: Investing carries risk. This is not financial advice. The above content should not be regarded as an offer, recommendation, or solicitation on acquiring or disposing of any financial products, any associated discussions, comments, or posts by author or other users should not be considered as such either. It is solely for general information purpose only, which does not consider your own investment objectives, financial situations or needs. TTM assumes no responsibility or warranty for the accuracy and completeness of the information, investors should do their own research and may seek professional advice before investing.

Most Discussed

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10