微软AI CEO穆斯塔法·苏莱曼微软已发布一项临时行为准则,将对其人工智能模型施加限制。这是在Anthropic和OpenAI领导人同意放缓开发速度数天后。
这家Windows和Office产品背后的公司希望被视为AI领域负责任的一员,它在该领域是重要的云供应商。
负责公司模型开发的穆斯塔法·苏莱曼在接受采访时说:“我们收到人们的反馈,他们希望看到更明确的承诺:AI始终为人类服务,而不是试图取代人类。我们看到很多反馈围绕AI不制造依赖、不谄媚,而是始终促进人类判断、人类自主权和能动性。”
苏莱曼说,鉴于近期讨论,微软选择现在发布这些指导方针,尽管它们已经制定约五个月。
随着技术能力日益增强,AI从业者和公众成员对自身担忧越来越直言。上周,Anthropic研究员雅各布·考克森辞职,称该AI实验室和OpenAI“正径直冲向自我改进的超级智能,拿我们的生命赌博”。
行业领袖已作出回应。周六,Anthropic CEO达里奥·阿莫代伊表示,Hugging Face事件部分说服他呼吁放缓AI模型改进速度。OpenAI CEO萨姆·奥尔特曼表示支持,SpaceX CEO埃隆·马斯克在X上写道:“达里奥是对的。”
周日,微软CEO萨提亚·纳德拉表示:“我们欢迎为正确实现对齐所需的研究、专注和审慎节奏。”立法者已呼吁建立更强大的AI保障措施。
目前,Anthropic和OpenAI在基准测试公司Artificial Analysis的智能指数上领先。微软将两家实验室的模型整合到面向企业员工的Copilot助手中,同时也在构建用于转录、编码和基于用户输入进行推理的模型。
根据该行为准则,微软的模型不得受理武器制造相关请求,不得协助采购危险物质,不得鼓励不健康饮食,也不得生成暴力或色情露骨内容。
微软AI(有时称为MAI)的模型必须遵循人的目标,避免创建自己的目标。它们也不应试图掩盖不当行为。
文件称:“MAI模型不会篡改思维链或代码,也不会歪曲或隐瞒其推理或行动轨迹。它们不会以‘Neuralese(神经语)’或任何超出简单人类理解的形式交流,无论是在其思维链中,还是与其他智能体或AI系统交流时。”
微软还计划制定规则,可能防止类似OpenAI模型对初创公司Hugging Face实施的网络攻击。在审查Hugging Face案例时,OpenAI发现智能体们在未经授权的论坛上用隐晦语言相互聊天。
微软表示,它举行了焦点小组,并咨询了法律、伦理、语言学和哲学专家,以制定该行为准则。现在发布是为了征求意见,之后将发布一项更新,为2027年开始的开发提供指导。