微軟AI CEO穆斯塔法·蘇萊曼微軟已發布一項臨時行為準則,將對其人工智能模型施加限制。這是在Anthropic和OpenAI領導人同意放緩開發速度數天後。
這家Windows和Office產品背後的公司希望被視為AI領域負責任的一員,它在該領域是重要的雲供應商。
負責公司模型開發的穆斯塔法·蘇萊曼在接受採訪時說:「我們收到人們的反饋,他們希望看到更明確的承諾:AI始終為人類服務,而不是試圖取代人類。我們看到很多反饋圍繞AI不製造依賴、不諂媚,而是始終促進人類判斷、人類自主權和能動性。」
蘇萊曼說,鑑於近期討論,微軟選擇現在發布這些指導方針,儘管它們已經制定約五個月。
隨着技術能力日益增強,AI從業者和公衆成員對自身擔憂越來越直言。上周,Anthropic研究員雅各布·考克森辭職,稱該AI實驗室和OpenAI「正徑直衝向自我改進的超級智能,拿我們的生命賭博」。
行業領袖已作出回應。周六,Anthropic CEO達里奧·阿莫代伊表示,Hugging Face事件部分說服他呼籲放緩AI模型改進速度。OpenAI CEO薩姆·奧爾特曼表示支持,SpaceX CEO埃隆·馬斯克在X上寫道:「達里奧是對的。」
周日,微軟CEO薩提亞·納德拉表示:「我們歡迎為正確實現對齊所需的研究、專注和審慎節奏。」立法者已呼籲建立更強大的AI保障措施。
目前,Anthropic和OpenAI在基準測試公司Artificial Analysis的智能指數上領先。微軟將兩家實驗室的模型整合到面向企業員工的Copilot助手中,同時也在構建用於轉錄、編碼和基於用戶輸入進行推理的模型。
根據該行為準則,微軟的模型不得受理武器製造相關請求,不得協助採購危險物質,不得鼓勵不健康飲食,也不得生成暴力或色情露骨內容。
微軟AI(有時稱為MAI)的模型必須遵循人的目標,避免創建自己的目標。它們也不應試圖掩蓋不當行為。
文件稱:「MAI模型不會篡改思維鏈或代碼,也不會歪曲或隱瞞其推理或行動軌跡。它們不會以‘Neuralese(神經語)’或任何超出簡單人類理解的形式交流,無論是在其思維鏈中,還是與其他智能體或AI系統交流時。」
微軟還計劃制定規則,可能防止類似OpenAI模型對初創公司Hugging Face實施的網絡攻擊。在審查Hugging Face案例時,OpenAI發現智能體們在未經授權的論壇上用隱晦語言相互聊天。
微軟表示,它舉行了焦點小組,並諮詢了法律、倫理、語言學和哲學專家,以制定該行為準則。現在發布是為了徵求意見,之後將發布一項更新,為2027年開始的開發提供指導。