炒股就看金麒麟分析師研報,權威,專業,及時,全面,助您挖掘潛力主題機會!
(來源:21世紀經濟報道)
21世紀經濟報道記者 趙雲帆
9月3日,北美人工智能大模型公司OpenAI旗下ChatGPT與Codex、Anthropic旗下Claude、xAI旗下Grok出現大規模宕機事件。截至北京時間9月4日00:00仍未恢復。
該起事件為有報告以來最大規模的AI宕機事件。受此影響,AI本地化概念股Palantir美股暴漲7.81%。
海外實時服務故障監測網站Downdetector數據顯示,美國用戶針對OpenAI服務的故障報告超過1.2萬份,Claude約1200份,Grok約1000份;谷歌Gemini、微軟Copilot同期亦收到大量中斷報告,AI編程工具Cursor部分服務受波及。
三家公司均在狀態頁確認故障並表示啓動修復。Anthropic技術部門員工CJ Avilla在社交媒體透露,事件由「基礎設施問題」引發。
「我們正在致力於解決問題,但目前還無法給出預計恢復時間。」CJ Avilla表示。
業內消息指出,微軟Azure、Cloudflare等多家AI大模型公司共享的雲算力基礎設施可能是故障背後的原因。
從各家大模型公司的狀態頁來看,三家公司全部確認了錯誤。OpenAI狀態頁9月3日晚8點28分記錄了一則題為「ChatGPT 和 Codex 出現高錯誤率」的事件,顯示 ChatGPT共15個組件、Codex共4個組件受到影響。OpenAI公司表示「正在對所列服務進行調查」。
Anthropic公司狀態頁顯示,Claude Mythos 5.1、Fable 5.1、Opus 5、Opus 4.8、Opus 4.6等多模型錯誤率升高,公司稱已識別Claude Mythos 5.1、Fable 5.1和Opus 5請求錯誤率升高的原因並着手修復,後續更新稱目前受影響的模型僅為Opus 4.8和Opus 5,其餘模型已恢復到基線錯誤率。
SpaceX旗下xAI Grok狀態頁確認其安卓應用出現模型級中斷,xAI表示正在恢復服務。
值得注意的是,谷歌Gemini與微軟Copilot同期亦收到大量中斷報告,但谷歌未確認Gemini發生全網宕機。AI編程工具Cursor狀態頁則顯示,其部分服務因Claude、ChatGPT和Grok故障受到波及。
三家公司同期掉線,引發外界對共享底層基礎設施的強烈質疑。
業內消息指出,微軟Azure同期宕機報告飆升,而OpenAI、Anthropic和xAI三家均以不同形式依賴Azure提供雲服務。
另一個對故障來源的推測則指向雲服務公司Cloudflare。此前在2024年11月,Cloudflare一次故障曾同時讓xAI和ChatGPT宕機。
值得注意的是,此次故障發生,正值海外對RSI(自我遞歸強化訓練)和背後安全問題討論熱烈之際。RSI允許大模型依託評價體系自行歸因分析並規劃訓練方案,但其安全性與不可控性被硅谷熱議。
9月1日,OpenAI 宣佈其下一代模型Astra已達到「關鍵網絡安全能力門檻」,即具備在無逐步人工指導情況下發現並利用未知安全漏洞的能力。而這一能力也被認為是一把人工智能安全的「雙刃劍」。
從歷史上看,此次事故為持續時間最長、影響範圍最廣的AI大模型集體宕機事件。而針對該起事件,不論是產業界還是資本圈,都會審視其問題源頭,對智能體接管社會運作的安全倫理和解決方案進行長期的討論。