智譜發布GLM-5.3模型、「為編程而生」,性能比肩Fable 5

華爾街見聞
昨天

智譜最新旗艦模型GLM-5.3正式亮相,在編程能力和網絡安全漏洞發現方面取得重大突破,向Anthropic、OpenAI等AI頭部企業發起新一輪挑戰。

據智譜官方聲明,GLM-5.3基於與前代GLM-5.2相同的7000億參數基礎模型構建,所有性能提升均來自後訓練階段的持續擴展。在自研評測基準智譜 Code Bench上,GLM-5.3的編程能力較GLM-5.2提升50%;在開源編程基準Terminal-Bench 3.0上,得分從4.6躍升至28.3。

智譜介紹模型時表示:GLM-5.3專為編程而生,隨時迎接網絡防禦挑戰。GLM-5.3在網絡安全漏洞挖掘能力上亦出現超預期的"湧現"式躍進,在現實代碼庫中累計識別出2436個安全漏洞。

智譜表示,模型權重將在發布兩周後公開,屆時將完成安全評估與加固工作。此次發布恰逢DeepSeek昨日上調旗下V4模型定價,進一步加強其在國內AI市場的競爭地位。

編程能力大幅躍升,超越Claude Opus 4.8

GLM-5.3的核心突破集中於複雜編程與長鏈路任務。智譜官方數據顯示,在智譜 Code Bench的最高難度設定下,GLM-5.3以約7.5萬個輸出token完成了34.5%的任務,而GLM-5.2在消耗更多token(9.6萬)的情況下,完成率僅為23.4%。在高難度設定下,GLM-5.3以約5萬個token達到31.4%的完成率,超越了Anthropic的Claude Opus 4.8(29.5%,耗用12萬token)。不過,GLM-5.3目前仍落後於Claude Fable 5——後者在最高難度設定下完成率為39.5%。

在公開基準測試上,GLM-5.3同樣表現亮眼:DeepSWE v1.1得分從46.2升至66.9,Agents' Last Exam得分從23.8升至28.5。

為實現上述進展,智譜在後訓練階段大幅擴展了訓練環境的規模與多樣性,引入更貼近真實工程場景的任務——部分任務的工作量相當於一名經驗豐富的工程師數天的工作量。智譜還構建了自動化流水線,用於端到端合成訓練環境及強化學習獎勵信號。

網絡安全能力「湧現」,已披露逾兩千個漏洞

在網絡安全領域,GLM-5.3展現出超出預期的能力躍升。在智譜引入漏洞發現數據和訓練環境後,模型不僅能夠識別單一缺陷,更開始跨多個漏洞利用階段進行綜合推理,形成完整的利用鏈路規劃。

在CyberGym基準測試中,GLM-5.3以84.5%的得分超越Anthropic的Mythos 5(83.8%)和OpenAI的GPT-5.6 Sol(83.6%),位居榜首。在要求更深層漏洞推理的ExploitBench上,GLM-5.3得分從GLM-5.2的24.4%躍升至54.4%,漲幅超過一倍;但與Mythos 5(78.0%)和GPT-5.6 Sol(76.5%)相比,仍有明顯差距。在ExploitGym測試中,GLM-5.3在兩小時內完成105項利用任務、六小時內完成130項,而GLM-5.2的對應數字僅為29項和39項;Mythos 5則以181項和247項保持領先。

智譜表示,這些能力已延伸至真實世界的實際應用。自GLM-5.2以來,智譜與中國多個安全團隊合作,針對現實代碼庫運行模型測試,經專家審核、篩查與去重後,在269個項目中識別出2436個漏洞,其中中高危漏洞1097個,涵蓋系統內核、操作系統、瀏覽器引擎、開源基礎設施、Web應用及網絡協議等領域,部分漏洞在代碼庫中已存留數十年,最早可追溯至約40年前。智譜已為此建立"智譜安全披露賬本",持續公開披露進展。

開源策略疊加競爭格局變化,市場空間打開

在商業層面,GLM-5.3的發布時機頗具戰略意義。DeepSeek於本周四宣佈將旗下V4 Flash和Pro模型價格上調最高四倍,儘管V4 Pro的綜合定價仍低於GLM-5.2,但此舉客觀上為智譜爭取用戶和開發者提供了窗口。Artificial Analysis給予DeepSeek頂級模型與GLM-5.2相同的智能評分53分,兩者均落後於Kimi K3以及Claude Fable 5、GPT 5.6等模型。

智譜計劃以寬鬆許可證開放GLM-5.3的模型權重,以吸引更廣泛的開發者群體。這一策略與GLM-5.2的路徑一脈相承——後者發布後,智譜市值一度衝至1370億美元,超越拼多多和網易(NetEase)等互聯網巨頭,此後雖回落至約800億美元,但較今年1月在香港上市時仍增逾十倍。

據彭博此前報道,智譜已完成一座數據中心的建設,部署了至少1萬枚國產芯片,用於GLM系列模型的研發與推理。其年度經常性收入(ARR)於今年7月達到10億美元。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10