DeepSeek下一波大模型被指即將問世:3萬億參數 性能超GPT-6 Astra

快科技
09/13

快科技9月13日消息,本周DeepSeek發布了V4.1 Flash,這個大模型架構變化之大,完全可以稱得上是V5了,但DeepSeek很低調地沒換大版本號。

Pro系列的新品確定了是V4.1 Pro,具體升級還沒公布,如果是V4到V4.1這樣的提升幅度,那V4.1 Pro性能上限也會很高,但考慮到之前V4 Pro-0813正式版的不及預期,大家期待值不要拉太高。

後續還有一波大模型,爆料者稱它叫做DeepSeek Code 2.0,即將發布,時間窗口是9月份,預計性能會擊敗Mythos 5.1和GPT-6 Astra,這是當前最強大的兩個前沿級大模型。

其他方面,DeepSeek Code 2.0預計會繼續保持開源開放,設計重點是Computer Use,也就是電腦控制,AI替代你操作電腦完成很多工作,Astra目前很多讓人驚訝的使用就來自這一方面。

這個Code 2.0擁有高達3萬億以上的參數量,顯然這也是它提高性能的關鍵,這方面國內目前最強的是K3大模型的2.8萬億,千問的Qwen 3.8 Max是2.4萬億參數量,DeepSeek V4 Pro是1.6萬億參數。

從V4.1 Flash換用新結構使得參數量翻倍來看,這個Code 2.0從當前1.6萬億提升到3萬億參數的可信度是有的,想跟Mythos 5.1及Astra這樣的大模型競爭就需要這個級別的參數量,不然性能上限是很難提升的。

這個爆料的可信度不好說,DeepSeek過去的23-24年倒是推出過三款名字帶Code的大模型,不過那時候表現平平,這次要是重推偏向代碼/邏輯的Code大模型,作為旗艦級產品倒也不失為一個方向,就讓V4.1 Pro及Flash面向通用Agent任務即可。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10