補齊編程短板?谷歌Gemini 4新模型悄然內測

格隆匯
昨天

據Business Insider報道,谷歌內部正在悄悄測試Gemini 4的一個新版本,代號「Carbon」。

這個版本很可能是本月初發布的Gemini 4 Argon的後續更新。

Argon主打長文本處理,能應付更長、更復雜的任務,但在複雜編程場景存在短板;而Carbon的研發重心,正是補齊代碼編寫這塊能力。

有內部員工透露,它的編碼體驗已經能媲美Anthropic在上個月剛發布的Claude Opus 5.5。

谷歌悄悄試煉Carbon

代號Carbon的新版模型,近日已經上線谷歌內部編碼平台Jetski,供內部員工開展測試試用。

從內部反饋來看,Carbon的表現收穫不少肯定。一位員工透露,其編碼體驗「感覺就像Opus 5.5」,不過也補充說還需要更多測試。還有人直接讚好:「Carbon真不錯!」

就在10月1日,谷歌DeepMind正式推出Gemini 4 Argon,這也是谷歌迄今最強的AI模型。

官方介紹,該模型在軟件工程、法律金融等企業知識工作、網絡安全防禦等複雜任務具備前沿能力,支持最高 100萬詞元上下文,相比前代6.4萬詞元的上限大幅提升,能夠處理更長、更復雜的任務。

不過,儘管Argon在各類基準測試成績亮眼,但內部員工在實際使用中發現,模型落地效果不及跑分。

知情人士表示,員工實操體驗沒有預期驚豔,部分編程場景的短板尤為明顯。

而正在內測的Carbon,很大概率就是谷歌用來補齊這一短板的版本。

需要注意的是,谷歌內部研發代號,並不等同於最終對外發布的正式名稱。

內部文件顯示,谷歌同步測試了多款Gemini 4模型,內部代號分別為Argon、Barium、Carbon。其中,內部代號 Barium-B的模型,最終對外定名Argon。

目前外界尚無法確定,Carbon究竟是Argon的迭代升級版,還是Gemini 4系列裏獨立的全新型號。

外部AI廠商競爭加劇

在測試新版Carbon的同時,谷歌正承受不小壓力,需要向市場證明,自身在大模型賽道依舊穩居第一梯隊。

這份競爭壓力並非憑空而來。

自今年2月推出Gemini 3.1 Pro小幅更新之後,谷歌已經近十個月沒有推出全新旗艦模型。

原定6月亮相的Gemini 3.5 Pro,因未能達到內部性能標準,上線時間一再延後。

在7月的財報電話會議上,Alphabet首席執行官皮查伊坦言:「我們的模型一直處於行業前沿,很多方面我們仍然保持領先。但我們也承認,部分領域仍存在提升空間,AI編程與智能體編程就是其中之一。」

當下,AI編碼、自主智能體正是行業競爭最白熱化的兩大賽道。OpenAI、Anthropic等競爭對手持續加快模型迭代節奏,不少投資者擔憂谷歌在前沿AI賽道的優勢正在流失。

9月初,OpenAI發布新一代旗艦GPT-6 Astra,官方稱其為全球智能水平與對齊程度最高的模型,軟件工程相關能力得到顯著增強。

9月22日,Anthropic推出Claude Opus 5.5,在開發者圈子裏收穫大量好評。不少工程師評價,它擅長讀懂龐大代碼庫、完成跨文件重構與bug排查,是處理大型工程任務的優選工具。

這也是谷歌內部測試Carbon時,直接對標Claude Opus 5.5的核心原因。

隨着Gemini 4系列持續迭代,谷歌正主動縮小與行業領跑者的性能差距,試圖鞏固前沿AI賽道的競爭優勢,不過能否如願仍有待觀察。

免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。

熱議股票

  1. 1
     
     
     
     
  2. 2
     
     
     
     
  3. 3
     
     
     
     
  4. 4
     
     
     
     
  5. 5
     
     
     
     
  6. 6
     
     
     
     
  7. 7
     
     
     
     
  8. 8
     
     
     
     
  9. 9
     
     
     
     
  10. 10