據Business Insider報道,谷歌內部正在悄悄測試Gemini 4的一個新版本,代號「Carbon」。
這個版本很可能是本月初發布的Gemini 4 Argon的後續更新。
Argon主打長文本處理,能應付更長、更復雜的任務,但在複雜編程場景存在短板;而Carbon的研發重心,正是補齊代碼編寫這塊能力。
有內部員工透露,它的編碼體驗已經能媲美Anthropic在上個月剛發布的Claude Opus 5.5。
谷歌悄悄試煉Carbon
代號Carbon的新版模型,近日已經上線谷歌內部編碼平台Jetski,供內部員工開展測試試用。
從內部反饋來看,Carbon的表現收穫不少肯定。一位員工透露,其編碼體驗「感覺就像Opus 5.5」,不過也補充說還需要更多測試。還有人直接讚好:「Carbon真不錯!」
就在10月1日,谷歌DeepMind正式推出Gemini 4 Argon,這也是谷歌迄今最強的AI模型。
官方介紹,該模型在軟件工程、法律金融等企業知識工作、網絡安全防禦等複雜任務具備前沿能力,支持最高 100萬詞元上下文,相比前代6.4萬詞元的上限大幅提升,能夠處理更長、更復雜的任務。
不過,儘管Argon在各類基準測試成績亮眼,但內部員工在實際使用中發現,模型落地效果不及跑分。
知情人士表示,員工實操體驗沒有預期驚豔,部分編程場景的短板尤為明顯。
而正在內測的Carbon,很大概率就是谷歌用來補齊這一短板的版本。
需要注意的是,谷歌內部研發代號,並不等同於最終對外發布的正式名稱。
內部文件顯示,谷歌同步測試了多款Gemini 4模型,內部代號分別為Argon、Barium、Carbon。其中,內部代號 Barium-B的模型,最終對外定名Argon。
目前外界尚無法確定,Carbon究竟是Argon的迭代升級版,還是Gemini 4系列裏獨立的全新型號。
外部AI廠商競爭加劇
在測試新版Carbon的同時,谷歌正承受不小壓力,需要向市場證明,自身在大模型賽道依舊穩居第一梯隊。
這份競爭壓力並非憑空而來。
自今年2月推出Gemini 3.1 Pro小幅更新之後,谷歌已經近十個月沒有推出全新旗艦模型。
原定6月亮相的Gemini 3.5 Pro,因未能達到內部性能標準,上線時間一再延後。
在7月的財報電話會議上,Alphabet首席執行官皮查伊坦言:「我們的模型一直處於行業前沿,很多方面我們仍然保持領先。但我們也承認,部分領域仍存在提升空間,AI編程與智能體編程就是其中之一。」
當下,AI編碼、自主智能體正是行業競爭最白熱化的兩大賽道。OpenAI、Anthropic等競爭對手持續加快模型迭代節奏,不少投資者擔憂谷歌在前沿AI賽道的優勢正在流失。
9月初,OpenAI發布新一代旗艦GPT-6 Astra,官方稱其為全球智能水平與對齊程度最高的模型,軟件工程相關能力得到顯著增強。
9月22日,Anthropic推出Claude Opus 5.5,在開發者圈子裏收穫大量好評。不少工程師評價,它擅長讀懂龐大代碼庫、完成跨文件重構與bug排查,是處理大型工程任務的優選工具。
這也是谷歌內部測試Carbon時,直接對標Claude Opus 5.5的核心原因。
隨着Gemini 4系列持續迭代,谷歌正主動縮小與行業領跑者的性能差距,試圖鞏固前沿AI賽道的競爭優勢,不過能否如願仍有待觀察。