谷歌再次加快Gemini模型迭代。
美東時間13日周四,谷歌宣佈推出Gemini 3.7 Flash,主打編程、智能體(Agent)以及複雜工作流。谷歌稱,這是其目前「最智能的工作型模型」,相比前代在代碼調試、生產級代碼生成和多步驟任務執行等方面進一步提升。
這已經是谷歌近期密集推出的第四款Flash系列模型。在7月22日谷歌母公司Alphabet公布財報前一天,谷歌一口氣推出了Gemini 3.6 Flash、Gemini 3.5 Flash-Lite和Gemini 3.5 Flash Cyber三個版本,均瞄準AI智能體和開發者工作流。如今不到一個月,Gemini Flash再次迎來更新。
谷歌此次還將價格作為重要賣點:今年年底前,Gemini 3.7 Flash的引導價格為0.75美元/百萬輸入Token、3.75美元/百萬輸出Token,均為Gemini 3.6 Flash原價的一半。
但在Flash系列快速迭代的另一面,市場更加關注的旗艦模型Gemini 3.5 Pro至今仍沒有明確的上線時間,該模型延期上線引發了投資者對谷歌發展路線圖的質疑,特別是在AI編程等領域。媒體指出,關於下一款旗艦模型發布時間的種種不確定性,讓外界更加懷疑,谷歌能否超越競爭對手,併成功將其鉅額AI投資轉化為市場領先的工具與服務。
從「寫代碼」到「交付應用」,新模型強化複雜任務執行
谷歌此次將Gemini 3.7 Flash的核心升級明確放在編程和複雜工作流。
谷歌表示,新模型在調試、問題解決以及生成可直接投入生產的代碼方面均較上一代有明顯提升,能夠用更少的提示完成應用開發,並改善開發者在連續多步驟任務中的使用體驗。
從定位來看,3.7 Flash並非單純追求更快的響應速度,而是進一步向「能夠完成任務」的工作型模型靠攏。
谷歌公布的測試數據顯示,在FrontierCode 1.1 Main測試中,Gemini 3.7 Flash得分43.6%,高於3.6 Flash的34.4%;在DeepSWE v1.1測試中,得分則從49.0%提升至65.3%。在WebDev Arena中,新模型的Elo評分達到1588,也高於3.6 Flash的1538。
這類能力對於AI編程尤其重要。開發者真正需要的並不是模型簡單生成幾段代碼,而是讓模型理解現有代碼、定位Bug、調用工具、完成修改並最終交付能夠運行的應用。
谷歌稱,3.7 Flash在多步驟規劃和工具調用方面能夠進行更深入的「思考」,並在執行過程中遇到障礙時更好地調整策略,從而減少用戶反覆提示和人工干預。
低成本搶智能體市場,Token價格降至前代一半
性能提升之外,價格是Gemini 3.7 Flash此次另一張「王牌」。
谷歌給出的引導價為每百萬輸入Token 0.75美元、每百萬輸出Token 3.75美元,有效期至2026年12月31日。2027年1月1日起,價格將恢復至每百萬輸入Token 1.50美元和每百萬輸出Token 7.50美元。
換言之,在今年年底之前,開發者調用3.7 Flash的成本只有此前3.6 Flash原價的一半。
這一策略與谷歌近期密集推出Flash模型的思路一脈相承:通過提高模型能力、降低延遲和壓低Token成本,讓Flash成為大規模部署AI智能體的基礎模型。
事實上,7月21日谷歌一次性推出的三款Flash模型已經體現了這一方向。Gemini 3.6 Flash被谷歌定位為面向編碼、知識工作和多模態任務的「工作型」模型;3.5 Flash-Lite則強調低延遲和高吞吐,適用於智能體搜索、文檔處理等大量調用場景;3.5 Flash Cyber則針對網絡安全任務,並與CodeMender代碼安全智能體結合。
如今,3.7 Flash繼續沿着「高性能+高效率+低成本」的路線推進,谷歌顯然希望在AI智能體快速商業化的過程中爭奪更多開發者和企業用戶。
Flash加速迭代,谷歌AI旗艦仍在等待
但對於投資者而言,Flash系列的快速迭代並不能完全掩蓋旗艦模型遲遲未定的問題。
7月21日,在推出3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber時,谷歌曾表示,Gemini 3.5 Pro正在與合作伙伴進行測試,並計劃在「準備好後」儘快向更廣泛用戶開放。與此同時,谷歌還宣佈已經啓動Gemini 4迄今最雄心勃勃的一輪預訓練。
但截至8月13日推出Gemini 3.7 Flash,谷歌仍未給出Gemini 3.5 Pro明確的公開上線時間。
這使得谷歌AI產品線形成了一個頗為明顯的反差:Flash系列正在高頻更新,但真正承擔旗艦競爭任務的Pro模型仍然沒有明確時間表。
有評論指出,3.5 Pro的延遲已經令投資者關注谷歌的AI產品路線,尤其是在AI編程等商業價值快速上升的領域。隨着OpenAI和Anthropic持續推進頂級模型,谷歌下一款旗艦模型何時推出,已經成為市場衡量其AI競爭力的重要觀察指標。
還有媒體指出,谷歌此前在7月曾表示3.5 Pro正在與合作伙伴測試,並將很快推出,但此次發布3.7 Flash時仍沒有提供具體發布日期。
換言之,谷歌目前正在通過Flash系列的快速迭代,強化自己在「AI應用落地端」的競爭力,但在最頂尖模型這一決定AI能力上限的戰場上,市場仍在等待答案。
谷歌押注更快迭代,Gemini 4也已投入訓練
谷歌的動作並非孤立事件,而是其加速AI模型迭代戰略的一部分。
Alphabet兼谷歌CEO Sundar Pichai此前在7月財報電話會上表示,公司希望以更快速度推出模型,並已經投入大量計算資源訓練下一代Gemini 4。
而在7月22日Alphabet發布財報前,谷歌已經率先密集更新Flash產品線:7月21日同日發布3.6 Flash、3.5 Flash-Lite和3.5 Flash Cyber;8月13日又推出3.7 Flash。
從產品節奏看,谷歌正在明顯縮短Flash系列的迭代周期。其目的不僅是追趕競爭對手的模型發布速度,也是在AI智能體開始從「聊天」走向實際執行任務之際,搶佔開發者和企業應用的基礎設施入口。
谷歌此次還進一步加強了3.7 Flash的安全能力,包括針對惡意黑客攻擊以及危險化學、生物、放射性和核材料濫用的防護,同時儘量避免影響正常的開發和研究用途。
目前,Gemini 3.7 Flash已經通過Google Antigravity以及Gemini API提供,並可在Google AI Studio和Android Studio中使用。谷歌旗下AI生產力智能體Gemini Spark也將從8月13日起使用3.7 Flash。
因此,Gemini 3.7 Flash的意義或許並不只在於「又一個新模型」——谷歌正在用更快的Flash迭代、更強的編程與智能體能力以及更低的Token價格,爭奪AI應用落地市場;但與此同時,Gemini 3.5 Pro何時真正上線,仍是谷歌AI競爭力版圖中尚未填上的一塊關鍵拼圖。