
智東西
作者 | 李水青
編輯 | 雲鵬
智東西8月6日報道,今日,Meta推出其首款編程Agent——Muse Code(測試版),以及該Agent搭載的新一代模型Muse Spark 1.2。
模型一經面世便引發海外熱議,核心關注點直指定價策略:比DeepSeek-V4-Flash更便宜。如果用戶允許Meta用他們的數據訓練模型,就能享受95折優惠。

有趣的是,就在同日,DeepSeek發布公告宣佈:「計劃近期整體上調API服務定價,預計漲幅較大。」國內其他頭部模型也有價格戰鬆動跡象,比如,智譜GLM模型在優惠結束後價格也將明顯上調。

當海外巨頭OpenAI、Meta紛紛殺入價格戰,DeepSeek等國產模型似乎不按套路出牌,這場全球大模型混戰變得越來越有意思了。
一、最高降價75倍,Meta盯上用戶數據
扎克伯格在推文中稱:「(這款模型)定位入門簡單且成本低廉,(用戶)只需一行代碼即可安裝,開始使用‘貢獻者套餐’。」


所謂「貢獻者套餐」,是指Meta提供兩個API版本:一個版本允許數據共享,另一個版本則不允許。前者輸入價格為0.10美元/百萬Tokens,比後者便宜12.5倍; 緩存輸入0.002美元/百萬Tokens,便宜75倍;輸出0.20美元/百萬Tokens,便宜21倍以上。

有網友調侃:「笑死,Muse Spark輸入、輸出成本都比DeepSeek-V4-Flash低,還擁有獨特優化的緩存命中率。他們不在乎利潤,只想要數據。」

此前7月31日,DeepSeek-V4-Flash正式上線API,該模型在未命中輸入緩存時價格為1元/百萬tokens,輸入命中緩存價格為0.2元/百萬tokens,輸出價格為2元/百萬tokens。

二、DeepSeek「強得不像Flash」,Meta跟得動嗎?
當下正值DeepSeek-V4-Flash在全球引起新一輪熱潮。自上線API以來,其超高性價比的口碑持續攀升。
拉美頭部在線教育平台Platzi聯創兼CEO今日啱啱發文感嘆:「我完全不明白DeepSeek-V4-Flash是如何達到這種速度和質量的,太厲害了。」
更有網友直言:「Claude死了。世界沒有理由繼續受制於一家價格高出百倍、性能卻與競爭對手不相上下的供應商。」

但DeepSeek-V4-Flash的口碑不僅源於低價,更在於性能表現。
這款模型基準測試遠超4月上線的自家「大哥」DeepSeek-V4-Pro-Preview。直到今天,還有不少海外網友仍在興奮讚嘆:「它現在完全不像一個Flash模型。」在Almanbench測試中,DeepSeek-V4-Flash 0731版本超越Kimi K3,得分幾乎媲美GPT-5.6 Sol xhigh。


那麼試圖與DeepSeek打價格戰的Meta,其最新的Muse Spark 1.2和Muse Code測試版性能如何?
三、編程測評僅次於Opus5,Muse Spark 1.2與前沿模型仍有距離
從模型性能來看,Muse Spark 1.2比自己前代模型提升較大,但與前沿模型仍有一定距離。
Muse Spark 1.2是專為編程優化的更新版本。在Terminal‑Bench 2.1、DeepSWE 1.1等代碼能力基準測試中,整體成績僅次於Claude Opus5,強於GPT‑5.6、Grok4.5和Gemini3.6。

在複雜推理GDPVal‑AA V2測試中,Muse Spark 1.2僅次於Opus5;在Agent工具調用MCP Atlas基準上,Muse Spark 1.2登頂榜首。

Meta測試了該模型在超過1000次工具調用(長達24小時)內迭代優化GPU內核的能力。藉助Muse Code的智能體編碼環境,該模型表現優於Gemini 3.6 Flash、GPT-5.6 Terra,但遜於GPT-5.6 Sol、Opus5。


Muse Code定位終端編碼Agent,能夠處理大型代碼庫中的完整軟件工程任務,包括規劃變更、編寫代碼、驗證結果。Meta公布了系列案例,但其實際能否與Claude Code、Codex一較高下,仍有待開發者真實場景的檢驗。
如下圖案例所示,Muse Code採用簡單的Agent循環,並輔以一組異步後台Agent來增強主Agent的功能。它們的持續運行降低了延遲,並降低複雜多步驟任務下的人工干預需求。

▲Muse Spark 1.2生成的光子球模擬

▲Muse Spark 1.2生成的遊戲射擊界面

▲Muse Spark 1.2生成的牛油果草坪遊戲
下圖為用戶將房屋的漫遊視頻以MP4文件的形式輸入到終端。Muse Code會解析該視頻,並生成一個視覺效果豐富的度假屋營銷和預訂頁面。

此外,Muse Spark 1.2人工智能分析指數 (AII) 中獲得54分,相比之前的版本,其智能體知識工作能力顯著提升,使Meta與SpaceXAI並列美國實驗室第三名。

結語:Meta降價搶客,DeepSeek漲價備戰,AI價格戰背後是Agent硬仗
緊隨OpenAI降價,Meta也在美國AI圈打起價格戰。Meta試圖以此在OpenAI、Anthropic的統治下分一杯羹;並首次入局終端編程Agent市場,試圖重新上桌。而谷歌DeepMind近期內部的大調整,恰好為Meta提供了機會窗口。
低價或許是不錯的引流手段,但打開局面還需要更高的模型性能和Token質量。這也是DeepSeek-V4-Flash再次爆火海外的原因。
值得注意的是,就在今日,DeepSeek發布公告計劃近期整體上調API服務定價。可見,DeepSeek並未將競爭侷限於價格戰,而是繼續聚焦模型質量的比拼。近期,DeepSeek正大力招聘Agent Harness人才、積極招攬優秀開源項目,其Agent Harness產品(或命名為DeepSeek Code)正在緊鑼密鼓推進中。
可以預見,價格戰只是序章,圍繞Agent的算力、性能、價格、應用、生態等全維度的競爭,將愈演愈烈。