作者I山上 薛星星
像所有 AI 行業人士一樣,月之暗面創始人楊植麟喜歡用「AI 一天,人間一年」的說法形容 AI 的迅速迭代。對於啱啱發布的 Kimi K3 而言,似乎沒有什麼形容比這句話更為貼切。月之暗面成立至今已有三年,但過去三年的所有積累可能都抵不上這三天的轟動。
自 ChatGPT 發布以來,中國 AI 行業有許多次震驚世界的時刻。一部分來自於真正的技術突破,一部分則是媒體與廠商們的自嗨,Kimi K3 的發布似乎是唯一能與「DeepSeek 時刻」相媲美的。
和去年年初 DeepSeek-R1 發布後美國芯片產業普跌類似,上周包括英偉達、博通以及美光在內的費城半導體指數重挫 10%,創下自 2025 年 4 月以來最大單周跌幅,進入技術性熊市區間。媒體統計稱,72 小時內美股 AI 板塊合計蒸發 4700 億美元,約超 3 萬億人民幣。
不止一家海外媒體及研究機構用諸如「DeepSeek 2.0」來形容 Kimi K3。《財富》雜誌稱這是「第二次 DeepSeek 衝擊」,《華爾街日報》強調 Kimi 加劇了華爾街芯片股拋售,彭博社則表示「Kimi 顛覆了美國領先中國的傳統認知」。
恐慌的情緒不斷蔓延,甚至令 OpenAI 及 Anthropic 都備受質疑,因為一家中國開源模型的性能似乎已接近頂級閉源模型。二者本就處在上市前的關鍵節點,模型性能領先是他們獲得高估值以及高定價的關鍵。部分美國開發者已經在質疑為何還要為 Claude 和 GPT 付出這麼多的價格。
過去幾日,Anthropic 宣佈為所有 Max 及 Team Premium 用戶開放 Claude Fable 5,但限額 50%,此前他們曾因算力問題而計劃完全從訂閱方案中移除這一模型。OpenAI 則在上周多次重置 Codex 限額,甚至一度取消了 5 小時的用量限制。
很難說這些事件都是 Kimi K3 的衝擊所致。在此之前,半導體產業已經連續承壓數周,華爾街分析師們迫切需要為這輪下跌尋找一個足夠醒目、也容易理解的藉口——境外勢力自然是萬能法寶。更不用說 OpenAI 及 Anthropic 本就處在激烈競爭之中,已經演變到大打價格戰的地步。
但這似乎並不影響美國科技行業對於 Kimi K3 的驚訝。即便 Kimi 承認自身總體性能仍落後於 Claude Fable 5 於 GPT-5.6 Sol,諸多海外評測機構仍在測評對 K3 不吝讚美,排名往往位列前茅。
Arena.ai 稱 Kimi K3 以 1679 分的成績獲得前端代碼競技場榜首,超越 Claude Fable 5。這家機構表示,上次中國模型如此接近領先,還是 2025 年的 DeepSeek-R1。
高昂的市場熱情下,連楊植麟都成為美國科技圈熱議的新偶像人物。大洋彼岸的人民群衆疑問為何他當年沒有留在美國,而是回到了中國。楊植麟的博士生導師不得不專門發文解釋,澄清楊回國並不是由於簽證或移民問題,而是他自己堅定要回去創業。
大模型行業仍然遵循着最簡單明瞭的優勝劣汰法則,只要性能足夠領先,價格就不是問題。即便 K3 模型的輸入及輸出價格均較上代 K2.6 模型均上升逾 3 倍有餘,也顯著高於 GLM-5.2 及 DeepSeek V4 Pro,已經是目前市面上最貴的國產模型,但 Kimi 依然遭遇了算力緊缺問題。
7 月 19 日晚,Kimi 宣佈由於算力緊缺,自即日起暫停 C 端新用戶訂閱。他們同時調整了會員權益,將原本覆蓋 Kimi 網頁版、App 以及 Kimi Work 的通用會員與 Kimi Code 會員拆分銷售。Kimi 總裁張予彤稱,K3 發布次日公司 ARR 創下歷史最大單日增幅。
算力緊缺一定程度上或許也與 K3 模型自身的 Token 效率相關。在 Artificial Analysis 的評測中,K3 完成整套測試輸出了 1.3 億個 Token,接近同類模型平均水平的兩倍。更長的輸出通常意味着更高的推理成本,這可能進一步加重 Kimi 的算力壓力。
社交媒體上,也有不少開發者吐槽 Kimi K3 是 Token 消耗大戶,有人稱跑了 15 分鐘就已經耗盡了 5 小時的限額。
K3 的出圈似乎再一次證明了 AI 時代模型的脆弱性。僅僅兩周之前,中國大模型市場最被人看好的還是已經上市的智譜。上半年智譜發布的 GLM-5.2 模型被譽為國產開源模型的驕傲,幾次大幅上調價格依然緊俏。上市半年來,智譜股價翻了 24 倍有餘,總市值一度突破 1.3 萬億港元。
但從上周開始,智譜的神話似乎就已鬆動。上周五,智譜股價下跌 28.49%,本周一再跌 19.56%,兩個交易日股價累計下跌超 4 成,市值跌破 5000 億港元。
Kimi K3 的領先可能也維持不了多久。7 月 19 日,阿里巴巴發布 Qwen3.8 Max 預覽版,參數規模達 2.4 萬億,宣稱綜合能力在全球範圍內僅次於 Claude Fable 5。馬斯克對外稱,擁有 2 萬億參數量的 Grok 新模型即將完成初步訓練,它可能在保持較高運行效率的同時超越 Kimi。
K3 發布當天,薩姆·奧爾特曼對外表示,他知道他們過去 12 個月並非最佳,這主要歸咎於他,但他們即將迎來迄今為止最好的 12 個月。「團隊正在做非常出色的工作,我相信你會對他們為你準備的驚喜感到非常滿意。」
芯片行業多年來一直奉行着摩爾定律,在成本大致不變的情況下芯片性能大約每 18 至 24 個月翻一倍。但就像 AI 行業人士常常掛在嘴邊的「AI 一天,人間一年」的說法,AI 時代的模型性能提升可能以周甚至天來計算。
去年谷歌的 Gemini 模型一度令薩姆·奧爾特曼在公司內拉響紅色警報,但現在 Gemini 更流行的稱謂是「北美豆包」。彭博社稱 Gemini 3.5 Pro 的發布時間已經推遲數月,因為模型在編程及代碼生成能力上未達預期。
兩個交易日的重挫後,市場消息稱智譜可能跳過 GLM-5.3,直接推出 GLM-5.5,預計最快將於 8 月發布,據稱將具備萬億以上的參數規模。智譜的員工們已經開始在推特上放出小道消息,稱現在可能是訂閱 GLM Coding Plan 的最佳時機。
啱啱完成首輪孖展的 DeepSeek 被曝即將推出 DeepSeek-V4 模型的正式版,外界稱性能將逼近 GPT-5.6,且繼續保持極高性價比的優勢。
過去的時代總在反覆證明時間的重要。無論是 PC 互聯網還是移動互聯網,一家公司只要起步足夠早、跑得足夠快,就有機會趕在窗口關閉前建立先發優勢。而隨着用戶和市場規模不斷擴大,領先非但不會被稀釋,反而會持續放大,令後來者越來越難以追趕。
但在 AI 時代,優勢並不總是站在時間這一邊。所有的領先都建立在模型性能的迭代上,總有後來者不斷推出更新的模型,縮短與前者的差距。如果說互聯網時代最難追趕的是規模,那麼 AI 最醒目的優勢就是模型。只是這種優勢的保質期,往往只有一個版本。
兩個交易日內股價連跌 4 成的智譜,今日盤中漲幅一度超 35%。市場消息稱,智譜已落地 1GW 級國產 AI 算力數據中心建設。
競爭仍在繼續。