Eduardo Baptista
路透北京8月3日 - 中國阿里巴巴 9988.HK 周一發布了其稱之為規模最大、能力最強的人工智能模型——Qwen3.8-Max。該模型的規模與國內競爭對手Moonshot AI上月推出的產品相比僅略遜一籌。
中國科技公司——作為全球開放式AI模型領域的一支重要力量——正陷入一場激烈且瞬息萬變的競爭,致力於構建更強大的系統,同時確保其運行成本不會高得令人望而卻步。
Qwen3.8-Max擁有2.4萬億個參數,這些數值參數是模型從數據中學習並用於識別模式、生成答案和執行任務的。Moonshot的Kimi K3擁有2.8萬億個參數。
參數數量越多並不一定意味着模型就越優秀,但它已成為衡量先進AI系統背後計算和數據規模的一個備受關注的指標。
中國科技公司熱衷於公布參數數量,以幫助其模型在開發者社區中獲得關注。這些模型通常採用開放權重模式,這意味着允許開發者運行或適配系統的底層學習參數可供下載。
相比之下,OpenAI、Anthropic和谷歌 GOOGL.O 則不公布其閉源模型的參數數量。
Qwen3.8-Max在衆包式模型對比平台Arena.AI上亮相,隨即成為該平台文本模型排名中位列第一的中國模型,儘管其排名仍落後於Claude Fable 5以及三款Opus變體——這些模型均來自Anthropic。
但在Arena.AI針對圖像及其他視覺素材分析的AI模型排行榜上,Qwen3.8-Max位列全球第二,僅次於一款Claude Fable 5變體。
Qwen3.8-Max 和 Kimi K3 均能處理文本、圖像和視頻,並可一次性處理多達 100 萬個令牌。
令牌是數據塊,通常是單詞的片段或短詞,數值越大意味着模型能夠一次性處理大量內容,例如冗長的法律文件、龐大的軟件代碼庫或數百頁的文檔。
阿里巴巴表示,其模型採用「專家混合」設計,將工作分配給系統中的專門模塊,而不是針對每個請求都啓動整個模型。每次僅使用950億個參數,從而降低了成本並縮短了響應延遲。
這家科技巨頭表示,該模型僅用16天就完成了一個軟件工程項目。
Qwen3.8-Max預計將於下周通過阿里雲的Model Studio平台發布。