Eduardo Baptista
路透北京8月3日 - 中国阿里巴巴 9988.HK 周一发布了其称之为规模最大、能力最强的人工智能模型——Qwen3.8-Max。该模型的规模与国内竞争对手Moonshot AI上月推出的产品相比仅略逊一筹。
中国科技公司——作为全球开放式AI模型领域的一支重要力量——正陷入一场激烈且瞬息万变的竞争,致力于构建更强大的系统,同时确保其运行成本不会高得令人望而却步。
Qwen3.8-Max拥有2.4万亿个参数,这些数值参数是模型从数据中学习并用于识别模式、生成答案和执行任务的。Moonshot的Kimi K3拥有2.8万亿个参数。
参数数量越多并不一定意味着模型就越优秀,但它已成为衡量先进AI系统背后计算和数据规模的一个备受关注的指标。
中国科技公司热衷于公布参数数量,以帮助其模型在开发者社区中获得关注。这些模型通常采用开放权重模式,这意味着允许开发者运行或适配系统的底层学习参数可供下载。
相比之下,OpenAI、Anthropic和谷歌 GOOGL.O 则不公布其闭源模型的参数数量。
Qwen3.8-Max在众包式模型对比平台Arena.AI上亮相,随即成为该平台文本模型排名中位列第一的中国模型,尽管其排名仍落后于Claude Fable 5以及三款Opus变体——这些模型均来自Anthropic。
但在Arena.AI针对图像及其他视觉素材分析的AI模型排行榜上,Qwen3.8-Max位列全球第二,仅次于一款Claude Fable 5变体。
Qwen3.8-Max 和 Kimi K3 均能处理文本、图像和视频,并可一次性处理多达 100 万个令牌。
令牌是数据块,通常是单词的片段或短词,数值越大意味着模型能够一次性处理大量内容,例如冗长的法律文件、庞大的软件代码库或数百页的文档。
阿里巴巴表示,其模型采用“专家混合”设计,将工作分配给系统中的专门模块,而不是针对每个请求都启动整个模型。每次仅使用950亿个参数,从而降低了成本并缩短了响应延迟。
这家科技巨头表示,该模型仅用16天就完成了一个软件工程项目。
Qwen3.8-Max预计将于下周通过阿里云的Model Studio平台发布。