新浪科技訊 8月26日晚間消息,阿里發布並同步開源千問最新模型 Qwen3.8-Flash。該模型採用全新下一代架構,千億總參數僅激活60億(6B)即可獲得超越Claude Opus4.6的前沿性能,創下模型效率全球新基準。
得益於架構和訓練的革新,Qwen3.8-Flash訓練成本較Qwen3.7-Plus驟降近90%,推理成本同樣大幅下降,每百萬Tokens輸入僅1元,輸出3元,價格最低至DeepSeek-V4-Flash的1/3。Qwen3.8-Flash今晚將首發上線「千問辦公」,開發者和企業也可通過千問AI平台獲取新模型API服務。
Qwen3.8-Flash是一個多模態混合專家(MoE)模型,採用了下一代(Next)模型架構,Transformer參數125B僅激活6B,性能表現超越Opus4.6、接近Opus4.8。僅完成預訓練的Qwen3.8-Flash基座(Base)模型,在通用(SuperGPQA)、數學推理(GSM8K)、編程(SWEBench-Pretrain)等基礎能力上超過了3倍其大小的Qwen3.7-Plus基座模型。經後訓練後,Qwen3.8-Flash性能實現躍遷:在考驗智能體編程的SWE-bench Pro評測中領先Opus4.6多達9.1分;在長程專業任務CoWorkBench、真實工具調用Toolathlon Verified等智能體任務中均超越了DeepSeek-V4-Flash。
Qwen3.8系列技術創新,帶來了訓練和推理的成本大幅下降。Qwen3.8-Flash性能與上一代Qwen3.7-Plus接近,但僅用九分之一的資源便完成了訓練,訓練成本降90%;推理時,Qwen3.8-Flash每百萬Tokens輸入低至1元,輸出3元,是Claude Opus4.6的3%,是DeepSeek-V4-Flash閒時價格的2/3、忙時價格的1/3。