8月26日,阿里旗下通義千問團隊釋出新一代多模態模型Qwen3.8-Flash,定位為Qwen4架構的早期預覽版。該模型採用MoE(混合專家)架構,總引數量達1250億,並額外包含510億的N-gram嵌入引數,但推理時每個Token僅啟用60億引數,在保持效能的同時大幅降低計算開銷。

據官方介紹,生產版Qwen3.8-Flash將很快通過Qwen Cloud API提供服務,定價為每百萬輸入Token 0.16美元、每百萬輸出Token 0.47美元,遠低於同類模型常見價格,凸顯其成本效益優勢。

此次釋出正值全球大模型競爭白熱化階段,各廠商紛紛在效能與價格之間尋求平衡。Qwen3.8-Flash的低啟用引數設計,使其在推理成本上具備競爭力,可能吸引對成本敏感的開發者和企業使用者。同時,作為Qwen4的預覽版,該模型也展示了阿里在下一代架構上的技術方向,為後續正式版本鋪路。

業內觀察人士認為,低價策略或進一步推動大模型應用的普及,但也可能加劇行業價格戰,對依賴模型推理收入的廠商構成壓力。目前,Qwen系列已在開源社群積累一定影響力,此次新模型的釋出有望鞏固其市場地位。