阿里雲旗下千問團隊近日釋出並開源了新一代大模型Qwen 3.8 Flash-Next,憑藉極具競爭力的定價和出色的效能,迅速引發行業關注。該模型釋出後即登上Huggingface模型榜首位,並在社交媒體上獲得大量討論,有工程師實測稱其能在消費級4090顯示卡上執行資料中心級的長文本任務,打破了以往對高階硬體的依賴。

據官方資訊,Qwen 3.8 Flash採用125B MoE架構,每個Token僅啟用約6B引數,原生支援262144 token的上下文長度,並可通過YaRN技術擴充套件至1M token。相比前代Qwen 3.7 Plus,其啟用引數縮減至三分之一,訓練成本降至九分之一,而通用能力、數學推理和程式設計能力均有提升。該模型也被視為Qwen 4新架構的提前預演。

價格方面,Qwen 3.8 Flash的API定價為每百萬Tokens輸入0.8元、輸出2.7元、快取命中0.1元,最低僅為DeepSeek-V4-Flash的三分之一。這一價格水平在同類模型中極具競爭力,直接衝擊了現有市場格局。

在實測環節,量子位團隊對Qwen 3.8 Flash進行了兩項辦公場景測試。第一項是讓模型在1元額度內,將一份近萬字的相機產品資料改寫成小紅書、微博、抖音和朋友圈四種風格的文案,全程不到2分鐘即完成,且風格和話題標籤把握準確。第二項是模擬一場產品週會,提供包含錯別字和閒聊的萬字會議實錄,模型在不到4分鐘內完成了要點總結、表格整理和郵件撰寫,並主動列出未決事項,表現出較強的實用性和主動性。

值得注意的是,在Qwen 3.8 Flash開源的同時,智譜也開源了GLM-5.3-Flash,該模型效能對標Claude Opus 4.8,價格僅為GLM-5.3的十分之一,並推出為期兩週的半價活動。兩款模型均以低價策略對DeepSeek-V4-Flash形成競爭壓力,顯示國產大模型價格戰正進一步加劇。

從行業角度看,Qwen 3.8 Flash的低價和高效能可能推動大模型在更多應用場景中的普及,尤其是在辦公自動化和內容生成領域。對於投資者而言,這一動態可能影響相關公司的市場策略和盈利能力,但具體影響仍需觀察市場反應和後續競爭態勢。