阿里巴巴旗下 AI 團隊 Qwen 於 8 月 14 日釋出 Qwen 3.8 系列模型,核心模型 Qwen3.8-27B 為 270 億引數的稠密多模態模型,官方稱其在程式設計和辦公任務上優於更大的 Qwen3.7-Plus。模型權重以 Apache 2.0 協議開源,已在 Hugging Face 和 ModelScope 平台上線,面向開發本地及智慧體應用的開發者。
Qwen3.8-27B 原生支援 262,000 token 的上下文長度,並可通過 YaRN 方法擴充套件至 100 萬 token。除文本外,模型還能處理影像和影片,包括圖表、文件以及長達數小時的影片。模型預設開啟靈活思考模式,但使用者可按查詢切換。
除核心模型外,Qwen 還發布了規模更大的 Qwen3.8-2.4T-A95B 權重,該模型定位在 Max 級別執行。兩個模型均可在 Hugging Face 和 ModelScope 上獲取。此外,Qwen Cloud(阿里雲 AI 服務)即將提供支援 100 萬 token 上下文的託管版本。
此次釋出延續了 Qwen 團隊在開源模型領域的策略,通過 Apache 2.0 協議開放權重,降低開發者使用門檻。Qwen3.8-27B 作為稠密模型,相比同系列更大的 MoE 模型(如 2.4T 引數版本)在部署上更具靈活性,適合本地執行和智慧體應用場景。
從行業角度看,開源模型在程式設計與辦公任務上的競爭日益激烈,Qwen 3.8 的釋出可能對同類開源模型構成壓力。同時,阿里雲通過 Qwen Cloud 提供託管服務,有望吸引更多企業使用者,進一步鞏固其在 AI 雲服務市場的地位。不過,模型實際效能仍需第三方基準測試驗證,開發者社群的反應也是重要觀察指標。