阿里云旗下千问团队近日发布并开源了新一代大模型Qwen 3.8 Flash-Next,凭借极具竞争力的定价和出色的性能,迅速引发行业关注。该模型发布后即登上Huggingface模型榜首位,并在社交媒体上获得大量讨论,有工程师实测称其能在消费级4090显卡上运行数据中心级的长文本任务,打破了以往对高端硬件的依赖。

据官方信息,Qwen 3.8 Flash采用125B MoE架构,每个Token仅激活约6B参数,原生支持262144 token的上下文长度,并可通过YaRN技术扩展至1M token。相比前代Qwen 3.7 Plus,其激活参数缩减至三分之一,训练成本降至九分之一,而通用能力、数学推理和编程能力均有提升。该模型也被视为Qwen 4新架构的提前预演。

价格方面,Qwen 3.8 Flash的API定价为每百万Tokens输入0.8元、输出2.7元、缓存命中0.1元,最低仅为DeepSeek-V4-Flash的三分之一。这一价格水平在同类模型中极具竞争力,直接冲击了现有市场格局。

在实测环节,量子位团队对Qwen 3.8 Flash进行了两项办公场景测试。第一项是让模型在1元额度内,将一份近万字的相机产品资料改写成小红书、微博、抖音和朋友圈四种风格的文案,全程不到2分钟即完成,且风格和话题标签把握准确。第二项是模拟一场产品周会,提供包含错别字和闲聊的万字会议实录,模型在不到4分钟内完成了要点总结、表格整理和邮件撰写,并主动列出未决事项,表现出较强的实用性和主动性。

值得注意的是,在Qwen 3.8 Flash开源的同时,智谱也开源了GLM-5.3-Flash,该模型性能对标Claude Opus 4.8,价格仅为GLM-5.3的十分之一,并推出为期两周的半价活动。两款模型均以低价策略对DeepSeek-V4-Flash形成竞争压力,显示国产大模型价格战正进一步加剧。

从行业角度看,Qwen 3.8 Flash的低价和高效能可能推动大模型在更多应用场景中的普及,尤其是在办公自动化和内容生成领域。对于投资者而言,这一动态可能影响相关公司的市场策略和盈利能力,但具体影响仍需观察市场反应和后续竞争态势。