据海外开发者开源项目团队OpenCode发布的数据,DeepSeek V4 Flash在8月3日单日处理量达到8万亿Token,其中5万亿来自免费试用额度,3万亿为开发者付费使用。与此同时,模型API分发平台OpenRouter的数据显示,上周(7月27日至8月2日)DeepSeek V4 Flash以7.22万亿Token的周调用量位居第一。

OpenRouter与OpenCode虽同为模型调用平台,但定位不同。OpenRouter是全场景通用API聚合网关,模型库较全,面向各类AI应用开发;而OpenCode本体是面向程序员的终端AI编程工具,其附带的Zen、OpenCode Go网关聚焦代码开发场景,模型池高度精简。两个平台的数据共同表明,DeepSeek V4 Flash正式版上线后,为平台带来了显著的调用量与用户规模提升。OpenCode CEO Jay(贾亚库马尔)8月1日发文称,DeepSeek V4 Flash上线后使用量单日增长30%,OpenCode Go的新订阅用户也增长30%。

值得注意的是,在OpenCode的评论区,OpenAI核心产品与平台负责人Tibo(蒂博·索蒂奥)为OpenAI GPT-5.6产品家族中的轻量经济型模型Luna打广告,但开发者并未买账,有开发者直言:“我们希望得到DeepSeek的价格。”这一幕折射出近期开闭源模型竞争的激烈程度。

就在7月31日,OpenAI宣布GPT-5.6 Luna降价80%,输出价格从每百万Token 6美元降至1.2美元,输入价格从1美元降至0.2美元。紧接着当日晚些时候,DeepSeek V4 Flash正式版API上线公测。

DeepSeek-V4-Flash正式版采用MoE架构,总参数规模达284B(激活13B),支持最长100万Token上下文,支持非思考与思考模式切换。其模型结构、尺寸与预览版一致,仅重新进行了后训练。在Artificial Analysis智能指数中,DeepSeek V4 Flash获得50分,仅比GPT-5.6 Luna的51分低1分。

在成本端,即使OpenAI已将GPT-5.6 Luna价格下调80%,DeepSeek V4 Flash在其自有API上的单任务成本仍比前者低约60%。关键原因是DeepSeek提供了约98%的缓存命中折扣——即命中缓存的Token仅按标价2%计费,远超业内普遍的90%折扣水平。定价方面,DeepSeek-V4-Flash输入命中缓存仅0.2元/百万Token,未命中输入1元/百万Token,输出2元/百万Token。

相近定位却更具性价比的优势,正是近期海外对开闭源模型争议的核心。分析认为,OpenAI面临多重竞争压力——中国开源模型快速迭代,模型差距不断缩小,这使得美国头部模型也不得不重新思考性价比。DeepSeek-V4-Flash正式版上线不到一周,便在两大平台交出单日8T、周调用7.22T的成绩单。当OpenAI以更低价格仍无法在成本与用户心智方面取胜时,国产开源模型将传统性价比概念带入新的竞争阶段。