8月6日,DeepSeek在用户后台突然发布调价预告,宣布计划在近期对全部API接口服务进行整体提价,且预计涨幅较大。官方建议企业与个人开发者合理规划调用量、控制充值金额,具体细则待后续公告。这一动作距离其V4 Flash正式版上线仅过去一周,引发市场对低价策略可持续性的广泛讨论。

7月31日,DeepSeek在API文档中更新日志,宣布DeepSeek-V4-Flash正式版上线公测。该模型架构与4月24日开源的预览版一致,采用2840亿总参数、130亿激活参数的MoE架构,仅重做了后训练。然而,正是这一改动带来显著性能提升:在官方公布的9项Agent基准测试中,正式版全面超越自家旗舰V4-Pro预览版,指令遵循能力实现跨代际提升。同时,DeepSeek首次原生支持Responses API格式,开发者可直接在ChatGPT桌面端或VS Code插件中将底层引擎切换为DeepSeek,直接对标OpenAI的Codex。

实测中,DeepSeek V4 Flash正式版展现出惊人的性价比。一位开发者用其修复生产环境bug,全程不到3分钟,消耗不到21.7万Token,缓存命中率高达99.8%,按正式版定价(输入1元/百万Token、缓存命中0.02元/百万Token、输出2元/百万Token)估算,总成本仅0.88元人民币(约0.13美元)。若仅算Bug定位与修复,成本更低至0.27元。不过,该模型仍不支持多模态图像输入,在复杂长流程任务规划中表现吃力,单点定位、单次修复是其强项。

凭借极致的性价比,DeepSeek V4 Flash正式版在AI圈引发“斩杀线”热议,被指“干翻Claude”。第三方评测机构Artificial Analysis的综合智能指数显示,其得分50,落后于Kimi K3的57分和智谱GLM-5.2的51分,排国内第三。但价格优势巨大:输出价格每百万token仅0.28美元,而GLM-5.2为4.29美元(15倍),Anthropic旗舰Claude Fable 5高达50美元(178倍)。按综合任务口径,DeepSeek完成一项任务平均成本约0.03美元,Kimi K3约0.86美元,Fable 5约3.15美元,最贵与最便宜相差105倍。在Agent场景中,这种成本差异被指数级放大,一次真实软件工程任务可能触发百次以上调用,0.03美元与3.15美元的单次成本差距,跑50次就是“一杯咖啡和一台咖啡机”的区别。

DeepSeek的低价策略迅速引发行业连锁反应。V4 Flash正式版上线前一天,OpenAI宣布GPT-5.6系列调价,入门款Luna降价80%;8月1日,智谱重新开放GLM Coding Plan订阅。虽然难以将所有降价归因于DeepSeek,但整个行业的价格锚点正在被重塑。性能比它强的价格贵出一两个数量级,价格向它看齐的性能又存在代差,这正是“斩杀线”的含义。

然而,低价狂欢背后是沉重的算力账单。据报道,DeepSeek已重启第二轮融资,计划募资500亿元,投前估值约5000亿元。两个月前,他们刚完成中国大模型史上规模最大的首轮融资,获得国家人工智能产业投资基金、腾讯、宁德时代等合计510亿元。两轮合计超千亿的募资中,超六成将用于自建智算中心与国产芯片适配,另有一条一年前秘密启动的自研推理芯片产线。这家曾以“轻资产、重算法”著称的公司,正被算力需求逼着变“重”。

梁文锋曾表示,采购一批服务器约10个月可通过API收入收回成本,这算“合理利润”。但V4 Flash正式版上线后,在OpenRouter榜单上单周消耗7.1万亿Token,极低价格引发开发者“报复性”调用,高峰期并发请求让服务器集群不堪重负。在自建智算中心尚未完全交付的当下,通过价格杠杆筛选高价值客户、抑制低效高频消耗,成为防止服务器被挤爆的自救手段。同时,自建超大规模智算中心、适配国产芯片、自研推理芯片产线,都是百亿级现金流黑洞,即便手握千亿融资,DeepSeek也必须重新算账。

8月6日的提价预告,戳破了低价狂欢的滤镜。它表明,算法的精妙可以压缩单位Token的算力成本,但算力集群的硬件天花板与现金流压力无法无限平抑。当强如DeepSeek都不得不踩下刹车、调头提价时,这场靠“价格战”互相放血的时代或许真的要画上句号。与此同时,阿里“千问办公”、腾讯WorkBuddy与字节豆包正在C端办公场景激烈竞争,而DeepSeek那个功能依然“简陋”的官网,克制得仿佛不属于这个时代。克制的产品形态、极致的API定价与千亿级别的重资产基建,构成了DeepSeek最真实的商业底色。这一脚刹车,与其说是向商业现实低头,不如说是整个行业在狂热价格战后对客观商业规律的第一次真正敬畏。