DeepSeek 于 8 月 13 日宣布,将其旗舰模型 V4 Pro 从测试阶段转为正式发布,同时开源其智能体软件 DeepSeek Harness,并上调 API 价格。这一系列动作标志着公司在产品成熟度、生态构建和商业化路径上的同步推进。
新版模型通过 deepseek-v4-pro 端点提供,版本号为 V4-Pro-0813。模型名称、参数数量和 100 万 token 的上下文窗口均保持不变,DeepSeek 表示现有集成无需任何调整即可继续运行。在应用和网页端,该模型以“Expert Mode”提供,并新增了对 OpenAI Responses API 的原生支持,集成 Codex。推理努力程度可设置为“低”“高”“最大”三档,DeepSeek 建议日常智能体使用选择中间档。
根据 DeepSeek 公布的对比数据,新版模型在 Terminal Bench 2.1 上的得分从 72.1 跃升至 87.9,DeepSWE 得分从 12.8 提升至 62.7,在多个智能体基准测试中超过了 Claude Opus 4.8。独立评测机构 Artificial Analysis 也确认了改进,但指出其 Intelligence Index 得分从 45 升至 53,与 GLM-5.2 持平,仍落后于 Muse Spark(57)、Qwen 3.8 Max(58)、Kimi K3(60)和排名第一的 Claude Opus 5(63)。DeepSeek 尚未发布新版本的权重,4 月预览版仍可在 Hugging Face 上获取。
此次更新也是对较小模型 V4 Flash 逼近旗舰的回应。7 月底,DeepSeek 为 V4 Flash 发布了 0731 更新,使其在 Artificial Analysis Intelligence Index 上几乎与 Pro 预览版持平,而成本仅为后者的一小部分。
与模型更新同步,DeepSeek Harness v0.1 作为开发者预览版以 MIT 许可开源。该智能体软件被定位为 OpenAI Codex 和 Claude 的替代方案,基于新发布的 Cordis 插件系统构建,所有功能(从工具、沙箱到会话和 UI)均为可替换插件。它提供连续会话日志,记录每次提示、工具调用和结果,支持运行恢复、分支和重放。最小模式仅保留 shell 和文件编辑器,DeepSeek 自身基准测试即采用此配置。软件通过 npx 启动本地 Web 界面,但 DeepSeek 警告存在兼容性问题。项目由 2026 年 3 月从量化交易公司 Jane Street 加入的 Cui Tianyi 领导。8 月初团队征集测试者时,三天内即有 712 个项目报名。
API 定价调整自 8 月 16 日 16:00 UTC 生效。DeepSeek 在 6 月底已宣布转向峰谷定价,但当时未公布具体数字和日期。此次调整后,非高峰时段(UTC 1:00-4:00 和 6:00-10:00,对应中国工作日)费用减半。非高峰时段 V4-Pro 输入价格从每百万 token 0.435 美元升至 0.66 美元,输出从 0.87 美元升至 1.98 美元;高峰时段则翻倍至 1.32 美元和 3.96 美元。缓存命中价格上涨最为显著,非高峰从 0.003625 美元升至 0.022 美元,高峰达 0.044 美元,使缓存折扣从约为常规输入价格的 1/120 缩小至 1/30。对于反复读取相同文件的智能体工作流,这是成本增加最大的部分。新定价部分抵消了 5 月的降价,缓存命中成本甚至高于降价前。
此次涨价发生在公司筹集新资本并筹备 IPO 之际。DeepSeek 通过模型升级、开源生态建设和价格调整,试图在竞争激烈的 AI 市场中巩固地位,同时为商业化铺路。对于开发者而言,缓存成本上升可能影响依赖高频读取的智能体应用的经济性;而开源 Harness 则可能吸引更多开发者加入其生态。市场将关注这些举措能否帮助 DeepSeek 在保持技术竞争力的同时实现可持续增长。