DeepSeek 今日在 API 平台正式上线新一代多模态模型 V4-Flash-Vision-Exp。据官方介绍,该模型在文本能力上与 DeepSeek-V4-Flash 持平,覆盖 agent、推理和世界知识等领域。

在多模态智能体基准测试中,V4-Flash-Vision-Exp 相较 V4-Flash 实现了重大跃升,使多模态智能体性能接近 Opus-4.8。这一进展表明 DeepSeek 在多模态融合与智能体任务上取得了显著突破。

多模态智能体是当前 AI 竞争的关键方向,涉及图像、视频、音频等多种模态的联合理解与推理,对自动驾驶、机器人、企业级应用等场景至关重要。DeepSeek 此次升级,直接对标行业领先水平,可能加剧大模型厂商在 多模态能力 上的军备竞赛。

对于关注马斯克生态的读者而言,SpaceXAI(原 xAI)旗下 Grok 模型同样在多模态领域发力,DeepSeek 的快速迭代意味着竞争进一步白热化。不过,目前尚不清楚该模型的具体参数、定价及开放范围,实际性能有待第三方评测验证。