DeepSeek 今日在 API 平台正式上線新一代多模態模型 V4-Flash-Vision-Exp。據官方介紹,該模型在文本能力上與 DeepSeek-V4-Flash 持平,覆蓋 agent、推理和世界知識等領域。
在多模態智慧體基準測試中,V4-Flash-Vision-Exp 相較 V4-Flash 實現了重大躍升,使多模態智慧體效能接近 Opus-4.8。這一進展表明 DeepSeek 在多模態融合與智慧體任務上取得了顯著突破。
多模態智慧體是當前 AI 競爭的關鍵方向,涉及影像、影片、音訊等多種模態的聯合理解與推理,對自動駕駛、機器人、企業級應用等場景至關重要。DeepSeek 此次升級,直接對標行業領先水平,可能加劇大模型廠商在 多模態能力 上的軍備競賽。
對於關注馬斯克生態的讀者而言,SpaceXAI(原 xAI)旗下 Grok 模型同樣在多模態領域發力,DeepSeek 的快速迭代意味著競爭進一步白熱化。不過,目前尚不清楚該模型的具體引數、定價及開放範圍,實際效能有待第三方評測驗證。