據海外開發者開源專案團隊OpenCode釋出的資料,DeepSeek V4 Flash在8月3日單日處理量達到8萬億Token,其中5萬億來自免費試用額度,3萬億為開發者付費使用。與此同時,模型API分發平台OpenRouter的資料顯示,上週(7月27日至8月2日)DeepSeek V4 Flash以7.22萬億Token的周呼叫量位居第一。

OpenRouter與OpenCode雖同為模型呼叫平台,但定位不同。OpenRouter是全場景通用API聚合閘道器,模型庫較全,面向各類AI應用開發;而OpenCode本體是面向程式設計師的終端AI程式設計工具,其附帶的Zen、OpenCode Go閘道器聚焦程式碼開發場景,模型池高度精簡。兩個平台的資料共同表明,DeepSeek V4 Flash正式版上線後,為平台帶來了顯著的呼叫量與使用者規模提升。OpenCode CEO Jay(賈亞庫馬爾)8月1日發文稱,DeepSeek V4 Flash上線後使用量單日增長30%,OpenCode Go的新訂閱使用者也增長30%。

值得注意的是,在OpenCode的評論區,OpenAI核心產品與平台負責人Tibo(蒂博·索蒂奧)為OpenAI GPT-5.6產品家族中的輕量經濟型模型Luna打廣告,但開發者並未買賬,有開發者直言:“我們希望得到DeepSeek的價格。”這一幕折射出近期開閉源模型競爭的激烈程度。

就在7月31日,OpenAI宣佈GPT-5.6 Luna降價80%,輸出價格從每百萬Token 6美元降至1.2美元,輸入價格從1美元降至0.2美元。緊接著當日晚些時候,DeepSeek V4 Flash正式版API上線公測。

DeepSeek-V4-Flash正式版採用MoE架構,總引數規模達284B(啟用13B),支援最長100萬Token上下文,支援非思考與思考模式切換。其模型結構、尺寸與預覽版一致,僅重新進行了後訓練。在Artificial Analysis智慧指數中,DeepSeek V4 Flash獲得50分,僅比GPT-5.6 Luna的51分低1分。

在成本端,即使OpenAI已將GPT-5.6 Luna價格下調80%,DeepSeek V4 Flash在其自有API上的單任務成本仍比前者低約60%。關鍵原因是DeepSeek提供了約98%的快取命中折扣——即命中快取的Token僅按標價2%計費,遠超業內普遍的90%折扣水平。定價方面,DeepSeek-V4-Flash輸入命中快取僅0.2元/百萬Token,未命中輸入1元/百萬Token,輸出2元/百萬Token。

相近定位卻更具價效比的優勢,正是近期海外對開閉源模型爭議的核心。分析認為,OpenAI面臨多重競爭壓力——中國開源模型快速迭代,模型差距不斷縮小,這使得美國頭部模型也不得不重新思考價效比。DeepSeek-V4-Flash正式版上線不到一週,便在兩大平台交出單日8T、周呼叫7.22T的成績單。當OpenAI以更低價格仍無法在成本與使用者心智方面取勝時,國產開源模型將傳統價效比概念帶入新的競爭階段。