8月6日,DeepSeek在使用者後台突然釋出調價預告,宣佈計劃在近期對全部API介面服務進行整體提價,且預計漲幅較大。官方建議企業與個人開發者合理規劃呼叫量、控制充值金額,具體細則待後續公告。這一動作距離其V4 Flash正式版上線僅過去一週,引發市場對低價策略可持續性的廣泛討論。
7月31日,DeepSeek在API文件中更新日誌,宣佈DeepSeek-V4-Flash正式版上線公測。該模型架構與4月24日開源的預覽版一致,採用2840億總引數、130億啟用引數的MoE架構,僅重做了後訓練。然而,正是這一改動帶來顯著效能提升:在官方公佈的9項Agent基準測試中,正式版全面超越自家旗艦V4-Pro預覽版,指令遵循能力實現跨代際提升。同時,DeepSeek首次原生支援Responses API格式,開發者可直接在ChatGPT桌面端或VS Code外掛中將底層引擎切換為DeepSeek,直接對標OpenAI的Codex。
實測中,DeepSeek V4 Flash正式版展現出驚人的價效比。一位開發者用其修復生產環境bug,全程不到3分鐘,消耗不到21.7萬Token,快取命中率高達99.8%,按正式版定價(輸入1元/百萬Token、快取命中0.02元/百萬Token、輸出2元/百萬Token)估算,總成本僅0.88元人民幣(約0.13美元)。若僅算Bug定位與修復,成本更低至0.27元。不過,該模型仍不支援多模態影像輸入,在複雜長流程任務規劃中表現吃力,單點定位、單次修復是其強項。
憑藉極致的價效比,DeepSeek V4 Flash正式版在AI圈引發“斬殺線”熱議,被指“幹翻Claude”。第三方評測機構Artificial Analysis的綜合智慧指數顯示,其得分50,落後於Kimi K3的57分和智譜GLM-5.2的51分,排國內第三。但價格優勢巨大:輸出價格每百萬token僅0.28美元,而GLM-5.2為4.29美元(15倍),Anthropic旗艦Claude Fable 5高達50美元(178倍)。按綜合任務口徑,DeepSeek完成一項任務平均成本約0.03美元,Kimi K3約0.86美元,Fable 5約3.15美元,最貴與最便宜相差105倍。在Agent場景中,這種成本差異被指數級放大,一次真實軟體工程任務可能觸發百次以上呼叫,0.03美元與3.15美元的單次成本差距,跑50次就是“一杯咖啡和一台咖啡機”的區別。
DeepSeek的低價策略迅速引發行業連鎖反應。V4 Flash正式版上線前一天,OpenAI宣佈GPT-5.6系列調價,入門款Luna降價80%;8月1日,智譜重新開放GLM Coding Plan訂閱。雖然難以將所有降價歸因於DeepSeek,但整個行業的價格錨點正在被重塑。效能比它強的價格貴出一兩個數量級,價格向它看齊的效能又存在代差,這正是“斬殺線”的含義。
然而,低價狂歡背後是沉重的算力賬單。據報道,DeepSeek已重啟第二輪融資,計劃募資500億元,投前估值約5000億元。兩個月前,他們剛完成中國大模型史上規模最大的首輪融資,獲得國家人工智慧產業投資基金、騰訊、寧德時代等合計510億元。兩輪合計超千億的募資中,超六成將用於自建智算中心與國產晶片適配,另有一條一年前秘密啟動的自研推理晶片產線。這家曾以“輕資產、重演算法”著稱的公司,正被算力需求逼著變“重”。
梁文鋒曾表示,採購一批伺服器約10個月可通過API收入收回成本,這算“合理利潤”。但V4 Flash正式版上線後,在OpenRouter榜單上單週消耗7.1萬億Token,極低價格引發開發者“報復性”呼叫,高峰期併發請求讓伺服器叢集不堪重負。在自建智算中心尚未完全交付的當下,通過價格槓桿篩選高價值客戶、抑制低效高頻消耗,成為防止伺服器被擠爆的自救手段。同時,自建超大規模智算中心、適配國產晶片、自研推理晶片產線,都是百億級現金流黑洞,即便手握千億融資,DeepSeek也必須重新算賬。
8月6日的提價預告,戳破了低價狂歡的濾鏡。它表明,演算法的精妙可以壓縮單位Token的算力成本,但算力叢集的硬體天花板與現金流壓力無法無限平抑。當強如DeepSeek都不得不踩下剎車、調頭提價時,這場靠“價格戰”互相放血的時代或許真的要畫上句號。與此同時,阿里“千問辦公”、騰訊WorkBuddy與位元組豆包正在C端辦公場景激烈競爭,而DeepSeek那個功能依然“簡陋”的官網,剋制得彷彿不屬於這個時代。剋制的產品形態、極致的API定價與千億級別的重資產基建,構成了DeepSeek最真實的商業底色。這一腳剎車,與其說是向商業現實低頭,不如說是整個行業在狂熱價格戰後對客觀商業規律的第一次真正敬畏。