DeepSeek於近日釋出最新模型V4-Flash,再次將AI模型的成本競爭推向台前。研究機構Artificial Analysis的測算顯示,V4-Flash平均每次任務完成成本僅約3美分,為當前全球主流大模型中最低,僅相當於Anthropic旗下Claude Fable 5的約1/105。這一資料意味著,在不少通用任務中,企業部署AI應用的邊際成本有望進一步下降,也再次引發市場對於AI鉅額資本開支回報率的討論。
V4-Flash的釋出正值DeepSeek商業化程序加速之際。據報道援引知情人士訊息,DeepSeek正籌備潛在IPO。其通過AI模型API雲服務獲得的年度經常性收入(ARR)已達4億至5億美元,毛利率超過50%。此次推出的V4-Flash延續了公司一貫的低成本、高效率路線,進一步強化其以價格和效率驅動市場競爭的策略。
根據Artificial Analysis的資料,V4-Flash的定價為每百萬輸入token 0.14美元、每百萬輸出token 0.28美元。不過,該機構指出,相比單純的標價,“每次任務完成成本(Cost per Task)”更能體現模型的實際使用成本。這一指標綜合考量了模型在完成同一任務時所消耗的輸入和輸出token總量,因而更具參考意義。按此口徑測算,V4-Flash平均每次任務成本約為3美分,在全球主流模型中處於最低水平。作為對比,Moonshot AI的Kimi K3約為86美分,OpenAI GPT-5.6 Sol約為1.86美元,Anthropic Claude Fable 5則約為3.15美元。V4-Flash的成本僅相當於後者的約1/105。
Artificial Analysis進一步強調,單位token價格低的模型,如果在任務執行中需要生成更多內容或經歷更多互動步驟,最終使用成本仍可能高於定價更高但效率更優的模型。因此,“每次任務完成成本”比單一價格指標更能真實反映模型的價效比。
低價突圍,AI競爭從“拼效能”轉向“拼價效比”。相比效能排名,V4-Flash此次更受市場關注的是其成本優勢。過去一年,AI行業競爭焦點已逐漸從模型能力擴充套件至推理成本和商業化效率。隨著企業AI應用規模不斷擴大,模型執行成本正成為採購決策的重要考量因素。當一款模型能夠以約3美分完成一次任務,而部分高階模型成本達到數美元時,企業在部署客服、辦公自動化、程式碼輔助等高頻場景時,整體使用成本可能出現數量級下降。
這也再次觸及華爾街持續關注的問題:AI鉅額資本投入最終能否轉化為足夠的商業回報。2025年初,DeepSeek釋出R1模型後,市場曾一度重新評估全球AI基礎設施投入的必要性,引發科技股大幅波動。如今,V4-Flash再次以極低的執行成本作為核心賣點,意味著AI行業的競爭正進一步從“誰的模型更強”,轉向“誰能以更低成本提供足夠好的能力”,AI投資回報率的討論或將再次升溫。