多模型聚合平台OpenRouter釋出的全球AI大模型呼叫量周榜單(7月27日至8月2日)顯示,DeepSeek V4 Flash以7.22萬億Token的呼叫量位居全球第一。這一數字遠超其他模型,凸顯了國產大模型在海外開發者市場中的強勁需求。

另據開源專案團隊OpenCode發文,其平台上DeepSeek V4 Flash的呼叫量大幅飆升,僅8月1日一天,模型單日處理達8萬億Token。其中,5萬億為免費試用額度消耗,3萬億為開發者通過OpenCode平台付費使用。這一資料表明,免費試用策略有效吸引了開發者,而付費使用也佔據相當比例,顯示出模型的商業價值。

OpenRouter資料顯示,上週全球AI大模型總呼叫量為56.8萬億Token,環比下滑2.07%。上榜的AI大模型中,中國AI大模型周呼叫量達28.13萬億Token,環比下滑14.76%;同期美國AI大模型周呼叫量為4.38萬億Token,環比增長87.18%。儘管中國大模型周呼叫量已連續十四周超過美國,穩居全球首位,但環比下滑明顯,而美國則呈現高速增長,兩者差距可能逐漸縮小。

8月5日,介面新聞查詢OpenRouter本週榜單看到,截至發稿,DeepSeek V4 Flash 0423仍排在首位,呼叫量為6.92萬億Token。該模型最早於今年4月推出,主打平衡推理速度、長上下文能力與呼叫成本,主要面向開發者、商用企業提供高吞吐推理服務。其持續領先表明,價效比和穩定性是吸引開發者的關鍵因素。

排在第二位的是小米推出的MiMo-V2.5,周呼叫量5.1萬億Token,環比前一週下滑52%,流量出現明顯回撥,市場熱度有所回落。小米這款模型於今年4月23日正式公測,4月底完成全系列開源。其採用混合專家MoE架構,總引數突破萬億級別,啟用引數42B,標配100萬Token超長上下文視窗,同時覆蓋文本、語音、影像全模態互動。低廉推理成本與穩定智慧體執行能力,是其吸引海外開發者批次接入的核心優勢。就在7月20日至7月26日當週,MiMo-V2.5曾登頂OpenRouter周呼叫量榜單首位,單週呼叫量達到10.5萬億Token,環比增長12%。

目前第三名來自騰訊自研大模型混元Hy3,呼叫規模5.01萬億Token。Hy3是騰訊自研通用大模型,該模型本期流量環比持平,增長幅度為0%。Hy3曾是7月26日所在周榜單增長勢頭最猛的模型,彼時周呼叫量3.94萬億Tokens,環比增幅超999%。Hy3於7月6日正式開源,總引數295B、單次推理僅啟用21B引數。其採用快慢思考融合架構,最大支援256K上下文,程式碼生成、智慧互動能力大幅迭代。騰訊混元曾發文表示,截至7月15日,Hy3總呼叫量較上一代模型Hy2增長已超68倍

第四名同樣來自DeepSeek的V4 Flash 0731模型,這是DeepSeek全新上線的新版本模型,周流量3.45萬億Token。第五名則是OpenAI推出的GPT-5.6 Luna,本週Token呼叫量2.99萬億,實現738%的爆發式增長。榜單前五席位之中,國產大模型包攬前四位,展現出極強的市場呼叫熱度。但OpenAI全新迭代模型強勢追趕,意味著全球頭部廠商之間的競爭並未放緩。

從前十來看,DeepSeek佔據三個席位,除兩款V4 Flash版本外,DeepSeek V4 Pro以2.97萬億Token排在第六位。Anthropic、谷歌、NVIDIA、MiniMax、階躍星辰、智譜AI等多家企業模型紛紛上榜。免費模型正在佔據越來越多流量份額,NVIDIA Nemotron 3 Ultra、Poolside Laguna S 2.1、Inclusion AI Ling-3.0-flash等免費模型實現高速增長,不少免費模型環比漲幅突破50%。

值得一提的是,此前備受馬斯克關注的Kimi K3模型在本週暫時跌出了前十,目前位列第12位。該模型總引數達2.8萬億,配備100萬Token超長上下文視窗,為當前全球引數規模最大開源大模型。

不同於過去依靠低價換取流量的競爭模式,當前國產模型依靠持續迭代的推理效能、穩定服務能力吸引海外開發者。但挑戰同樣存在,OpenAI、Anthropic持續推出新版本模型,不斷縮小效能差距;谷歌Gemini系列多款模型穩定盤踞榜單前列,海外巨頭依舊擁有穩固基本盤。

賽道內部的分化同樣值得警惕。部分國產模型本期出現呼叫量大幅下滑,小米MiMo-V2.5、MiniMax M3、智譜GLM5.2均出現不同程度流量回落。由於熱度輪換速度不斷加快,一旦產品迭代節奏放緩,很容易快速流失開發者流量。

有人工智慧行業分析師指出,海外獨立開發者市場已經進入白熱化競爭,僅僅依靠單次版本更新很難守住優勢。如何持續迭代、高效控制推理成本,將決定各大模型能否長期留住使用者。