根據OpenRouter最新測算,上星期(8月3日至8月9日)全球AI大模型總調用量為69萬億Token,按周增長21.48%。上榜的AI大模型中,中國AI大模型周調用量達34.25萬億Token,按周增長21.76%;同期美國AI大模型周調用量為9.17萬億Token,增長109.36%。中國大模型周調用量連續15個星期超過美國,穩居全球首位。
上星期全球調用量排名前4位,都是中國AI大模型。其中,DeepSeek-V4-Flash正式版位居第1,周調用量達8.83萬億Token,按周增長570%;騰訊Hy3位居第2,周調用量達8.05萬億Token,增長67%;DeepSeek-V4-Flash預覽版排名第3,周調用量達5.88萬億Token,下滑19%;小米MiMo-V2.5由之前1周的第2,跌至第4,周調用量達5.39萬億Token,下滑14%。GPT-5.6 Luna在大幅減價80%後,打入第5位,周調用量4.43萬億Token,增長128%。
值得注意的是,DeepSeek在7月31日宣布,DeepSeek-V4-Flash正式版API上線公測。模型結構、尺寸和DeepSeek-V4-Flash預覽版保持一致,只是重新進行後訓練。官方日志顯示,V4-Flash正式版在Agent能力上大幅增強,基準測試遠超預覽版本。據Artificial Analysis測算,V4-Flash正式版完成單項測試任務的平均成本,約為0.03美元,只有Anthropic旗艦模型Claude Fable 5的1/100,成為目前全球主流模型中成本最低的模型。