據OpenRouter最新數據,9月14日至20日,全球AI大模型總調用量達129萬億Token,環比增長1.57%。其中,中國大模型周調用量達67.46萬億Token,環比增長10.28%;美國大模型爲14.21萬億Token,環比下降34.7%。中國大模型周調用量已連續21周超過美國。

上週全球調用量排名前五中有4款來自中國。DeepSeek V4.1-Flash以15.8萬億Token躍居第一,環比增長219%。該模型9月10日發佈,重點提升Coding、Agent和多模態理解能力,採用Causal-Encoder-Decoder架構,全局KV Cache降至V4-Flash約1/4。其閒時每百萬Token輸入緩存命中、未命中及輸出價格分別爲0.02元、1元和4元,較前代分別下降60%、33.3%和11.1%。

不過,Token單價下降並不意味着單項任務成本同步下降。Artificial Analysis測試顯示,V4.1-Flash平均每項任務使用約8.9萬輸出Token,高於V4Flash0731的約6.2萬Token,並被評價爲輸出較爲冗長。

此外,智譜GLM5.3Flash周調用量14.1萬億Token,排名第二;騰訊混元Hy4preview以12.5萬億Token排名第三;DeepSeek-V4-Flash-0731以9.44萬億Token排名第五。