是美国的4.7倍!中国AI大模型周调用量连续二十一周领跑:DeepSeek V4.1-Flash登顶,环比增长219%

是美国的4.7倍!中国AI大模型周调用量连续二十一周领跑:DeepSeek V4.1-Flash登顶,环比增长219%

《每日经济新闻》根据OpenRouter最新数据测算,上周(9月14日至9月20日)全球AI大模型总调用量为129万亿Token,环比增长1.57%。

其中,上榜的AI大模型中,中国AI大模型周调用量达67.46万亿Token,环比增长10.28%;同期美国AI大模型周调用量为14.21万亿Token,环比下滑34.7%。中国大模型周调用量连续二十一周超过美国,稳居全球首位。

https://x0.ifengimg.com/res/2026/3C42C6D56589DD67E4D60E974E71960AF3DB5E84_size808_w768_h1023.png

https://x0.ifengimg.com/res/2026/0E518991D5E5B29F9C912157084B2340EE5A1FC0_size865_w794_h1059.png

《每日经济新闻》注意到,上周,全球调用量排名前五中,有四款中国AI大模型。其中,DeepSeek V4.1-Flash升至第一,周调用量达15.8万亿Token,环比增长219%。

该模型于9月10日正式发布,在实现Coding与Agent能力提升的同时强化多模态理解能力。V4.1-Flash采用全新的Causal-Encoder-Decoder(因果编码器—解码器)结构,全局KV Cache降至V4-Flash的约1/4。

架构优化释放推理降本空间。据DeepSeek官方定价,V4.1-Flash每百万Token闲时缓存命中输入、未命中输入及输出价格分别为0.02元、1元、4元,较前代的0.05元、1.5元、4.5元分别下降60.0%、33.3%、11.1%,高峰时段价格为闲时的两倍。

据DeepSeek介绍,DeepSeek V4.1-Flash在性能、费用、速度和任务总用时等指标上已全面超越V4-Pro。

中信证券认为,国产模型将沿高性价比与前沿智能两条路径继续展开竞争,DeepSeek深度适配下国产算力基础设施与国产模型同步受益,同时高性价比推理将加速FDE(前线部署工程师)及企业级Agent(智能体)落地。

不过,Token单价下降并不意味着单项任务总成本必然下降。据第三方机构Artificial Analysis的评测,在该机构测试中,V4.1-Flash平均每项任务使用约8.9万输出Token,高于上一代V4 Flash 0731的约6.2万。该机构评价V4.1-Flash的输出非常冗长(very verbose)。

https://x0.ifengimg.com/res/2026/9ADE1EFEF18D6DD2D88CC90B80CEB18F07881797_size757_w732_h976.png

智谱GLM 5.3 Flash位居第二,周调用量达14.1万亿Token,环比增长18%;腾讯混元Hy4 preview排名第三,周调用量达12.5万亿Token,环比下滑26%;DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)位居第五,周调用量达9.44万亿Token,环比下滑18%。

免责声明:本文内容与数据仅供参考,不构成投资建议,使用前请核实。据此操作,风险自担。

每日经济新闻