中国大模型调用量连续二十周领跑全球

据《每日经济新闻》基于OpenRouter最新数据测算,9月7日至13日当周,全球AI大模型总调用量达到127万亿Token,环比增长10.43%。其中,上榜的中国AI大模型周调用量为61.17万亿Token,环比增长7.85%;美国AI大模型周调用量为21.76万亿Token,环比增长31.56%。中国大模型周调用量已连续二十周超过美国,稳居全球首位。

前五占四席:中国模型领跑

在上周全球调用量排名前五的模型中,有四款来自中国厂商,显示出中国大模型在真实使用侧的强势地位。

排名 模型 周调用量 环比变化
2 腾讯混元 Hy4 preview 16.8万亿Token +15%
3 智谱 GLM 5.3 Flash 11.9万亿Token -4%
4 DeepSeek V4 Flash 0731 11.6万亿Token -6%
5 小米 MiMo-V2.5 7.77万亿Token +230%
6 DeepSeek V4.1 Flash 4.94万亿Token 新上榜

腾讯混元Hy4 preview于8月28日正式发布并开源,总参数770B、激活参数49B,上下文长度突破1M(百万Token),重点面向Agent(智能体)、Coding(编程)与生产力场景优化,增强在真实业务场景中完成复杂任务的能力。

DeepSeek V4.1 Flash于9月10日发布,采用全新的Causal-Encoder-Decoder(因果编码器—解码器)结构,是一个总参数量552B的混合专家模型(MoE)。据DeepSeek介绍,该模型在性能、费用、速度和任务总用时等指标上已全面超越V4 Pro。

价格战同步打响

伴随V4.1 Flash发布,DeepSeek同步下调了API定价。按每百万Token计算,空闲时段缓存命中输入价格为0.02元、缓存未命中输入为1元、输出为4元;高峰时段分别为0.04元、2元和8元。新价格自2026年9月10日12:00起生效,与此前V4 Flash同一时段价格相比,缓存命中输入降价60%,未命中输入降价约33.3%,输出降价约11.1%。

榜单变动:MiniMax M3、GLM 5.3跌出

值得注意的是,此前一周排名第六的MiniMax M3、排名第九的智谱GLM 5.3,在本周跌出榜单。头部模型的排名在调用量这一维度上波动明显,反映出用户与开发者对性价比、响应速度与场景适配的高度敏感。

解读:调用量为何成为新标尺

与评测榜单衡量”能力上限”不同,调用量衡量的是”真实使用规模”。中国大模型连续二十周在调用量上领跑,说明国产模型不仅在参数与跑分上逼近前沿,更在成本、可用性与生态上赢得了开发者和企业的持续选择。当AI从演示走向生产,谁被真正用起来,正在成为比谁跑分更高更硬的指标。

*本文事实据《每日经济新闻》基于OpenRouter数据的测算及DeepSeek、腾讯混元官方信息整理。*