中国AI大模型调用量持续领跑全球二十周:DeepSeek V4.1 Flash新晋上榜,智谱GLM 5.3等跌出前十
2026-09-15 17:50:50未知 作者:徽声在线
根据徽声在线援引OpenRouter最新发布的数据分析,在刚刚过去的统计周期(9月7日至9月13日)内,全球AI大模型的总调用量攀升至127万亿Token,较前一周实现了10.43%的显著增长。
在统计的AI大模型中,中国AI大模型表现尤为抢眼,周调用量高达61.17万亿Token,环比增长7.85%;相比之下,美国AI大模型在同一时期的周调用量为21.76万亿Token,尽管环比增长了31.56%,但中国AI大模型的周调用量已连续二十周超越美国,稳坐全球榜首。
徽声在线进一步观察发现,在全球调用量排名前五的AI大模型中,中国占据了四席。其中,腾讯混元Hy4 preview以出色的表现位居第二,周调用量高达16.8万亿Token,环比增长15%,显示出强劲的增长势头。
腾讯混元Hy4 preview于8月28日正式亮相并开源,该模型拥有总参数770B、激活参数49B的庞大体系,上下文长度更是突破了1M的限制。它特别针对Agent、Coding与生产力场景进行了优化,旨在提升在真实业务场景中完成复杂任务的能力。
在排名中,智谱GLM 5.3 Flash紧随其后,位列第三,周调用量达到11.9万亿Token,尽管环比下降了4%,但依然保持着较高的调用量水平;DeepSeek V4 Flash 0731(即DeepSeek V4 Flash的正式版本)则位居第四,周调用量为11.6万亿Token,环比下降6%;而小米MiMo-V2.5则异军突起,升至第五,周调用量达到7.77万亿Token,环比增长高达230%,成为本周的一大亮点。
此外,DeepSeek V4.1 Flash也成功跻身榜单,排名第六,周调用量达到4.94万亿Token。该模型于9月10日正式发布,采用了全新的Causal-Encoder-Decoder(因果编码器—解码器)结构,是一个总参数量为552B的混合专家模型(MoE),展现了DeepSeek在AI大模型领域的深厚实力。
在价格策略上,DeepSeek对V4.1 Flash的API定价进行了下调。按照每百万Token计算,空闲时段的缓存命中输入价格降至0.02元、缓存未命中输入为1元、输出为4元;高峰时段则分别为0.04元、2元和8元。这一新价格策略将于2026年9月10日12:00正式生效。
与V4 Flash同一时段的价格相比,V4.1 Flash的缓存命中输入价格降低了60%,未命中输入价格降低了约33.3%,输出价格降低了约11.1%,为用户提供了更为经济实惠的选择。
据DeepSeek官方介绍,DeepSeek V4.1 Flash在性能、费用、速度和任务总用时等关键指标上均已全面超越V4 Pro,为用户带来了更为卓越的使用体验。
然而,值得注意的是,此前一周排名第六的MiniMax M3和排名第九的智谱GLM 5.3则未能保持住榜单位置,跌出了本周的榜单。
免责声明:本文所载内容与数据仅供参考之用,并不构成任何投资建议。在使用前,请务必进行核实。据此操作,风险自担。

