中国AI大模型调用量持续领跑全球:DeepSeek V4.1 Flash崭露头角,智谱GLM 5.3等模型排名变动
2026-09-25 08:00:55未知 作者:徽声在线
据徽声在线援引OpenRouter最新发布的统计数据推算,在刚刚过去的统计周期(9月7日至9月13日)内,全球范围内AI大模型的总调用量攀升至127万亿Token,与前一周相比实现了10.43%的显著增长。
聚焦上榜的AI大模型,中国AI大模型在这一周内的调用量高达61.17万亿Token,尽管增长率略低于全球平均水平,但仍保持了7.85%的稳健增长;而同期美国AI大模型的周调用量则为21.76万亿Token,增长率高达31.56%,呈现出强劲的增长势头。值得注意的是,中国AI大模型的周调用量已经连续二十周超越美国,持续领跑全球市场。
徽声在线进一步分析发现,在全球调用量排名前五的AI大模型中,中国AI大模型占据了四席之地。其中,腾讯混元Hy4 preview凭借出色的表现稳居第二,其周调用量达到了惊人的16.8万亿Token,环比增长15%,显示出强大的市场竞争力。
腾讯混元Hy4 preview于8月28日正式亮相并开源,该模型拥有总参数770B、激活参数49B的庞大规模,上下文长度更是突破了1M的限制。它特别针对Agent、Coding与生产力场景进行了优化,显著增强了在真实业务场景中完成复杂任务的能力,为用户提供了更加高效、便捷的AI解决方案。
在排名中,智谱GLM 5.3 Flash紧随其后,位列第三,其周调用量达到了11.9万亿Token,尽管环比出现了4%的下滑,但依然保持着较高的市场热度;DeepSeek V4 Flash 0731(即DeepSeek V4 Flash的正式版本)则位居第四,周调用量为11.6万亿Token,环比下滑6%;而小米MiMo-V2.5则异军突起,升至第五位,周调用量达到了7.77万亿Token,环比增长高达230%,成为本周的一大亮点。
此外,DeepSeek V4.1 Flash也成功登上榜单,排名第六,其周调用量达到了4.94万亿Token。该模型于9月10日正式发布,采用了全新的Causal-Encoder-Decoder(因果编码器—解码器)结构,是一个总参数量为552B的混合专家模型(MoE),为用户提供了更加多样化的AI应用选择。
在价格策略上,DeepSeek对V4.1 Flash的API定价进行了下调。按照每百万Token计算,空闲时段的缓存命中输入价格降至0.02元、缓存未命中输入为1元、输出为4元;高峰时段则分别为0.04元、2元和8元。这一新价格政策将于2026年9月10日12:00正式生效。
与DeepSeek V4 Flash同一时段的价格相比,缓存命中输入价格降低了60%,未命中输入价格降低了约33.3%,输出价格降低了约11.1%,为用户带来了更加实惠的AI使用体验。
据DeepSeek官方介绍,DeepSeek V4.1 Flash在性能、费用、速度和任务总用时等多个指标上均已全面超越V4 Pro,成为用户更加优选的AI大模型。
然而,市场总是充满变数。值得注意的是,此前一周还排名第六的MiniMax M3和排名第九的智谱GLM 5.3在这一周中跌出了榜单,显示出AI大模型市场的竞争之激烈和变化之迅速。
免责声明:本文所载内容与数据均仅供参考之用,并不构成任何投资建议。投资者在使用前应进行核实,并自行承担操作风险。
