中国AI大模型调用量十五周领跑全球:DeepSeek-V4-Flash正式版夺冠,GPT-5.6 Luna与Gemini 3.6 Flash崭露头角
2026-08-10 11:08:48未知 作者:徽声在线
每经特约记者:林晓晨 每经编辑:苏文婷
据徽声在线对OpenRouter最新数据的深度分析,在上周(8月3日至8月9日)期间,全球AI大模型的总调用量攀升至69万亿Token,较前一周增长了21.48%,显示出AI技术的持续火热。
聚焦上榜的AI大模型,中国AI大模型以34.25万亿Token的周调用量脱颖而出,环比增长21.76%;而同期美国AI大模型的周调用量为9.17万亿Token,尽管增长率高达109.36%,但仍无法撼动中国大模型的领先地位。中国大模型周调用量已连续十五周超越美国,稳坐全球榜首。
徽声在线特别关注到,上周全球调用量排名前四的席位均被中国AI大模型占据。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash正式版)以8.83万亿Token的周调用量傲视群雄,环比增长高达570%;腾讯Hy3紧随其后,周调用量达到8.05万亿Token,环比增长67%;DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash预览版)位列第三,周调用量为5.88万亿Token,略有下滑19%;小米MiMo-V2.5则滑落至第四,周调用量为5.39万亿Token,环比下降14%。
7月31日,DeepSeek宣布其DeepSeek-V4-Flash正式版API正式上线公测。据悉,该正式版在模型结构、尺寸上与预览版保持一致,但经过了重新后训练。官方更新日志显示,V4-Flash正式版在Agent能力上实现了质的飞跃,基准测试成绩远超预览版。
根据Artificial Analysis的测算,V4-Flash正式版完成单项测试任务的平均成本仅为0.03美元,仅为Anthropic旗舰模型Claude Fable 5的百分之一,成为当前全球主流模型中成本最低的佼佼者。
OpenAI旗下的GPT-5.6 Luna也成功跻身前五,周调用量达到4.43万亿Token,环比增长128%。
7月10日,OpenAI正式发布了GPT-5.6系列模型,而GPT-5.6 Luna作为该系列中速度最快、成本最低的模型,特别适合处理大规模、高频率的任务,支持工具调用和多步骤工作流程。在该系列模型上线不到三周的时间里,OpenAI便宣布对GPT-5.6系列模型的定价和性能进行优化,以提升企业用户AI应用的性价比。其中,GPT-5.6 Luna模型的价格更是下调了80%。
谷歌Gemini 3.6 Flash也首次亮相榜单,排名第九,周调用量达到2.33万亿Token,环比增长高达446%。
Gemini 3.6 Flash于7月22日发布,第三方测评机构Artificial Analysis Index的数据显示,该模型在输出时消耗的token数量比上一代Gemini 3.5 Flash平均减少了17%。
在价格方面,Gemini 3.6 Flash每百万输入Token的价格保持在1.50美元,而输出价格则从上一代的9美元降至7.50美元,降幅约为16.7%。
值得注意的是,此前一周排名第七的MiniMax M3和排名第九的阶跃星辰Step 3.7 Flash此次未能保住榜单席位,遗憾出局。
免责声明:本文内容与数据仅供参考,不构成任何投资建议,使用前请务必核实。据此操作,风险自担。




