中国AI大模型调用量持续领跑全球:DeepSeek-V4-Flash正式版蝉联榜首,价格策略调整引关注
2026-08-17 12:09:06未知 作者:徽声在线
根据徽声在线援引OpenRouter最新发布的统计数据,经过详细测算发现,在刚刚过去的一周(8月10日至8月16日),全球范围内AI大模型的总调用量达到了惊人的75.3万亿Token,与前一周相比,环比增长了9.13%,显示出AI技术的持续火热与广泛应用。
在众多上榜的AI大模型中,中国AI大模型的表现尤为抢眼,周调用量高达36.84万亿Token,环比增长7.56%;而同期美国AI大模型的周调用量则为10.26万亿Token,虽然环比增长了11.89%,但与中国相比仍有较大差距。值得一提的是,中国大模型的周调用量已经连续十六周超越美国,稳稳占据全球榜首的位置。
徽声在线进一步观察发现,在全球调用量排名前二的AI大模型中,均来自中国。其中,DeepSeek-V4-Flash-0731(即DeepSeek-V4-Flash的正式版本)连续两周蝉联榜首,周调用量高达11.2万亿Token,环比增长27%;而腾讯Hy3则紧随其后,连续两周位居第二,周调用量达到9.95万亿Token,环比增长24%,展现出中国AI大模型的强劲实力。
与此同时,DeepSeek-V4-Flash-0423(即DeepSeek-V4-Flash的预览版本)虽然排名第四,但周调用量也达到了4.83万亿Token,不过与前一周相比下滑了18%。值得注意的是,从8月17日0时开始,DeepSeek正式实施了更新调整后的API价格策略,采用峰谷定价模式,空闲时段的价格仅为高峰时段的一半。其中,V4-Pro在高峰时间段的涨幅最高达到了1100%,显示出其市场策略的灵活性与调整能力。
OpenAI旗下的GPT-5.6 Luna模型首次跻身全球前三,周调用量达到5.31万亿Token,环比增长20%,实现了连续三周的增长势头。这一成绩的取得,得益于GPT-5.6 Luna模型在速度、成本以及适用性方面的优势。
据悉,7月10日OpenAI正式公开发布了GPT-5.6系列模型,而GPT-5.6 Luna作为该系列中的佼佼者,以其最快的速度和最低的成本脱颖而出,特别适用于大规模、高频率的任务处理场景,能够支持工具调用和多步骤工作流程。为了进一步提升企业用户AI应用的性价比,该系列模型上线不到三周之际,OpenAI就宣布对GPT-5.6系列模型的定价和性能进行优化调整,其中GPT-5.6 Luna模型的价格更是下调了80%。
根据Artificial Analysis的测算数据,GPT-5.6 Luna正式版完成单项测试任务的平均成本约为0.05美元,这一价格仅为Anthropic旗舰模型Claude Fable 5的1/60,显示出其在成本控制方面的卓越表现。
随着中国头部AI大模型能力和调用量的不断提升,其价格也逐渐水涨船高;而美国厂商则继续通过降低中低端模型的价格来争夺开发者市场。这一趋势导致中美大模型之间的价格差正在逐渐收窄。摩根士丹利的数据显示,到2025年第一季度,中国大模型的平均输入、输出API价格将分别只有美国同行的6%和5%;而到了2026年第二季度,这两个比例已经上升至19%和14%,显示出中国AI大模型在市场上的竞争力正在不断增强。
月之暗面企业业务负责人黄震昕此前也曾公开表示:“开源模型、中国大模型不应该被简单地贴上低价标签。我们已经做出了SOTA级(State-of-the-Art,即最先进的)模型,完全有能力匹配合理的商业定价。”
此外,Claude Opus 5也首次进入了榜单,排名第八,周调用量达到2.67万亿Token,环比增长高达102%。这一成绩的取得,得益于Claude Opus 5在编程、Agent任务及复杂推理等能力上的进一步提升。
Claude Opus 5于7月25日正式发布。Anthropic表示,Opus 5在整体性能上已经接近更高端的Claude Fable 5,但API价格仍然维持在上一代Opus 4.8的水平。这使得该模型更适合企业办公、软件开发等日常高频场景,并进一步增强了其安全性和抗滥用能力。
值得注意的是,此前一周还排名第八的英伟达Nemotron 3 Ultra (free)模型则跌出了榜单,显示出AI大模型市场的竞争之激烈与变化之快速。
免责声明:本文内容与数据仅供参考之用,并不构成任何投资建议。在使用前请务必进行核实,据此操作风险自担。

