
全球大模型调用量前五名,第一次全部来自同一国家——中国。
根据全球最大AI模型API聚合平台OpenRouter最新周度数据,上周(7月27日至8月2日),DeepSeek-V4-Flash以7.22万亿Token的周调用量登顶全球第一。排名第二至第五位的分别是:小米MiMo-V2.5(6.3万亿Token)、腾讯Hy3(4.82万亿Token)、DeepSeek-V4-Pro(3.28万亿Token)和智谱GLM-5.2(2.89万亿Token)。
全球调用量前五名,被中国AI大模型包揽。
DeepSeek-V4-Flash的走红并非偶然。海外独立评测社区Artificial Analysis在实测上百款大模型后,将DeepSeek-V4-Flash定位为一条分界线——它代表的是性能与价格的平衡临界值。业内将其称为斩杀线:定价显著高于DeepSeek的模型,将持续流失中小开发者;性能弱于DeepSeek、成本却更高的产品,生存空间将快速萎缩。
7月31日DeepSeek V4 Flash正式版上线后,其极致性价比迅速扭转了全球开发者的AI使用格局。OpenCode平台的数据显示,仅8月1日单日调用量即达8万亿Token,其中5万亿为免费试用额度消耗,3万亿为开发者付费使用。OpenCode CEO透露,V4 Flash上线后使用量单日增长了30%,新订阅用户也增长了30%。
多名海外AI初创创始人在X平台公开复盘:团队全线迁移至DeepSeek之后,月度推理成本下降60%至85%。对于尚未盈利、现金流紧绷的小微AI公司,这样的成本差异足以决定项目能否活下去。
OpenRouter聚合了超过400款全球顶尖和开源大模型,拥有约800万注册用户。上周全球AI大模型总调用量为56.8万亿Token。
其中,中国AI大模型周调用量达28.13万亿Token,同期美国AI大模型周调用量为4.38万亿Token。中国大模型的周调用量,已经是美国的6.4倍。这标志着中国大模型周调用量连续十四周超过美国,稳居全球首位。
访问流量中,美国、欧洲开发者占比接近半数。大量Agent自动化项目、代码辅助工具、长文本处理应用主动将默认模型切换至DeepSeek。市场正在分化为两个圈层:大型跨国企业依旧倾向采购OpenAI等本土厂商服务;但对成本极度敏感的中小开发者群体,已经开始大规模向中国模型迁移。
OpenAI的应对是降价。GPT-5.6 Luna上周首次登上OpenRouter榜单,位居第八,周调用量达1.95万亿Token,环比增长456%。上线不到三周,OpenAI宣布Luna模型价格下调80%。然而,中国开源模型的快速迭代让模型差距不断缩小,价格差距却在逐渐拉大。
正如一位行业观察者所言,过去很多团队选择硅谷大厂模型,并非认定其性能无可替代,而是长期缺少性价比足够高的备选方案。当具备一线梯队能力的低价模型出现,需求侧的选择立刻发生了转向。
全球大模型的定价权,正在被改写。而这张榜单上,硅谷巨头们的名字,已经很久没有出现在前五了。