当前位置:首页>排行榜>全球大模型调用量排行榜: 前六全是中国的

全球大模型调用量排行榜: 前六全是中国的

  • 更新时间 2026-07-14 00:10:33
全球大模型调用量排行榜: 前六全是中国的

说实话,看到这个数据的时候我愣了三秒。

OpenRouter刚公布了7月第二周(7月6日-12日)的全球大模型调用量数据——全球调用量排名前六名,清一色,全是中国的。

不是第四、第五是中国的,是第一到第六,一个不落。

这不是什么"弯道超车"的叙事了,这基本上是换了一条赛道,然后在赛道上插满了旗帜。

先看全局:27.58万亿 vs 6.33万亿

这周全球AI大模型的总调用量达到了54.6万亿Token,环比上周增长12.6%。市场在加速膨胀,不是放缓。

4倍+中国AI大模型本周调用量27.58万亿Token,美国6.33万亿Token。中国是美国的四倍以上,且已连续11周稳居全球首位。

中国这边,27.58万亿Token,环比增长17.61%,已经连续七周增长。美国那边,6.33万亿Token,虽然环比暴增47.9%——但基数摆在那,追起来谈何容易。

🇨🇳 中国 27.58万亿🇺🇸 美国 6.33万亿
81%
19%

简单算一下:中国占全球调用量的比例已经过半。这不再是"崛起"的故事,这是"统治"的故事。

Top 6 逐一点评:有人登顶,有人跌落
1
腾讯 Hy3 (free)
MoE架构 · 总参数2950亿 · 激活参数210亿 · 256K上下文
6.13万亿🆕 新王登基
2
小米 MiMo-V2.5
连续四周亚军 · 势头稳健
5.95万亿↑ 环比+36%
3
DeepSeek-V4-Flash
此前连续七周榜首 · 本周退位
5.22万亿↓ 环比-2%
4
MiniMax M3
稳步增长
4.26万亿↑ 环比+4%
5
智谱 GLM 5.2
总参数744B · MIT协议开源 · 支持1M上下文 · 连续两周第五
3.19万亿↑ 环比+24%

没错,前五名之外,第六名依然是中国模型——全球调用量Top 6清一色国产,这在OpenRouter历史上还是头一回。

再往下看,英伟达Nemotron 3 Ultra首次上榜,周调用量2.04万亿Token,环比暴涨109%。单次推理成本仅为行业头部闭源大模型的十分之一,6月4日刚上线。势头很猛,但也只排到了第8名。

另一个细节:阶跃星辰Step 3.7 Flash本周跌出了榜单。这个赛道的残酷程度,堪比手机圈——你不上新品,下周就没你。

Hy3免费登顶:终结DeepSeek七连冠

这一周最大的戏剧性事件,就是腾讯Hy3以"free"模式空降榜首,直接终结了DeepSeek-V4-Flash长达七周的连冠。

几个数字感受一下Hy3的爆发力:

上线到OpenRouter第八位3天
接入WorkBudd后排队率超50%紧急扩容
发布当天腾讯股价涨幅+4.82%
Hy3 Preview后日均Token消耗增长20倍

更有意思的是人——前OpenAI研究员姚顺雨加入腾讯后交出的第一份正式答卷,就是这个Hy3。2950亿总参数、只激活210亿的MoE架构,256K上下文窗口,快慢思考融合,工程型定位,性价比拉满,Agent倾向明显。

跑分方面,SWE-bench Verified 78分,虽然还没追上Claude Fable 5和GLM-5.2,但在SWE-bench Pro上拿到了57.9分,反超了DeepSeek V4 Pro。WildClawBench也超过了GLM-5.1和DeepSeek V4 Pro。这说明什么?跑分和实际调用量,有时候说的是两件事——免费才是真正的杀手锏。

Hy3处于"整体能力第二梯队上沿、开放与低成本模型第一梯队"。

—— 资深Agent从业者 赵江杰
七天逆袭:从GLM 5.1垫底到GLM 5.2开源第一

如果Hy3的故事是"空降奇兵",那智谱GLM的故事就是"一代版本一代神"。

就在上周,GLM 5.1还在榜单垫底区域挣扎。七天后,GLM 5.2横空出世——总参数744B,MIT协议开源,支持1M上下文,直接杀到周调用量3.19万亿Token,环比增长24%。

跑分才叫炸裂:

Terminal-Bench81.0分开源第一
与Claude Opus 4.8差距<1%
FrontierSWE74.4分接近Opus 4.8
Function Calling成功率98.5%

Function Calling 98.5%——这个数字才是企业用户真正关心的。你做Agent、做工具调用、做MCP协同,调不稳什么都白搭。智谱这一刀,砍在了企业需求的命门上。

从垫底到夺冠,只隔了七天。国产大模型已经卷到了"周更"的节奏。这速度,比手机厂商发系统更新还快。

全世界为什么都在用中国模型?

别以为只有国内用户在用。OpenRouter是全球平台,调用数据反映的是全世界开发者的真实选择。

答案其实不复杂,三个字:性价比

布鲁金斯学会学者Kyle Chan说得很直白:中国模型的价格通常只是美国竞品的一小部分,而性能已经接近前沿水平,整体技术差距大约只有6到9个月。

企业模型选型三个关键——能力、性价比、模型特性是否适合Agent/工具调用/MCP协同等企业场景。中国大模型用户增长核心在于"多元供给、极致性价比、开源开放与持续迭代的综合优势"。

—— 上海财经大学特聘教授 胡延平

开源 + 低价 + 能力够用 + Agent适配好 = 全球开发者的理性选择。

这不是什么情怀驱动,是纯粹的市场行为。开发者又不看国旗,他们只看调用成本和服务质量。

美国企业的"真香定律"

有一组数据特别值得玩味:

30%-46%自2026年2月8日以来,美国企业使用中国AI大模型的Token占比每周稳定在30%以上,最高触及46%。而2025年上半年,这个数字仅为4.5%。

从4.5%到46%,十倍增长。嘴上喊着脱钩,手上疯狂调用。这就是AI领域的"真香定律"。

你说限制出口?结果是——美国企业通过OpenRouter这样的第三方平台,大规模调用中国模型。因为便宜、好用、开源、不锁死。市场永远比政策跑得快。

造芯暗线:从模型到算力的下一站

就在榜单发布的同一天,两条消息几乎同时传出:DeepSeek和智谱都在自研AI芯片。

DeepSeek刚完成约510亿元首轮融资,估值520-590亿美元。智谱则已经在港交所上市。两家公司,一个在一级市场吸金,一个在二级市场融资,现在又不约而同地冲向芯片。

逻辑很清楚:模型层卷到极致后,瓶颈就转移到算力上了。谁掌握了芯片,谁就掌握了下一层的成本优势。

与此同时,中国首个全国产十万卡AI超集群——曙光8000(登峰)正式落成。从模型到芯片到超算集群,一条完整的自主化链路正在成型。

未来成功的智能体会根据不同任务的能力要求和成本约束,自主选择合适模型。

—— 腾讯首席战略官 詹姆斯·米切尔

翻译成大白话:以后的AI Agent不会管你是中国模型还是美国模型,谁便宜好用就用谁。而这,恰恰是中国模型最大的优势。

写在最后

回看这一周的榜单,三个信号已经很明确了:

第一,中国大模型在全球调用量上的领先已经不是"能不能保持"的问题,而是"领先多少"的问题。27.58万亿对6.33万亿,四倍差距,还在拉大。

第二,国内竞争已经进入"周更淘汰赛"模式。DeepSeek七连冠被终结,GLM从垫底到夺冠只用了七天,阶跃星辰直接跌出榜单——这个节奏,一个月不看就可能完全跟不上。

第三,美国企业在用脚投票。30%-46%的Token调用来自中国模型,嘴上再怎么硬,身体是诚实的。

最后分享一句在圈子里流传的话:

"月费比年费安全,
因为下个月格局可能又变了。"

这大概就是2026年AI赛道最真实的写照。

#大模型#OpenRouter#全球格局#腾讯Hy3#GLM5.2
数据来源:OpenRouter · 2026年7月第二周

最新文章

随机文章