当前位置:首页>排行榜>全球前10开源模型8款来自中国,这不是排行榜的故事,而是全球开发者用"脚"投票的选择

全球前10开源模型8款来自中国,这不是排行榜的故事,而是全球开发者用"脚"投票的选择

  • 更新时间 2026-07-25 17:46:22
全球前10开源模型8款来自中国,这不是排行榜的故事,而是全球开发者用"脚"投票的选择

——全球前10开源模型8款来自中国,这不是排行榜的故事,而是全球开发者用"脚"投票的选择

一、100亿次下载:不是政府推广,是全球开发者用"脚"投的票

2026年夏天,一组数据在全球科技圈引发了一场静默的地震。

Hugging Face——全球最大的开源AI模型托管平台,托管近300万个公开模型和100万个公开数据集,平均每7秒就有一个新代码库被创建——在其2026年春季报告中披露了一个历史性的转折:中国研发模型下载量占全球41%,首次超越美国的36.5%,成为全球第一大开源模型供给国(华尔街见闻)。

与此同时,中国开源大模型全球累计下载量突破100亿次 (中新网)。

这不是一夜之间发生的。但如果我们把时间轴压缩成一张图,你会看到一条从2024年末开始陡峭上扬的曲线——在2025年初DeepSeek引爆全球关注之后,这条曲线几乎变成了直线上升。

更值得关注的不只是"量",还有"质"。Artificial Analysis开源智能指数前6名全部为中国模型——智谱GLM-5.2以51分断层领先,MiniMax-M3、DeepSeek V4 Pro、Kimi K2.6以44分并列第二,小米MiMo-V2.5-Pro以42分紧随其后,DeepSeek V4 Flash以40分位列第六 (掘金)。全球AI调用平台OpenRouter上,当前最受欢迎的前六大模型,全部来自中国机构——腾讯、小米、DeepSeek、MiniMax和智谱均在列,Anthropic的Claude Opus 4.7排名第七 (华尔街见闻)。

请允许我用一个类比来解释这组数据意味着什么。

想象全球有300万个开发者——分布在硅谷的车库、柏林的联合办公空间、班加罗尔的咖啡馆、圣保罗的大学实验室——他们每天需要挑选AI模型来构建产品。这不像选总统,没有竞选广告、没有拉票团队。他们的"投票"方式非常朴素:打开Hugging Face,点击下载。每7秒,这个平台就创建一个新的代码库,每一次下载都是真金白银的技术决策。

这不是哪个国家给AI刷的下载量——是全球300万开发者、财富500强企业中一半,在7秒一个的速度里,一次又一次选择了同一个来源(华尔街见闻)。

二、谁在下载?从硅谷80%初创到全球银行

如果只有下载量,我们可以说这是"开发者的好奇心"。但当企业开始用真金白银投票,性质就完全不同了。

据新浪综合报道,硅谷约80%的AI初创公司在融资路演时使用中国开源模型(新浪)。Pinterest、爱彼迎、西门子等跨国企业已常态化使用中国开源模型 (新浪财经)。

更引人注目的是API调用端的变化。据《每日经济新闻》基于OpenRouter数据的测算,2026年7月第3周(7月13日-19日),全球AI大模型总调用量达62.2万亿Token,其中中国AI大模型周调用量达36.11万亿Token,连续十二周超过美国(每日经济新闻)。在OpenRouter上,美国企业调用中国模型Token占比最高达63%,连续11周超越美国 (新浪)。

谁在花钱调用?不是中国公司,是全球企业。

瑞银证券分析师团队在2026年6月23日发布的AI研究报告中描述了一个典型案例:一家大型全球银行已在本地部署阿里Qwen,以平衡Claude等高端模型的使用成本(华尔街见闻)。AWS Bedrock的模型菜单中已纳入MiniMax、Kimi、Qwen、DeepSeek、GLM;微软Azure AI Foundry也提供DeepSeek接入 (华尔街见闻)。

据Vercel平台数据,2026年6月,开源模型已处理该平台近三分之一的AI请求,承接了大量基础设施密集型工作负载 (华尔街见闻)。瑞银报告同时指出,约60%的企业已以某种方式限制AI开支,核心动作是为Token使用加设护栏 (华尔街见闻)。

用一个生活化的比喻来解释这个趋势:

以前企业选AI模型像选餐厅——去最贵的米其林,什么菜都点同一家的。现在变成了"模型路由"——简单问题吃快餐,复杂推理才上米其林。瑞银报告将"模型路由"定义为:将不同任务分配给不同模型,只有复杂推理、关键代码和长上下文分析才调用最贵的模型,简单任务则转向低价甚至中国开源模型 (华尔街见闻)。

而全球最火的"快餐连锁",全是中国品牌。

三、为什么选中国?三个不可替代的优势

优势一:成本——同等任务成本仅为美国闭源模型的1/5到1/20

价格差异是最直接的驱动力。

据新浪财经报道,中国开源模型Token成本仅为美国闭源模型的1/5至1/20,DeepSeek输出百万Token仅需0.3美元(新浪财经)。

以Anthropic为例,Haiku 4.5输出价格为每百万Token 5美元,Opus 4.5-4.8为25美元,最高端模型达50美元——从低端到高端,输出Token价格相差10倍 (华尔街见闻)。而腾讯Hy3的输出价格低至每百万Token 0.42美元,DeepSeek V4 Flash更是只要0.28美元 (CSDN)。

类比:  同样的装修效果,美国闭源模型报价100万,中国开源模型报价5万——不是偷工减料,是换了一套施工方法。这套方法叫MoE(混合专家架构):1.6万亿总参数的DeepSeek V4 Pro,实际推理时只激活49B参数,相当于一个1000人的公司只派3个人来干你的活——但这3个人恰好是最对口的专家 (掘金)。

优势二:自由度——"你不会被一键关停"

2026年6月,一记警钟敲醒了所有依赖闭源API的企业:美国联邦AI监管部门要求Anthropic在90分钟内下架两款前沿模型(新浪)。

这件事的影响远超事件本身。它向全世界企业传递了一个信号:闭源=把核心能力交给一个你无法控制的黑盒API,而这个API的主人可以随时拔掉插头。

Hugging Face CEO Clem Delangue对此直言不讳:"如果你是一家AI公司或科技公司,你不会想把核心能力外包给一个你无法控制的黑盒API。"(Edgen)

微软CEO Satya Nadella也从另一个角度发出了类似警示:"如果学习只朝一个方向流动,经济价值就会向学习基础设施的拥有者集中,而非流向知识的创造者。"(华尔街见闻)

开源意味着什么?可本地部署、可审计、不受政治干预。  你的模型跑在你自己的服务器上,数据不出门,合规无忧,没有任何人能在90分钟内让你的核心能力"消失"。

类比:  闭源模型像租房子——房东随时可以涨租甚至收回;开源模型像自己盖房子——虽然初期费点劲,但永远是你的。

优势三:生态——Qwen一个系列的下载量超过了很多国家

如果说成本和自由度是"进入门槛",那生态就是"留下来的理由"。

据中新社和新浪财经报道,Qwen(通义千问)系列下载量超10亿次,衍生模型超20万个(中新网)(新浪财经)。据掘金社区基于HuggingFace官方组织页的统计,Qwen3.6-35B-A3B单模型下载量达667万次,位列全场第一(掘金)。在2026年7月15日Hugging Face Trending榜上,Qwen系列变体(MoE、视觉、量化、多token预测等版本)至少占据10个席位,是社区微调生态中最大的"底座" (GitHub)。

Qwen采用Apache 2.0许可——这是商用最干净的开源协议之一,可自由商用、修改、闭源分发,无需申请授权,无任何附加限制 (掘金)。

类比:  Qwen不像一家餐厅,更像一个菜市场——从一颗葱到一桌宴席的食材全有,你想要什么自己搭。3B的小模型可以跑在手机上,397B的大模型可以服务企业级场景,中间几十种尺寸任你挑选。这种"全尺寸覆盖"策略,让它成了全球开发者默认的"基础层"。

四、八大金刚:TOP10里的中国模型都是谁?

全球开源智能指数前12名中,中国模型占据前6席以及第8席。让我逐一拆解这些模型的核心差异化定位。

阿里Qwen(通义千问)——生态之王。  下载量全球第一,Apache 2.0最干净的商用许可,从3B到397B的全尺寸模型家族,20万+衍生模型构成了全球最大的社区微调生态。它不是最强的单模型,但它是最大的"底座"——全球开发者在上面盖房子。智能指数34分,排名第八,但它的真正价值不在排名,而在于生态惯性 (掘金)。

DeepSeek(深度求索)——推理天花板。  MIT许可,V4 Pro智能指数44分,SWE-bench Verified达80.6%;V4 Flash仅13B激活参数,输出百万Token低至0.28美元,是全球最便宜的前沿模型。三个月内估值从100亿美元翻至710亿美元(约4800亿人民币),已全面启动A股IPO筹备 (秋原看雁)(掘金)。

智谱GLM——智能指数之王。  GLM-5.2以51分断层领先,比第二名高7分,MIT许可,753B总参数中仅激活40B,1M上下文窗口。在Arena智能体榜杀入第9,Bash恢复速度碾压所有海外模型。SWE-bench Pro 62.1%,与闭源第一梯队的差距为有史以来最小 (掘金)(秋原看雁)。

月之暗面Kimi——参数之王与长上下文之王。  Kimi K3以2.8万亿参数成为全球首个开源的3万亿级别模型,在Frontend Code Arena以1679分登顶世界第一,领先Claude Fable 5整整48分。发布当天引发美股震动——谷歌母公司Alphabet跌2%、Meta跌3%,华尔街称之为"Kimi时刻"。马斯克在评测下留言"Impressive",并在预告Grok 4.6时以Kimi K3作为对比目标 (中新网)(每日经济新闻)。

MiniMax——轻量化效率之王。  MiniMax-M3智能指数44分,428B总参数仅激活23B,原生多模态能力使其成为开源前六中唯一的多模态选手。在OpenRouter上持续位列全球调用量前五 (掘金)(每日经济新闻)。

小米MiMo——端侧与云端双适配。  MiMo-V2.5-Pro智能指数42分,1万亿总参数、42B激活,1M上下文,在OpenRouter连续五周位居第二,周调用量达9.19万亿Token。定价低至$0.44/$0.87每百万Token (掘金)(每日经济新闻)。

腾讯混元Hy3——调用量之王。  7月6日正式发布后仅6天即登顶OpenRouter全球调用榜,终结了DeepSeek V4 Flash的七连冠。采用MoE架构,总参数295B、激活参数21B,限时免费期间单周处理11.5万亿Token,Apache 2.0许可 (CSDN)(每日经济新闻)(金融界)。

字节跳动Seed/即梦——视频生成赛道全球第二。  即梦Seedance 2.0在Arena AI视频榜以ELO 1482分稳居全球第二,Seedream 5.0 Pro在AI生图榜排名第11,为国产最高排名 (秋原看雁)。

五、美国为什么落后了?——不是不努力,是走错了路

当我们说"美国落后"时,需要精确地界定"落后"的含义——不是闭源前沿模型落后,而是开源阵营的系统性停滞。

据掘金社区基于HuggingFace与Artificial Analysis的统计,Meta Llama主线超14个月未更新,OpenAI gpt-oss主线超11个月未更新(掘金)。在中国模型以"周"为单位迭代的时候(仅2026年7月前两周就有MiniMax-M3、LongCat-2.0、Gemma 4更新、Hy3、GLM-5.2等密集发布),美国两大开源主力却按下了暂停键 (掘金)。

真正开放权重的美国最强模型是Google Gemma 4 31B(智能指数29分),与中国第一梯队差距超过20分(掘金)。NVIDIA Nemotron 3 Ultra虽然智能指数38分看似不低,但榜单明确标注权重"Not available"——目前只有API,严格意义上不算开放权重 (掘金)。

路线选择是根本原因。Anthropic CEO Dario Amodei认为,发布能力越来越强的开源模型存在风险,"一旦发布便难以控制" (华尔街见闻)。OpenAI战略未来负责人迪恩·鲍尔公开发帖抨击开源模型为"减速主义力量" (每日经济新闻)。

但Delangue反驳称:"把它锁在少数几个玩家的门后,并不能让它变得安全。最大的AI风险是权力的集中。"(Edgen)

当然,个别美国模型仍显示强劲势头。arXiv论文"The ATOM Report"指出,经过按模型规模与发布时间调整后,GPT-OSS 120B和Nemotron Super 120B的采用势头依然强劲(奇绩创坛)。

类比:  美国像一家米其林餐厅,不断升级菜单但只让VIP进;中国像把配方公开让所有人都能做的连锁——短期内米其林更精致,长期看连锁的生态更庞大。当20万个衍生模型在Qwen的"配方"上生长出来时,这个生态本身就成了护城河。

六、地缘政治的意外推手——越封锁,开源越香

历史总是充满讽刺。美国对中国AI的芯片出口管制,反而倒逼中国AI公司走出了一条更高效的路线。

逻辑很简单:买不到足够的GPU,就只能把每个GPU的潜力榨到极致。  这催生了MoE稀疏化架构的全面普及——DeepSeek V4 Pro的1.6万亿参数中只激活49B,相当于用别人1/30的算力做到接近的效果 (掘金)。效率优先而非暴力堆算力,成了中国AI的差异化路径。

而封锁的另一面,是一场意想不到的"逆向声援"。

2026年7月22日,包括Proton和Y Combinator在内的近200家硅谷企业,通过新成立的"小科技协会"(Little Tech Association)联名致函白宫,要求不要切断美国企业获取中国开源AI模型的渠道(IT之家)。信中直言:"剥夺美国初创公司获取海外模型的渠道,不仅会扼杀竞争,巩固现有大型企业的地位,而且会造成一种'智能税'。"AI基础设施创业公司Particle创始人Suhail Doshi更警告:"会有数百家公司瞬间死亡。"(网易)

英伟达CEO黄仁勋也公开表态,美国企业"绝对可以"使用中国开源AI模型,认为开放使用反而有利于AI生态,反对以国家安全为由全面限制 (新浪)。

与此同时,中国开源模型正在全球南方"爆炸式"增长。据新浪财经报道,中国模型已适配非洲20种本土语言(新浪财经)。乌干达研究团队基于中国开源底座开发了覆盖31种语言的大模型 (新浪)。外媒评价中国开源模型"物美价廉,且不受地缘政治控制" (新浪财经)。

类比:  芯片封锁像堵了一条高速公路,中国AI公司被迫走了一条更难但更高效的小路——结果发现这条小路反而通向了更大的市场。当你在高速公路上堵着的时候,别人已经修了一条省道,沿途还开了无数加油站。

七、从"输出产品"到"输出能力"——中国AI正在做什么?

下载量和调用量只是表象。更深层的变化是:中国AI正在从"卖产品"转向"提供基础设施"。

2026年7月,上海世界人工智能大会发布了《人工智能合作发展行动计划》,核心措辞是"联通""协作""共建",而非"输出" (新浪)。中国主导的 "世界人工智能合作组织"已有29个成员国加入,聚焦全球南方国家参与AI治理 (中新网)(新浪)。

国家发改委创新驱动发展中心主任霍福鹏表示,此次行动计划的提出将有助于提升人工智能普惠可及性,推动各国平等共享新一轮科技革命红利 (中新网)。

据国家发改委发布的《中国智·惠世界》案例集,中国AI国际合作经历了三级跳:2024年单模型输出→2025年完整方案输出→2026年底层能力+生态共建(新浪)。

这意味着什么?当一个乌干达的研究团队可以用中国开源底座训练覆盖31种语言的大模型,当马来西亚的橡胶加工者可以用中国小模型算法优化劳作方式,当泰国的矿区可以采用中国远程控制系统年节省百万美元成本——中国输出的不再是"产品",而是"能力本身" 。

产业数据也在印证这一转变。2025年中国AI核心产业规模突破1.2万亿元,AI企业超6200家,AI专利申请量占全球60% (新浪财经)。

类比:  以前中国AI像代工厂——别人设计你生产;现在像安卓——你提供底层系统,全世界在上面盖房子。20万个Qwen衍生模型,就是20万个"基于安卓开发的应用"。

八、开源不是让利,是另一种形式的赢

回到开头的核心叙事:这不是一个排行榜的故事,而是一场AI基础设施控制权转移的故事。

Hugging Face CEO Delangue的判断极为直接:"如果中国持续引领开源,可能在一两年内整体领先AI。"(华尔街见闻)

月之暗面企业业务负责人黄震昕在Kimi K3发布后的媒体回应中说了一句值得反复咀嚼的话: "今天关于价格和Token消耗的所有争论,都只是一个更大故事的开场。"(每日经济新闻)

美国彭博社的评论更直白: "'美国在AI领域领先世界'这一观念被中国打破了。"  美国阿克西奥斯新闻网则称: "中国刚刚抹去了美国人工智能的领先优势。"(中新网)

但我想提出一个不同的视角:AI不是零和博弈。

100亿次下载不是中国"赢"了美国,而是全球开发者共同选择了一条更高效、更开放、更可控的技术路径。开源是普惠,不是慈善。当一个乌干达的大学生用Qwen底座训练出自己母语的大模型时,当一家硅谷初创公司用DeepSeek Flash以1/20的成本跑通MVP时,当一家全球银行用Qwen本地部署平衡成本时——受益的不是某一个国家,而是整个AI生态。

真正的竞争不在参数规模,不在于谁的模型在哪个榜单上排第几。真正的竞争在于,谁能把模型能力最高效地转化为全人类的生产力。

从这个维度看,100亿次下载不是终点——它是全球AI基础设施控制权转移的起点。

正如Linux基金会CTO Matt White考察后指出的,全球AI正走向事实上的"双轨制":一条是美国闭源体系,另一条是中国开源生态 (新浪)。而在"双轨"竞争中,最终胜出的不会是参数更大的模型,而是让更多人以更低成本、更高自由度、更强掌控力来使用AI的那一条轨道

参考资料:

  1. 华尔街见闻:占比达41%!中国开源模型下载量超越美国
  2. 中新网:从DeepSeek到Kimi:中国AI大模型群星闪耀时
  3. 掘金:开源模型最全盘点(2026年7月版):中美14家厂商30+模型全景图
  4. 新浪财经:中国AI开源模型下载量全球第一意味着什么?
  5. Edgen: Chinese open-source AI models surpass US with 41% of downloads
  6. 奇绩创坛:中国开源模型下载量超越美国,Qwen成主导力量
  7. 秋原看雁:突发!2026全球大模型最新排名出炉
  8. 每日经济新闻:Kimi K3风暴第四日:月之暗面黄震昕回应争议
  9. CSDN:2026全球开源大模型TOP10榜单+主流模型深度解析
  10. 新浪BigNews:开源AI模型的崛起是否会开启技术无国界的共享新时代?
  11. 每日经济新闻:调用量连续八周增长!中国大模型单周包揽全球前五
  12. IT之家:200家硅谷初创联名反对白宫政府封禁中国开源AI模型
  13. CSDN:OpenRouter 7月第2周周榜深度解析
  14. 金融界:腾讯混元Hy3限免延长两周,调用量增长逾68倍
  15. 网易:数百家公司会瞬间死亡!YC等200家硅谷公司集体反对禁用中国开源模型

最新文章

随机文章