凌晨两点,硅谷一家AI创业公司的技术负责人盯着屏幕,久久说不出话。
就在刚才,他常用的那个中国模型,悄悄爬上了全球AI大模型调用量排行榜的第一名。不是第二,不是并列,是断层第一。
更可怕的是,它的代码能力得分是93.5%——第二名连它的尾灯都看不见。
8月4日,一条消息在开发者圈子里炸开了锅:DeepSeek V4-Flash,登顶全球AI大模型调用量排行榜第一。
这不是什么野鸡榜单,是全球开发者用脚投票的结果。调用量第一,意味着全球最多程序员、最多创业公司、最多AI应用,正在把它的API接进自己的产品里。
而在LiveCodeBench代码评测中,它拿下了93.5%的分数。
什么概念?这是断层式领先。第二名还在80分档挣扎,它已经冲进了90分俱乐部。就像高考数学,别人考120分已经拼尽全力,它考了145分——而且卷子满分150。
如果只是分数高,那不过是个"学霸模型"。真正让硅谷睡不着觉的是:它又快又便宜。
性能与成本"双重断层式领先"——这句话翻译成人话就是:花你十分之一的钱,干你十倍的活。
在Arena.ai前端代码竞技场,它拿下1586分,冲进开放类别全球第三。要知道,这个竞技场的参赛者,全是全球顶尖AI模型。一个中国团队做出来的模型,正在以"白菜价"收割全球开发者的心。
更讽刺的是另一组数据。就在同一天,红杉资本合伙人扔出一篇重磅文章——《America's Open-Model Paradox》(美国的开源模型悖论)。
文章里有一个数字,刺眼得让人无法忽视:2024年1月,中国Qwen模型在开源微调适配中仅占1%。2026年2月,这个数字飙升到了69%。
也就是说,美国整个AI产业,正在对中国开源模型形成深度依赖。美国在闭源前沿模型上可能还领先半步,但在开源生态里,中国模型已经成了"难以绕开的基础组件"。
美国赢了闭源,却输在了开源。这就像一个武林高手,内功深厚,却发现自己的招式全是从对手那里学来的。
从DeepSeek到Qwen,中国AI正在完成一次漂亮的"双线作战":
- 闭源赛道:DeepSeek用V4-Flash证明,中国模型可以在性能上碾压全球对手。
- 开源赛道:Qwen用69%的市占率证明,中国模型可以在生态上绑定全球开发者。
前者是"我能比你强",后者是"你离不开我"。两条线同时推进,这才是最可怕的地方。
以前我们总说"中国AI在追赶"。现在或许该换个说法了:在某些赛道上,中国AI已经开始领跑。
凌晨两点,那个硅谷技术负责人终于回过神来,在Slack群里发了一条消息:"我们得重新评估技术栈了。"
评论区聊聊:你觉得中国AI现在是"追赶者"还是"领跑者"?你最常用哪个AI模型?DeepSeek、ChatGPT、还是Claude?