570% 暴涨背后:中国大模型,正在接管全球开发者的"服务器"
570% 暴涨背后:中国大模型,正在接管全球开发者的”服务器”

一、一组让人无法忽视的数字
上周(8月3日至8月9日),全球 AI 大模型的调用总量达到了 69 万亿 Token,环比增长 21.48%。这个数字本身已经足够惊人,但更值得玩味的是它的结构。
OpenRouter 的周榜上,前四名全部是中国模型。第一名 DeepSeek-V4-Flash 正式版,周调用量 8.83 万亿 Token,环比暴涨 570%;第二名腾讯混元 Hy3,8.05 万亿 Token,环比增长 67%;第三名仍是 DeepSeek,预览版 V4-Flash-0423,5.88 万亿 Token;第四名被小米 MiMo-V2.5 占据。前十名里,中国模型占了六席,合计约 35.58 万亿 Token。
如果把时间轴拉长,这条曲线会更陡峭。2026 年 2 月底,MiniMax 和月之暗面首次把中国开源模型送进全球 Token 使用量前列,终结了美国开发者长达一年的主导地位。3 月 1 日,中国大模型周调用量 5.16 万亿 Token,首次超越美国的 2.7 万亿。到 6 月,这个数字涨到 18.42 万亿,连续七周领跑。而现在,中国模型已经连续十五周压过美国模型。
十五周。三个月零三周。这不是一次性的新闻事件,而是一个正在固化的市场格局。 
二、8.83 万亿 Token:一家中国公司的”暴力增长”
570% 的环比增长,放在任何一个商业指标里都近乎疯狂。更疯狂的是它发生的方式。
DeepSeek-V4-Flash 正式版发布于 7 月 31 日,开放 API 仅四天,就冲上了 OpenRouter 全球周榜第一。海外开发者平台 OpenCode 的数据显示,8 月 1 日当天,DeepSeek V4 Flash 在其平台上单日处理了 8 万亿 Token——其中 5 万亿来自免费试用额度,3 万亿来自开发者付费调用。
注意这个结构:付费调用已经占了近四成。这说明它不是单纯的”薅羊毛式”流量,而是开发者真金白银的选择。
到了 8 月 12 日的最新数据,DeepSeek-V4-Flash-0731 的周调用量进一步攀升至 9.39 万亿 Token,继续稳居第一。它的核心受众从一开始就很明确:开发者和企业用户。主打高吞吐量的定位,让它成了海外 AI 应用层最顺手的”引擎”。 
三、不只是 DeepSeek:一场”集体出海”
如果只是 DeepSeek 一家独秀,这个故事还称不上”格局变化”。真正的信号在于,这是一场集体行动。
腾讯混元 Hy3 以 8.05 万亿 Token 紧随其后,环比增长 67%;小米 MiMo-V2.5 曾以 5.1 万亿 Token 登顶过周榜,虽然随后回落,但依然稳定在前四;前十名里,中国模型占据六席——DeepSeek 两款、腾讯、小米,加上其他国产模型。
这些名字放在一起,指向一个被很多人忽略的事实:中国大模型的出海,不是个别公司的奇袭,而是整个生态的系统性输出。从头部大厂到新锐创业公司,从聊天模型到代码模型,中国 AI 正在全球开发者调用体系里,形成一种”无处不在”的存在感。
OpenRouter 作为全球开发者最常用的模型聚合平台,它的数据某种程度上就是全球 AI 应用生态的”用脚投票”结果。开发者不关心公司国籍,只关心三个词:能力、价格、稳定性。当中国模型在这三项上同时胜出,格局的逆转就只是时间问题。 
四、便宜,才是硬道理
这套增长的底层逻辑,其实朴素得惊人:性价比。
DeepSeek-V4-Flash 采用 MoE 混合专家架构,总参数 284B,但推理时只激活约 13B——这意味着它用更少的算力做更多的事。价格上,0.2 元/百万 Token 的成本,让它成为全球开发者最容易”无脑接入”的选项之一。
这不是玄学,而是工程能力。同样的任务,别人要烧掉十倍的成本,中国模型用更聪明的架构和更精细的推理优化,把价格打到了地板。当”能用”变成”好用又便宜”,全球开发者的迁移就成了必然。
这也是为什么 8 月 6 日传出 DeepSeek 将”大幅涨价”的消息时,业内反而一片兴奋——涨价,说明需求已经旺到需要价格杠杆来调节。The Information 此前的报道也印证了这一点:DeepSeek 年化收入据称已达 4 亿至 5 亿美元,V4 API 毛利率超过 50%,公司还在筹备引入中东等海外投资者,并允许以美元投资。
流量正在变成收入,收入正在变成资本,资本正在反哺下一轮技术迭代。这个飞轮一旦转起来,就很难停下来。 
五、真正的竞争才刚刚开始
当然,理性地看,OpenRouter 的数据只反映特定聚合平台上的活跃度,并不代表 DeepSeek 在全球范围内的全部使用量。而且,榜单的波动也很剧烈——预览版 V4-Flash-0423 环比下滑 19%,小米 MiMo 环比下滑 52%,说明用户对模型的选择越来越”用脚投票”,忠诚度低,迭代压力大。
但这恰恰是健康的信号。当竞争焦点从”谁的参数大”转向”谁更便宜、更快、更好用”,整个行业的效率就在被拉高。对开发者是好事,对用户是好事,对还在烧钱堆参数的大厂来说,则是必须面对的警钟。
连续十五周领跑全球调用量,中国模型用最朴素的市场逻辑赢得了最真实的投票。接下来要看的,不是能不能守住第一,而是这场由性价比驱动的出海浪潮,能不能沉淀出真正的生态壁垒——从模型、到工具链、到开发者社区,再到收入结构。
毕竟,调用量只是入场券。谁能把流量变成可持续的生意,谁才是最后的赢家。 
数据来源:OpenRouter 公开数据、OpenCode 平台数据、The Information、每日经济新闻、界面新闻(2026年8月)