三天三连发:开源世界的中心,正在悄悄搬向中国
三天三连发:开源世界的中心,正在悄悄搬向中国

这个 8 月中旬,中国开源模型按下了加速键
8 月 13 日到 15 日,短短三天,DeepSeek、智谱、阿里三家中国公司接连投下了三枚重磅开源炸弹。这三天里发生的事情,放在一年前几乎不可想象:全球最大的开源权重模型、编程能力最强的开源模型、下载量登顶全球的开源家族,全部来自中国团队。
一周前,我们刚聊过 OpenRouter 上中国模型连续 15 周霸榜调用量。这周的故事更进一步——不只是”用得多”,而是”生态已经换了主场”。
第一发:DeepSeek V4-Pro 正式版,悄然上线的巨兽
8 月 13 日凌晨,DeepSeek V4-Pro 正式版(DeepSeek-V4-Pro-0813)没有发布会、没有预热,直接同步上线 APP、网页端和 API。
这是一头真正的巨兽。总参数约 1.6 万亿(MoE 架构、激活参数 49B),100 万 token 上下文、38.4 万 token 最大输出,是目前已知最大的开源权重模型——超过 Kimi K2.6 的 1.1 万亿和 GLM-5.1 的 7540 亿。更夸张的是它的进步速度:在软件工程智能体测试 DeepSWE 上,正式版得分从预览版的 12.8 直接跃升到 62.7,翻了近五倍。
同日,DeepSeek 还开源了智能体框架 DeepSeek Harness(v0.1 预览版,MIT 协议),主打”一切皆插件”。8 月 14 日,国家超算互联网宣布上线 V4-Pro 正式版与 Harness,依托全国首个十万卡级超智融合算力资源池,把从训练、微调、评测到部署的全生命周期链路开放给科研院所和开发者。
值得一提的是,8 月 17 日起 DeepSeek 将执行 API 峰谷定价。能力涨了,价格也要调整——这是实力的信号,不是退缩。 
第二发:GLM-5.3,用后训练把同一个基座拉上天花板
8 月 14 日,智谱发布 GLM-5.3。这可能是三发里最”反直觉”的一发:它的基座模型和 GLM-5.2 完全一样,7530 亿参数,一克都没加。全部提升来自极致的后训练 Scaling——数十倍的长程任务环境、更丰富多样的环境类型、超长的后训练时间。
效果惊人。在智谱自研的 Z.ai Code Bench 上,GLM-5.3 较前代提升 50%;公开基准 Terminal-Bench 3.0 从 4.6 跃升至 28.3,拿下开源第一;DeepSWE v1.1 达到 66.9,甚至反超了 DeepSeek V4-Pro-0813 的 62.7。智谱称它是”编程能力最强的开源模型”,编程与智能体能力已接近 Claude Fable 5,网络安全能力在白盒代码审计、漏洞挖掘等任务上对标 Mythos 5。
在大模型普遍”堆参数”的当下,智谱用一条非主流路径验证了一个判断:基座的潜力远未触顶。模型权重将在发布两周后开源(MIT 协议),同步启动的还有”开源的盾”计划。 
第三发:Qwen3.8,把旗舰和”跑得动”一起开源
8 月 14 日晚,阿里千问正式开源 Qwen3.8 系列。主角是 Qwen3.8-27B——270 亿参数的稠密模型,原生多模态(文本、图像、视频都能端到端理解),262K 原生上下文可外推至 1M。整体水平超越 Qwen3.7-Plus,编程和办公场景表现突出,采用 Apache 2.0 协议。
但它最打动人的是三个字:跑得动。量化后在消费级显卡上就能流畅运行,社区实测单张 RTX 5090 解码速度 206.1 tok/s,17GB 内存环境也能跑,vLLM 实现了 Day-0 支持。同时,旗舰级 Qwen3.8-Max(2.4 万亿参数)此前也已开源权重——巨兽归巨兽,平民归平民,两条腿走路。
而真正让海外震动的,是彭博社的报道:Qwen 过去六个月全球累计下载量超 30 亿次,超过 Meta、Alphabet,成为下载量最高的开源 AI 模型。阿里已累计开源 460 多个模型,生态中衍生模型超 30 万款。 
三个信号:中国开源正在改写游戏规则
把三发放在一起看,能读出三个清晰的信号。
第一,军备竞赛的主战场从预训练转向了后训练。GLM-5.3 用同一个基座证明了”智能上界”远未触顶;DeepSeek 用近五倍的 DeepSWE 提升展示了正式版打磨的威力。当预训练红利见顶,谁的后训练工程能力强,谁就掌握下一轮主动权。
第二,“巨兽 + 平民”双轨战略成型。1.6 万亿的 DeepSeek V4-Pro、2.4 万亿的 Qwen3.8-Max 负责冲击性能天花板;284B 的 V4-Flash、27B 的 Qwen3.8-27B 负责让每个普通开发者都跑得起。开源不再是实验室的装饰品,而是下沉到每一张消费级显卡。
第三,开源生态的坐标系正在东移。Hugging Face 的报告显示,中国模型下载量已占全球 41%,首超美国的 36.5%;Hugging Face CEO Clément Delangue 公开预测,中国玩家可能在今年年底领跑前沿 AI。硅谷 AI 初创约 80% 在用中国开源模型——这不是情怀,是性价比,是生产力,是全世界的开发者用脚投票的结果。 
结语
三天三连发,听起来像巧合,其实是同一个产业逻辑的必然:当开源从”中国制造”变成”中国定义”,全球 AI 的权力结构就已经悄悄改写了。
下一周,GLM-5.3 权重即将开放。这场大戏,才刚刚开场。 