Home
avatar

杨晏

中国大模型进入「超节点时代」:Qwen3.8上线,黄仁勋罕见点赞

中国大模型进入「超节点时代」:Qwen3.8上线,黄仁勋罕见点赞

cover_封面

7月第三周,中国AI圈发生了三件看似独立的事。

7月19日,阿里Qwen3.8-Max预览版深夜上线,2.4万亿参数,自称「仅次于Fable 5」。

7月21日,英伟达CEO黄仁勋接受Axios采访,点名表扬DeepSeek、Kimi、阿里、腾讯、MiniMax、百度,说「中国开源AI模型非常优秀,美国企业应该使用」。

7月23日,阿里真武M890超节点适配Qwen3.8,64张国产芯片800GB/s互联,9TB显存,国内首个跑通超2万亿参数模型的超节点。

这三件事,指向同一个趋势:中国大模型正在从「单点突破」走向「系统级能力」。


模型层:2.4T参数的自信

先看Qwen3.8本身。

2.4万亿参数,MoE+DSAG动态稀疏自适应门控架构。没有第三方跑分,没有对比表格,纯自评。阿里官方就一句话:「这可能是除了Fable 5外,最强大的模型。」

这种自信从哪来?不是参数规模,而是生态

Qwen3.8预览版首发上线了四个平台:Token Plan、Qoder、QoderWork、千问PC端。模型还在Preview阶段,工具链已经全部就绪。开发者打开Qoder就能直接用,不需要等API申请、不需要配置环境。

这就是阿里做模型的方式:模型只是入口,生态才是护城河。

对比一下Kimi K3。K3在Frontend Code Arena 1679分登顶,前端编程能力确实强。但上线三天就因算力见顶暂停C端新用户注册。模型再强,算力跟不上,用户就体验不到。

Qwen3.8没有这个问题。不是因为它比K3轻,而是因为阿里云的算力底盘足够厚。 illust_01_2.4T生态


算力层:真武超节点,国产芯片的「超节点时刻」

7月23日这个消息,在我看来比Qwen3.8本身更重要。

真武M890超节点,64张国产芯片通过ICN Switch 1.0互联,800GB/s高速互联带宽,9TB显存。单实例就能跑通2.4T参数的Qwen3.8,Agentic推理场景下性能提升1.5倍。

几个关键数字值得记住:

64张国产芯片,不是英伟达。800GB/s互联,不是NVLink。9TB显存,单实例支撑2万亿参数模型。

这是国内首个成功运行超2万亿参数模型的超节点。而且从芯片到互联到软件栈,全部自研。

坦率地讲,真武M890和英伟达的H100/B200相比,单卡性能还有差距。但超节点的意义不在于单卡,在于系统。64张卡互联成一个整体,把单卡的短板用系统级能力补上。这是国产AI芯片从「能跑」到「能用」的关键一步。

超节点,正在成为AI算力的新计量单位。 过去我们比的是「多少张卡」,以后比的是「多少个超节点」。 illust_02_真武超节点


信号层:黄仁勋为什么要挺中国AI开源

黄仁勋7月21日的采访,很多人没看懂。

他不是在说客套话。他是英伟达的CEO,英伟达的生意是卖算力。中国AI开源越活跃,中国AI公司对算力的需求越大,英伟达的芯片就卖得越多。

他挺中国AI开源,挺的是自己的生意。

但更深层的原因,是他看到了一个趋势:中国AI正在从「追赶」变成「并跑」。DeepSeek、Kimi、Qwen、GLM、MiniMax,这些模型已经不是「低配版GPT」,而是有自己技术路线的独立选手。

他点名的那六家公司,覆盖了从基础模型到应用的全链路。这不是随口一说,是英伟达对中国AI生态的正式认可。

而且他说了一句很有意思的话:「美国会长期存在,中国也会长期存在。」

这句话的潜台词是:AI竞争不是谁取代谁,而是谁能在自己的生态里跑得更快。 illust_03_黄仁勋挺AI


三条线汇合:中国大模型的「超节点时代」

把这三条线放在一起看,图景就很清晰了。

模型层,Qwen3.8 2.4T参数,国产模型第一次进入「仅次于Fable 5」的讨论范围。算力层,真武超节点64卡互联,国产芯片第一次跑通超2万亿参数模型。信号层,英伟达CEO公开认可中国AI生态。

三条线,指向同一个判断:中国大模型正在进入「超节点时代」。

这个「超节点」有两层含义。

第一层是技术层面的。超节点架构让国产芯片通过系统级能力弥补单卡差距,为大规模模型部署提供了可行的路径。

第二层是产业层面的。模型、算力、生态三个环节开始形成正向循环。模型越强,对算力的需求越大,推动算力基础设施升级;算力越强,模型能跑得更大,推动模型能力提升;生态越完善,开发者越愿意进来,推动整个系统加速运转。

这个飞轮,正在转起来。 illust_04_三条线汇合


开发者怎么应对

回到最实际的问题:这件事对你意味着什么?

短期来看,Qwen3.8的Token Plan 39元/月,兼容两套API协议,值得上手试试。 特别是如果你用Qoder或QoderWork,几乎零切换成本。

中期来看,国产芯片的超节点化是一个重要信号。 如果你的项目涉及大规模模型部署,现在就应该关注真武芯片的生态进展。不是说要马上迁移,而是保持关注,等生态成熟的时候能快速决策。

长期来看,中国AI正在从「单点突破」走向「系统级能力」。 模型、算力、芯片、工具链,四个环节的协同效应,会比任何单一突破都更有杀伤力。 illust_05_飞轮转起来

黄仁勋说中国AI模型「非常优秀」,不是客套,是事实。

而支撑这个事实的,是正在运转的「超节点」飞轮。

AI GPT API DeepSeek Qwen 编程