Home
avatar

杨晏

国产开源双雄对决:K3 vs Qwen3.8,两条路线谁更狠

国产开源双雄对决:K3 vs Qwen3.8,两条路线谁更狠

cover_封面

7月16日,Kimi K3 2.8T发布。7月19日,Qwen3.8 2.4T官宣。7月21日,Qwen3.8更新版本,前端能力再提升。

一周之内,两个万亿级开源模型,正面撞上了。

这不是巧合。这是国产大模型从「追赶」到「对攻」的转折点。过去一年,国产模型的竞争逻辑是「谁先追上GPT」;现在,变成了「谁先跑通自己的路线」。

K3和Qwen3.8,恰好代表了两种完全不同的路线。


参数之战:2.8T vs 2.4T

先看硬指标。

Kimi K3,总参数2.8万亿,896专家中激活16个,激活参数约50B级别。KDA混合线性注意力,注意力残差结构,原生视觉理解,100万token上下文。

Qwen3.8,总参数2.4万亿,激活参数288B。MoE+DSAG动态稀疏自适应门控,推理效率官方称提升47%。兼容OpenAI和Anthropic两套API协议。

2.8T和2.4T,差4000亿参数。 但真正的差距不在总参数量,在激活参数。

K3的激活参数约50B,Qwen3.8的激活参数288B。K3的稀疏度更高,同样跑一次推理,算力消耗远低于Qwen3.8。但Qwen3.8的激活参数更多,理论上单次推理的能力上限更高。

这是两种不同的MoE哲学。 K3走极致稀疏路线,用896个专家覆盖更多知识面,每次只激活最相关的16个。Qwen3.8走少而精路线,激活参数占比更高,每个token能调用的模型能力更充分。

谁的路线对?没有标准答案。但有一个事实:K3上线三天就因算力见顶暂停C端新用户注册,而Qwen3.8通过Token Plan的39元/月直接面向开发者开放。

极致稀疏降低了推理成本,但2.8T参数的开源权重,部署门槛依然高到离谱。

illust_01_参数之战


定价之战:按量付费 vs 订阅制

K3的API定价:输入3/百万token(缓存命中3/百万token(缓存命中0.3),输出$15/百万token。

Qwen3.8的定价:Token Plan个人版39元/月起,兼容两套API协议。白天Credits1折,夜间再享2折,实际低至0.2折。

两种定价逻辑,两种商业模式。

K3走的是「按量付费」路线,对标Claude Sonnet的定价档位。输出15/百万token,比ClaudeFable515/百万token,比Claude Fable 5的50便宜70%以上,但比前代K2.6贵了6倍。月之暗面在把K3从「中端性价比」重新定位为「前沿智能」。

Qwen3.8走的是「订阅制」路线,39元/月打包价。这不是模型定价,是生态定价。阿里不指望靠卖模型赚钱,而是靠Qoder、QoderWork、阿里云整个生态变现。模型只是入口。

K3在卖算力,Qwen3.8在卖生态。

一个数据能说明问题:Qoder已经拿下了中国AI编程市场47.6%的营收份额。模型升级直接反哺工具链,工具链的用户增长又反哺模型迭代。阿里这套飞轮,转起来了。 illust_02_定价之战


生态之战:开源 vs 工具链

K3承诺7月27日前开源权重,Apache 2.0协议,零商业限制。这是全球首个3T级开源模型,权重文件几百GB,没有8张H100级别显卡连跑都跑不起来。

Qwen3.8也承诺开源,但时间未定。目前Preview阶段已上线Token Plan、Qoder、QoderWork和千问PC端。

开源和开放,是两条完全不同的路。

K3选择开源,赌的是社区力量。权重放出去,社区开发者会帮你做适配、优化、落地。但这条路的问题是:2.8T参数的模型,社区开发者里有几个人能跑?DeepSeek从开源到生态成熟,用了将近一年。

Qwen3.8选择开放,赌的是生态闭环。模型通过Token Plan和Qoder触达开发者,数据留在阿里生态内,模型迭代和用户增长形成正向循环。这条路的问题是:开发者用得越深,对阿里的依赖越强。

K3赌的是「开源的力量」,Qwen3.8赌的是「生态的粘性」。 illust_03_生态之战


算力之战:谁卡住了谁的脖子

算力这个话题绕不开。

K3上线三天就暂停C端新用户注册,原因就是算力见顶。2.8T参数的模型,跑一次推理的算力消耗是前代K2.6的几倍。月之暗面在算力储备上,显然没预料到需求会这么猛。

Qwen3.8没有这个问题。阿里云的算力储备,是中国互联网公司里最大的。从数据中心到芯片,阿里有完整的算力基础设施。

算力,正在成为国产大模型分化的关键变量。

那些参数规模最大、但算力储备不足的模型,会先遇到天花板。那些算力充足、但模型能力不够强的,会先遇到性能天花板。两条线都走到极限之前,拼的是谁先补齐短板。 illust_04_算力之战


开发者怎么选

回到最实际的问题:作为开发者,你用K3还是Qwen3.8?

我的判断分三种场景。

前端编程。 K3在Frontend Code Arena 1679分登顶,7个细分领域6个第一。前端开发,K3是目前开源模型里的最优解。而且7月27日权重开源后,可以本地部署,数据安全可控。

全栈开发+办公场景。 Qwen3.8在代码工程和专业办公场景有专项优化,加上Token Plan 39元/月,兼容两套API协议,切换成本几乎为零。如果你主力用Cursor或Claude Code,Qwen3.8是更省心的选择。

成本敏感型任务。 夜间批处理、非实时推理,DeepSeek V4的峰谷定价仍然是最优解。高峰时段翻倍后也才$1.74/百万输出,比K3和Qwen3.8都便宜。

别急着选边站。 窗口期还有6个月,足够你跑三轮测试。去试试K3的API,去跑跑Qwen3.8的预览版,去算算哪个方案在你的场景里性价比最高。 illust_05_开发者怎么选

开源双雄的时代,选择权在开发者手里。

AI GPT Claude OpenAI Anthropic Cursor