Home
avatar

杨晏

国产开源大模型,正在完成一次「双线突破」

国产开源大模型,正在完成一次「双线突破」

cover_封面

7月27日,一个值得记住的日子。

今天,月之暗面按承诺开源了Kimi K3的完整权重。2.8万亿参数,896个专家,100万token上下文,MIT协议。 全球最大开源模型,正式面向所有人开放。

与此同时,另一条战线也在悄然推进——国产AI编程工具正在从Claude Code后门事件的阴影中,抢夺海外工具的市场份额。智谱的GLM-5.2在FrontierSWE上只差Opus 4.8一个百分点,阿里的Qoder在中文场景已经超越海外工具,腾讯的CodeBuddy NPC刚刚发布了自主Agent模式。

这两条线,一个指向「模型能力」,一个指向「工具落地」,正在同时发生。我觉得这个趋势,比单一的技术突破更有意思。 illust_01_冰山真相


2.8万亿,不是堆参数,是效率革命

先说Kimi K3本身。

2.8万亿参数,这个数字确实炸裂。但我想说的是,参数规模本身不是重点,重点是怎么用这2.8万亿。

K3用的是MoE(混合专家)架构,896个专家,每次推理只激活16个。打个比方,医院有896个科室,你感冒了只去呼吸科,不用全院出动。所以虽然总参数量是2.8万亿,但单次推理的激活参数只有约50B,算力消耗并没有等比膨胀。

真正让K3站上顶级的,是两个自研架构创新:

KDA(Kimi Delta Attention)混合线性注意力。传统Transformer模型读100万token,是逐字逐句算注意力,复杂度是O(n²),长文本越读越慢。K3的KDA把复杂度降到了近似线性,同时KV Cache压缩了75%。同样的算力,能处理4倍长的上下文。

AttnRes(注意力残差)。信息在100多层网络里穿行,没有接力站的话,传到后面信号就衰减了。K3每层都加了「注意力残差」,让深层网络的信息不丢失。这个技术,核心贡献者之一是一位深圳17岁少年。

这两项配合,K3的扩展效率比上一代K2提升了2.5倍。用更少的算力,产出更多的智能。


illust_02_896专家

前端编程全球第一,马斯克点了赞

K3发布四天后,第三方盲测平台LMArena的Frontend Code Arena榜单更新了。

K3以1679分登顶,超过Claude Fable 5的1631分和GPT-5.6 Sol的1618分。 七个前端细分领域,K3拿下了六个第一。

这是历史上第一次有开源模型在权威编程榜单上超过全部海外闭源模型。

马斯克在一个第三方评测帖下公开回复了四个字:「令人印象深刻。」

综合能力方面,Artificial Analysis的评测显示K3综合得分57分,全球排名第三,落后于Claude Fable 5的60分,但超过了Claude Opus 4.8。Vals AI的CEO评价说,K3综合性能稍逊于Fable 5,但已超越GPT-5.6 Sol。

坦率讲,这不是全面超越,但这是开源模型第一次摸到天花板。 以前我们讨论「开源接近闭源」的时候,中间总隔着一层模糊的滤镜。但这次,是实打实的榜单数据。


价格也涨到了美国档

K3的定价很有意思。

每百万token,缓存命中输入0.30美元,未命中输入3美元,输出15美元。后两项跟Anthropic Sonnet 5完全一样。

中国大模型,第一次照着美国大模型的价目表收钱。

以前国产模型的价格战是「打骨折」——DeepSeek V4输出0.87美元/百万token,GLM-5.2输出4.2美元,都是远低于海外竞品的定价策略。但K3直接对标Sonnet 5,输出15美元,比自家K2贵了将近10倍。

这个信号很明确:月之暗面认为K3的产品力已经可以支撑美国档定价了。

当然,权重是开源的,7月27日(今天)已经放出。FP4量化后仍需约1.4TB显存,虽然个人开发者跑不动,但企业用户可以用自己的算力集群部署,不用按API付费。


illust_03_登顶

另一条线:国产AI编程工具正在抢市场

K3的发布,恰好赶上了Claude Code后门事件引发的国产替代潮。

7月9日工信部预警,阿里全面禁用Claude Code,这件事在开发者圈子里震动很大。一个会在你代码里藏后门的工具,能力再强,谁敢用?

而国产AI编程工具,恰好在这个时间点集体交卷。

Qoder(阿里):通义千问QWIN编码专用模型,Quest Mode/Agent Mode,跨文件重构成功率70%,中文场景体验明显优于海外工具。月费59元。

CodeBuddy NPC(腾讯,7月23日发布):云端智能体,开发者下发任务后自动完成方案规划→编码→PR→测试全流程,Token降幅超90%。

ZCode 3.0 + GLM-5.2(智谱):全面切换自研Agent内核,GLM-5.2开源,FrontierSWE 74.4%仅落后Opus 4.8一个百分点,Code Arena全球可用模型第一。而且完全免费,MIT协议。

Kimi K3本身也是一款编程工具。 它在前端代码能力上全球第一,100万token上下文意味着可以一次性读完整套代码库做重构。而且权重开源,企业可以本地部署,数据安全完全可控。 illust_04_价格对标


双线突破,指向同一个方向

把这两条线放在一起看,你会发现一个有意思的格局:

模型层,Kimi K3和GLM-5.2正在把开源模型的天花板往上推。K3在编程榜单上超越闭源,GLM-5.2在FrontierSWE上只差1个百分点。开源模型不再是「可以用但不够好」的备胎,而是真正可选的方案。

工具层,Qoder、CodeBuddy、ZCode、K3正在形成完整的国产AI编程工具链。从IDE插件到CLI工具到云端Agent,每个环节都有国产替代方案。而且没有后门风险,没有封禁隐患。 illust_05_双线突破

以前我们讨论国产替代,多少带着点「没办法」的无奈。但这次不一样。 K3在前端编程上打败Fable 5,不是靠政策保护,是实打实的1679分。

这条赛道可能还跑不到最前面,但至少,赛道是自己的。

而且今天,权重开源了。你可以去下载,自己试试。

你怎么看呢?

AI GPT Claude Anthropic API DeepSeek