Home
avatar

杨晏

全球首个3万亿开源模型,前端编程把Claude Fable 5拉下王座

全球首个3万亿开源模型,前端编程把Claude Fable 5拉下王座

cover_封面

7月16日凌晨,月之暗面放出Kimi K3。

2.8万亿参数,全球首个开源3万亿级别模型。

这不是重点。重点是,它在Arena前端编程盲测里,把Claude Fable 5拉下来了。


illust_01_开源追到闭源门口

1679分,Claude Fable 5排第二

Arena Code Arena是匿名盲测平台,用户看不到模型名字,只根据生成代码的质量投票。

Kimi K3拿了1679分,第一。

Claude Fable 5,1631分,第二。

GPT-5.6 Sol,1618分,第三。

上一代Kimi K2.6排第18。一代产品,狂涨17名直接登顶

7个细分领域,K3拿了6个第一。 illust_02_1679分登顶


开源追到闭源门口了

Artificial Analysis综合榜单上,Kimi K3拿57分排第四。前三分别是Claude Fable 5(60分)、GPT-5.6 Sol(59分和58分,不同思考强度)。

Claude Opus 4.8是56分。GPT-5.5是55分。都在K3后面。

月之暗面自己也没回避差距。官方技术博客原话,「虽然Kimi K3的整体表现仍落后于最强的闭源模型Claude Fable 5和GPT-5.6 Sol,但在我们的整套评测中展现出前沿水平的能力,并稳定超过了其他所有模型。」

AI研究者Nathan Lambert评论了一句,「关于中国模型是蒸馏出来的说法,可以停了。中国确实擅长做模型。」

> K3还没正式发布,就被网友在Arena上扒了出来。化名「Kivine」,提前偷跑。

开发者@chetaslua拿Kimi K3和GPT-5.6 Sol做了一轮正面对比,「如果我把Kimi K3的名字换成Fable 5,你会直接相信。两者都能实现相同的结果,但Kimi更有创造力。」 illust_03_价格三分之一


价格不到Fable 5的三分之一

Kimi K3 API定价,输入20元/百万token,输出100元

编程场景缓存命中率超过90%,实际输入成本大约只有标价的四分之一。

作为对比,Claude Fable 5输出定价约360元/百万token,GPT-5.6 Sol约216元。

Kimi K3不到Fable 5的三分之一。

这可能是第一次,一个国产开源模型能真正和闭源顶级模型掰手腕,同时价格压到对手零头。 illust_04_48小时芯片


KDA和注意力残差,2.5倍扩展效率

Kimi K3基于Kimi Delta Attention(KDA)混合线性注意力机制和**Attention Residuals(注意力残差)**技术构建,原生支持视觉理解,100万token上下文窗口。

相比上代K2,整体扩展效率提升约2.5倍

它面向长程编程、知识工作和复杂推理设计。实际能力演示里有两个比较炸的案例。

48小时自主设计芯片。K3在48小时内独立设计并验证了一款用于运行自身架构Nano模型的芯片,从架构到验证全闭环。

56段素材剪出品牌视频。视频剪辑任务中,用56段原始素材剪出品牌视频,完成选片、动作匹配剪辑、逐帧卡点、音频处理,以及多轮修改。

Agentic Coding能力上,K3支持大型代码库理解、工具调用、测试执行,并能根据反馈持续调整任务方案。结合视觉推理能力,它还能根据运行结果和截图实现「看见输出,即时优化」的视觉闭环,适用于游戏开发、前端设计和CAD场景。


illust_05_开源端碗上桌

开源不再是Plan B

Kimi K3的意义不只是「国产模型又进步了」。

3万亿开源 + 前端编程登顶 + 价格1/3,这三件事放在一起,说明开源模型已经从「Plan B」「便宜替代」走到「能打主力的位置」。

Claude Fable 5和GPT-5.6 Sol的综合能力仍然领先,但差距已经从「代差」缩小到「3分以内」。

而K3是开源的。任何人都能下载、微调、部署。

> 以前是「闭源吃肉,开源喝汤」。现在开源端着碗上桌了。

7月17日,Kimi K3已同步在Kimi网页版、App、Kimi Work桌面客户端、Kimi Code以及Kimi API开放平台上线。

试试看,免费的。

AI GPT Claude API 编程 模型