阿里跟了。2.4万亿参数,每48小时一个万亿模型
阿里跟了。2.4万亿参数,每48小时一个万亿模型

7月19日深夜,阿里通义千问官宣了Qwen3.8-Max-Preview。
没有发布会,没有技术博客,只有一句官方原话,「这可能是除了Fable 5外,最强大的模型。」
2.4万亿参数。 MoE架构,激活参数约288B。兼容OpenAI和Anthropic两套API协议。宣布即将开源。
三天前,Kimi K3刚以2.8T参数炸场。
三天后,阿里跟上。
国产大模型的发布节奏,已经从「按月更新」卷到了**「每48小时刷新」**。
三天两篇万亿开源,国产模型集体冲线
把时间线拉短到一周:
7月15日,DeepSeek V4峰谷定价上线,高峰时段价格翻倍。
7月17日,Kimi K3 2.8T开源发布,Frontend Code Arena 1679分登顶。
7月19日,Qwen3.8 2.4T预览版官宣,自评仅次于Fable 5。
三天两篇万亿开源。 这个节奏,硅谷一年发一次旗舰,中国一个月发五次。
横向对比一下当前国产模型参数规模:Kimi K3 2.8T > Qwen3.8 2.4T > DeepSeek V4 Pro 1.6T。三家加起来,一周内放出了超过6.8万亿参数的开源或准开源模型。
开源阵营在这一周完成了集体突破。闭源模型的护城河,正在被一点点填平。 
39元用上旗舰模型,夜间0.2折
阿里这次同步推出了Token Plan个人版订阅服务。
定价相当激进。个人版三档:Lite 39元/月,Standard 139元/月,Pro 499元/月。 团队版150元/席位起。
限时优惠更猛。白天Credits消耗1折,夜间(22:00-08
)再享2折,叠加下来实际0.2折。39元,就能调用2.4万亿参数的旗舰模型。
但真正值得关注的不是价格本身,而是兼容两套API协议——OpenAI和Anthropic的格式都支持。这意味着Cursor、Claude Code、OpenClaw这些主流AI编程工具可以无缝切换,迁移成本几乎为零。
千问PC端和Web端还提供免费体验入口。
39元不是让利,是阿里在赌,赌开发者用完就离不开。 先用价格圈人,再用生态锁人。夜间0.2折的价格已经击穿成本线,本质是用补贴换习惯。 
阿里系内部赛马:Kimi vs 千问
一个有趣的背景。
阿里既是Qwen的母公司,也是月之暗面(Kimi)的投资方。Kimi K3和Qwen3.8,同属阿里生态,却在参数规模上正面交锋。
技术路线也有差异。K3走KDA混合线性注意力路线,原生视觉能力,计划7月27日开放权重。Qwen3.8走MoE+动态稀疏自适应门控(DSAG),官方称推理效率提升47%。
两家都在抢「最大开源模型」的话语权。区别在于,K3选择了原生视觉路线,Qwen3.8选择了超大规模MoE路线。
投资了对手,又亲自下场。这不是矛盾,是阿里的赛马机制。 两条路线同时跑,谁先跑通谁就是主力。对用户来说,同一个生态里两条鲶鱼,总有一条会先咬到。 
Qoder占据47.6%编程市场,模型+工具链闭环
Qwen3.8-Max的定位非常明确:代码工程 + 专业办公场景旗舰。
内部评测数据显示,在全栈开发、数据分析、Office工作流等场景,Qwen3.8相比Qwen3.7-Max有显著提升。
Qoder这个阿里旗下的AI编程IDE,已经拿下了中国AI编程市场47.6%的营收份额。模型升级直接反哺工具链。
阿里的布局逻辑很清晰:Qoder(AI编程IDE)+ QoderWork(团队协作端),形成模型+工具链闭环。1M token上下文长度,靠Ring Attention分布式推理支撑。
阿里不只想做模型,更想做「模型+工具」的完整生态。用自己的模型喂自己的IDE,数据飞轮一旦转起来,后来者很难追赶。代码场景是AI落地最直接的变现场景,阿里在这里押了重注。 
开源承诺:soon是多快?
官方原话是「going open-weight soon」,正式版近期发布并开源。预计采用Apache 2.0协议,零商业限制。
对比闭源阵营。Anthropic的Fable 5严防死守,OpenAI的GPT-5.6分三档区隔销售。一个2.4T参数的模型开源,等于将数百亿训练成本送给全球开发者。
但需要注意。目前Preview阶段权重尚未公开,许可证未公布,具体日期未定。
「soon」是AI圈最模糊的时间单位,可以是一周,也可以是半年。 开源承诺和开源兑现之间,隔着一个叫「待定」的深渊。2.4T模型就算开源,部署门槛也不低,没有8张H100级别显卡,普通开发者连跑都跑不起来。
冷静一下
参数不等于能力。「自评仅次于Fable 5」没有第三方验证。Fable 5这个名字在公开渠道信息有限,当对标对象本身存疑时,「仅次于」这个排名也就只剩下营销价值。
开源不等于能落地。2.4T参数的模型,至少需要8张H100级别显卡才能运行,中小企业仍然只能靠API调用。
价格战正在反噬。39元/月的定价,头部厂商的商业化空间被自己压缩。这种补贴能持续多久,谁也说不准。
但无论如何,这一周发生的事值得记住。
Kimi K3 2.8T开源 + Qwen3.8 2.4T官宣 + Token Plan 39元/月 + 兼容两套API协议。 四个信号叠在一起,指向同一个方向——最高级的军备竞赛,不是参数比谁大,而是让每个开发者都用得起顶尖AI。
当开源模型的能力逼近闭源,当39元就能调用万亿参数,这东西真的开始变得像水电一样随手可得了。
Qwen3.8-Max-Preview已经在Token Plan、Qoder和QoderWork上线了。试试看,免费的。