阿里把最强的Qwen开源了,2.4万亿参数,第一次
阿里把最强的Qwen开源了,2.4万亿参数,第一次

8月3日,阿里干了件以前从不干的事。
Qwen3.8-Max 正式发布,并且宣布下周开源完整权重。 这是 Qwen 系列史上第一次把 Max 级旗舰模型开源。
以前阿里开源的都是一些小尺寸模型,真正的旗舰一直捂在 API 后面。这次直接把压箱底的东西拿出来了。
2.4 万亿参数,950 亿激活,100 万上下文,原生多模态。放在一年前,这个配置只能出现在闭源模型的宣传页上。
但真正炸裂的不是参数,是这件事本身。 全球开发者马上就能下载一个性能对标 Claude 的旗舰模型,自己部署,随便改。
16天,没有人类干预,它自己写完了一个项目
先看它干了什么,这比参数更有画面感。
官方演示里,Qwen3.8-Max 从一个空文件夹开始,仅凭一句指令,连续自主开发了大约 16 天,完成了「oh-my-cli」这个自进化智能体框架的开发。
16 天里它自己提交了 265 次 commit、127 个 PR、151 个 Issue,自己写构建脚本、单元测试、端到端测试,还自己配了异常监控和恢复流程。
没有人盯着,没有人干预,没有人为它调试。
这还不是孤例。同一个模型,125 小时复现了一篇涉及上千行代码的研究论文;做芯片设计优化,500 多个步骤的迭代任务,把芯片面积砍掉了 81%。
Frontend Code Arena 基准上,它拿了 1668 分,只比 Claude Opus 5 的最强版本低 37 分,超过了 Meta 的旗舰模型。OSWorld 测试 86.1 分,超过了 GPT-5.6 Sol Max。
这些数字确实漂亮。 但有个细节我得说清楚,这些演示都是阿里官方自产的,还没有被独立评测机构广泛复现。成绩单可以参考,别当实锤。 
比性能更狠的,是价格
如果只是性能强,那它只是又一个「很能打的开源模型」。真正让闭源厂商坐不住的,是价格。
Qwen3.8-Max 的 API 定价,国内输入 12 元/百万 token,输出 36 元/百万 token,隐式缓存命中只要 1.5 元。
国际价格更直接,输入 2 美元,输出 6 美元。作为对比,Claude Opus 5 的输入价格是它的 2.5 倍,输出价格是它的 4 倍多。
用 Opus 5 四分之一的价格,买到接近 Opus 5 的性能。 这个性价比公式,去年还只属于小模型,今年直接套在了旗舰上。
而且它适配 Claude Code、Codex 这些主流开发工具,开发者改一行配置就能换上。还支持三档推理强度,精度和速度自己选。
以前开源模型是「够用但差点意思」,现在是「旗舰级性能 + 白菜价 + 随便部署」三个选项一次给齐。 
闭源旗舰的溢价,正在被一点点拆掉
把这周的新闻叠在一起看,会发现一条清晰的主线。
7 月 30 日,OpenAI 把 GPT-5.6 Luna 的 API 价格砍了 80%,官方口径是被中国开源模型挤压。8 月 3 日,阿里开源 Max 级旗舰。8 月 6 日,OpenAI 干脆把 Luna 免费给 C 端用户无限量用。
DeepSeek 那边,V4-Flash 用 0.03 美元完成一个标准化任务,同档位闭源模型要 1.86 美元。7 月底宣布 API 涨价,但涨完之后依然是全球性价比标杆。
闭源厂商的处境越来越尴尬。 性能优势在缩小,价格优势已经不存在,剩下的卖点只有「省心」和「服务」。当开源模型性能追平、价格便宜几十倍的时候,「省心」这个溢价能撑多久,是个问题。
阿里这次的选择尤其有意思。它不是被逼着开源,而是主动把最强的模型交出去。原因也不难猜,开源能换来生态,生态能反哺云服务。模型本身不赚钱,模型带动的算力、工具、企业服务才赚钱。这招叫「用模型换市场」。 
开源旗舰时代,对普通人意味着什么
说点实际的,这件事对你我有什么影响。
短期看,API 账单会继续降。Qwen3.8-Max 开源后,各种聚合平台、云厂商会跟进上架,价格只会更低。前几天刚说价格战结束了,今天看,模型层的价格战确实在收尾,但开源和闭源的博弈才刚刚开始。
中期看,「最强的 AI」不再只属于大厂。2.4T 的旗舰权重下载下来,企业可以私有化部署,数据不出门,自己微调,这是闭源 API 永远给不了的。对注重数据安全的企业,这是质变。
长期看,开源旗舰会把整个行业的天花板抬高一截。Kimi K3 开源了 2.8T,Qwen3.8-Max 开源了 2.4T,DeepSeek 一直在开源,GLM 下周也要发新版本。当最强模型都开源了,闭源的护城河就只剩下服务和生态。
阿里开源的这一步,比参数本身重要得多。 它宣告了一件事,旗舰模型的竞争,从「谁更强」进入了「谁更开放」的阶段。
这场仗,才刚刚开始。 