2026 AI 编程模型价格战打到什么程度了?我算了一笔账
2026 AI 编程模型价格战打到什么程度了?我算了一笔账

半年时间,高端编程模型的价格跌了 97%。
不是夸张。7 月 24 号 Anthropic 发了 Opus 5,价格跟 Opus 4.8 一样,性能逼近旗舰 Fable 5,等于直接把 Fable 5 打了五折。
这还没完。7 月 28 号 xAI 的 Grok 4.5 入驻 GitHub Copilot,7 月 30 号面向 Cursor 全量开放。输入 2 美元/百万 token,输出 6 美元。不到 Fable 5 的十分之一。
而 DeepSeek V4 早就把开源模型的底价打到地板了。Flash 版本输入 0.14 美元/百万 token,输出 0.56 美元。
这不是价格战。
这是定价权重构。
Opus 5 半价镜像
7 月 24 号,Anthropic 悄悄发了 Opus 5。没有轰轰烈烈的发布会,一篇官方博客就上了。
数据不低调。
Frontier-Bench v0.1 上分数是 Opus 4.8 的两倍多。ARC-AGI 3 甩第二名三倍。CursorBench 3.2 最高努力模式只比 Fable 5 峰值低不到 1%。IMO 2026 满分 42/42,没靠任何外部工具和 Agent 框架。
关键是价格。Opus 5 输入 5 美元/百万 token,输出 25 美元,跟 5 月的 Opus 4.8 一样。Fable 5 是 10/50。半价拿到 95% 的性能。
算一笔。你每个月用 Claude Code 跑 5000 万 token 输出。
Fable 5:2500 美元
Opus 5:1250 美元
省 1250 美元,性能几乎没掉。
Anthropic 这步棋走得很聪明。Fable 5 锚定「最贵最强」,Opus 5 锁定「性价比旗舰」,中间形成一个定价梯度。开发者想省钱就降档,想冲性能就升档,但钱都流回 Anthropic 口袋。

Grok 4.5 多模型混战入场券
7 月 28 号,SpaceXAI 宣布 Grok 4.5 入驻 GitHub Copilot。7 月 30 号,面向 Cursor 所有套餐用户开放。
两个月前还只在 Grok Build 里能用,现在直接铺到全球最主流的两个编程平台上。
Grok 4.5 的定位很清楚。输入 2 美元、输出 6 美元/百万 token,500K 上下文,支持文本+图像输入,三种推理难度可选。为「快速编码和复杂多步骤工作流」设计。
这个定价很有意思。比 Opus 5 便宜一半以上,比 DeepSeek V4-Pro 贵一些。正好卡在闭源性价比和开源地板价之间的无人区。
让我更在意的不是价格本身。是 Copilot 的多模型策略。
GitHub Copilot 之前主要绑 OpenAI 系模型,现在官宣支持切换 Grok 4.5,后面很可能还会加其他模型。编程助手从单模型绑定走向多模型路由,开发者选模型像选手机套餐一样自由。
Cursor 走得更远。同时支持 GPT-5.6、Claude Opus 5、Grok 4.5 等多个模型,开发者可以在同一个 IDE 里根据不同任务切换。
模型不再是壁垒,路由和编排才是。 
DeepSeek V4 开源地板价还在往下打
DeepSeek V4 是四月底发的,但在价格战里,它一直在扮演压舱石。
V4-Pro:1.6T 参数,49B 激活,输入 1.74 美元、输出 3.48 美元/百万 token。V4-Flash:284B 参数,13B 激活,输入 0.14 美元、输出 0.56 美元。
100 万 token 上下文,MIT 开源。
SWE-Bench Verified 上 V4-Pro 拿 58.2%,比不过 Claude、GPT 的旗舰。但考虑到价格和开源身份,这个成绩相当能打。
更重要的是,V4 的价格是永久降价。之前 2.5 折优惠期结束后,直接永久按 1/4 原价执行。中文场景下,输出只要 6 元/百万 token,缓存命中降到 0.025 元。
不是打折。是永久性的定价重置。
一张表看懂现在的价格格局(以下均为每百万 token 计)
Claude Fable 5: 入 10 / 出 50 美元,1M 上下文,最贵旗舰
Claude Opus 5: 入 5 / 出 25 美元,1M 上下文,性价比旗舰
GPT-5.6 Sol: 入 5 / 出 30 美元,1.5M 上下文,通用旗舰
GPT-5.6 Terra: 入 2.5 / 出 15 美元,1.5M 上下文,日常主力
Grok 4.5: 入 2 / 出 6 美元,500K,快速编码
GPT-5.6 Luna: 入 1 / 出 6 美元,1.5M,轻量
DeepSeek V4-Pro: 入 1.74 / 出 3.48 美元,1M,开源旗舰
DeepSeek V4-Flash: 入 0.14 / 出 0.56 美元,1M,开源地板
从 Fable 5 到 V4-Flash,输出价格差了 89 倍。 
这意味着什么
几个我自己的判断。
第一,模型能力天花板已经不是竞争焦点了。 当 Opus 5 半价就能拿到接近 Fable 5 的性能,那几个百分点的分数差失去了实际意义。用户关心的是:某件事,用哪个模型做,成本最低。
第二,编程 Agent 会迎来第二波爆发。 半年前的 Agent 热潮被算力成本卡住。跑一个复杂任务动辄几十万 token,根本烧不起。现在输出价格从 50 美元掉到 0.56 美元,Agent 的每任务成本下降了俩数量级。以前不敢让 Agent 做的事,现在可以放手做了。
第三,多模型路由成为基础架构。 Copilot 接 Grok,Cursor 跑多模型,Claude Code 也支持切换底座。模型不再是单一选择,而是在一个工作流里动态路由。谁的路由层做得好,谁就拿到了下一轮竞争的入场券。
最后关于 DeepSeek。
7 月 29 号有消息说 V4 正式版可能延到 8 月中旬,同时 Harness 团队开启了内测。如果 V4 正式版在 SWE-bench 上冲到 65%+,配上目前的地板价和百万上下文,「开源模型足够好且足够便宜」会从一个判断变成基础设施级的现实。
到那时候,模型价格战就不再是战了。
是定局。 
数据截至 2026 年 7 月 30 日。API 价格均为标准计费模式,不含批量折扣和订阅套餐。