GPT-5.6把价格砍一半,DeepSeek把推理速度翻倍,AI编程工具的利润要没了
GPT-5.6把价格砍一半,DeepSeek把推理速度翻倍,AI编程工具的利润要没了

一、三档定价,OpenAI在打价格战
6月27日,OpenAI发布GPT-5.6系列,三款模型,三个名字,三档价格。
旗舰版Sol,输入5美元/百万token,输出30美元。均衡版Terra,输入2.5美元,输出15美元。轻量版Luna,输入1美元,输出6美元。
这个价格意味着什么,对比一下就清楚了。
Claude Fable 5,输入10美元,输出50美元。GPT-5.6 Sol比Fable 5便宜了一半。
Luna更是夸张,输出6美元,是Fable 5的零头都不到。
OpenAI不是在跟你比谁模型强了,是在用价格直接碾你。你SWE-Bench Pro跑分高,无所谓,我价格是你一半,开发者用脚投票。
而且这次定价策略明显是分场景卡位。Sol打复杂推理,Terra打日常平衡,Luna打高速低成本。一个模型家族覆盖从重度到轻量的全部需求。
Cursor和Claude Code的商业模式直接被威胁了。
Cursor Pro月费20美元,底层用Claude和GPT模型。如果GPT-5.6 Luna输出只要6美元,Cursor的模型成本骤降,但用户也会想,我为什么不直接用Codex,省掉中间商? 
二、Claude Code的处境更尴尬
Anthropic这边的问题更大。
Fable 5确实强,SWE-Bench Pro 80.3%是事实。但定价是GPT-5.6 Sol的两倍,开发者会算账。
更麻烦的是,OpenAI上周刚推出了30天免费迁移政策,企业用户迁移到Codex,2个月免费用量,桌面端内置迁移工具,Claude Code的system prompts、custom skills、chat history、MCP server配置一键全搬。
价格砍一半,迁移成本打到零。
这不是竞争,这是清场。
Anthropic的反制是Claude Tag,6月23日发布的AI虚拟同事,嵌入Slack,从开发者工具升级为团队协作平台。65%代码由Claude Tag生成这个数据确实硬,但Tag是给团队用的,跟Codex抢的是不同赛道。
个人开发者这边,Claude Code的性价比正在快速流失。 
三、DeepSeek DSpark,推理速度翻倍
就在GPT-5.6发布的同一天,6月27日,DeepSeek联合北京大学开源了DSpark推理加速框架。
推理速度提升60%到85%。
这个数字什么概念,原来等3秒的回复,现在1秒出头就回来了。高并发场景下提升更明显。
DSpark的核心技术是半自回归结构加置信度动态验证机制。传统推测解码一次生成多个token,但token之间关联不足,被拒绝比例高,浪费验证算力。DSpark在并行生成骨干上加入轻量级顺序模块,增强token之间的依赖关系,提高草稿质量。同时根据不同请求的成功概率和系统负载,自适应调整验证长度,减少无效计算。
实测数据,以Qwen3-4B为例,相比Eagle3提升30.9%,相比DFlash提升16.3%。单轮有效生成长度全面优于主流基线。
DSpark已经部署在DeepSeek-V4-Flash和DeepSeek-V4-Pro的预览版服务引擎中。论文、训练代码、模型检查点全部在GitHub的DeepSpec项目开源。
梁文锋署名。 
四、中小团队接入大模型的成本崩塌
DSpark对中小团队意味着什么,算一笔账。
以前中小团队接入大模型,最大的成本不是模型本身,是推理算力。你用千亿参数模型,要么买A100集群,要么按token付费给云厂商。高并发场景下,推理成本能占到总成本的70%以上。
DSpark把推理速度提升60%到85%,等价于同样的硬件能服务1.6到1.85倍的请求量。
推理成本直接打六折。
再加上DeepSeek V4-Pro本身的定价已经是永久2.5折,输出6元/百万token,缓存命中0.025元。DSpark加持后,实际推理成本可能再降一半。
一个中小团队,月调用1亿token,原来用Claude Fable 5要花5000美元。换DeepSeek V4-Pro+DSpark,可能只要300美元。
差了16倍。
这不是理论数字,是实际可计算的成本差异。DeepSeek的开源策略让中小团队第一次有了”用得起”的前沿模型推理方案。

五、AI编程工具的利润空间正在消失
把GPT-5.6定价和DSpark开源放一起看,你会发现一个趋势。
AI模型的边际利润正在快速归零。
OpenAI用三档定价把价格压到竞品一半,DeepSeek用DSpark把推理成本再砍一半。上游模型方在降价,下游工具方在开源。夹在中间的AI编程工具,利润空间被两头挤压。
Cursor月费20美元,Claude Code按token计费。但当GPT-5.6 Luna输出只要6美元,当DeepSeek V4-Pro+DSpark的推理成本低到可以忽略,用户会越来越难接受中间商赚差价。
未来会怎样,两条路。
一条路是工具方也开源。 OpenCode已经17万星,完全开源免费。MonkeyCode接入M3,每天500亿token免费。工具免费,靠增值服务赚钱。
另一条路是工具方做深生态。 Claude Tag走的就是这条路,从开发者工具变成团队协作平台,嵌入Slack,嵌入工作流。你买的不是模型调用,是团队协作体验。
纯粹的模型调用中间商,活不下去了。

AI编程工具的战争,从比模型到比价格到比生态,最终会比谁活得久。