Home
avatar

杨晏

DeepSeek下月涨价,MiniMax M3用2%的成本追平Opus,开发者该怎么选

DeepSeek下月涨价,MiniMax M3用2%的成本追平Opus,开发者该怎么选

图片


一、DeepSeek V4峰谷定价,7月中旬生效

6月29日,多位DeepSeek API用户收到官方邮件,V4正式版7月中旬上线,同时引入峰谷定价机制。

高峰时段价格翻倍。

高峰时段是每日北京时间9:00-12:00和14:00-18

,正好覆盖工作日核心开发时间。其余时段(晚间、夜间、周末全天)维持现行价格。

具体数字,V4-Pro高峰时段,缓存命中输入0.05元/百万token,缓存未命中6元,输出12元。平时段分别是0.025元、3元、6元。直接翻倍。

V4-Flash高峰时段,缓存命中0.04元,缓存未命中2元,输出4元。平时段是0.02元、1元、2元。

听起来涨价不少,但算一笔账。V4-Pro首发价是输入12元、输出24元。即便高峰翻倍后的6元和12元,**仍然比首发价便宜50%**。DeepSeek今年4月先打2.5折,5月宣布永久降价,现在7月又引入峰谷机制,本质上是用价格杠杆把白天高峰流量往夜间引导。 图片


二、避坑省钱攻略,三档策略

峰谷定价对开发者影响很直接。你白天写代码调API,9点到12点、2点到6点,正好全踩在高峰里。月账单直接翻倍不夸张。

怎么避坑,三档策略。

第一档,错峰调用。 批量处理任务放到晚上8点以后或者周末跑。CI/CD流水线、批量代码审查、文档生成这些异步任务,挪到非高峰时段,成本直接砍半。实测把 nightly build 的AI审查从下午3点挪到晚上9点,月省40%API费用。

第二档,缓存优先。 DeepSeek的缓存命中价格是未命中的1/120。V4-Pro平时段,缓存命中0.025元,未命中3元。差了120倍。 重复调用的prompt一定要做缓存,system prompt和few-shot examples固定不变的部分,用prefix caching,命中率能拉到60%以上。

第三档,Flash兜底。 V4-Flash平时段输出只要2元,是Pro的1/3。简单代码补全、格式化、注释生成这些轻量任务用Flash就够了。复杂推理和Agent任务才上Pro。按场景分流,综合成本能再降30%。 图片


三、MiniMax M3,2%成本追平Opus

就在DeepSeek涨价的同一周,MiniMax M3的实测数据出来了。

SWE-Bench Pro 59.0%,超GPT-5.5的58.6%,接近Claude Opus 4.7的64.3%。

BrowseComp浏览器信息检索83.5分,直接把Opus 4.7的79.3甩在身后。Claw-Eval Agent评测最高分。

然后看价格。

M3定价,输入2.1元/百万token,输出8.4元。Claude Opus 4.7,输入约105元,输出约525元。

M3的输出价格是Opus 4.7的1.6%。

不到2%的成本,编程能力逼近同一梯队。这不是打骨折,这是把价格桌子掀了。

而且M3是开源的。196B参数,11B激活,MSA稀疏注意力架构,1M上下文,原生多模态。你可以本地部署,数据不出内网,可以fine-tune,没有API调用上限焦虑。


图片

四、国产模型性价比横评

把当前几个主流模型的输出价格放一起比,每百万token。

Claude Opus 4.7,约525元。 最强编程模型,SWE-Bench Pro 64.3%,但价格是其他所有模型的几十倍。

GPT-5.5,约210元。 Terminal-Bench 2.0 82.7%是标杆,但贵,而且政府管控越来越严。

DeepSeek V4-Pro高峰,12元。 性能对标GPT-5级别,价格是GPT-5的1/17。训练成本约600万美元,对标GPT-4级别。

DeepSeek V4-Flash高峰,4元。 轻量推理够用,是Pro的1/3。

MiniMax M3,8.4元。 开源,编程超GPT-5.5,1M上下文,性价比最高。

小米MiMo-V2.5,约1元。 最高降幅99%,但能力跟上面几个有差距,适合简单任务。

结论很清楚。重度编程任务,M3是当前性价比天花板。复杂推理和Agent,DeepSeek V4-Pro错峰调用。轻量任务,Flash或MiMo兜底。 Opus 4.7留给不差钱的核心场景。 图片


五、开发者的实际选择

说了这么多数据,实际怎么选。

个人开发者,月调用1亿token以内。 首选MiniMax M3通过MonkeyCode,每天500亿token免费额度,大部分个人开发者根本用不完。超出部分按M3定价,8.4元/百万token输出,月费可能就几十块。

小团队,5-10人,月调用5-10亿token。 DeepSeek V4-Pro+DSpark推理加速,错峰调用,缓存优先,Flash兜底。综合月成本控制在500-1000元。同样用量用Claude Opus要5万+。

中大型团队,有敏感数据要求。 M3本地部署,一次性硬件投入,长期边际成本趋近于零。1M上下文能整个项目一次喂进去,不用RAG分块。

需要最强编程能力的核心场景。 Claude Opus 4.7或者GPT-5.5,只在关键路径用,日常用M3和DeepSeek分流。

别当loyalty user。 模型迭代太快,3个月前的最优解3个月后可能就不是了。每季度重新评估一次性价比,随时准备切换。 图片


会省钱的开发者,比会写代码的开发者更值钱。

DeepSeek MiniMax Claude