DeepSeek搞峰谷定价,MiniMax搞2.7万亿参数
DeepSeek搞峰谷定价,MiniMax搞2.7万亿参数

一、两封邮件,两种信号
7月8日,两件事在同一天被爆出来。
DeepSeek给开发者发了一封邮件。V4正式版计划7月中旬上线,同步引入峰谷定价。高峰时段API价格翻倍。上午9点到12点,下午2点到6点,基本上就是工作时间的全部。
MiniMax被The Information和路透社爆出正在研发2.7万亿参数的新模型,内部代号M3 Pro,计划Q3发布并开源。4280亿参数的M3是6月15日刚开源的,两个月不到,2.7T已经在路上了。
一个在改游戏规则,一个在冲天花板。 
二、DeepSeek的峰谷定价,到底谁受影响
先看具体数字。V4 Pro高峰时段,缓存未命中输入从3元涨到6元/百万token,输出从6元涨到12元。V4 Flash高峰输入从2元涨到4元,输出从4元涨到8元。非高峰时段维持原价不变。
腾讯云已经发了公告,7月中旬同步跟原厂调整。
受影响最大的,是把DeepSeek绑在工作流里的开发者。 早上9点开始跑批处理,下午2点开始推Agent任务,这些时段正好是高峰。如果没法把任务改到凌晨跑,成本直接翻倍。
但换个角度想,DeepSeek V4 Pro非高峰输出6元/百万token,高峰12元。GPT-5.6 Sol输出30美元。Grok 4.5输出6美元。Claude Opus输出25美元。12元人民币约1.7美元,依然是大厂模型里最便宜的。 价格战的领先优势太大,翻倍也没翻到对手的水平。
DeepSeek的邮件说得很清楚,目的是「更合理地配置资源、提升服务稳定性」。坦率的讲,开源模型的API调用是一个很难算的经济账。没有峰谷定价,所有人都挤在工作时间用,服务器压力峰值拉满,非高峰闲置。峰谷定价能平滑负载曲线,理论上服务会更稳定。
峰谷定价未必是涨价,是算力资源的市场化分配。 
三、MiniMax的2.7万亿参数,拼什么
M3 Pro的消息更让人兴奋。
MiniMax M3是6月15日刚开源的,4280亿参数,激活23B,SWE-Bench Pro 59%超GPT-5.5。现在M3 Pro的2.7万亿参数是M3的6倍多。
如果按计划开源,这将是全球参数规模最大的开源模型。 目前最大的是美团LongCat-2.0的1.6T。M3 Pro直接拉到2.7T,如果激活参数能控制住,推理效率跟得上,那影响力不是量变是质变。
关键参数还需要等更多细节。2.7T总参数意味着什么?激活参数多少?上下文多长?训练用了多少算力?定价怎么给?这些决定了M3 Pro到底是宣传用的参数竞赛还是真正能用得上的工具。
但有一点可以确认。MiniMax在国产大模型里走出了自己的节奏。 M3主打编程和Agent,SWE-Bench Pro直接对标GPT-5.5。M3 Pro瞄准的是更大更复杂的逻辑推理和多步任务处理。不是一个方向反复叠加,是在往上探天花板。

四、国产大模型的两种活法
DeepSeek和MiniMax,代表了国产大模型的两种打法。
DeepSeek走的是生态定价路线。 用永久降价抢开发者,用峰谷定价优化算力资源。V4 Pro 6元/百万token的非高峰价格,距离GPT-5.6 Sol的30美元大约差了35倍。这不是价格战,这是在重新定义「AI API应该值多少钱」。
MiniMax走的是开源突破路线。 M3在编程赛道对标GPT-5.5,M3 Pro用2.7T参数往上冲。从428B到2.7T,6倍跨度。而且都开源。不是闭门造车,是让全球开发者都用得上。
两种活法背后是同一个判断。中国大模型不能只做追随者。 DeepSeek在价格上做先行者,MiniMax在参数规模上做先行者。一个向下拉地板,一个向上探天花板。

五、开发者的算盘
对开发者来说,两件事意味着什么。
先算DeepSeek的账。 如果你的工作流不是必须在工作时间跑,调整到凌晨或周末,成本不变。如果必须在工作时间跑,翻倍之后的12元/百万token还是GPT-5.6 Sol的1/17。大部分场景下,迁移的成本比峰谷差价高得多。
再掂量MiniMax的重量。 M3 Pro Q3开源,如果激活参数控制得当(比如激活300-500B),推理效率跟得上,那会成为又一个可以替代GPT-5.5的选择。而且开源意味着可以本地部署,没有峰谷定价的困扰。 
DeepSeek在用价格教育市场。MiniMax在用参数推动开源。两个方向同时往前走,最终受益的是开发者。
峰谷定价不是坏事,2.7T也不是终点。 一个让AI服务更稳定,一个让开源生态更强大。剩下的就看谁先做出下一个真正的突破。