
刚宣布永久降价一个月,DeepSeek又把价"涨"回去了。
今天(6月29日),多位开发者向蓝鲸新闻确认,已经收到了DeepSeek发送的升级提醒邮件。
核心信息就几条,但每一条都值得仔细看。
DeepSeek V4正式版计划于7月中旬上线。 伴随正式版而来的,是一套全新的定价策略——峰谷定价机制。
简单说就是:平时价格不变,但高峰时段价格翻倍。
高峰时段有两个:上午9点到12点,下午2点到6点。
这两个时间段加起来,刚好覆盖了绝大多数企业的标准工作时间。
具体涨了多少
先上数据。
V4 Pro 高峰时段价格:
| 项目 | 平时价格 | 高峰价格 |
|---|---|---|
| 缓存命中输入 | 0.025元/百万Tokens | 0.05元 |
| 缓存未命中输入 | 3元/百万Tokens | 6元 |
| 输出 | 6元/百万Tokens | 12元 |
V4 Flash 高峰时段价格:
| 项目 | 平时价格 | 高峰价格 |
|---|---|---|
| 缓存命中输入 | 0.02元/百万Tokens | 0.04元 |
| 缓存未命中输入 | 1元/百万Tokens | 2元 |
| 输出 | 2元/百万Tokens | 4元 |
所有价格,高峰时段正好是平时的2倍。
看起来绝对值不高——V4 Pro输出也才12元/百万Tokens。但别忘了,高峰期覆盖了每天最核心的5个工作小时。如果你的业务主要在工作时间调用API,那实际成本不是2倍的问题,而是大部分调用都落在2倍区间的问题。
一个有趣的前后对比
这次峰谷定价之所以引发讨论,很大程度上是因为一个多月前,DeepSeek刚做了一件相反的事。
今年4月,DeepSeek V4预览版上线,当时给了限时2.5折优惠。结果5月份,DeepSeek直接宣布把这个折扣变成永久降价了。
当时的方案是:
V4 Pro从原价直接降到四分之一——缓存命中输入从0.1元降到0.025元,缓存未命中输入从12元降到3元,输出从24元降到6元。
这个价格在当时引起了不小轰动。同行在涨价,它在打价格战。媒体标题都是"DeepSeek永久降价,搅动AI江湖"。
现在回头看,永久降价和峰谷定价,其实是一套组合拳。
先低价抢市场,让开发者把API接进来、把业务跑起来。等生态形成依赖了,再通过峰谷定价把高峰期的成本收回来。
商业上无可厚非,但对开发者来说,实际使用的成本,比"永久降价"那个新闻标题看起来要多。
对谁影响最大
这不是所有人都需要担心的事。
影响最大的群体:在企业办公时间大规模调用API的开发者。
如果你的使用场景是:
那你的实际成本,会比之前计算的多出一截。
影响较小的群体:
对后两类用户来说,DeepSeek在非高峰时段的价格依然是全行业最低那一档。
行业的一个新趋势
DeepSeek不是第一家搞峰谷定价的。
早在今年年初,智谱AI就开始尝试按时间段差异化定价。这种模式在云计算领域很成熟——阿里云、腾讯云的按量付费本来就有峰谷区别。
但在AI大模型API领域,这还是个新东西。
过去两年,各家模型厂商的定价策略经历了几个阶段:
阶段一:统一定价。 不管什么时候调用,都是一个价。简单透明,但高峰期服务器压力大。
阶段二:免费/低价抢市场。 各家烧钱补贴,先把用户圈进来。
阶段三:峰谷定价。 用价格杠杆调节需求,把非刚需用户引流到低峰时段。
DeepSeek V4这一步,基本标志着大模型API从"补贴期"进入了"精细化运营期"。
以前拼谁钱多、谁烧得起。现在拼谁更会定价、谁能把成本结构做优。
写在最后
6月29日这一天,DeepSeek V4正式版定价方案流出,同一天GLM-5.2在Hacker News刷屏——中国AI的两个头部选手,在同一天走了两条完全不同的路。
智谱走的是"性能对标顶尖,全面开源"的路。DeepSeek走的是"极致性价比,精细化运营"的路。
没有对错之分。
但对正在选型的企业开发者来说,理解这些定价策略背后的逻辑,比只看一两个新闻标题重要得多。
"永久降价"和"峰谷翻倍"可以同时为真。 你的实际成本是多少,取决于你的调用模式落在曲线的哪一段。
想清楚这个问题,比纠结"它到底是涨了还是降了"更有意义。
本文由老张整理编写,信息综合自蓝鲸新闻、凤凰网科技、极客公园、驱动之家、证券时报等公开报道。
相关阅读: GPT-5.6发布即受限:白宫要求分批释出的背后 GLM-5.2全面开源:中国AI正在改写全球格局 OpenAI的芯片野心:Jalapeño推理芯片意味着什么