近日,DeepSeek API的新定价策略正式生效,引发了开发者和用户群体的广泛讨论。与许多人预想中的温和调整不同,这次价格变动不仅引入了“峰谷定价”机制,其涨幅之大也着实让不少人感到意外。
新定价体系于8月17日零时启动,最核心的变化是采用了类似电力系统的峰谷计费模式。每日的9:00至12:00和14:00至18:00被划定为高峰时段,价格较高,其余时间则为空闲时段,价格为高峰时段的一半。这一调整覆盖了V4 Flash和V4 Pro两款主力模型。

具体来看,价格上涨幅度相当显著。以更受关注的V4 Pro模型为例,在高峰时段,其输出价格从原先的每百万tokens 6元飙升至27元,涨幅达350%。而此前因价格极低而备受青睐的缓存命中输入,其高峰价格更是从0.025元涨至0.3元,涨幅高达1100%,这也是网络上“最高涨12倍”说法的来源。即便是空闲时段,各项服务的价格也较之前有了明显上浮。
新价格生效后,用户的实际体验与感受差异巨大。许多开发者在社交媒体上分享了他们“一夜惊醒”的账单变化。有用户表示,过去一天消耗几十元已经算重度使用,如今在高峰期同样强度下,短短几小时就可能花费50元。一位开发者通过对比发现,在调用量减少的情况下,其实际成本却翻了近两倍。这种“账单震撼”让不少人感慨,过去那个“便宜到懒得算”的时代已经结束,现在“不掏计算器都不敢点发送”。用户情绪的变化也体现在网络昵称的转变上,DeepSeek创始人梁文锋的称呼从“梁圣”变成了“梁子”甚至“牢梁”,生动地反映了社区心态的转变。

受冲击最直接的是API的重度使用者,尤其是依赖其构建Agent应用的开发者和一些中小团队。对于提供API中转服务的平台而言,上游成本的激增直接导致其业务模式难以为继。有数据显示,某个提供固定套餐的服务商,在涨价后其DeepSeek Flash模型的调用量在短时间内骤降了94%,直观地展现了价格杠杆的威力。

不过,对于只在网页端和APP进行日常聊天的普通用户来说,由于这些服务仍然免费,因此几乎没有受到影响。
对于涨价的原因,市场普遍认为,这并非一次简单的商业策略调整,其背后是算力资源面临的巨大压力。随着Agent等复杂应用的爆发,大模型的Token消耗量呈指数级增长,有数据显示,DeepSeek的日调用量曾达到万亿级别。如此巨大的需求,使得原有的低价补贴模式难以为继,算力成本已经“扛不住了”。因此,采用峰谷定价,旨在通过价格杠杆引导用户错峰调用,将批量处理、数据分析等非实时任务转移到夜间等空闲时段,以缓解白天的服务器压力,保证服务稳定性。
同时,这次涨价也被看作是整个大模型行业告别“烧钱内卷”、走向商业化和价值定价的标志性事件。过去一年,国产大模型市场经历了激烈的价格战,而DeepSeek的率先提价,为全行业释放了定价空间。分析指出,即使涨价后,DeepSeek的价格在全球范围内与OpenAI、Anthropic等顶级模型相比,依然具有显著的成本优势。
面对成本上涨的现实,开发者们也迅速开始调整策略。最直接的应对方式就是“错峰调用”和“优化缓存”。对于批量任务,安排在空闲时段运行可使成本减半。更关键的是对缓存命中率的优化,有经验的用户指出,通过调整Prompt结构,将固定的系统提示词放在前面,动态变化的内容置于末尾,可以将缓存命中率提升至90%以上。在新的定价体系下,高缓存命中率不再仅仅是“省钱”,而是控制成本不失控的关键。此外,根据任务复杂程度,灵活切换使用V4 Flash和V4 Pro模型,也成为控制开销的有效手段。

DeepSeek的新定价策略给市场带来了强烈的冲击,用户的感受也呈现两极分化:一方面是对成本飙升的“阵痛”与抱怨,另一方面则是对行业回归理性商业模式的理解。这次调整不仅考验着DeepSeek自身的模型价值,也迫使所有API使用者重新审视自己的成本结构和调用策略,标志着大模型API“无限便宜”的时代正在过去,一个更加注重成本效益和精细化运营的新阶段已然来临。