近日,人工智能公司DeepSeek宣布,其旗舰大模型DeepSeek-V4-Pro的API(应用程序编程接口)2.5折限时优惠活动将延长至5月31日。这一消息迅速在开发者和科技行业中引发了广泛关注。结合此前一系列的价格调整,此次优惠延期不仅是对用户的直接利好,更被视为DeepSeek技术实力和市场策略的一次集中展现。
需要厘清DeepSeek此次价格调整的两个核心层面。第一个层面是针对DeepSeek-V4-Pro模型的限时优惠。在此期间,其API的输入价格(缓存未命中)调整为3元/百万Tokens,输出价格为6元/百万Tokens。这一举措最初的截止日期较短,延长至整个五月,给了开发者更充裕的时间来测试和迁移工作流。
第二个层面,也是更具结构性影响的,是针对全系列模型“输入缓存命中”价格的永久性下调。DeepSeek将所有模型的输入缓存命中价格降至原价的十分之一。调整后,DeepSeek-V4-Pro的缓存命中价格在叠加2.5折优惠后低至0.025元/百万Tokens,而轻量版的V4-Flash模型也仅为0.02元/百万Tokens。

对于普通用户来说,“缓存命中”可能是一个陌生的技术词汇。简单来说,当用户反复向模型输入相同或相似的内容时(例如在多轮对话中重复的背景信息、在RAG应用中反复查询的同一份文档),模型不必每次都从头进行完整计算,这部分被“记住”并复用的内容调用就属于缓存命中。由于其成本极低,这一调整极大地降低了长文本处理、知识库问答(RAG)和AI智能体(Agent)等需要大量重复上下文的应用场景的实际使用成本。

这种激进的定价策略并非单纯的“烧钱补贴”,其背后有坚实的技术创新作为支撑。根据DeepSeek公布的技术信息,V4系列模型采用了创新的注意力机制架构,大幅优化了推理效率。相较于前代模型,V4在处理百万级Token长文本时,其推理算力消耗和关键的KV缓存(模型在推理时占用的显存)占用都降低了超过70%,从根本上实现了成本的优化。这使得DeepSeek有底气在保证模型性能的同时,将节省的成本回馈给用户。

技术革新之外,与国产算力的深度协同是另一个关键因素。DeepSeek官方明确指出,目前Pro版本的服务吞吐能力受到高端算力的限制,并预计在下半年随着华为昇腾950超节点等国产算力产品批量上市后,Pro版本的价格还将有大幅下调的空间。这不仅展示了DeepSeek对未来成本进一步优化的信心,也标志着其向构建自主可控AI技术生态的战略方向迈进。

从市场反响来看,DeepSeek的举动获得了开发者的积极响应。许多用户表示,极具竞争力的价格,加上模型本身在代码生成、长文本理解等方面的优异表现,使其成为一个高性价比的选择。在AI行业算力成本普遍上涨的背景下,DeepSeek的降价策略无疑为市场注入了新的活力,也加剧了模型厂商之间的竞争。这一系列操作,已不仅仅是简单的促销活动,它更像是一次宣言,展示了通过技术创新和与本土产业链的结合,实现高性能AI普惠的可能性,或将对未来大模型市场的竞争格局产生深远影响。