近日,人工智能公司 DeepSeek 官网更新信息,宣布其旗舰大模型 DeepSeek-V4-Pro 的 API 2.5折优惠活动将延长至2026年5月31日。此前的优惠活动原定于5月上旬结束,这一延期在开发者和行业用户中引发了广泛关注。
这次优惠的核心是针对 DeepSeek-V4-Pro 模型的 API 调用价格。在优惠期间,其输入价格(缓存未命中)为每百万 tokens 3元,输出价格为6元。然而,更引人注目的是其“缓存命中”场景下的定价。DeepSeek 先前已宣布,将全系列模型 API 的输入缓存命中价格降至原价的十分之一,在此基础上,V4-Pro 模型再叠加此次的2.5折优惠,使得其缓存命中的输入价格低至每百万 tokens 0.025元,即2.5分钱。作为对比,其轻量级的 V4-Flash 模型,缓存命中输入价格也仅为每百万 tokens 0.02元。

如此激进的定价策略,被市场普遍视为一场大模型领域的“价格战”。这一价格远低于国内外许多主流大模型,尤其是对于需要处理大量文本、进行多轮推理的 Agent(智能体)应用开发者而言,极低的成本意味着之前因算力开销而受限的复杂应用有了落地的可能性。

从用户反馈来看,此次降价受到了普遍欢迎。许多开发者表示,DeepSeek V4 Pro 在代码生成等专业任务上表现出色,能力接近甚至在某些方面超越了部分国际顶尖模型。一位用户分享,他因担心 token 消耗过大而预先充值了百元,但在高强度使用后,发现由于高达近90%的缓存命中率,实际账单仅花费了4.32元,远低于预期。这种“性能强、价格低”的组合,让不少开发者选择将其作为主力模型,甚至将整个工作流迁移至该平台。
DeepSeek 能够采取低价策略,背后是其技术架构的创新。据介绍,V4 模型采用了业界前沿的混合专家(MoE)架构,并通过对 KV Cache(键值缓存,影响模型处理长文本效率和成本的关键技术)等方面的系统级优化,大幅降低了模型在处理百万级长文本时的推理算力需求和成本。官方报告中的数据显示,V4 Pro 在处理百万 token 上下文时,其单 token 推理算力需求仅为前代产品的27%。
此外,与国产算力的深度适配也是其成本控制和未来降价信心的来源。DeepSeek 方面已确认,目前 Pro 版本的服务吞吐能力受限于高端算力,并预计在下半年华为昇腾950超节点批量上市后,Pro 版本的价格还将有大幅下调的空间。这表明,当前的低价并非单纯的短期补贴,而是基于技术进步和国产算力生态构建的长期战略。
DeepSeek V4 Pro 优惠延期,不仅为开发者提供了一个更长的低成本体验窗口,也反映出 AI 大模型行业竞争的焦点正从单纯的性能比拼,扩展到“性价比”的综合较量。通过技术创新和与国产算力生态的结合来降低成本,正成为中国 AI 企业在全球竞争中探索的一条新路径,而这最终将惠及广大开发者和用户,加速 AI 技术的普及和应用创新。