近日,国产大模型公司深度求索(DeepSeek)在48小时内连续两次宣布大幅降价,其API(应用程序编程接口)服务价格创下全球新低,引发了人工智能行业的广泛关注。这一系列动作被业界普遍视为点燃了新一轮大模型“价格战”的导火索。

事件始于4月25日晚间,DeepSeek宣布其新发布的DeepSeek-V4-Pro模型API开启限时2.5折优惠。仅隔一天,在4月26日晚,DeepSeek再度加码,宣布旗下全系列API服务中,“输入缓存命中”场景的价格降至原有价格的十分之一。
在这两轮降价措施叠加后,DeepSeek模型的调用成本被大幅拉低。其中,V4-Flash模型在缓存命中场景下,每百万Tokens(通常理解为文本处理的基本单位)的输入价格低至0.02元人民币;而V4-Pro模型在叠加限时优惠后,同场景下的价格也仅为0.025元。这一价格水平不仅远低于国内外主流的高性能大模型,也直接击穿了行业此前的价格底线。

此次降价的底气,源于其技术创新与对国产算力的深度适配。据披露,DeepSeek V4模型采用了自研的“混合注意力架构”,该技术能够显著降低模型在处理长文本时的计算量和显存占用,从而大幅削减了推理成本。更关键的是,DeepSeek V4模型已全面适配华为昇腾等国产AI芯片,摆脱了对高价海外芯片的依赖,从硬件层面为成本控制提供了有力支撑。DeepSeek方面也表示,降价并非亏本换市场,而是在保证盈利的基础上,将技术降本带来的红利普惠给用户。

DeepSeek的“骨折式”降价,精准地击中了当前AI应用落地的核心痛点。随着大模型从“聊天”迈向“干活”,在处理长文本、运行AI智能体(Agent)和执行自动化工作流等复杂任务时,高昂的Token消耗成本一直是困扰开发者和中小企业的主要难题。此次降价使得这些高频调用、长上下文处理场景的成本骤降超过90%,极大地降低了AI技术的应用门槛。
市场对此反应迅速,降价消息发布后,DeepSeek模型的API调用量一度暴涨近4倍。对于开发者和企业而言,成本的降低意味着创新的空间被打开,许多因成本顾虑而搁置的AI项目得以重新启动。同时,这一举动也给其他大模型厂商带来了巨大的竞争压力,行业竞争的焦点正从单纯的能力比拼,加速转向“性价比”的综合较量。
值得注意的是,DeepSeek的降价行为发生在部分云厂商和模型厂商因算力成本上涨而提价的背景之下,显得尤为突出。此举不仅可能重塑AI行业的定价体系,更预示着AI技术正加速从“奢侈品”向普惠的“基础设施”转变,一个成本更低、选择更多的大模型应用时代或将加速到来。