DeepSeek V4永久降价,缓存命中低至0.02元/百万tokens
源自68位全网作者
05-23 22:03
精选参考来源
1
#DeepSeek连续两天降价# 4月25-26日,国产大模型DeepSeek连续两天“跳楼价”,直接把行业价盘砸穿:先打2.5折,再把缓存输入价砍到原价1/10,叠加后百万token最低只要2分钱,比GPT-5.5便宜几百倍。这事不只是降价,是中国AI要改写全球游戏规则。 首先,用技术硬实力,把成本打下来。这次降价不是亏本赚吆喝,是真有底气:V4模型用了自研稀疏注意力架构,算力消耗大减;还全面适配华为昇腾等国产算力,摆脱对高价海外芯片的依赖,推理成本直接压到地板价。 其次,抢市场、锁生态,逼对手跟着卷。AI行业现在拼的是谁家用户多、应用多。DeepSeek这波降价,直接让中小企业、个人开发者用得起顶级大模型,调用量一天暴涨近4倍。同行被逼到墙角:智谱、MiniMax股价大跌,不降价就丢市场,降价就利润崩,彻底陷入被动。 更关键的是行业逻辑变天。以前AI是“奢侈品”,只有大厂玩得起;现在DeepSeek把它变成“平价水电”,核心是推百万上下文+Agent普惠,让长文档、智能体、自动化工作流真正落地 。这是从“卖模型”到“做AI基础设施”的野心。 最后,国产AI的话语权硬了。以前全球看OpenAI脸色,现在中国模型性能不输、价格碾压,还全栈国产化。DeepSeek用价格战告诉世界:高端AI不是只有美国能做,中国不仅能做,还能做得更便宜、更普惠。
2
云涨 Token 涨,DeepSeek 偏降价?其他的企业集体上调 AI 算力价格,行业 Token 成本普涨之际,DeepSeek V4 却逆势降价,V4-Flash 输出价低至 2 元 / 百万 Token,仅为竞品的 1/40,上演价格反向操作,DeepSeek的底气在哪里?系统方面,DeepSeek通过稀疏注意力革命,在同样是百万 Token 场景下,推理算力需求降至前代 10%-27%,KV Cache 占用仅 7%-10%,这就让长文本成本不升反降。V4-Pro 1.6T 参数仅激活 49B,V4-Flash 284B 参数仅激活 13B,避免 全参数计算浪费,算力利用率拉满。小模型继承大模型能力,推理成本再降 50%。在硬件方面,DeepSeek 率先全栈适配华为昇腾 950,从 CUDA 迁移至 CANN 框架。国产芯片单卡推理性能为英伟达 H20 的 2.87 倍,采购成本更低。芯模协同优化,训练推理成本较海外方案降低 70%-85%,直接对冲云厂商涨价影响。市场方面,2026 年是AI智能体落地元年,Token 消耗呈指数级增长,低成本是规模化关键。DeepSeek 采用了V4-Flash 低价走量,V4-Pro 走高端市场的市场价格策略。开源吸引开发者,降低企业落地门槛,是能够快速抢占市场份额的。DeepSeek 逆势降价,是国产 AI 摆脱海外依赖、靠技术定义成本的里程碑。这场降价,本质是国产 AI 的成本革命与话语权争夺。
全部
来源
来源
内容由AI生成
提示信息
取消
确认
评论举报
已收藏
去我的收藏夹
林琰森
校验提示文案
林琰森
校验提示文案