OpenAI推理成本骤降50%,API价格同步减半

源自13位全网作者

07-01 10:07

精选参考来源

1
科技巨头集体押注自研芯,AI芯片战场正加速向推理端迁移
2
云涨 Token 涨,DeepSeek 偏降价?其他的企业集体上调 AI 算力价格,行业 Token 成本普涨之际,DeepSeek V4 却逆势降价,V4-Flash 输出价低至 2 元 / 百万 Token,仅为竞品的 1/40,上演价格反向操作,DeepSeek的底气在哪里?系统方面,DeepSeek通过稀疏注意力革命,在同样是百万 Token 场景下,推理算力需求降至前代 10%-27%,KV Cache 占用仅 7%-10%,这就让长文本成本不升反降。V4-Pro 1.6T 参数仅激活 49B,V4-Flash 284B 参数仅激活 13B,避免 全参数计算浪费,算力利用率拉满。小模型继承大模型能力,推理成本再降 50%。在硬件方面,DeepSeek 率先全栈适配华为昇腾 950,从 CUDA 迁移至 CANN 框架。国产芯片单卡推理性能为英伟达 H20 的 2.87 倍,采购成本更低。芯模协同优化,训练推理成本较海外方案降低 70%-85%,直接对冲云厂商涨价影响。市场方面,2026 年是AI智能体落地元年,Token 消耗呈指数级增长,低成本是规模化关键。DeepSeek 采用了V4-Flash 低价走量,V4-Pro 走高端市场的市场价格策略。开源吸引开发者,降低企业落地门槛,是能够快速抢占市场份额的。DeepSeek 逆势降价,是国产 AI 摆脱海外依赖、靠技术定义成本的里程碑。这场降价,本质是国产 AI 的成本革命与话语权争夺。
全部
来源
内容由AI生成

精选参考来源

1. 科技巨头集体押注自研芯,AI芯片战场正加速向推理端迁移

2. 云涨 Token 涨,DeepSeek 偏降价?其他的企业集体上调 AI 算力价格,行业 Token 成本普涨之际,DeepSeek V4 却逆势降价,V4-Flash 输出价低至 2 元 / 百万 Token,仅为竞品的 1/40,上演价格反向操作,DeepSeek的底气在哪里?系统方面,DeepSeek通过稀疏注意力革命,在同样是百万 Token 场景下,推理算力需求降至前代 10%-27%,KV Cache 占用仅 7%-10%,这就让长文本成本不升反降。V4-Pro 1.6T 参数仅激活 49B,V4-Flash 284B 参数仅激活 13B,避免 全参数计算浪费,算力利用率拉满。小模型继承大模型能力,推理成本再降 50%。在硬件方面,DeepSeek 率先全栈适配华为昇腾 950,从 CUDA 迁移至 CANN 框架。国产芯片单卡推理性能为英伟达 H20 的 2.87 倍,采购成本更低。芯模协同优化,训练推理成本较海外方案降低 70%-85%,直接对冲云厂商涨价影响。市场方面,2026 年是AI智能体落地元年,Token 消耗呈指数级增长,低成本是规模化关键。DeepSeek 采用了V4-Flash 低价走量,V4-Pro 走高端市场的市场价格策略。开源吸引开发者,降低企业落地门槛,是能够快速抢占市场份额的。DeepSeek 逆势降价,是国产 AI 摆脱海外依赖、靠技术定义成本的里程碑。这场降价,本质是国产 AI 的成本革命与话语权争夺。

3. 两个200亿美元:OpenAI和英伟达在打一场“推理之战”

4. DeepSeek这次调价,可能会让AI开发进入一个新阶段。以前大家优化Prompt,是为了让AI回答得更好;以后还要为了让AI"回答得更便宜"。什么时候调用模型、哪些内容走缓存、哪些任务放到夜间批量执行……这些原本属于云计算时代的优化思路,正在进入大模型时代。同样一个AI应用,最后比拼的可能不是模型能力,而是谁每个月能省下几十万甚至上百万的推理成本。#DeepSeek涨价是否合理#

5. #DeepSeek发布DSpark#AI圈又迎来国产技术新惊喜,这次DeepSeek推出的DSpark真的戳中行业痛点。作为适配V4系列模型的全新推理优化方案,它依靠置信度调度推测解码,大幅拉高模型吞吐效率,实测相比原有基线性能提升最高四倍,同时兼容多款主流开源大模型,适配性拉满。而且DSpark从底层解码逻辑优化,不用大幅增加硬件投入,就能直接压低推理成本,不管是做AI客服、内容生成还是企业部署都很实用。 DeepSeek这次的更新,实实在在给国内AI产业降本增效提供了新思路,期待后续开源落地,让更多开发者体验到技术红利。

6. OpenAI 考虑大幅降价,与 Anthropic 争夺用户 OpenAI 正在考虑大幅降低向用户收取的费用,以期从其宿敌 Anthropic 手中争夺客户。 该公司正在权衡大幅削减 token 费用,并预计 Anthropic 也会做出类似的降价举措。大幅降价可能会进一步蚕食两家公司的利润空间。由于 AI 系统所需的计算资源成本极其高昂,这两家公司目前已经面临数十亿美元的亏损。#人工智能##ai大模型#

7. OpenAI 发布 GPT-5.6 ,降价开启美国大模型价格战,为何会降价?对行业有什么影响?

8. DSpark真正值得关注的,不只是"更快",而是"更省"。大模型商业化最大的成本之一就是推理,每一次用户提问都在消耗GPU资源。如果在不增加硬件的情况下,把吞吐量提升4倍,相当于同样一套服务器可以服务更多用户,企业的部署成本和运营成本都会明显下降。对于AI行业来说,训练决定模型上限,而推理效率决定商业化下限。DSpark的意义,更像是在补齐大模型落地的最后一公里。#DeepSeek新发布的DSpark有多强#

9. 如何评价 DeepSeek-V4 的价格?

10. #微博大模型可真能省钱#对于普通用户来说,30亿参数和3000亿参数可能只是数字差异。但对于企业和开发者来说,背后代表的是完全不同的部署成本和应用空间。更小的模型意味着更低的训练成本、更低的推理成本,以及更容易在本地设备和垂直场景中落地。当行业开始出现这类高性价比推理模型时,一个重要变化正在发生:AI竞争的核心,正在从“谁拥有最多算力”,逐步转向“谁能用更低成本实现更高效率”。这或许才是AI走向规模化应用最关键的一步。

11. LLM 推理是如何工作的?

12. 【OpenAI正考虑大幅下调产品价格,预判将与Anthropic展开用户之争】为从竞争对手Anthropic手中争夺客户,OpenAI正考虑大幅下调面向用户的收费标准。据知情人士透露,该公司计划大幅下调代币计费单价——代币是人工智能企业核算产品费用的计量单位。此举意在应对Anthropic预计也会推出的降价举措。目前,企业高管已开始对高昂的AI使用成本感到抵触。OpenAI首席执行官山姆·奥尔特曼在近期一场活动中坦言,成本问题已成为一大难题。

13. 【AI巨头被曝考虑降价 AI应用或向更低成本模式转变】于不少企业抱怨AI成本过高,并转向低成本的AI模型,近日AI巨头OpenAI和Anthropic都被曝出考虑降价,进而争夺用户。  据《华尔街日报》报道,OpenAI正在考虑大幅降低其AI产品的价格,报道称,“该公司正在考虑大幅削减代币(token)的收费,代币是AI公司用来对其产品进行计费的计量单位。”报道还称,OpenAI此举是为了应对Anthropic也可能采取类似的降价措施。网页链接

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章