DeepSeek Flash降价60%藏着猫腻,输出只降11%,省钱要靠错峰调度

源自155位全网作者

08:29

内容由AI生成

精选参考来源

1. 刚刚,Claude 5.1 发布!全球最强模型来了

2. 薛定谔的Deepseek定价:我们将于北京时间2026年9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。请合理安排您的使用。相较涨价后:缓存命中降幅60% 缓存未命中降幅33% 输出降幅11%

3. 刚刚,最强模型Fable 5.1发布!打爆Fable 5还降价,但依旧死磕「反蒸馏」

4. #DeepSeekV4.1Flash中间版本#DeepSeek 又整活了,而且这次来得比想象中更快。就在今天 9 月 8 日下午,DeepSeek 在官方交流群里放出了 V4.1 Flash 中间版本内测。没有发布会,也没有什么预热海报,甚至官方直接称它为“中间版本”,模型有效期也只有两天——9 月 10 日到期。但别看它只是个“中间版本”,这次更新的信息量其实不小:新模型结构、原生多模态、能力更强、速度更快、成本更低。尤其是“原生多模态”这几个字,可能比单纯的“速度更快”更值得关注。此前的 V4-Flash-Vision-Exp,本质上是在文本模型之外接入视觉能力;而 V4.1 Flash 采用了新的架构路线,视觉和文本能力是在同一套架构中训练的。换句话说,这不只是给模型“外挂了一双眼睛”,而更像是在往下一代基础模型的方向走。怎么体验?其实非常简单。原来的 API 地址不用改,只需要把模型名称替换成:"deepseek-v4.1-flash-expires-on-0910"目前内测期间的计费和 V4-Flash 一致,而且官方给出的单账号并发上限是 20。这里也提醒一下:千万别把它当成线上生产模型。正式版 V4-Flash 的单账号并发上限据官方信息达到 2500,而这个内测版本只有 20,并且 9 月 10 日就会到期。它现在更适合拿来做能力测试、Agent 测试、多模态体验和模型横向对比,而不是拿来压测或者直接接线上业务。我自己也简单跑了一轮测试,最大的感受其实就一个字:快。在一些推理、代码生成以及复杂指令任务里,V4.1 Flash 的响应速度非常夸张,确实有一种“Flash 名副其实”的感觉。当然,速度快不代表所有任务都稳。这次测试了几道比较典型的题:强约束文本生成、24 点、多位数密码推理、网页应用生成、3D 赛车以及 Trello 看板。结果比较有意思:24 点的 3 个解法全部正确,七位数密码锁也成功推理出正确答案;3D 赛车可以正常运行,Trello 看板的列表、卡片、拖动等核心功能也基本没问题。但在“浏览器操作系统”这个综合型网页生成任务上,表现就比较拉胯了:桌面部分疑似资源加载异常,里面的太空设计游戏甚至直接无法运行。所以目前来看,它给我的感觉不是“全面碾压”,而是能力底盘明显在提升,同时把速度和成本做得非常激进。还有一个特别有意思的细节。V4.1 Flash 明明官方已经明确支持原生多模态,但部分 DeepSeek 自家的第三方/工具适配目前还没跟上,甚至会直接显示“不支持图片”。换到其他支持自定义模型的 AI 工具里,按照 DeepSeek API 的方式接入,并把输入类型里的“图片”打开,就可以正常进行识图。这多少有点魔幻:模型已经进化了,工具生态反而还没完全跟上。不过我觉得真正值得关注的,还不是“它现在到底有多快”,而是 DeepSeek 为什么突然把这个版本放出来。因为官方内测问卷里有一个问题非常耐人寻味:“你觉得这个模型能全面替换线上的 DeepSeek V4 Pro 吗?”注意,是“全面替换”。V4 Pro 才刚在 8 月 12 日转为正式版,也是目前 DeepSeek 更偏高端、推理能力更强的付费档。而现在一个定位为 Flash、强调速度和成本的新架构模型,已经开始被拿来和 V4 Pro 做替代关系上的测试。这就很有意思了。如果 V4.1 Flash 最终能够做到接近 Pro 的能力 + Flash 的速度 + 更低的价格 + 原生多模态,那它的意义就不仅仅是“又出了一个新模型”。它可能意味着 DeepSeek 正在尝试把原本需要高价模型承担的工作,逐渐下放到更便宜、更快的模型上。而从产品演进来看,这几个月 DeepSeek 的节奏也确实越来越快:4 月 24 日 V4 预览版 → 7 月 31 日 V4-Flash 正式 API → 8 月 21 日 V4-Flash-Vision-Exp → 8 月 31 日视觉版开源 → 9 月 8 日 V4.1 Flash 内测。短短几个月,连续推进模型、API、多模态和开源。所以这次真正让我感兴趣的,不是“DeepSeek 又发新模型了”,而是:V4.1 Flash 会不会成为 DeepSeek 下一代模型架构的一个提前预览?目前官方还没有公布 V4.1 Flash 的参数量、正式跑分以及正式版发布时间。网上流传的“300 tokens/s”“知识截止到 2026 年 1 月”等说法,目前更多来自内测用户和社区测试,不要直接当成官方数据。但有一点基本可以确定:这个只有两天寿命的模型,值得 AI 玩家抓紧测。因为这种短期内测最大的价值,从来不是拿来长期使用,而是让我们提前摸一摸下一代模型到底在往什么方向走。速度、多模态、Agent、代码能力、成本……这些东西如果真的同时往前走,V4.1 Flash 的正式版可能会比这个“中间版本”本身更值得期待。而我现在最好奇的反而是另一个问题:如果 V4.1 Flash 最终真的做到接近 V4 Pro 的能力,你还愿意为 Pro 多花钱吗?

5. OpenAI总裁说“欢迎来到AGI时代”。但AGI的代价是什么?是开发者看着Token账单心跳加速,是企业为了抢算力排队等GPU,是10万块H100烧出来的20亿美金成本最终摊到每一个API调用上。国产大模型走的是另一条路——通义千问输入12元/百万token、输出36元,文心一言预训练成本只有业界6%。AGI时代确实来了,至少对中国开发者来说,性价比时代也来了。#GPT6全面上线#

6. #全球最强模型Fable5.1发布#Anthropic 正式发布 Claude Fable 5.1 与 Mythos 5.1,在科研与编程能力大幅超越前代及 GPT-5.6 Sol 的同时,缓存读取费用从 1 美元降至 0.25 美元/百万 Token,降幅达 75%,典型工作负载用成本降低约25%,高度Agent化任务账单最高降50%。现在大模型也太卷了,不仅拼能力还要拼价格,不过这是好事啊,我们用户要的就是又好用又便宜的模型

7. #企业AI办公进入爆发期##国产AI已经省上词元了#国产头部AI办公产品上线首月用户数就突破三千万,企业用户占比过半,不少企业已经把它落地到真实业务环节,不仅能大幅压缩人工耗时,还能降低Token消耗、沉淀数字资产,企业AI办公正式进入爆发落地阶段。

8. GPT-6 Astra发了一天就因"Token消耗惊人"上热搜:定价$10/$50每百万token,是上代2.5倍;超27.2万token整请求费率翻倍。单任务效率碾压同行(1/7 token),但max推理档+长Agent=账单刺客。设预算上限再玩。#GPT6消耗的Token量惊人#

9. 太反常识:美国顶流AI大模型比国产便宜很多 唯一真神只有DS V4

10. 大模型价格战:DeepSeek降价12%,Llama4-Scout跟进,开发者该怎么选

11. DeepSeek V4 Flash正式版来了,用MoE把'大总参、小激活'玩到极致:总参数284B,每次推理只激活13B,在保性能的同时把成本压到地板。更狠的是峰谷定价——高峰输入3.0元/百万token,低谷更便宜,鼓励企业把重活排到闲时。这背后是整个行业从卷参数转向卷效率:Agent规模化调用下,单位成本比榜单分数更致命。DeepSeek这手,逼着友商重新算账。 Flash不是减配,是把刀磨得更省。当调用量以十倍计增长,每省一分成本都是利润,效率模型才是Agent时代真正的护城河与王道。省下来的,都是净利润。

12. V4系列模型推理FLOPs降至27%,闲时价格减半且估值逼近5000亿元 DeepSeek V4系列确立Pro与Flash双模型路线以兼顾性能与效率,其核心战略正转向极致追求单位算力智能产出。在2026-2030年AI芯片需求复合增速达40%及国内算力未来1-2年紧平衡背景下,V4通过架构创新将百万Token推理FLOPs降至27%,KV Cache占用降至10%,以软件优化对冲算力瓶颈。同时,其商业模式转向峰谷精细化调度,Flash输入低至3元/百万 Token,Pro输出达27元/百万Token,并在9:00-12:00及14:00-18:00之外闲时价格减半,重塑算力定价权。叠加Harness平台构建的数据飞轮,资本市场关注点已向单位算力毛利润全面切换,推动其在最新80亿元融资预期下估值逼近5000亿元。 寒武纪/阿里巴巴(算力基础设施,受益于算力紧缺与弹性租赁需求),腾讯控股/宁德时代(大模型参投方,受益于头部生态布局与投资红利),智谱/MiniMax(大模型厂商,受益于计算成本下降及调用规模爆发),掌阅科技(AI应用端,受益于推理成本暴降带来的毛利提升)

13. DeepSeek结束Token价格战 V4-Flash定价不到GPT-4的1%

14. DeepSeek V4 价格最新全解析:V4 Flash/Pro 怎么选,哪个最省钱?

15. 2026年9月国内主流大模型API价格全景图

16. 国产大模型杀到四毛钱一百万字,低价背后有哪些坑?

17. 8月国产大模型:阿里智谱降价,DeepSeek涨价,格局生变?

0
扫一下,分享更方便,购买更轻松
1评论

  • 精彩
  • 最新
  • 草台班子,说涨价就涨价,说降价就降价 [高兴]

    校验提示文案

    提交
提示信息

取消
确认
评论举报

最新文章 热门文章