DeepSeek发布V4.1 Flash,API价格最高降60%,旧旗舰Pro同步下线

源自233位全网作者

16:05

精选参考来源

1
#DeepSeekV4.1Flash中间版本#DeepSeek 又整活了,而且这次来得比想象中更快。就在今天 9 月 8 日下午,DeepSeek 在官方交流群里放出了 V4.1 Flash 中间版本内测。没有发布会,也没有什么预热海报,甚至官方直接称它为“中间版本”,模型有效期也只有两天——9 月 10 日到期。但别看它只是个“中间版本”,这次更新的信息量其实不小:新模型结构、原生多模态、能力更强、速度更快、成本更低。尤其是“原生多模态”这几个字,可能比单纯的“速度更快”更值得关注。此前的 V4-Flash-Vision-Exp,本质上是在文本模型之外接入视觉能力;而 V4.1 Flash 采用了新的架构路线,视觉和文本能力是在同一套架构中训练的。换句话说,这不只是给模型“外挂了一双眼睛”,而更像是在往下一代基础模型的方向走。怎么体验?其实非常简单。原来的 API 地址不用改,只需要把模型名称替换成:"deepseek-v4.1-flash-expires-on-0910"目前内测期间的计费和 V4-Flash 一致,而且官方给出的单账号并发上限是 20。这里也提醒一下:千万别把它当成线上生产模型。正式版 V4-Flash 的单账号并发上限据官方信息达到 2500,而这个内测版本只有 20,并且 9 月 10 日就会到期。它现在更适合拿来做能力测试、Agent 测试、多模态体验和模型横向对比,而不是拿来压测或者直接接线上业务。我自己也简单跑了一轮测试,最大的感受其实就一个字:快。在一些推理、代码生成以及复杂指令任务里,V4.1 Flash 的响应速度非常夸张,确实有一种“Flash 名副其实”的感觉。当然,速度快不代表所有任务都稳。这次测试了几道比较典型的题:强约束文本生成、24 点、多位数密码推理、网页应用生成、3D 赛车以及 Trello 看板。结果比较有意思:24 点的 3 个解法全部正确,七位数密码锁也成功推理出正确答案;3D 赛车可以正常运行,Trello 看板的列表、卡片、拖动等核心功能也基本没问题。但在“浏览器操作系统”这个综合型网页生成任务上,表现就比较拉胯了:桌面部分疑似资源加载异常,里面的太空设计游戏甚至直接无法运行。所以目前来看,它给我的感觉不是“全面碾压”,而是能力底盘明显在提升,同时把速度和成本做得非常激进。还有一个特别有意思的细节。V4.1 Flash 明明官方已经明确支持原生多模态,但部分 DeepSeek 自家的第三方/工具适配目前还没跟上,甚至会直接显示“不支持图片”。换到其他支持自定义模型的 AI 工具里,按照 DeepSeek API 的方式接入,并把输入类型里的“图片”打开,就可以正常进行识图。这多少有点魔幻:模型已经进化了,工具生态反而还没完全跟上。不过我觉得真正值得关注的,还不是“它现在到底有多快”,而是 DeepSeek 为什么突然把这个版本放出来。因为官方内测问卷里有一个问题非常耐人寻味:“你觉得这个模型能全面替换线上的 DeepSeek V4 Pro 吗?”注意,是“全面替换”。V4 Pro 才刚在 8 月 12 日转为正式版,也是目前 DeepSeek 更偏高端、推理能力更强的付费档。而现在一个定位为 Flash、强调速度和成本的新架构模型,已经开始被拿来和 V4 Pro 做替代关系上的测试。这就很有意思了。如果 V4.1 Flash 最终能够做到接近 Pro 的能力 + Flash 的速度 + 更低的价格 + 原生多模态,那它的意义就不仅仅是“又出了一个新模型”。它可能意味着 DeepSeek 正在尝试把原本需要高价模型承担的工作,逐渐下放到更便宜、更快的模型上。而从产品演进来看,这几个月 DeepSeek 的节奏也确实越来越快:4 月 24 日 V4 预览版 → 7 月 31 日 V4-Flash 正式 API → 8 月 21 日 V4-Flash-Vision-Exp → 8 月 31 日视觉版开源 → 9 月 8 日 V4.1 Flash 内测。短短几个月,连续推进模型、API、多模态和开源。所以这次真正让我感兴趣的,不是“DeepSeek 又发新模型了”,而是:V4.1 Flash 会不会成为 DeepSeek 下一代模型架构的一个提前预览?目前官方还没有公布 V4.1 Flash 的参数量、正式跑分以及正式版发布时间。网上流传的“300 tokens/s”“知识截止到 2026 年 1 月”等说法,目前更多来自内测用户和社区测试,不要直接当成官方数据。但有一点基本可以确定:这个只有两天寿命的模型,值得 AI 玩家抓紧测。因为这种短期内测最大的价值,从来不是拿来长期使用,而是让我们提前摸一摸下一代模型到底在往什么方向走。速度、多模态、Agent、代码能力、成本……这些东西如果真的同时往前走,V4.1 Flash 的正式版可能会比这个“中间版本”本身更值得期待。而我现在最好奇的反而是另一个问题:如果 V4.1 Flash 最终真的做到接近 V4 Pro 的能力,你还愿意为 Pro 多花钱吗?
2
【DeepSeek下调flash系列模型定价,最高砍60%】9月9日,DeepSeek开放平台公告,将于北京时间9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33%和11%。
全部
来源
内容由AI生成

精选参考来源

1. #DeepSeekV4.1Flash中间版本#DeepSeek 又整活了,而且这次来得比想象中更快。就在今天 9 月 8 日下午,DeepSeek 在官方交流群里放出了 V4.1 Flash 中间版本内测。没有发布会,也没有什么预热海报,甚至官方直接称它为“中间版本”,模型有效期也只有两天——9 月 10 日到期。但别看它只是个“中间版本”,这次更新的信息量其实不小:新模型结构、原生多模态、能力更强、速度更快、成本更低。尤其是“原生多模态”这几个字,可能比单纯的“速度更快”更值得关注。此前的 V4-Flash-Vision-Exp,本质上是在文本模型之外接入视觉能力;而 V4.1 Flash 采用了新的架构路线,视觉和文本能力是在同一套架构中训练的。换句话说,这不只是给模型“外挂了一双眼睛”,而更像是在往下一代基础模型的方向走。怎么体验?其实非常简单。原来的 API 地址不用改,只需要把模型名称替换成:"deepseek-v4.1-flash-expires-on-0910"目前内测期间的计费和 V4-Flash 一致,而且官方给出的单账号并发上限是 20。这里也提醒一下:千万别把它当成线上生产模型。正式版 V4-Flash 的单账号并发上限据官方信息达到 2500,而这个内测版本只有 20,并且 9 月 10 日就会到期。它现在更适合拿来做能力测试、Agent 测试、多模态体验和模型横向对比,而不是拿来压测或者直接接线上业务。我自己也简单跑了一轮测试,最大的感受其实就一个字:快。在一些推理、代码生成以及复杂指令任务里,V4.1 Flash 的响应速度非常夸张,确实有一种“Flash 名副其实”的感觉。当然,速度快不代表所有任务都稳。这次测试了几道比较典型的题:强约束文本生成、24 点、多位数密码推理、网页应用生成、3D 赛车以及 Trello 看板。结果比较有意思:24 点的 3 个解法全部正确,七位数密码锁也成功推理出正确答案;3D 赛车可以正常运行,Trello 看板的列表、卡片、拖动等核心功能也基本没问题。但在“浏览器操作系统”这个综合型网页生成任务上,表现就比较拉胯了:桌面部分疑似资源加载异常,里面的太空设计游戏甚至直接无法运行。所以目前来看,它给我的感觉不是“全面碾压”,而是能力底盘明显在提升,同时把速度和成本做得非常激进。还有一个特别有意思的细节。V4.1 Flash 明明官方已经明确支持原生多模态,但部分 DeepSeek 自家的第三方/工具适配目前还没跟上,甚至会直接显示“不支持图片”。换到其他支持自定义模型的 AI 工具里,按照 DeepSeek API 的方式接入,并把输入类型里的“图片”打开,就可以正常进行识图。这多少有点魔幻:模型已经进化了,工具生态反而还没完全跟上。不过我觉得真正值得关注的,还不是“它现在到底有多快”,而是 DeepSeek 为什么突然把这个版本放出来。因为官方内测问卷里有一个问题非常耐人寻味:“你觉得这个模型能全面替换线上的 DeepSeek V4 Pro 吗?”注意,是“全面替换”。V4 Pro 才刚在 8 月 12 日转为正式版,也是目前 DeepSeek 更偏高端、推理能力更强的付费档。而现在一个定位为 Flash、强调速度和成本的新架构模型,已经开始被拿来和 V4 Pro 做替代关系上的测试。这就很有意思了。如果 V4.1 Flash 最终能够做到接近 Pro 的能力 + Flash 的速度 + 更低的价格 + 原生多模态,那它的意义就不仅仅是“又出了一个新模型”。它可能意味着 DeepSeek 正在尝试把原本需要高价模型承担的工作,逐渐下放到更便宜、更快的模型上。而从产品演进来看,这几个月 DeepSeek 的节奏也确实越来越快:4 月 24 日 V4 预览版 → 7 月 31 日 V4-Flash 正式 API → 8 月 21 日 V4-Flash-Vision-Exp → 8 月 31 日视觉版开源 → 9 月 8 日 V4.1 Flash 内测。短短几个月,连续推进模型、API、多模态和开源。所以这次真正让我感兴趣的,不是“DeepSeek 又发新模型了”,而是:V4.1 Flash 会不会成为 DeepSeek 下一代模型架构的一个提前预览?目前官方还没有公布 V4.1 Flash 的参数量、正式跑分以及正式版发布时间。网上流传的“300 tokens/s”“知识截止到 2026 年 1 月”等说法,目前更多来自内测用户和社区测试,不要直接当成官方数据。但有一点基本可以确定:这个只有两天寿命的模型,值得 AI 玩家抓紧测。因为这种短期内测最大的价值,从来不是拿来长期使用,而是让我们提前摸一摸下一代模型到底在往什么方向走。速度、多模态、Agent、代码能力、成本……这些东西如果真的同时往前走,V4.1 Flash 的正式版可能会比这个“中间版本”本身更值得期待。而我现在最好奇的反而是另一个问题:如果 V4.1 Flash 最终真的做到接近 V4 Pro 的能力,你还愿意为 Pro 多花钱吗?

2. 【DeepSeek下调flash系列模型定价,最高砍60%】9月9日,DeepSeek开放平台公告,将于北京时间9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。据悉,缓存命中、缓存未命中及输出价格最高降幅分别为60%、33%和11%。

3. 互联网技术#DeepSeek计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。# DeepSeek计划9月10日前后推出V4.1 Flash,并把现有V4 Pro请求临时路由到新模型、按Flash低价计费,这套组合拳的信号很明确:它不想再让“Pro=贵、Flash=凑合”的二分法继续存在,而是要用轻量档把速度、多模态和成本一次打穿。从已披露信息看,V4.1 Flash的看点不在“又大又全”,而在“更便宜还能干重活”:官方称性能、费用、速度、总用时全面超过V4 Pro;新架构、原生多模态,内测反馈输出约280—400 token/秒,图文/截图/表格理解不再靠外挂视觉模块;9月10日12点起Flash重新计价,闲时缓存命中输入0.02元/百万token、未命中1元、输出4元,高峰翻倍。 对客服、知识库、代码生成、报表解析、Agent串联这类高并发、长前缀、反复调用的场景,这比单纯追参数实用得多。但评论要留半句冷话。厂商说“全面超越Pro”,通常指内部/外部选定基准下的综合账,不等于所有难任务都平替:超长文档推理、复杂数学、强工具规划、医学/法律等高风险问答,仍要看正式版公开评测而非内测体感。把Pro流量自动切到Flash是好事——用户省成本、迁移零改动;也是风险——若路由后在某些任务上质量回退,企业侧要有灰度、回滚和人工抽检。多模态更快更便宜后,OCR误读、图表幻觉、图片隐私、缓存复用带来的上下文泄露,也会跟着被放大。更大的行业含义是,大模型竞争正在从“谁榜高分”转向“谁把可用智能的边际成本压下来”。Flash化、峰谷计价、原生多模态、自动路由,本质都是把AI从demo预算拉到生产预算。对开发者是利好,对闭源高价API是压力;但对所有厂商也是提醒——降价不是终点,稳定、可审计、可降级,才决定模型能不能真正进业务系统。

4. 怎么看 DeepSeek Flash 系列9月10日将再调整定价,除输出外回归8月17日前价格?DeepSeek三周就把Flash输入价退回去,因为调价后流量被中转平台和GLM抢走了。企业用API只看够不够用和多少钱,不看品牌。Flash本来就是靠低价抢量的产品,一涨价就失去存在意义。但输出价只降一成、峰谷计费保留,说明两件事:推理成本确实需要覆盖,产能确实还紧张。这本质是在调整:用Flash守住用户量,用Pro和高峰时段赚钱。开源模型能被第三方托管商打到官方价格的零头,意味着定价权已经不完全在模型厂商手里。降价不是慈善,是发现自己定贵了。涨价测试市场承受力是正常商业行为,三周后退回来同样正常——数据会说话。真正值得看的是V4.1转正后怎么定价,那才能看出新架构能不能在成本和能力上同时压过竞品。现在这次调整只是战术修正,价格战的主战场还在输出token和高峰时段上。

5. 涨价不到一个月,DeepSeek宣布降价,最高降幅60%

6. DeepSeek V4 Flash又降价了!9月10日生效

7. DeepSeek宣布降价!最高降幅60%

8. DeepSeek官宣flash系列模型降价 最高直降60%

9. DeepSeek降价消息传来,一张模拟账单能省多少

10. 原生多模态支持!DeepSeek V4.1-Flash内测:能力更强、速度更快、成本更低

11. DeepSeek V4.1 Flash中间版本内测:新模型结构,更强、成本更低

12. DeepSeek开放平台公告:将于9月10日12:00起,调整flash系列定价

2
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章