DeepSeek Flash再次调价,闲时输入缓存命中降至0.02元,输出仍比涨前贵一倍
源自141位全网作者
09-09 14:09
精选参考来源
1
#DeepSeekV4.1Flash中间版本#DeepSeek 又整活了,而且这次来得比想象中更快。就在今天 9 月 8 日下午,DeepSeek 在官方交流群里放出了 V4.1 Flash 中间版本内测。没有发布会,也没有什么预热海报,甚至官方直接称它为“中间版本”,模型有效期也只有两天——9 月 10 日到期。但别看它只是个“中间版本”,这次更新的信息量其实不小:新模型结构、原生多模态、能力更强、速度更快、成本更低。尤其是“原生多模态”这几个字,可能比单纯的“速度更快”更值得关注。此前的 V4-Flash-Vision-Exp,本质上是在文本模型之外接入视觉能力;而 V4.1 Flash 采用了新的架构路线,视觉和文本能力是在同一套架构中训练的。换句话说,这不只是给模型“外挂了一双眼睛”,而更像是在往下一代基础模型的方向走。怎么体验?其实非常简单。原来的 API 地址不用改,只需要把模型名称替换成:"deepseek-v4.1-flash-expires-on-0910"目前内测期间的计费和 V4-Flash 一致,而且官方给出的单账号并发上限是 20。这里也提醒一下:千万别把它当成线上生产模型。正式版 V4-Flash 的单账号并发上限据官方信息达到 2500,而这个内测版本只有 20,并且 9 月 10 日就会到期。它现在更适合拿来做能力测试、Agent 测试、多模态体验和模型横向对比,而不是拿来压测或者直接接线上业务。我自己也简单跑了一轮测试,最大的感受其实就一个字:快。在一些推理、代码生成以及复杂指令任务里,V4.1 Flash 的响应速度非常夸张,确实有一种“Flash 名副其实”的感觉。当然,速度快不代表所有任务都稳。这次测试了几道比较典型的题:强约束文本生成、24 点、多位数密码推理、网页应用生成、3D 赛车以及 Trello 看板。结果比较有意思:24 点的 3 个解法全部正确,七位数密码锁也成功推理出正确答案;3D 赛车可以正常运行,Trello 看板的列表、卡片、拖动等核心功能也基本没问题。但在“浏览器操作系统”这个综合型网页生成任务上,表现就比较拉胯了:桌面部分疑似资源加载异常,里面的太空设计游戏甚至直接无法运行。所以目前来看,它给我的感觉不是“全面碾压”,而是能力底盘明显在提升,同时把速度和成本做得非常激进。还有一个特别有意思的细节。V4.1 Flash 明明官方已经明确支持原生多模态,但部分 DeepSeek 自家的第三方/工具适配目前还没跟上,甚至会直接显示“不支持图片”。换到其他支持自定义模型的 AI 工具里,按照 DeepSeek API 的方式接入,并把输入类型里的“图片”打开,就可以正常进行识图。这多少有点魔幻:模型已经进化了,工具生态反而还没完全跟上。不过我觉得真正值得关注的,还不是“它现在到底有多快”,而是 DeepSeek 为什么突然把这个版本放出来。因为官方内测问卷里有一个问题非常耐人寻味:“你觉得这个模型能全面替换线上的 DeepSeek V4 Pro 吗?”注意,是“全面替换”。V4 Pro 才刚在 8 月 12 日转为正式版,也是目前 DeepSeek 更偏高端、推理能力更强的付费档。而现在一个定位为 Flash、强调速度和成本的新架构模型,已经开始被拿来和 V4 Pro 做替代关系上的测试。这就很有意思了。如果 V4.1 Flash 最终能够做到接近 Pro 的能力 + Flash 的速度 + 更低的价格 + 原生多模态,那它的意义就不仅仅是“又出了一个新模型”。它可能意味着 DeepSeek 正在尝试把原本需要高价模型承担的工作,逐渐下放到更便宜、更快的模型上。而从产品演进来看,这几个月 DeepSeek 的节奏也确实越来越快:4 月 24 日 V4 预览版 → 7 月 31 日 V4-Flash 正式 API → 8 月 21 日 V4-Flash-Vision-Exp → 8 月 31 日视觉版开源 → 9 月 8 日 V4.1 Flash 内测。短短几个月,连续推进模型、API、多模态和开源。所以这次真正让我感兴趣的,不是“DeepSeek 又发新模型了”,而是:V4.1 Flash 会不会成为 DeepSeek 下一代模型架构的一个提前预览?目前官方还没有公布 V4.1 Flash 的参数量、正式跑分以及正式版发布时间。网上流传的“300 tokens/s”“知识截止到 2026 年 1 月”等说法,目前更多来自内测用户和社区测试,不要直接当成官方数据。但有一点基本可以确定:这个只有两天寿命的模型,值得 AI 玩家抓紧测。因为这种短期内测最大的价值,从来不是拿来长期使用,而是让我们提前摸一摸下一代模型到底在往什么方向走。速度、多模态、Agent、代码能力、成本……这些东西如果真的同时往前走,V4.1 Flash 的正式版可能会比这个“中间版本”本身更值得期待。而我现在最好奇的反而是另一个问题:如果 V4.1 Flash 最终真的做到接近 V4 Pro 的能力,你还愿意为 Pro 多花钱吗?
2
薛定谔的Deepseek定价:我们将于北京时间2026年9月10日12:00起,调整flash系列定价:空闲时段输入缓存命中单价0.02元、输入缓存未命中单价1元,输出单价4元;高峰时段价格为空闲时段价格的2倍。请合理安排您的使用。相较涨价后:缓存命中降幅60% 缓存未命中降幅33% 输出降幅11%
全部
来源
来源
内容由AI生成
1
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
-
40岁一到,那股"洗不掉"的味就开始找上门了!116 82 -
【评论有奖】你家最难清理的地方是哪?最后怎么搞定的?140 255
已收藏
去我的收藏夹