DeepSeek V4.1 Flash上线,轻量版性能反超旗舰版,API价格最高降60%

源自255位全网作者

09-11 15:47

精选参考来源

1
#DeepSeekV4.1Flash发布#DeepSeek V4.1 Flash 上新,看完亮点总结下:原生多模态,全新因果编解码架构,552B MoE,激活控制优秀。性能超过 V4 Pro,硬件资源需求大幅下降,同步下调 API 价格。既能做到更高的智能上限,又把推理速度、显存成本一起优化。大模型技术迭代速度越来越快,持续期待后续社区的实测结果。#DeepSeekV4.1Flash发布#
2
#DeepSeekV4.1Flash发布#DeepSeek今日正式发布DeepSeek V4.1 Flash,这是全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。经内部及多方外部测试,V4.1 Flash在性能、响应速度、计算费用及总处理用时等核心指标上均全面超越此前的V4 Pro模型。V4.1 Flash已上线DeepSeek开放平台,开发者将模型名称改为deepseek-flash即可调用,旧模型名deepseek-v4-flash和deepseek-v4-flash-vision-exp暂时路由到新模型。V4.1 Flash为552B参数的MoE模型,输入激活仅8B、输出激活16B,成本显著低于已知同尺寸模型。采用创新的causal-encoder-decoder结构,输入输出不对称设计;配合新预训练方式与更大规模强化学习后训练,基准测试智能水平超越V4 Pro等旗舰模型。KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。自9月10日12时起Flash系列调价,空闲时段输入缓存命中降至0.02元/百万Token、未命中1元、输出4元,其中缓存命中输入价格降幅高达60%。延续峰谷分时计价,高峰时段(周一至周五9:00-12:00、14:00-18:00)价格为空闲时段两倍。2026年9月14日12:00之后至V4.1 Pro上线前,所有deepseek-v4-pro请求将全部路由至V4.1 Flash并按新单价计费。#热点跨界共创##老张聊科技# #DeepSeekV4.1Flash发布#
全部
来源
内容由AI生成

精选参考来源

1. #DeepSeekV4.1Flash发布#DeepSeek V4.1 Flash 上新,看完亮点总结下:原生多模态,全新因果编解码架构,552B MoE,激活控制优秀。性能超过 V4 Pro,硬件资源需求大幅下降,同步下调 API 价格。既能做到更高的智能上限,又把推理速度、显存成本一起优化。大模型技术迭代速度越来越快,持续期待后续社区的实测结果。#DeepSeekV4.1Flash发布#

2. #DeepSeekV4.1Flash发布#DeepSeek今日正式发布DeepSeek V4.1 Flash,这是全新模型结构系列中的最小尺寸模型,具备原生多模态视觉理解能力。经内部及多方外部测试,V4.1 Flash在性能、响应速度、计算费用及总处理用时等核心指标上均全面超越此前的V4 Pro模型。V4.1 Flash已上线DeepSeek开放平台,开发者将模型名称改为deepseek-flash即可调用,旧模型名deepseek-v4-flash和deepseek-v4-flash-vision-exp暂时路由到新模型。V4.1 Flash为552B参数的MoE模型,输入激活仅8B、输出激活16B,成本显著低于已知同尺寸模型。采用创新的causal-encoder-decoder结构,输入输出不对称设计;配合新预训练方式与更大规模强化学习后训练,基准测试智能水平超越V4 Pro等旗舰模型。KV Cache大幅缩减,对HBM需求降至上一代的1/4、SSD需求降至1/8,Agent场景缓存命中成本大幅降低;相对初代模型,KV Cache已缩减至原来的1/437。自9月10日12时起Flash系列调价,空闲时段输入缓存命中降至0.02元/百万Token、未命中1元、输出4元,其中缓存命中输入价格降幅高达60%。延续峰谷分时计价,高峰时段(周一至周五9:00-12:00、14:00-18:00)价格为空闲时段两倍。2026年9月14日12:00之后至V4.1 Pro上线前,所有deepseek-v4-pro请求将全部路由至V4.1 Flash并按新单价计费。#热点跨界共创##老张聊科技# #DeepSeekV4.1Flash发布#

3. #DeepSeekV4.1Flash发布# 刚刚,DeepSeek V4.1 Flash 正式上线了!这次更新有几个值得关注的点:· 全新架构:采用 Causal-Encoder-Decoder 非对称设计,总参数 552B,输入仅激活 8B、输出激活 16B,推理成本大幅降低· 原生多模态:终于补齐了视觉理解能力,识图、文本、推理三合一,不用再手动切换模式· 性能反超:官方测试显示在多项基准上超越了 V4 Pro,代码和 Agent 任务表现尤其亮眼· 缓存大瘦身:KV Cache 压缩后,HBM 需求降至 1/4,SSD 需求降至 1/8,Agent 场景调用成本更友好了· 价格再降:Flash 系列闲时输入缓存命中低至 0.02 元/百万 Token,降幅达 60%9 月 14 日起,V4 Pro 的 API 请求会自动路由到 V4.1 Flash,按新价格计费。网页和 App 端也已经统一接入,直接就能用。国产大模型迭代速度越来越快了,你试过了吗?感觉怎么样?

4. #DeepSeekV4.1Flash发布# DeepSeek今天发了V4.1 Flash。552B参数的MoE,用了个新的Causal-Encoder-Decoder结构,输入输出不对称:输入激活8B,输出激活16B。参数堆得大,真干活时用的少,成本就下来了。然后是,把他们自家的V4 Pro干掉了。官方说在性能、费用、速度、总用时上全面超越V4 Pro。所以9月14号之后,访问V4 Pro的请求全部路由到V4.1 Flash,按Flash的价格计费。当然价格是重点。输出4块/百万token,缓存命中0.02元,闲时一律半价。加上KV Cache比初代压缩了437倍、对HBM的需求降到四分之一,跑Agent和长上下文的人,会实惠很多。另外,原生多模态视觉,模型名统一成deepseek-flash,旧名字暂时兼容路由过去,迁移成本基本为零。腾讯WorkBuddy、CodeBuddy和OpenCode已经全量接入。我在Lobster上也已经在用了。以前是小模型又快又便宜,但不够聪明。现在是最小的那个最便宜,还比旗舰聪明。梁圣又要卷了。

5. 外媒破防了,16万颗AI芯片,25.6亿美元,全是国产芯片。 刚刚,有外媒报道:DeepSeek计划在内蒙古乌兰察布建设一座大型智算中心,部署至少16万颗华为昇腾950DT芯片。按市场价每颗约1.6万美元估算,订单总额约25.6亿美元。而英伟达为中国市场特供的H20,售价1.5万到2.5万美元一颗

6. 互联网技术#DeepSeek计划于北京时间2026年9月10日前后正式发布V4.1 Flash模型。# DeepSeek计划9月10日前后推出V4.1 Flash,并把现有V4 Pro请求临时路由到新模型、按Flash低价计费,这套组合拳的信号很明确:它不想再让“Pro=贵、Flash=凑合”的二分法继续存在,而是要用轻量档把速度、多模态和成本一次打穿。从已披露信息看,V4.1 Flash的看点不在“又大又全”,而在“更便宜还能干重活”:官方称性能、费用、速度、总用时全面超过V4 Pro;新架构、原生多模态,内测反馈输出约280—400 token/秒,图文/截图/表格理解不再靠外挂视觉模块;9月10日12点起Flash重新计价,闲时缓存命中输入0.02元/百万token、未命中1元、输出4元,高峰翻倍。 对客服、知识库、代码生成、报表解析、Agent串联这类高并发、长前缀、反复调用的场景,这比单纯追参数实用得多。但评论要留半句冷话。厂商说“全面超越Pro”,通常指内部/外部选定基准下的综合账,不等于所有难任务都平替:超长文档推理、复杂数学、强工具规划、医学/法律等高风险问答,仍要看正式版公开评测而非内测体感。把Pro流量自动切到Flash是好事——用户省成本、迁移零改动;也是风险——若路由后在某些任务上质量回退,企业侧要有灰度、回滚和人工抽检。多模态更快更便宜后,OCR误读、图表幻觉、图片隐私、缓存复用带来的上下文泄露,也会跟着被放大。更大的行业含义是,大模型竞争正在从“谁榜高分”转向“谁把可用智能的边际成本压下来”。Flash化、峰谷计价、原生多模态、自动路由,本质都是把AI从demo预算拉到生产预算。对开发者是利好,对闭源高价API是压力;但对所有厂商也是提醒——降价不是终点,稳定、可审计、可降级,才决定模型能不能真正进业务系统。

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章