DeepSeek V4.1 Flash:架构重构,超越旗舰

源自50位全网作者

08:20

DeepSeek正式推出了全新的 V4.1 Flash 模型。与以往简单增减参数规模的迭代不同,这次升级的核心在于底层架构的彻底重构。这款模型凭借全新的结构设计,不仅在推理速度和计算吞吐上实现了显著跃升,更在综合智能水平——特别是智能体(Agent)和编程场景中,展现出了超越自家上一代旗舰模型 V4 Pro 的表现。它的发布标志着大模型行业正从单纯拼杀参数规模,转向依靠架构创新追求极致性价比与实用落地。

DeepSeek V4.1 Flash:架构重构,超越旗舰

在架构设计上,DeepSeek V4.1 Flash 采用了全新的因果编码器-解码器(CED)结构,模型主体包含5520亿参数,但在运行机制上做出了精妙的“非对称”设计。在智能体等实际应用场景中,大模型往往面临“读取上下文极长、生成回答较短”的负载特点。CED架构将40层神经网络拆分为前20层编码器与后20层解码器,在输入预填充阶段仅激活80亿参数,到了生成输出阶段才激活160亿参数。这种设计让模型在读取海量上下文时大幅减轻了计算负担,显著降低了服务器预填充开销。同时,它还外挂了1960亿参数的 Engram 条件记忆模块,并实现了原生多模态视觉理解,无需额外挂载视觉组件即可直接处理图文混合任务。

长期以来,超长上下文和多轮智能体任务最大的硬件瓶颈在于显存与存储的占用。V4.1 Flash 通过第二代压缩稀疏注意力机制(CSA2)、FP4低精度量化以及滑动窗口有限回放等技术,对键值缓存(KV Cache)进行了深度压缩。相较于初代模型,其单 Token 全局缓存体积缩减了437倍;与上一代相比,对高带宽内存(HBM)的需求缩减至四分之一,对固态硬盘(SSD)的存储需求更是降至八分之一。这种存储维度的优化,直接降低了百万 Token 级超长上下文在工业级生产中的部署门槛与硬件成本。

架构的重构带来了直观的性能与体验提升。在实际运行中,V4.1 Flash 的生成速度普遍可达每秒300至400个 Token,首字响应时间显著缩短。在衡量代码智能体和工程自动化任务解决能力的测试集(如 DeepSWE v1.1、Terminal-Bench 和 CyberGym)中,它展现出了极强的实际问题解决能力,部分跑分甚至赶超了行业内的顶尖闭源模型。不过客观来看,在 GPQA Diamond 等侧重高阶科学推理的学术测试中,它与国际顶尖的旗舰闭源模型相比仍存有一定差距,其优势主要集中于高频的编程、智能体以及工程落地场景。

随着底层算力与存储开销的大幅削减,DeepSeek 也随之调整了商业策略与计费方案。API 调用价格整体下调,并继续采用峰谷分时计费机制,空闲时段缓存命中输入单价降至每百万 Token 0.02元。由于 V4.1 Flash 在综合表现与性价比上已具备明显优势,DeepSeek 计划逐步下线 V4 Pro 模型,并将相关 API 请求路由至 V4.1 Flash 处理,按新单价计费。在面向普通用户的客户端,原有快速、专家、识图等多个对话模式也完成合并,统一由该模型提供支持。同时,新模型与自研智能体框架 DeepSeek Harness 进行了深度适配,并同步开源了模型权重,全量接入了合作方的开发者工具生态。

DeepSeek V4.1 Flash:架构重构,超越旗舰

DeepSeek V4.1 Flash 的发布为大模型技术路线提供了一个极具参考价值的范式转换。它证明了通过巧妙的非对称网络设计、极致的存储压缩以及软硬件协同优化,轻量化激活的模型同样可以在复杂应用场景中实现越级表现。这种“高智能、高速度、平民价”的组合,不仅重塑了自身的产品矩阵,也极大地推动了长上下文智能体应用在商业化场景中的落地步伐。

内容由AI生成

精选参考来源

1. 深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手

深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手 深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手雷峰网1789039070 KV 缓存暴降 4

2. DeepSeek 今天发了 V4.1-Flash 技术报告

DeepSeek 今天发了 V4.1-Flash 技术报告 跑分表很热闹,但我想让你先看另一条曲线,历代模型每 token 的全局 KV 缓存字节数。V1 是 389,120,V3.2 降到 48,0

3. DeepSeek V4.1 Flash 内测上线,新架构加持,支持原生多模态

DeepSeek V4.1 Flash 内测上线,新架构加持,支持原生多模态 DeepSeek V4.1 Flash 内测上线,新架构加持,支持原生多模态钱江晚报1788856502 潮新闻客户端 记

4. DeepSeek V4.1 Flash转正,模型价格战继续

DeepSeek V4.1 Flash转正,模型价格战继续 DeepSeek V4.1 Flash转正,模型价格战继续第一财经1789030826 “鲸鱼回来了。”9月10日,经过两天内测,DeepS

5. 刚刚,DeepSeek V4.1 Flash正式发布!

刚刚,DeepSeek V4.1 Flash正式发布! 刚刚,DeepSeek V4.1 Flash正式发布!新智元1789020212 DeepSeek 发布原生多模态模型 V4.1 Flash,5

6. 全新款DeepSeek突破KV Cache压缩极限

全新款DeepSeek突破KV Cache压缩极限 长程Agent的普及让模型负载日益"输入密集",Prefill算力开销与庞大KV Cache对HBM、SSD的挤占,已成为部署成本的核心瓶颈。Dee

7. DeepSeek发新模型,对HBM需求降至原来1/4

DeepSeek发新模型,对HBM需求降至原来1/4 DeepSeek发新模型,对HBM需求降至原来1/4观察者网1789032240 (文/赖家琪 编辑/吕栋)9月10日,DeepSeek正式发布新

8. Deepseek-V4.1-Flash 论文给我看爽了!

Deepseek-V4.1-Flash 论文给我看爽了! Deepseek-V4.1-Flash 这个模型 感觉是 Deepseek 的阶段性成果的集大成者了: ㅤ 这次把此前公开论文里的技术几乎都塞

9. Deepseek V4 Pro正式版已被干掉了

Deepseek V4 Pro正式版已被干掉了 主角:DeepSeek V4 Pro 正式版。生于 2026 年 8 月 13 日,卒于 2026 年 9 月 10 日前后——享年 28 天。 ✨ 官

10. DeepSeek V4.1 Flash:更强、更快、更普惠

DeepSeek V4.1 Flash:更强、更快、更普惠 今天,我们正式发布 DeepSeek V4.1 Flash 模型,具备原生多模态视觉理解能力,能力更强,速度更快,价格更优惠。 - 552B

11. 9月10日,DeepSeek正式发布V4.1 Flash模型。官方宣称,经内部与多方外部测试,V4.1 Flash在性能...

9月10日,DeepSeek正式发布V4.1 Flash模型。官方宣称,经内部与多方外部测试,V4.1 Flash在性能... 9月10日,DeepSeek正式发布V4.1 Flash模型。官方宣称,

12. 深度求索发布DeepSeek V4.1 Flash 的中间版本内测,该模型体验如何?

深度求索发布DeepSeek V4.1 Flash 的中间版本内测,该模型体验如何? 你们先蹬,我等六点梁文谷再蹬。官方说法是:新模型结构、原生多模态、能力更强、速度更快、成本更低。问卷里还提到:“你

13. DeepSeek V4.1 Flash 测试版上线,速度很快但口碑有分歧

DeepSeek V4.1 Flash 测试版上线,速度很快但口碑有分歧 DeepSeek V4.1 Flash 测试版上线,速度很快但口碑有分歧西瓜散人1788871117 DeepSeek 放出了

14. 刚刚,Flash统一了DeepSeek 今日,DeepSeek新模型 V4.1 Flash正式上线。 官方称V4...

刚刚,Flash统一了DeepSeek 今日,DeepSeek新模型 V4.1 Flash正式上线。 官方称V4... 刚刚,Flash统一了DeepSeek 今日,DeepSeek新模型

15. DeepSeek V4.1Flash,这斩断线的没谁了!

DeepSeek V4.1Flash,这斩断线的没谁了! 🔥 DeepSeek V4.1 Flash 快得不得了 他们给这东西喂了什么? 🏆 便宜,但强得不含糊:1% 的成本,拿榜首 98% 的

16. 如何评价正式发布的 DeepSeek V4.1 Flash?

如何评价正式发布的 DeepSeek V4.1 Flash? 这次变化还是挺大的,原生多模态加全新框架,参数上来的同时,速度还变快了,基本全面超越了 V4-Pro :这里的非对称激活 / 全新架构说的

17. 原生多模态支持!DeepSeek V4.1-Flash内测:能力更强、速度更快、成本更低

原生多模态支持!DeepSeek V4.1-Flash内测:能力更强、速度更快、成本更低 原生多模态支持!DeepSeek V4.1-Flash内测:能力更强、速度更快、成本更低澎湃新闻1788857

18. 如何评价正式发布的 DeepSeek V4.1 Flash?

如何评价正式发布的 DeepSeek V4.1 Flash? 短的结论:最是一年春好处 基本情况: DeepSeek 与众不同的是,他们热衷,并且擅长通过底层创新来提效,在这样持续不懈努力之下,即便会

19. DeepSeek V4.1 Flash正式上线!已适配Harness

DeepSeek V4.1 Flash正式上线!已适配Harness DeepSeek V4.1 Flash正式上线!已适配Harness机器之心Pro1789023482 太快了。周四上午,Deep

20. 如何看待2026年9月9日deepseek官网公告将v4pro统一路由至v4.1flash?

如何看待2026年9月9日deepseek官网公告将v4pro统一路由至v4.1flash? 官方公告其实有三层核心信息:V4.1 Flash 暂时替换 V4 Pro 这个决定应该算是合理的(但是是不

21. #DeepSeekV4.1Flash内测# DeepSeek V4.1 Flash低调开启内测,最核心变化就是原生...

#DeepSeekV4.1Flash内测# DeepSeek V4.1 Flash低调开启内测,最核心变化就是原生... DeepSeek V4.1 Flash低调开启内测,最核心变化就

22. dsh 0.1.5 正式发布,V4.1 Flash 太顶了!

dsh 0.1.5 正式发布,V4.1 Flash 太顶了! 家人们,DeepSeek 这次双喜临门 🎉 9 月 10 日同一天: ✅ dsh v0.1.5 正式发布 ✅ DeepSeek V4.

23. #DeepSeekV4.1Flash发布#DeepSeek V4.1 Flash来了,这次更新看点挺实在。最大变化是原生...

#DeepSeekV4.1Flash发布#DeepSeek V4.1 Flash来了,这次更新看点挺实在。最大变化是原生... DeepSeek V4.1 Flash来了,这次更新看点挺实在。最大变化

24. DeepSeek V4.1Flash发布

DeepSeek V4.1Flash发布 DeepSeek V4.1 Flash 是一个全新的中间版本内测模型,于2026年9月8日开启内测。它并非V4 Flash的简单升级,而是一次架构层面的重构。

25. #DeepSeekV4.1Flash发布#近日,DeepSeek V4.1 Flash正式对外发布,这次最大亮点是原生搭...

#DeepSeekV4.1Flash发布#近日,DeepSeek V4.1 Flash正式对外发布,这次最大亮点是原生搭... 近日,DeepSeek V4.1 Flash正式对外发布,这次最大亮点是

26. Deepseek-V4.1-Flash 直接干掉了V4-Pro!!

Deepseek-V4.1-Flash 直接干掉了V4-Pro!! 很好!V4.1-Flash 正式发布! 牢梁又变成了梁圣了! DeepSeek V4.1 Flash 发布稳稳地干掉了之前的

27. 如何评价DeepSeek-V4 Flash 正式版,有哪些亮点?

如何评价DeepSeek-V4 Flash 正式版,有哪些亮点? 和GLM‑5.2 比,八战八胜,已经杀死比赛了。DeepSeek‑V4‑Flash:不好意思啦~我确实是正式版 API 公测啦!我也确

28. DeepSeek V4.1 Flash 9月10日前后发布 全面超越V4 Pro

DeepSeek V4.1 Flash 9月10日前后发布 全面超越V4 Pro DeepSeek V4.1 Flash 9月10日前后发布 全面超越V4 ProCNMO科技1788941141 【C

29. Deepseek V4.1 测评报告!究竟有多能打?

Deepseek V4.1 测评报告!究竟有多能打? Deepseek V4.1 测评报告!究竟有多能打? 好视频扶持计划 Deepseek v4.1‑flash 内测版本新鲜实测!使用祖传测试用例最

30. DeepSeek V4.1 Flash 上新:越级,还降价

DeepSeek V4.1 Flash 上新:越级,还降价 DeepSeek 又更新了,这次值得说。 新模型叫 V4.1 Flash,官方原话:能力更强,速度更快,价格更优惠。 1️⃣ 越级了

31. DeepSeek 4.1Flash快到爆炸

DeepSeek 4.1Flash快到爆炸 实测速度最少是4.0Flash的2倍,太牛了 今日DeepSeek V4.1 Flash 的中间版本正式开启内测邀请。据了解,新模型采用了新的模型结构,

32. DeepSeek-V4.1-Flash 技术报告里12个Insigh

DeepSeek-V4.1-Flash 技术报告里12个Insigh DeepSeek 这次推出的 V4.1-Flash 是一个 552B 骨干参数的多模态 MoE 模型,prefill 只激活 8B

33. 国外媒体测试DeepSeek V4.1 Flash性能

国外媒体测试DeepSeek V4.1 Flash性能 DeepSeek V4.1 Flash 与 @deepseek_ai 的性能。 在根据用户需求的日常设计任务中,其表现达到了 GPT-6 Ast

34. DeepSeek V4.1 Flash 真夯啊

DeepSeek V4.1 Flash 真夯啊 V4.1 Flash在 性能、费用、速度、总用时全面超越V4 Pro。 基准测试部分超过 Kimi-K3、GLM-5.3。 之前所有的Flash

35. Codex 接入 DeepSeek-V4-Flash,丝滑的一批

Codex 接入 DeepSeek-V4-Flash,丝滑的一批 DeepSeek-V4-Flash 的一经发布属实非常炸裂了,昨天发布之后,明显 DeepSeek 的响应速度变得很慢了,我估计大家都

36. 深度求索发布DeepSeek V4.1 Flash 的中间版本内测,该模型体验如何?

深度求索发布DeepSeek V4.1 Flash 的中间版本内测,该模型体验如何? 好踏马地快,像蹿稀一样的速度,很有爽感。而且不止是 decode tokens/s 能打到 400+,首字速度(t

37. 【DeepSeek V4.1 Flash模型正式发布】9月10日,DeepSeek正式发布DeepSeek V4.1 F...

【DeepSeek V4.1 Flash模型正式发布】9月10日,DeepSeek正式发布DeepSeek V4.1 F... 【DeepSeek V4.1 Flash模型正式发布】9月10日,Dee

38. DeepSeek V4.1 Flash 进化更强?价格还降了

DeepSeek V4.1 Flash 进化更强?价格还降了 刚看到 DeepSeek 这次的更新,我确实愣了一下。 官方计划逐步下线 V4 Pro:北京时间 9 月 14 日 12:00 起,调用

39. 如何评价正式发布的 DeepSeek V4.1 Flash?

如何评价正式发布的 DeepSeek V4.1 Flash? 刚刚,DeepSeek V4.1 Flash 如期正式发布了。这次 V4.1 Flash 比我想象的变化大。模型总参数提升到了 552B,

40. 突发!DeepSeek4.1 灰测了!

突发!DeepSeek4.1 灰测了! 刚刚DeepSeek官方宣布,已经开始V4.1 Flash 的中间版本内测。 V4.1 Flash采用了新的模型结构,原生多模态支持、能力更强、速度更快、且

41. DeepSeek V4 flash 正式版发布,有哪些亮点值得关注?

DeepSeek V4 flash 正式版发布,有哪些亮点值得关注? 终于来了!刚刚,DeepSeek-V4-Flash 正式版 API 上线(App和网页未更新),目前已开启公测。模型权重也已经开源

42. DeepSeek V4.1 新在哪

DeepSeek V4.1 新在哪 DeepSeek 今天中午发了 V4.1 Flash,同一天宣布把自家旗舰 V4 Pro 送下线。 9 月 14 日中午 12 点起,代码里写的 deepsee

43. #DeepSeekV4.1Flash发布# DeepSeek V4.1 Flash正式发布,这次我比较关注的不是单纯“参...

#DeepSeekV4.1Flash发布# DeepSeek V4.1 Flash正式发布,这次我比较关注的不是单纯“参... DeepSeek V4.1 Flash正式发布,这次我比较关注的不是单

44. DeepSeek V4.1 Flash正式发布,有几个细节值得关注:首先,它开始支持原生多模态视觉理解,意味着图像不再只...

DeepSeek V4.1 Flash正式发布,有几个细节值得关注:首先,它开始支持原生多模态视觉理解,意味着图像不再只... DeepSeek V4.1 Flash正式发布,有几个细节值得关注:首先

45. DeepSeek4.1全网真实口碑

DeepSeek4.1全网真实口碑 DeepSeek 又搞偷袭了🐳 9月8号,V4.1 Flash 悄悄开内测,没发布会、没技术报告、没跑分表,就往开发者群里丢了个模型。名字还叫 expires-

46. #DeepSeekV4.1Flash发布#DeepSeek新出的V4.1 Flash看点挺有意思,别看它是系列里尺寸最小...

#DeepSeekV4.1Flash发布#DeepSeek新出的V4.1 Flash看点挺有意思,别看它是系列里尺寸最小... 这次最大亮点是全新非对称MoE架构,激活参数量很小,直接把算力开销打

47. DS v4.1flash国产全模型实测:道阻且长

DS v4.1flash国产全模型实测:道阻且长 deepseek-v4.1-flash-expires-on-0910于8号下午开始内测,我手头正好有一个复杂度较高的真实代码工程项目,因此,我借助一

48. Deepseek v4.1 flash用起来极度舒适

Deepseek v4.1 flash用起来极度舒适 由于v4 pro太区好久没用Deepseek了,今天回坑感受就是:快!好快[萌萌哒R][萌萌哒R]在这个质量的模型里面算是最快的一个,243tok

49. DeepSeek-V4.1-Flash模型正式发布!

DeepSeek-V4.1-Flash模型正式发布! 今天(9月10日),deepseek正式发布DeepSeek-V4.1-Flash模型! DeepSeek-V4.1-Flash模型采用了新的

50. 刚刚!DeepSeek V4.1 Flash 来了,原生多模态支持。 本次模型换了新结构,并在原生层面支持多模态。新...

刚刚!DeepSeek V4.1 Flash 来了,原生多模态支持。 本次模型换了新结构,并在原生层面支持多模态。新... 刚刚!DeepSeek V4.1 Flash 来了,原生多模态支持。
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章