DeepSeek V3.2更新:自研架构大降价,模型学会“边想边做”

源自50位全网作者

25-12-02

近期,DeepSeek 公司接连发布了多个 V3.2 系列新模型,引发了人工智能领域的广泛关注。这次更新不仅包括一个奠定技术基础的实验性版本,还正式推出了两个面向不同应用场景的正式版模型,在技术创新、模型能力和商业化落地等多个层面都带来了显著亮点。

更新的核心可以分为两个阶段。首先是作为技术探索的 DeepSeek-V3.2-Exp 实验性模型。它最大的创新在于引入了团队自研的 DeepSeek 稀疏注意力机制 (DeepSeek Sparse Attention, DSA)。传统注意力机制在处理长文本时,计算量会随着文本长度急剧增加,导致成本高昂、效率低下。DSA 机制则像一个智能过滤器,通过一个高效的“闪电索引器”快速筛选出上下文中最关键的信息,让模型只对这些重要部分进行精细计算。这一创新在几乎不影响模型性能的前提下,显著提升了长文本的训练和推理效率,为后续模型的升级奠定了“降本增效”的基础。

DeepSeek V3.2更新:自研架构大降价,模型学会“边想边做”

在验证了 DSA 技术的有效性后,DeepSeek 正式发布了两个 V3.2 模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。

DeepSeek-V3.2 是面向日常应用的标准版。它沿用了高效的 DSA 架构,旨在平衡强大的推理能力与合理的计算开销。在多个公开基准测试中,其综合能力被认为达到了行业顶尖水平。更重要的是,该版本重点强化了 Agent (智能体) 能力,首次实现了“思考融入工具调用”。这意味着模型在解决复杂问题时,不再是先规划好所有步骤再执行,而是可以像人一样“边想边做”,在思考过程中动态调用搜索、计算等外部工具,获取信息后再继续思考,极大地提升了处理复杂任务的泛化能力和准确性。

DeepSeek-V3.2-Speciale 则是为探索模型能力极限而生的“长思考增强版”。它专为处理高难度、高复杂度的逻辑推理任务而设计,融合了 DeepSeek 在数学领域的先进技术。该版本在多个国际顶级的数学和编程竞赛(如 IMO、ICPC、IOI 等)模拟测试中取得了金牌级别的优异成绩,证明了其在严谨的逻辑验证和数学证明方面具备顶尖实力。不过,强大的能力也意味着更高的计算成本,该模型在推理时会消耗更多的资源,目前主要作为研究用途开放,以供社区探索模型能力的边界。

除了模型能力上的飞跃,这次更新还带来了多项实际利好。得益于 DSA 机制带来的效率提升,DeepSeek 大幅下调了其官方 API 的价格,降价幅度超过 50%,显著降低了开发者和企业的使用成本。同时,所有新模型均已在官方网站、App 和小程序等平台同步上线,并已在 Hugging Face 和 ModelScope 等社区开源。为方便开发者研究,DeepSeek 还开源了实现 DSA 所需的 GPU 算子,并提供了基于 TileLang 和 CUDA 的两种版本。

值得注意的是,DeepSeek 的新模型发布后,华为昇腾、寒武纪等国产芯片厂商也迅速宣布完成了适配和支持。这表明国内 AI 产业从模型算法到硬件算力的协同正在不断加深,有助于构建更加自主可控的 AI 生态。

DeepSeek V3.2 系列的更新,不仅通过稀疏注意力机制在长文本处理效率上取得关键突破,还通过强化的 Agent 能力和极致的推理表现,进一步缩小了开源模型与顶级闭源模型的差距。加之大幅降低的 API 价格和对国产硬件生态的支持,这次更新无疑为 AI 技术的应用和普及注入了新的动力。

内容由AI生成

精选参考来源

1. DeepSeek新模型上线!引入DSA新稀疏注意力

DeepSeek新模型上线!引入DSA新稀疏注意力 刚发V3.1“最终版”,DeepSeek最新模型又来了! DeepSeek-V3.2-Exp刚刚官宣上线,不仅引入了新的注意力机制——DeepS

2. DeepSeek自研大模型V3.2亮相!华为、寒武纪芯片同步适配开源,API成本将降低50%以上

DeepSeek自研大模型V3.2亮相!华为、寒武纪芯片同步适配开源,API成本将降低50%以上 DeepSeek自研大模型V3.2亮相!华为、寒武纪芯片同步适配开源,API成本将降低50%以上华尔街

3. DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3.2 系列模型正式发布:开源 AI 推理能力直逼...

DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3.2 系列模型正式发布:开源 AI 推理能力直逼... DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3

4. DeepSeek更新V3.2版,成本低效果好

DeepSeek更新V3.2版,成本低效果好 DeepSeek-V3.2-Exp-Thinking 在SuperCLUE 9月的通用能力测评中以62.62分获得了国内第一名的成绩,与国际top1分差进

5. DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点?

DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点? 刚刚,DeepSeek已经官宣了新模型。这次直接发布两个V3.2的正式版模型:DeepSeek-V3.2 和 DeepSeek-V3.2

6. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? 不得不说,DeepSeek团队效率和架构创新真的太牛逼了。细粒度稀疏注意力机制,长文本计算复杂度从指数增长降低到近似线性增长,效率大幅

7. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? 刚刚看到,DeepSeek线上模型已经更新到DeepSeek-V3.2(严格来说叫DeepSeek-V3.2-Exp)。这次的V3.2

8. DeepSeek v3.2 发布:人工智能全链条国产的算力突围

DeepSeek v3.2 发布:人工智能全链条国产的算力突围 DeepSeek v3.2 发布:人工智能全链条国产的算力突围路边同学1759199096 9 月 29 日,DeepSeek 大模型迎

9. 深度求索正式发布 DeepSeek-V3.2-Exp,本次更新有什么特别之处?

深度求索正式发布 DeepSeek-V3.2-Exp,本次更新有什么特别之处? 这次的V3.2一个最大亮点是成功把稀疏注意力应用上了,在效果几乎不变的情况下,API调用价格降低超过50%(其中输出to

10. D老师发力了,V3.2三大亮点解读

D老师发力了,V3.2三大亮点解读 💬9月29日,DeepSeek-V3.2-Exp模型正式在Hugging Face平台发布并开源 该版本作为迈向下一代架构的重要中间步骤,在V3.1-Termi

11. DeepSeek最新发布: 12月1日晚间,DeepSeek发布两个正式版模型:DeepSeek-V3....

DeepSeek最新发布: 12月1日晚间,DeepSeek发布两个正式版模型:DeepSeek-V3.... DeepSeek最新发布: 12月1日晚间,DeepSe

12. DeepSeek-V3.2-Exp发布,API降五成,公开DSA

DeepSeek-V3.2-Exp发布,API降五成,公开DSA 刚刚, DeepSeek-V3.2-Exp 模型正式发布,这是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步

13. #DeepSeek新模型发布#DeepSeek V3.2-Exp 是 DeepSeek AI 于 2025 年 9 月 ...

#DeepSeek新模型发布#DeepSeek V3.2-Exp 是 DeepSeek AI 于 2025 年 9 月 ... DeepSeek V3.2-Exp 是 DeepSeek AI 于 20

14. 【DeepSeek发布V3.2系列模型,强化Agent能力,推理能力追平GPT-5】DeepSeek发布V3.2系列两款...

【DeepSeek发布V3.2系列模型,强化Agent能力,推理能力追平GPT-5】DeepSeek发布V3.2系列两款... 【DeepSeek发布V3.2系列模型,强化Agent能力,推理能力追平

15. 对标 GPT-5!DeepSeekV3.2正式版发布:强化Agent能力 融入思考推理

对标 GPT-5!DeepSeekV3.2正式版发布:强化Agent能力 融入思考推理 对标 GPT-5!DeepSeekV3.2正式版发布:强化Agent能力 融入思考推理财闻1764588431

16. #DeepSeek发布V3.2正式版#【#DeepSeekV3.2性能比肩GPT5# ,略低于 Gemini-3.0-P...

#DeepSeek发布V3.2正式版#【#DeepSeekV3.2性能比肩GPT5# ,略低于 Gemini-3.0-P... ,略低于 Gemini-3.0-Pro】 继两个月前发布实验性的 De

17. DeepSeek团队今日发布了DeepSeek-V3.2和DeepSeek-V3.2-Speciale两个正式版模型。V...

DeepSeek团队今日发布了DeepSeek-V3.2和DeepSeek-V3.2-Speciale两个正式版模型。V... DeepSeek团队今日发布了DeepSeek-V3.2和DeepSee

18. DeepSeek-V3.2-Exp发布并开源

DeepSeek-V3.2-Exp发布并开源 [浅肤色R]DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效

19. deepseek更新版v3.2已上线,附5个实测效果

deepseek更新版v3.2已上线,附5个实测效果 深度求索延续了节前卡点更新的惯例,于 9 月 29 日正式上线了其新的实验性模型——DeepSeek-V3.2-Exp. 该版本是针对企业场景优化

20. ✨重磅更新|DeepSeek V3.2 ✖️ SGLang ✨

✨重磅更新|DeepSeek V3.2 ✖️ SGLang ✨ 我们很高兴地宣布:SGLang 成为了 DeepSeek V3.2 官方推荐的推理部署引擎! 🚀 在这次升级中,DeepSeek-V

21. 原来DeepSeek这帮人这么牛🐮啊

原来DeepSeek这帮人这么牛🐮啊 该团队发表DeepSeek‑V3.2‑Exp 是 DeepSeek‑AI 公布的一个“实验性”模型版本,定位为其下一代架构过渡阶段。关键升级在于引入了一种新的注意

22. DeepSeek 今天憋了个大招——V3.2 正式版发布,而且一口气放出两个版本:标准版和 Speciale(特供版)。...

DeepSeek 今天憋了个大招——V3.2 正式版发布,而且一口气放出两个版本:标准版和 Speciale(特供版)。... DeepSeek 今天憋了个大招——V3.2 正式版发布,而且一口气放出

23. 🔥DeepSeek V3.2:再次通过算法创新逼近闭源头部模型🌟DeepSeek V3.2 正式版发布。两个月前其实就有...

🔥DeepSeek V3.2:再次通过算法创新逼近闭源头部模型🌟DeepSeek V3.2 正式版发布。两个月前其实就有... 🔥DeepSeek V3.2:再次通过算法创新逼近闭源头部模型🌟Deep

24. DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点?

DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点? 先省流:DeepSeek 更新并开源 V3.2 正式版,同时开源长思考增强版 V3.2 Speciale 模型。亮点:已经进 12 月了

25. DeepSeek V3.2 追平 Gemini:V4 还有多远?这一年究竟在憋什么大招?

DeepSeek V3.2 追平 Gemini:V4 还有多远?这一年究竟在憋什么大招? DeepSeek V3.2 追平 Gemini:V4 还有多远?这一年究竟在憋什么大招?不二小段1764595

26. #DeepSeek同时发布2款新模型# DeepSeek刚刚发布 V3.2 正式版:强化 Agent 能力,融入思考推理...

#DeepSeek同时发布2款新模型# DeepSeek刚刚发布 V3.2 正式版:强化 Agent 能力,融入思考推理... DeepSeek刚刚发布 V3.2 正式版:强化 Agent 能力,融

27. DeepSeek 刚刚发布了新模型——DeepSeek-V3.2-Speciale!从分数上看就是 DeepSeek-V...

DeepSeek 刚刚发布了新模型——DeepSeek-V3.2-Speciale!从分数上看就是 DeepSeek-V... DeepSeek 刚刚发布了新模型——DeepSeek-V3.2-Spe

28. DeepSeek这波创新有东西啊

DeepSeek这波创新有东西啊 DeepSeek-V3.2-Exp刚刚更新,虽然不是V4,但为了V4测试新架构,以及长文本和推理效率升级,API价格更是降50%以上: 1. 稀疏注意力革命 首

29. 2025年9月29日,DeepSeek发布了V3.2-Exp实验性模型。该模型在V3.1-Terminus基础上引入了D...

2025年9月29日,DeepSeek发布了V3.2-Exp实验性模型。该模型在V3.1-Terminus基础上引入了D... 2025年9月29日,DeepSeek发布了V3.2-Exp实验性模型。

30. DeepSeek-V3.2-Exp发布,且继续大降价。我请DS通俗解释了一下技术亮点,ta讲得很好:优势领域 具体表现⚡...

DeepSeek-V3.2-Exp发布,且继续大降价。我请DS通俗解释了一下技术亮点,ta讲得很好:优势领域 具体表现⚡... DeepSeek-V3.2-Exp发布,且继续大降价。我请DS通俗解释了

31. 又是长假之前更新DeepSeek-V3.2-Exp 发布!有两大看点。第一:DeepSeek Sparse Attent...

又是长假之前更新DeepSeek-V3.2-Exp 发布!有两大看点。第一:DeepSeek Sparse Attent... 又是长假之前更新DeepSeek-V3.2-Exp 发布!有两大看点。第

32. 【国盛计算机】DeepSeek-V3.2发布,国产模型再度引领创新DeepSeek-V3.2(标准版)在公开推理 Ben...

【国盛计算机】DeepSeek-V3.2发布,国产模型再度引领创新DeepSeek-V3.2(标准版)在公开推理 Ben... 【国盛计算机】DeepSeek-V3.2发布,国产模型再度引领创新Dee

33. 9月29日DeepSeek-V3.2-Exp 模型发布。作为迈向新一代架构的中间步骤,引入了 DeepSeek Spar...

9月29日DeepSeek-V3.2-Exp 模型发布。作为迈向新一代架构的中间步骤,引入了 DeepSeek Spar... 9月29日DeepSeek-V3.2-Exp 模型发布。作为迈向新一代架

34. DeepSeek 开源 V3.2-Exp,DSA 稀疏注意力机

DeepSeek 开源 V3.2-Exp,DSA 稀疏注意力机 DeepSeek 在假期前一天推出了大模型领域的重要更新 —— 开源 DeepSeek-V3.2-Exp。 DeepSeek-V3.2-

35. 【东吴电子陈海进】DeepSeekV3.2正式发布:思考融合工具,推理能力再跃升推理全面升级,Speciale版登顶多项...

【东吴电子陈海进】DeepSeekV3.2正式发布:思考融合工具,推理能力再跃升推理全面升级,Speciale版登顶多项... 【东吴电子陈海进】DeepSeekV3.2正式发布:思考融合工具,推理能

36. DeepSeek宣布正式发布两款型号:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。高效...

DeepSeek宣布正式发布两款型号:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。高效... DeepSeek宣布正式发布两款型号:DeepSeek-V3.2 和 D

37. DeepSeek又发新模型新架构,还阴了英伟达

DeepSeek又发新模型新架构,还阴了英伟达 【DeepSeek又发新模型新架构,成本降50%开挖英伟达墙角】 英伟达 DeepSeek-V3.2-Exp刚刚官宣上线,不仅引入了新的注意力机制——

38. ds发布重磅更新——DeepSeek-V3.2-Exp 模型。作为迈向新一代架构的中间步骤,V3.2-Exp引入了Dee...

ds发布重磅更新——DeepSeek-V3.2-Exp 模型。作为迈向新一代架构的中间步骤,V3.2-Exp引入了Dee... ds发布重磅更新——DeepSeek-V3.2-Exp 模型。作为迈向新

39. #DeepSeek同时发布2款新模型#Deepseek同时发布两个正式版模型:DeepSeek-V3.2和DeepSee...

#DeepSeek同时发布2款新模型#Deepseek同时发布两个正式版模型:DeepSeek-V3.2和DeepSee... Deepseek同时发布两个正式版模型:DeepSeek-V3.2和De

40. DeepSeek V3.2 的 DSA 技术是什么?

DeepSeek V3.2 的 DSA 技术是什么? Kevin9月29日,DeepSeek隆重推出 DeepSeek-V3.2-Exp,该模型首次引入 DeepSeek 稀疏注意力机制(DSA),实

41. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? DeepSeek-V3.2-Exp 是在 DeepSeek-V3.1-Terminus 的基础上通过持续训练引入 DeepSeek S

42. 刚刚,DeepSeek 发布了最新 V3.2 模型,主打高效推理与强大的 Agent 能力。引入稀疏注意力(DSA) 机...

刚刚,DeepSeek 发布了最新 V3.2 模型,主打高效推理与强大的 Agent 能力。引入稀疏注意力(DSA) 机... 刚刚,DeepSeek 发布了最新 V3.2 模型,主打高效推理与强大的

43. DeepSeek-V3.2-Exp官宣发布,性能更强,API价格腰斩

DeepSeek-V3.2-Exp官宣发布,性能更强,API价格腰斩 DeepSeek-V3.2-Exp官宣发布,性能更强,API价格腰斩观察者网1759139577 9月29日,DeepSeek-V

44. DeepSeekV3.2:稀疏注意力提升长上下文效率

DeepSeekV3.2:稀疏注意力提升长上下文效率 DeepSeek-V3.2-Exp 是一款实验性模型,该模型基于 DeepSeek-V3.1-Terminus 进行持续训练,核心改进在于 Dee

45. 英伟达员工带你上手实测 DeepSeek-V3.2-Exp

英伟达员工带你上手实测 DeepSeek-V3.2-Exp 最近一位 @NVIDIA英伟达 工程师录制了一期教程视频,带我们体验了最新的 DeepSeek-V3.2-Exp 模型 在 vLLM 上的推

46. DeepSeek,重大突发!

DeepSeek,重大突发! DeepSeek,重大突发!券商中国1759145193 刚刚,DeepSeek放大招!今日,DeepSeek宣布,官方App、网页端、小程序均已同步更新为DeepSee

47. 【#DeepSeek新模型降价#:优化推理效率,API价格降超50%】9月29日,DeepSeek正式发布DeepSee...

【#DeepSeek新模型降价#:优化推理效率,API价格降超50%】9月29日,DeepSeek正式发布DeepSee... 【:优化推理效率,API价格降超50%】9月29日,DeepSeek正式

48. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? 创意写作评价:自成一派,登堂入室!中文写作主观评分:DeepSeek-V3.2-Exp (Thinking)8.69 分DeepSee

49. 刚刚,DeepSeek开源V3.2-Exp,公开新稀疏注意力机制DSA

刚刚,DeepSeek开源V3.2-Exp,公开新稀疏注意力机制DSA 刚刚,DeepSeek开源V3.2-Exp,公开新稀疏注意力机制DSA机器之心Pro1759141998 机器之心报道机器之心编

50. 独家!DeepSeek新模型上线,全新注意力机制基于北大ACL最佳论文

独家!DeepSeek新模型上线,全新注意力机制基于北大ACL最佳论文 独家!DeepSeek新模型上线,全新注意力机制基于北大ACL最佳论文新智元1759147347 编辑:好困 定慧【新智元导读】
2
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章