DeepSeek V3.2更新:实现“边想边用”,API价格直接腰斩

源自50位全网作者

25-12-02

近日,DeepSeek公司发布了其v3.2系列的两个新模型:DeepSeek-V3.2和DeepSeek-V3.2-Speciale,引发了业界的广泛关注。此次更新不仅带来了模型性能的显著提升,更在底层技术架构和应用能力上实现了重要突破。

本次更新推出了两个定位不同的模型。DeepSeek-V3.2作为标准版,旨在平衡推理能力与运行效率,适合问答、通用智能体(Agent)任务等日常应用场景。据官方介绍,其在公开推理基准测试中的表现已达到一个非常高的水平,同时相比部分同类模型,V3.2的输出长度大幅降低,减少了用户的等待时间和计算开销。而DeepSeek-V3.2-Speciale则是一个“特长版”,作为长思考增强版本,专攻高难度任务。它结合了DeepSeek-Math-V2的定理证明能力,在数学证明、复杂逻辑验证和编程竞赛等领域表现突出,甚至在多项国际竞赛的模拟测试中斩获金牌。不过,Speciale版本在处理复杂任务时消耗的Tokens更多,成本也更高,目前主要以临时API形式开放给社区进行评测和研究,且暂不支持工具调用。

此次更新最大的技术亮点之一,是正式应用了自研的DeepSeek稀疏注意力机制(DeepSeek Sparse Attention, DSA)。传统注意力机制在处理长文本时,计算复杂度会随文本长度呈平方级增长,导致成本高、效率低。DSA通过引入细粒度的稀疏注意力,有效解决了这一瓶颈,可以将计算复杂度显著降低。这项技术在实验性版本中得到了验证,它能在几乎不影响模型性能的前提下,大幅提升长文本的训练和推理效率。这一架构层面的优化,直接促成了官方API价格超过50%的大幅下调,让大模型在长文本场景下的规模化应用变得更具可行性。

DeepSeek V3.2更新:实现“边想边用”,API价格直接腰斩

在模型能力方面,最核心的突破是实现了“思考融入工具调用”。以往的模型在思考和行动(调用工具)之间往往是割裂的,通常是先完成一系列思考规划,再执行工具调用。而DeepSeek-V3.2则实现了“边想边用”,模型可以在推理过程中动态调用工具(如搜索引擎、代码解释器),获取外部信息后继续思考和规划。这种模式更接近人类解决复杂问题的思维闭环,极大地增强了模型的Agent能力。为了实现这一能力,DeepSeek设计了一套大规模Agent训练数据合成方法,构造了超过1800个环境和85000多条复杂指令的强化学习任务,有效提升了模型在真实应用场景中的泛化能力。

此外,DeepSeek在后训练阶段的投入也值得关注。技术报告显示,其在强化学习(RL)上的计算投入超过了预训练成本的10%,这在开源模型中较为罕见。通过对GRPO(Group Relative Policy Optimization)等算法的改进,模型的高级推理能力得到了充分释放。

在开放生态方面,DeepSeek不仅开源了模型权重,还开源了研发过程中设计的GPU算子,包括TileLang和CUDA两种版本,并建议社区使用更易于调试的TileLang版本进行研究。同时,新模型也快速获得了华为昇腾、寒武纪等国产算力平台的支持与适配。

尽管取得了显著进展,DeepSeek也在技术报告中坦诚地指出了当前模型的局限性,例如由于总训练计算量相对较少,世界知识的广度仍有待提升;同时,模型的“Token效率”仍有优化空间,有时需要更长的思考链才能达到顶级闭源模型的效果。这些都将是其未来迭代的方向。

内容由AI生成

精选参考来源

1. Kimi:听说你在点我?

Kimi:听说你在点我? 今晚,DeekSeek一口气发布两个正式版模型:DeepSeek-V3.2 和 DeepSeek-V3.2-Speciale。一言蔽之,现在它脑子更灵活了,并且学会了一边动脑

2. 快评DeepSeek-V3.2,AI Agent 即将发生质变

快评DeepSeek-V3.2,AI Agent 即将发生质变 这次更新真正超预期的地方不在标准版“性能对标 GPT-5”,而是它直接把过去 AI Agent 最卡的三个死结一起解决了。 第一,它

3. DeepSeek-V3.2-Exp 新技术DSA真猛啊

DeepSeek-V3.2-Exp 新技术DSA真猛啊 DeepSeek-V3.2-Exp 召回摧枯拉朽!新的DSA机制真的有效果啊! 8K 94.4%!60K仍然有 71.4%!目前数据上仅次于

4. DeepSeek新模型上线!引入DSA新稀疏注意力

DeepSeek新模型上线!引入DSA新稀疏注意力 刚发V3.1“最终版”,DeepSeek最新模型又来了! DeepSeek-V3.2-Exp刚刚官宣上线,不仅引入了新的注意力机制——DeepS

5. DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3.2 系列模型正式发布:开源 AI 推理能力直逼...

DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3.2 系列模型正式发布:开源 AI 推理能力直逼... DeepSeek,正如其名,深耕求索 AI 边界。DeepSeek V3

6. D老师发力了,V3.2三大亮点解读

D老师发力了,V3.2三大亮点解读 💬9月29日,DeepSeek-V3.2-Exp模型正式在Hugging Face平台发布并开源 该版本作为迈向下一代架构的重要中间步骤,在V3.1-Termi

7. 原来DeepSeek这帮人这么牛🐮啊

原来DeepSeek这帮人这么牛🐮啊 该团队发表DeepSeek‑V3.2‑Exp 是 DeepSeek‑AI 公布的一个“实验性”模型版本,定位为其下一代架构过渡阶段。关键升级在于引入了一种新的注意

8. DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点?

DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点? 刚刚,DeepSeek已经官宣了新模型。这次直接发布两个V3.2的正式版模型:DeepSeek-V3.2 和 DeepSeek-V3.2

9. 对标 GPT-5!DeepSeekV3.2正式版发布:强化Agent能力 融入思考推理

对标 GPT-5!DeepSeekV3.2正式版发布:强化Agent能力 融入思考推理 对标 GPT-5!DeepSeekV3.2正式版发布:强化Agent能力 融入思考推理财闻1764588431

10. DeepSeek V3.2八股 VQA

DeepSeek V3.2八股 VQA 深感技术发展得太快了,技术报告一个接一个,遂以VQA的形式整理了下DeepSeek V3.2技术报告的八股,方便复习理解 Q1:DeepSeek-V3.2

11. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? 不得不说,DeepSeek团队效率和架构创新真的太牛逼了。细粒度稀疏注意力机制,长文本计算复杂度从指数增长降低到近似线性增长,效率大幅

12. DeepSeek V3.2正式发布:推理达GPT-5水平,智能体评测中开源模型最高水平

DeepSeek V3.2正式发布:推理达GPT-5水平,智能体评测中开源模型最高水平 DeepSeek V3.2正式发布:推理达GPT-5水平,智能体评测中开源模型最高水平澎湃新闻176459173

13. DeepSeekv3.2 发布亮点

DeepSeekv3.2 发布亮点 DeepSeekv3.2 亮点通俗版: 我觉得最重要的两点就这两个,一是模型推理复杂度降低提高了模型速度和长下文的能力;二是Agent任务能力大幅提升。 1、引入了

14. V3.2正式版:强化Agent能力,融入思考推理

V3.2正式版:强化Agent能力,融入思考推理 两个月前,我们发布了实验性的 DeepSeek-V3.2-Exp,并收到了众多热心用户反馈的对比测试结果。 目前未发现 V3.2-Exp 在任何特定场

15. DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点?

DeepSeek 更新两个 v3.2 新模型,这次有哪些亮点? 短的结论:同样配方的震撼 基本情况: DeepSeek 已经给国产模型和开源世界带来了太多的震撼和颠覆,并不介意再来一次。而这一次,“保

16. DeepSeek V3.2正式版发布:强化Agent能力,融入思考推理

DeepSeek V3.2正式版发布:强化Agent能力,融入思考推理 DeepSeek V3.2正式版发布:强化Agent能力,融入思考推理第一财经1764587783 据DeepSeek官微消息,

17. 开源最强!“拳打GPT 5”,“脚踢Gemini-3.0”,DeepSeek V3.2为何提升这么多?

开源最强!“拳打GPT 5”,“脚踢Gemini-3.0”,DeepSeek V3.2为何提升这么多? 开源最强!“拳打GPT 5”,“脚踢Gemini-3.0”,DeepSeek V3.2为何提升这

18. DeepSeek发布V3.2系列模型,强化Agent能力,推理能力追平GPT-5

DeepSeek发布V3.2系列模型,强化Agent能力,推理能力追平GPT-5 DeepSeek发布V3.2系列模型,强化Agent能力,推理能力追平GPT-5华尔街见闻1764588563 Dee

19. 🔥DeepSeek-V3.2发布,分享一下技术报告

🔥DeepSeek-V3.2发布,分享一下技术报告 今天,DeepSeek 正式推出了 DeepSeek-V3.2,这是一个将高计算效率与优秀推理和智能体性能相结合的模型。主要技术突破如下: 1️

20. DeepSeek 开源 V3.2-Exp,DSA 稀疏注意力机

DeepSeek 开源 V3.2-Exp,DSA 稀疏注意力机 DeepSeek 在假期前一天推出了大模型领域的重要更新 —— 开源 DeepSeek-V3.2-Exp。 DeepSeek-V3.2-

21. DeepSeek-V3.2系列开源,性能直接对标Gemini-3.0-Pro

DeepSeek-V3.2系列开源,性能直接对标Gemini-3.0-Pro DeepSeek-V3.2系列开源,性能直接对标Gemini-3.0-Pro量子位1764597536 衡宇 发自 奥特赛

22. DeepSeek-V3.2-Exp 发布,API大幅降价

DeepSeek-V3.2-Exp 发布,API大幅降价 今天,我们正式发布 DeepSeek-V3.2-Exp 模型,这是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步骤,

23. 硅基流动上线 DeepSeek-V3.2-Exp

硅基流动上线 DeepSeek-V3.2-Exp 大模型“价格屠夫”又发力了。DeepSeek-V3.2-Exp 开源,价格再砍一刀,比此前版本直降超 50%。 这是深度求索团队在模型架构上深度优

24. DeepSeek重磅发布全新模型,性能直逼Gemini 3.0 Pro!

DeepSeek重磅发布全新模型,性能直逼Gemini 3.0 Pro! DeepSeek重磅发布全新模型,性能直逼Gemini 3.0 Pro!Silicn1764588939 今天,DeepSee

25. DeepSeek自研大模型V3.2亮相!华为、寒武纪芯片同步适配开源,API成本将降低50%以上

DeepSeek自研大模型V3.2亮相!华为、寒武纪芯片同步适配开源,API成本将降低50%以上 DeepSeek自研大模型V3.2亮相!华为、寒武纪芯片同步适配开源,API成本将降低50%以上华尔街

26. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? 刚刚看到,DeepSeek线上模型已经更新到DeepSeek-V3.2(严格来说叫DeepSeek-V3.2-Exp)。这次的V3.2

27. 📄 DeepSeek-V3.2 技术拆解

📄 DeepSeek-V3.2 技术拆解 DeepSeek 发布的 V3.2 技术报告中,最值得关注的不仅仅是 Benchmark 上的 SOTA,而是其在「计算效率」与「推理深度」之间所做的工程取舍

28. DeepSeek V3.2 的 DSA 技术是什么?

DeepSeek V3.2 的 DSA 技术是什么? Kevin9月29日,DeepSeek隆重推出 DeepSeek-V3.2-Exp,该模型首次引入 DeepSeek 稀疏注意力机制(DSA),实

29. DeepSeek v3.2 发布:人工智能全链条国产的算力突围

DeepSeek v3.2 发布:人工智能全链条国产的算力突围 DeepSeek v3.2 发布:人工智能全链条国产的算力突围路边同学1759199096 9 月 29 日,DeepSeek 大模型迎

30. DeepSeek-V3.2-Exp老陈解读

DeepSeek-V3.2-Exp老陈解读 昨天晚上,DeepSeek官宣发布V3.2-Exp。 [一R]本次升级,主要是在上周发布的V3.1最终版上面,使用DeepSeek新推出是DSA(Dee

31. DeepSeek-V3.2-Exp发布,API降五成,公开DSA

DeepSeek-V3.2-Exp发布,API降五成,公开DSA 刚刚, DeepSeek-V3.2-Exp 模型正式发布,这是一个实验性(Experimental)的版本。作为迈向新一代架构的中间步

32. DeepSeekV3.2让我能早下班了!!

DeepSeekV3.2让我能早下班了!! 今天下午,DeepSeek团队正式发布了V3.2版本,还同步介绍了这次升级的几个重点:更高效的多模态融合架构、更快的响应速度、更精准的任务规划能力。看完官方

33. DeepSeekV3.2:稀疏注意力提升长上下文效率

DeepSeekV3.2:稀疏注意力提升长上下文效率 DeepSeek-V3.2-Exp 是一款实验性模型,该模型基于 DeepSeek-V3.1-Terminus 进行持续训练,核心改进在于 Dee

34. 深度求索正式发布 DeepSeek-V3.2-Exp,本次更新有什么特别之处?

深度求索正式发布 DeepSeek-V3.2-Exp,本次更新有什么特别之处? 这次的V3.2一个最大亮点是成功把稀疏注意力应用上了,在效果几乎不变的情况下,API调用价格降低超过50%(其中输出to

35. ✨重磅更新|DeepSeek V3.2 ✖️ SGLang ✨

✨重磅更新|DeepSeek V3.2 ✖️ SGLang ✨ 我们很高兴地宣布:SGLang 成为了 DeepSeek V3.2 官方推荐的推理部署引擎! 🚀 在这次升级中,DeepSeek-V

36. DeepSeek更新V3.2版,成本低效果好

DeepSeek更新V3.2版,成本低效果好 DeepSeek-V3.2-Exp-Thinking 在SuperCLUE 9月的通用能力测评中以62.62分获得了国内第一名的成绩,与国际top1分差进

37. DeepSeek-V3.2-Exp发布并开源

DeepSeek-V3.2-Exp发布并开源 [浅肤色R]DeepSeek-V3.2-Exp模型正式发布并开源。模型引入稀疏 Attention 架构,这种架构能够有效降低计算资源消耗并提升模型推理效

38. 挑战华尔街定律,DeepSeek又放了个大招,两大新模型干啥用的?

挑战华尔街定律,DeepSeek又放了个大招,两大新模型干啥用的? 挑战华尔街定律,DeepSeek又放了个大招,两大新模型干啥用的?硬核熊猫说1764598703 本文仅在今日头条发布,谢绝转载De

39. 🔥DeepSeek V3.2:再次通过算法创新逼近闭源头部模型🌟DeepSeek V3.2 正式版发布。两个月前其实就有...

🔥DeepSeek V3.2:再次通过算法创新逼近闭源头部模型🌟DeepSeek V3.2 正式版发布。两个月前其实就有... 🔥DeepSeek V3.2:再次通过算法创新逼近闭源头部模型🌟Deep

40. deepseek更新版v3.2已上线,附5个实测效果

deepseek更新版v3.2已上线,附5个实测效果 深度求索延续了节前卡点更新的惯例,于 9 月 29 日正式上线了其新的实验性模型——DeepSeek-V3.2-Exp. 该版本是针对企业场景优化

41. DeepSeek V3.2 追平 Gemini:V4 还有多远?这一年究竟在憋什么大招?

DeepSeek V3.2 追平 Gemini:V4 还有多远?这一年究竟在憋什么大招? DeepSeek V3.2 追平 Gemini:V4 还有多远?这一年究竟在憋什么大招?不二小段1764595

42. DeepSeek V3.2-Exp发布,向Gemini看齐?

DeepSeek V3.2-Exp发布,向Gemini看齐? 预热了一下午,DeepSeek V3.2-Exp来了,开始学Google Gemini了么(各种Exp) [鄙视R]最大的惊喜是下面这

43. 如何看待DeepSeek发布的新模型DeepSeek-Math-V2?

如何看待DeepSeek发布的新模型DeepSeek-Math-V2? deepseek-v3.2为什么那么重视降本,而且是降低某些人(如chenqin)嗤之以鼻的inference cost,其实就

44. 终于知道为啥之前用不好DeepSeek3.2了

终于知道为啥之前用不好DeepSeek3.2了 国庆前,DeepSeek 发布了 DeepSeek-V3.2-Exp,官方报告性能挺强的,但有开发者说,实际部署时,总感觉结果不太满意,以为是用法不对。

45. DeepSeek V3.2发布:推理与工具能力双重升

DeepSeek V3.2发布:推理与工具能力双重升 DeepSeek V3.2正式版重磅发布,带来推理能力和工具调用的双重提升,性能与效率全方位优化。 🌟 版本亮点: ✔️ 推理能力全面升级 V

46. DeepSeek发布最强开源新品,瞄向全能Agent,给GPT-5与Gemini 3下战书

DeepSeek发布最强开源新品,瞄向全能Agent,给GPT-5与Gemini 3下战书 DeepSeek发布最强开源新品,瞄向全能Agent,给GPT-5与Gemini 3下战书钛媒体APP176

47. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? Huggingface的这个吐槽绝了,DeepSeek发新产品的时间节点貌似都在法定节假日前的1-10天不等。这次发布的V3.2是接着

48. DeepSeek-V3.2-Exp RL细节

DeepSeek-V3.2-Exp RL细节 论文:DeepSeek-V3.2-Exp: Boosting Long-Context Efficiency with DeepSeek Sparse A

49. DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注?

DeepSeek-V3.2-Exp版本更新,有哪些信息值得关注? 创意写作评价:自成一派,登堂入室!中文写作主观评分:DeepSeek-V3.2-Exp (Thinking)8.69 分DeepSee

50. DeepSeek团队发布视觉压缩OCR模型,哪些信息和技术亮点值得关注?

DeepSeek团队发布视觉压缩OCR模型,哪些信息和技术亮点值得关注? 这问题没热度真是可惜,我找deepseek探讨了一会,发个ds的总结,方便像我一样不懂技术细节的门外汉理解这次更新的意义,后面
2
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章