DeepSeek再掀开源狂潮:数学模型夺金,架构创新,硬核实力藏不住了

源自50位全网作者

01-15 07:25

近期,人工智能领域的明星公司DeepSeek动作频频,接连发布多项开源成果,以其在技术创新和开源共享上的决心,持续吸引着全球开发者的目光。从颠覆性的模型架构到具体应用领域的突破,DeepSeek正通过一系列“又开源了”的实际行动,展示其在AI浪潮中的硬核实力。

最引人瞩目的成就之一,当属其在数学推理领域的重大突破。DeepSeek开源了DeepSeek-Math-V2模型,该模型在国际数学奥林匹克(IMO)等多个顶级数学竞赛中达到了金牌水平,成为全球首个达成此成就的开源模型。这一成果的关键,在于其提出并实践了一套创新的“自验证”训练框架。传统的AI训练方法常因“结果导向”而忽视推理过程的严谨性,可能导致模型“猜”对答案但过程漏洞百出。DeepSeek-Math-V2则通过构建一个包含“生成器”(学生)、“验证器”(老师)和“元验证器”(教学监督)的协同系统,实现了AI的“自我反思”。模型在解题时不仅要给出答案,还要评估自身证明过程的可靠性,由验证器来检查逻辑链条,再由元验证器监督验证器的评判标准,形成一个不断迭代、自我完善的闭环。这种“左右互搏”的训练方式,让模型真正从“会做题”进化到“会证明”,系统性地提升了其数学推理的严谨性和深度。

DeepSeek再掀开源狂潮:数学模型夺金,架构创新,硬核实力藏不住了

在模型底层架构上,DeepSeek同样没有停下探索的脚步。通过与北京大学合作发表的署名梁文锋的新论文,DeepSeek提出了一种全新的“条件记忆”(Conditional Memory)机制,并开源了其实现模块Engram。该技术旨在解决当前大模型的一个痛点:模型需要耗费大量计算资源去重复处理一些静态、固定的知识,比如常见的实体名称或固定短语。Engram的思路非常直观,它为模型配备了一个类似“速查表”的记忆库。当遇到这些固定知识时,模型可以直接“查表”获取,而无需通过复杂的计算来“回忆”,从而将宝贵的计算资源解放出来,专注于更高级的动态推理任务。实验表明,这一机制能有效提升模型在知识调用、推理、代码和数学等任务上的表现,并被认为是通往下一代稀-疏模型,乃至DeepSeek-V4的关键一步。

DeepSeek再掀开源狂潮:数学模型夺金,架构创新,硬核实力藏不住了

为了提升模型处理长文本的效率并降低成本,DeepSeek还在DeepSeek-V3.2版本中正式引入了DeepSeek稀疏注意力(DSA)机制。传统注意力机制在处理长序列时计算量巨大,而DSA通过一个“闪电索引器”,让模型能快速评估并只关注上下文中最重要的部分,从而将计算复杂度从二次方级别降低到近似线性水平。这一创新不仅大幅提升了长文本的训练和推理效率,也直接惠及了广大开发者。伴随该模型的发布,DeepSeek也大幅下调了其API调用价格,让高性能AI服务变得更加普惠。这一举措获得了产业界的积极响应,华为、寒武纪、海光信息等国产AI芯片厂商纷纷宣布对新模型完成适配,形成了良好的生态联动。

此外,DeepSeek还将创新的视角延伸到了多模态领域,开源了DeepSeek-OCR模型。该模型验证了“上下文光学压缩”的可行性,即“一图胜千言”。它不再让AI逐字“阅读”文本,而是让其“观看”文本的图像,并对图像信息进行高效压缩。实验显示,在10倍的压缩比下,模型识别准确率仍能高达97%。这意味着可以用远少于传统文本的token量来表征丰富的文档信息,为解决大语言模型的长上下文处理难题开辟了一条全新的道路。这项创新不仅能识别文字,还能解析图表、化学公式等复杂内容,在科研、金融等领域展现了巨大的应用潜力,其思路甚至获得了OpenAI联合创始人安德烈·卡帕西(Andrej Karpathy)等业内专家的关注。

从不断迭代模型版本、扩展上下文窗口,到在数学、底层架构和多模态等领域进行颠覆式创新,DeepSeek正通过持续、高质量的开源贡献,向外界清晰地传递其技术路线。它不仅在追赶世界顶尖水平,更在多个关键方向上提出了自己的解决方案,推动着整个AI技术生态的演进和知识的民主化。

内容由AI生成

精选参考来源

1. 【#DeepSeek又开源了# 梁文锋署名新论文发布,实习生挑大梁】智东西1月13日报道,昨晚,DeepSeek又开源了...

【#DeepSeek又开源了# 梁文锋署名新论文发布,实习生挑大梁】智东西1月13日报道,昨晚,DeepSeek又开源了... 【 梁文锋署名新论文发布,实习生挑大梁】智东西1月13日报道,昨晚,De

2. DeepSeek新模型开源,新架构亮了,国产AI芯片集体狂欢

DeepSeek新模型开源,新架构亮了,国产AI芯片集体狂欢 DeepSeek新模型开源,新架构亮了,国产AI芯片集体狂欢36氪1759194971 DeepSeek离下一代架构,又近了一步!智东西9

3. 重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个

重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个 重磅!DeepSeek再开源:视觉即压缩,100个token干翻7000个新智元1760958768 编辑:KingHZ【新

4. 刚刚,DeepSeek新模型开源,五大能力变化明显,附一手体验

刚刚,DeepSeek新模型开源,五大能力变化明显,附一手体验 刚刚,DeepSeek新模型开源,五大能力变化明显,附一手体验36氪1755648995 智东西8月20日报道,昨日晚间,DeepSee

5. 重磅,DeepSeek再开源:视觉即压缩,100个token干翻7000个

重磅,DeepSeek再开源:视觉即压缩,100个token干翻7000个 重磅,DeepSeek再开源:视觉即压缩,100个token干翻7000个36氪1761010638 一图胜千言!Deep

6. 刚刚,DeepSeek新模型开源!五大能力变化明显,附一手体验

刚刚,DeepSeek新模型开源!五大能力变化明显,附一手体验 刚刚,DeepSeek新模型开源!五大能力变化明显,附一手体验智东西1755648516 智东西作者 | 陈骏达编辑 | 心缘智东西8月

7. #DeepSeek新模型能否再次爆火# 继此前凭高性价比开源模型一战成名,DeepSeek近期动作频频,开源Engram...

#DeepSeek新模型能否再次爆火# 继此前凭高性价比开源模型一战成名,DeepSeek近期动作频频,开源Engram... 继此前凭高性价比开源模型一战成名,DeepSeek近期动作频频,开源E

8. #DeepSeekV4架构或提前曝光#【#DeepSeek开源大模型记忆模块##DeepSeek发布梁文锋署名论文#】D...

#DeepSeekV4架构或提前曝光#【#DeepSeek开源大模型记忆模块##DeepSeek发布梁文锋署名论文#】D... 】DeepSeek于12日晚发布新论文《Conditional Memo

9. DeepSeek-V4核心公开?梁文锋署名新论文发布,实习生挑大梁

DeepSeek-V4核心公开?梁文锋署名新论文发布,实习生挑大梁 DeepSeek-V4核心公开?梁文锋署名新论文发布,实习生挑大梁智东西1768277196 智东西作者 | 骏达 王涵编辑 | 心

10. DeepSeek开源大模型记忆模块,梁文锋署名新论文,下一代稀疏模型提前剧透

DeepSeek开源大模型记忆模块,梁文锋署名新论文,下一代稀疏模型提前剧透 DeepSeek开源大模型记忆模块,梁文锋署名新论文,下一代稀疏模型提前剧透36氪1768288600 DeepSeek节

11. DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代模型剧透

DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代模型剧透 DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代模型剧透量子位1768264890 梦晨 发自 凹非寺量子位 | 公众

12. 【#DeepSeek开源大模型记忆模块# #DeepSeekV4架构或提前曝光#】#DeepSeek发布梁文锋署名论文#...

【#DeepSeek开源大模型记忆模块# #DeepSeekV4架构或提前曝光#】#DeepSeek发布梁文锋署名论文#... 【DeepSeek节前开始蓄力!最新论文直接给Transformer加上

13. DeepSeek又上新!模型硬刚谷歌,承认开源与闭源差距拉大

DeepSeek又上新!模型硬刚谷歌,承认开源与闭源差距拉大 DeepSeek又上新!模型硬刚谷歌,承认开源与闭源差距拉大第一财经1764595882 12月1日晚,DeepSeek又上新了两款新模型

14. DeepSeek发布梁文锋署名新论文 开源相关记忆模块Engram

DeepSeek发布梁文锋署名新论文 开源相关记忆模块Engram DeepSeek发布梁文锋署名新论文 开源相关记忆模块Engram和讯网1768266825 格隆汇1月13日|DeepSeek于1

15. DeepSeek 开源了一个数学推理大模型:DeepSeek-Math-V2 超越 Gemini 获得 IMO 金牌它不...

DeepSeek 开源了一个数学推理大模型:DeepSeek-Math-V2 超越 Gemini 获得 IMO 金牌它不... DeepSeek 开源了一个数学推理大模型:DeepSeek-Math-

16. 再创历史!DeepSeek最新开源模型Math-V2实现IMO金牌水准,提出可自验证的数学推理

再创历史!DeepSeek最新开源模型Math-V2实现IMO金牌水准,提出可自验证的数学推理 再创历史!DeepSeek最新开源模型Math-V2实现IMO金牌水准,提出可自验证的数学推理大数据文摘

17. #DeepSeek新模型有多猛# 开源AI杀疯了!首个IMO金牌数学模型横空出世🔥谁能想到,现在免费就能拥有“顶尖数学家...

#DeepSeek新模型有多猛# 开源AI杀疯了!首个IMO金牌数学模型横空出世🔥谁能想到,现在免费就能拥有“顶尖数学家... 开源AI杀疯了!首个IMO金牌数学模型横空出世🔥谁能想到,现在免费就能

18. DeepSeek-V3.2系列开源,性能直接对标Gemini-3.0-Pro

DeepSeek-V3.2系列开源,性能直接对标Gemini-3.0-Pro DeepSeek-V3.2系列开源,性能直接对标Gemini-3.0-Pro量子位1764597536 衡宇 发自 奥特赛

19. 新鲜出炉的,DeepSeek刚发了一个开源项目 LPLB github.com/deepseek-ai/LPLB/还是为...

新鲜出炉的,DeepSeek刚发了一个开源项目 LPLB github.com/deepseek-ai/LPLB/还是为... 新鲜出炉的,DeepSeek刚发了一个开源项目 LPLB github.

20. DeepSeek开源DeepSeekMath-V2 #ai新星计划 Intro: 00:00 DeepSeek开源DeepSeekMath-V2数学推理模型: 00:10 阶跃星辰发布 Step-A

各位观众早上好,今天是11月28日,星期五,欢迎收看AI早报。以上是今天的主要内容,接下来请看详细报道。DeepSeek开源了DeepSeek Math VR模型。这是一个6850亿参数的数学推理模型

21. DeepSeekMath-V2开启模型训练新范式! DeepSeekMath-V2正式开源,左右互搏无限进化,数学能力超越Gemini Deep Think!自验证数学推理训练流程深度详解,DeepS

如果我告诉你一个人既是运动员同时还是裁判并且还负责监督裁判并最终在这种左右互搏的游戏中能力暴涨你是不是觉得简直是天方夜谭啊是的或许人类不行但大模型可以啊这种一人分尸三绝通过左右互搏来提升自我能力实现无

22. DeepSeekMath-V2:开源「奥赛金牌级」数学模型

DeepSeekMath-V2:开源「奥赛金牌级」数学模型数学推理是考量大语言模型(LLM)能力的重要指标,如果能够进一步提升,还可以对科学研究产生影响。 通过利用奖励正确最终答案的强化学习来扩展

23. 2025年AI十大事件:DeepSeek开源炸场,谷歌绝地反击,独角兽扎堆IPO

2025年AI十大事件:DeepSeek开源炸场,谷歌绝地反击,独角兽扎堆IPO 2025年AI十大事件:DeepSeek开源炸场,谷歌绝地反击,独角兽扎堆IPO智东西1767182170 智东西编译

24. 【重磅发布】DeepSeekMath-V2正式开源!吊打Gemini DeepThink,模型训练新范式全解析!手把手带你玩转最强大模型!#ai #DeepSeek #大模型 #agent #人工智能

就在昨天晚上,也就是11月27日那么DeepSync悄悄发布了它最新的一款模型叫做DeepSync MathVR模型目前是世界排名第一的数学电力模型按照DeepSync的惯例的话它现在已经把模型开源并

25. Deepseek V3.2 万星开源项目实测!拒绝玩具demo!

就在今天DeepSync V3.2正式发布用一句话总结在动手之前他可以先动脑子去思考了那官方宣称呢是他首个将思考融入工具使用的一个开眼模型并且他也发布了一个特别版本专攻逻辑推理简单的说他可以做奥数节了

26. DeepSeekMath-V2破局!首款开源IMO金牌模型终结闭源时代

DeepSeekMath-V2破局!首款开源IMO金牌模型终结闭源时代 DeepSeekMath-V2破局!首款开源IMO金牌模型终结闭源时代科工洞洞拐1764332040 【本文仅在今日头条发布,谢

27. 重磅!DeepSeek推出DeepSeekMath‑V2模型

重磅!DeepSeek推出DeepSeekMath‑V2模型 重磅!DeepSeek推出DeepSeekMath‑V2模型每日经济新闻1764254663 11月27日,DeepSeek在Huggin

28. DeepSeek推出DeepSeekMath‑V2 模型,主攻自验证数学推理能力

DeepSeek推出DeepSeekMath‑V2 模型,主攻自验证数学推理能力 DeepSeek推出DeepSeekMath‑V2 模型,主攻自验证数学推理能力华尔街见闻1764252635 11月

29. DeepSeek前两天开源了个DeepSeek-OCR,不少博主都已经讲过了,讲的挺好的。但时不时会有粉丝让我再讲一下。...

DeepSeek前两天开源了个DeepSeek-OCR,不少博主都已经讲过了,讲的挺好的。但时不时会有粉丝让我再讲一下。... DeepSeek前两天开源了个DeepSeek-OCR,不少博主都已经讲

30. DeepSeek上新:开源模型首达IMO金牌水平,AI推理告别“死记硬背”

DeepSeek上新:开源模型首达IMO金牌水平,AI推理告别“死记硬背” DeepSeek上新:开源模型首达IMO金牌水平,AI推理告别“死记硬背”观察者网1764313877 (文/陈济深 编辑/

31. DeepSeek发布最强开源新品,瞄向全能Agent,给GPT-5与Gemini 3下战书

DeepSeek发布最强开源新品,瞄向全能Agent,给GPT-5与Gemini 3下战书 DeepSeek发布最强开源新品,瞄向全能Agent,给GPT-5与Gemini 3下战书钛媒体APP176

32. GPT-5危了,DeepSeek开源世界首个奥数金牌AI,正面硬刚谷歌

GPT-5危了,DeepSeek开源世界首个奥数金牌AI,正面硬刚谷歌 GPT-5危了,DeepSeek开源世界首个奥数金牌AI,正面硬刚谷歌36氪1764295251 沉寂许久的DeepSeek又

33. 刚刚,DeepSeek 再次创造历史,一出手就是数学奥赛金牌水平当 Gemini 和 Claude 接连炸场时,不少网友...

刚刚,DeepSeek 再次创造历史,一出手就是数学奥赛金牌水平当 Gemini 和 Claude 接连炸场时,不少网友... 刚刚,DeepSeek 再次创造历史,一出手就是数学奥赛金牌水平当 Ge

34. AI写小说神器,DeepSeek开源免费辅助,本地向量记忆工具箱

本期分享的AI写小说开源免费神器,链接已经放在置顶评论区了,大家可以自取。今天我们要聊的是一个困扰了无数网文作者,尤其是长篇小说作者的终极难题。你是不是也有过这样的经历,满怀激情地开了一本新书,设定了

35. DeepSeek-V3.2 在推理任务中的表现优于 GPT-5

DeepSeek-V3.2 在推理任务中的表现优于 GPT-5 DeepSeek-V3.2 在推理任务中的表现优于 GPT-5InfoQ1768120367 作者 | Anthony Alford 译

36. 看了第一个基于DeepSeek-OCR做的开源工具,终于打开思路了。

看了第一个基于DeepSeek-OCR做的开源工具,终于打开思路了。DeepSeek-OCR前几天给大家详细地讲过。当时我还说,大家很难用上,主要是能用到的场景太少了。DeepSeek-OCR虽然不能

37. 震惊全球,DeepSeek再放大招!DeepSeekMath-V2论文揭秘颠覆创新

震惊全球,DeepSeek再放大招!DeepSeekMath-V2论文揭秘颠覆创新 震惊全球,DeepSeek再放大招!DeepSeekMath-V2论文揭秘颠覆创新Silicn1764284469

38. 【DeepSeek出了新模型,数学推理赢了谷歌和GPT】#deepseek##AI超级工厂##大模型##谷歌# 11...

【DeepSeek出了新模型,数学推理赢了谷歌和GPT】#deepseek##AI超级工厂##大模型##谷歌# 11... 【DeepSeek出了新模型,数学推理赢了谷歌和GPT】 11月27

39. 一个强大的开源OCR工具,基于DeepSeek OCR

一个强大的开源OCR工具,基于DeepSeek OCR一个强大的开源OCR工具,基于DeepSeek OCRAi学习的老章1761296132 今天,我是Ai学习的老章向大家介绍一个非常出色的开源

40. 🔥文档处理神器!DeepSeek OCR 让复杂内容秒变整洁 Markdown🚀 今天给大家分享一个在线使用DeepSeek OCR的工具。 DeepSeek OCR是个开源AI模型,能把复杂的文档、

🔥文档处理神器!DeepSeek OCR 让复杂内容秒变整洁 Markdown🚀 今天给大家分享一个在线使用DeepSeek OCR的工具。 DeepSeek OCR是个开源AI模型,能把复杂的文档、

41. DeepSeek发布梁文锋署名新论文;百川智能开源医疗大模型Baichuan-M3|数智早参

DeepSeek发布梁文锋署名新论文;百川智能开源医疗大模型Baichuan-M3|数智早参 DeepSeek发布梁文锋署名新论文;百川智能开源医疗大模型Baichuan-M3|数智早参每日经济新闻1

42. 上周 DeepSeek-OCR 这个开源项目,在全球爆火,当人们都震惊于 DeepSeek 团队的创新能力之际的时候,一...

上周 DeepSeek-OCR 这个开源项目,在全球爆火,当人们都震惊于 DeepSeek 团队的创新能力之际的时候,一... 上周 DeepSeek-OCR 这个开源项目,在全球爆火,当人们都震惊于

43. #DeepSeek新模型能否再次爆火#DeepSeek新模型大概率会再次爆火,其MoE架构+DSA稀疏注意力技术,实现长...

#DeepSeek新模型能否再次爆火#DeepSeek新模型大概率会再次爆火,其MoE架构+DSA稀疏注意力技术,实现长... DeepSeek新模型大概率会再次爆火,其MoE架构+DSA稀疏注意力技

44. 第1个获得数学奥赛金牌的开源模型!DeepSeek新模型获网友盛赞:公开技术文件,了不起!

第1个获得数学奥赛金牌的开源模型!DeepSeek新模型获网友盛赞:公开技术文件,了不起!第1个获得数学奥赛金牌的开源模型!DeepSeek新模型获网友盛赞:公开技术文件,了不起!华尔街见闻17642

45. 【东吴电子陈海进】DeepSeekV3.2正式发布:思考融合工具,推理能力再跃升推理全面升级,Speciale版登顶多项...

【东吴电子陈海进】DeepSeekV3.2正式发布:思考融合工具,推理能力再跃升推理全面升级,Speciale版登顶多项... 【东吴电子陈海进】DeepSeekV3.2正式发布:思考融合工具,推理能

46. 零帧起手,不懂代码也可以用deepseek写程序 #知识分享 #deepseek #AI

完全不懂代码如何实现让DeepSeek帮我写程序OK 打开DeepSeek然后将我要实现的小程序功能发给它 那么这里我要写的是一个抽签小程序具备以下功能比如设计一个点击按钮点一次抽一次然后可以手动上传

47. DeepSeek发布梁文锋署名新论文 开源相关记忆模块Engram

DeepSeek发布梁文锋署名新论文 开源相关记忆模块Engram DeepSeek发布梁文锋署名新论文 开源相关记忆模块Engram财联社1768266308 【DeepSeek发布梁文锋署名新论文

48. DeepSeek开源OCR模型,视觉压缩技术突破

DeepSeek开源OCR模型,视觉压缩技术突破技术圈再迎重磅消息!DeepSeek-AI团队今日正式开源全新OCR模型DeepSeek-OCR,这项突破性研究实现了用极少量视觉token完成海量文本

49. DeepSeek开源全栈技术方案重塑全球大模型创新格局

DeepSeek开源全栈技术方案重塑全球大模型创新格局DeepSeek开源全栈技术方案重塑全球大模型创新格局通信世界1745826431 通信世界网消息(CWW)近期,深度求索(DeepSeek)

50. 为V4铺路?DeepSeek开源记忆模块刺痛硅谷,国外网友:我放弃抄谷歌了

为V4铺路?DeepSeek开源记忆模块刺痛硅谷,国外网友:我放弃抄谷歌了 为V4铺路?DeepSeek开源记忆模块刺痛硅谷,国外网友:我放弃抄谷歌了智猩猩1768332698 智猩猩AI整理编辑:
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章