DeepSeek V4数学推理成本降至竞品1/500

源自34位全网作者

06-07 20:05

内容由AI生成

精选参考来源

1. 为什么DeepSeek V4这么强?它到底更新了啥?

2. 国产开源大模型全球累计下载量突破100亿次,我国已成为全球人工智能专利最大拥有国,专利申请量全球占比达60%。目前,我国AI企业数量已超过6200家,2025年人工智能核心产业规模超过1.2万亿元。 DeepSeekV4与华为昇腾国产芯片体系深度适配,证明了国产大模型也可以在本土算力架构上更高效、更低成本地运行。

3. #DeepSeekV4 价格屠夫##DeepSeekV4 价格屠夫#刚用上GPT-5.5,转身就得给DeepSeek-V4让路,不到半天。OpenAI加价,DeepSeek降价,双管齐下让人哭笑不得。2元/百万Token的输出价,让Pro版12元的价格都显得“昂贵”,相比之下GPT-5.5 Pro高达180美元。Flash速度经济,Pro性能比肩顶级闭源,百万上下文还标配。当友商还在纠结性价比,DeepSeek已经用1.55‰的价格把Agent大战拉入普惠元年。算力成本遮羞布,这次真被扯干净了。 #DeepSeekV4比海外模型便宜约60%##黄仁勋预言的灾难仅9天就成真##DeepSeek昇腾首发#请问老黄现在作何感想?

4. 【#DeepSeekV4Pro大幅领先其他开源模型#】4月24日, DeepSeek全新系列模型DeepSeek-V4 的预览版本正式上线并同步开源,据介绍DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。模型按大小分为两个版本deepseek-v4-pro 和deepseek-v4-flash,其中DeepSeek-V4-Pro在 Agentic Coding 评测中,已达到当前开源模型最佳水平,并在其他 Agent 相关评测中同样表现优异;在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型 Gemini-Pro-3.1;在数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型,取得了比肩世界顶级闭源模型的优异成绩。(密度新闻)#DeepSeekV4深度适配国产算力##DeepSeek v4 百万上下文#

5. DeepSeek-V4终于更新了!一百万超长上下文,Agent能力大幅增强,能力接近Opus 4.6

6. #腾讯云DeepSeekV4最高降97.5%#【#DeepSeekV4系列模型大降价#】6月2日,腾讯云宣布,智能体开发平台将于北京时间2026年6月3日00:00对DeepSeek-V4系列模型价格进行下调,最高降幅达97.5%。本次调整仅涉及价格变更,模型服务能力保持不变。(界面新闻)@徽视点 腾讯云:DeepSeek-V4系列模型降价,最高降幅达97.5%

7. DeepSeek V4好用吗?【秋芝的AI开箱】

8. 【阿里云百炼上线DeepSeek-V4,API价格与官网一致】4月24日,阿里云百炼平台首发上线DeepSeek-V4-Pro与DeepSeek-V4-Flash两款模型,API定价与DeepSeek官网完全一致。核心信息:Flash版本输入价格最低1元/百万Tokens,输出最低2元/百万Tokens。两款模型均支持100万Tokens超长上下文,在Agent能力、世界知识和推理性能上达到开源顶尖水平。V4-Pro在Agentic Coding评测中已达开源模型最佳水平,并对OpenClaw、CodeBuddy等主流Agent产品做了适配优化。观察:阿里云百炼作为“AI模型超市”引入DeepSeek-V4系列,进一步丰富了平台模型生态。开发者无需在官网和云平台间二选一,按需调用即可。#阿里云百炼 #DeepSeekV4 #大模型

9. 「Github一周热点112期」DeepSeek V4王者归来,一个项目玩转GPT-Image-2

10. #DeepSeekV4比海外模型便宜约60%#【#DeepSeekV4深度适配华为芯片#】DeepSeek今天正式发布V4系列预览版并同步开源,分为V4-Pro和V4-Flash两个版本,主打100万(1M)超长上下文能力,官网、App及API均已同步更新。#DeepSeekV4深度适配国产芯片#据科技博主卡兹克实测,DeepSeekV4大概比海外模型平均便宜60%左右。DeepSeek V4的报告里,透露出非常多国产化的细节1. V4在后训练和推理体系里引入了MXFP4。虽然训练还是用的英伟达体系,但是在后训练和推理上用这个基本上就意味着,DeepSeek在往开放低精度格式和多硬件适配方向走,可以适配国产卡比如华为昇腾、寒武纪、壁仞等等。2. V4的底层内核不再完全靠CUDA写,用了一个叫TileLang的DSL。DeepSeek希望底层算子开发不要完全锁死在CUDA上,而是用更高一层的语言描述计算,再尽量编译到不同硬件上,这个非常牛逼,可以大大降低迁移成本。3. V4专门搞了一个叫MegaMoE的融合内核,设计目标是减少专家并行中的通信等待,目前已经在华为昇腾上跑通。卡兹克称:“这三条放一起,方向就非常清楚了,V4是完完全全的,为了国产卡而设计的模型。”(综合卡兹克)#DeepSeek v4 百万上下文#

11. #DeepSeekV4发布# DeepSeekV4终于发布了,简单总结下:1、双版本发布:推出 DeepSeek-V4-Pro(高性能)和 DeepSeek-V4-Flash(高性价比)两个版本,可按需选择。2、超长上下文:支持 1M token(约百万字) 的上下文长度,能一次性处理海量信息。3、核心能力领先:在 Agent能力、世界知识和推理性能 三方面均达到国内及开源模型的领先水平。4、具体任务表现:V4-Pro版本的代理编码能力接近顶尖闭源模型,在数学、编程等推理任务上超越所有已开源评测的模型。5、技术创新与迁移提醒:采用 DSA稀疏注意力机制 降低长上下文计算成本;原有 deepseek-chat 等模型名3个月后停止使用,需迁移到新名称。

12. 【#DeepSeek唯一遗憾无多模态##DeepSeekV4再次开出行业最低价#】DeepSeek今日宣布,拥有百万字超长上下文的deepseek-v4-pro和deepseek-v4-flash两款模型发布并开源,即日起登录官网或官方App即可与最新的DeepSeek-v4对话,探索1M(百万)超长上下文记忆的全新体验。 据官方公布基准测评,在上下文长度、知识、推理及Agent等能力上,DeepSeekv4性能比肩国际顶级闭源模型,达到国际开源模型一流水平。《BUG》栏目对比发现,在API调用价格上,去年以一己之力撬动国内大模型行业降价的DeepSeek,V4版本再次开出了行业“最低价”。 据DeepSeek官方介绍,受限于高端算力,目前Pro的服务吞吐量十分有限,预计下半年昇腾950超节点批量上市后,Pro的价格会大幅下调。 “虽然每百万Tokens调用价格国内模型均未下降太多,但超长上下文长度及不俗的性能,让其极具竞争优势!”有业内人士感慨道:“那个大模型价格屠夫,又回来了!” 遗憾的是,目前v4版本依然是一款纯文本模型,没有太多的文生图、文生视频等多模态能力。(新浪科技 文) “价格屠夫”!DeepSeekV4百万上下文打到2毛,国产卡将腰斩API价格?

13. 终于来了!DeepSeek-V4 正式发布!免费开源,百万上下文,Agent能力直逼Claude!| 零度解说

14. #DeepSeekV4 尺度#V4是DeepSeek首个在训练和推理层面与国产芯片(华为昇腾)完成深度适配的旗舰模型。最大的亮点在于,它通过一系列架构创新,率先实现了百万级超长上下文的真正普惠。等下半年华为昇腾950等国产超节点批量上市后,Pro版的高昂算力成本将被大幅摊薄,价格有望进一步大幅下调。比较权威的评测,在第三方Vibe Code Benchmark中,V4以压倒性优势拿下开源权重模型第一;在Arena.ai代码竞技场中位列开源模型第3,性能较前代V3.2跃升约10倍。目前综合性能跻身全球第一梯队,V4在多领域的性能达到了世界前沿水平,与顶级闭源模型的差距缩短至3-6个月。

15. 困扰人类60年的数学猜想,AI花80分钟解出来了! #大有学问 #红衣聊AI #数学 #科研

16. 新版本发布,DeepSeek再掀效率革命|甲子光年

17. 首批DeepSeek-V4云服务已上线

18. #DeepSeekV4发布# ---## 🏆 DeepSeek V4 vs 业界主流模型横向对比(2026年4月)### 📊 一、核心 Benchmark 成绩对比| 评测维度 | DeepSeek V4-Pro | Claude Opus 4.7 | GPT-5.5 | 说明 ||----------|:-:|:-:|:-:|------|| **MMLU**(多学科综合) | 90.1% | ~90%+ | ~92%+ | 旗鼓相当 || **GPQA Diamond**(研究生科学) | 90.1% | ~88% | ~89% | V4 略优 || **LiveCodeBench**(动态代码) | **93.5%** 🥇 | ~88% | ~85% | **V4 领先** || **Codeforces Rating**(竞技编程) | **3206** 🥇 | 未公开 | 未公开 | **开源最高** || **SWE-Bench Verified**(工程代码) | 80.6% | **87.6%** 🥇 | ~75-80% | Claude 领先 || **AIME 2026**(数学竞赛) | **99.4%** 🥇 | ~95% | ~96% | **V4 接近满分** || **IMO Answer Bench**(奥数) | 88.4% | 未公开 | 未公开 | 极强 || **FrontierMath Tier 4**(前沿数学) | 23.5% | 约2% | 约2.1% | **V4 领先约11倍** || **C-Eval**(中文综合) | **93.1%** 🥇 | — | — | 明显优势 || **上下文窗口** | **1M token** 🥇 | ~200K | ~128-400K | **V4 最长** |---### 💰 二、价格对比(每百万 token)| 模型 | 输入价格 | 输出价格 | 相对 V4 倍数 ||------|:-------:|:-------:|:----------:|| **DeepSeek V4-Pro** | ~¥4 | **$3.48** | 1× 基准 || GPT-5.5 | — | ~$70+ | **约 20× 贵** || Claude Opus 4.7 | — | ~$35 | **约 7× 贵** || GPT-5.4 | — | ~$15 | **约 4.3× 贵** || Claude Opus 4.6 | — | ~$25 | **约 7.2× 贵** |---### 🎯 三、能力雷达:各模型擅长领域| 模型 | 最强项 | 相对弱项 ||------|--------|----------|| **DeepSeek V4-Pro** | 数学推理、竞技编程、超长上下文、成本 | 视频/音频多模态、创意写作 || **Claude Opus 4.7** | 工程代码(SWE-bench第一)、自我纠错、金融代码 | 价格昂贵、无开源 || **GPT-5.5** | 综合生态、全模态(音视频)、工具链 | 价格最贵、上下文较短 || **Gemini 3.1 Pro** | 超长上下文、Google生态集成 | 中文能力、推理模型待追赶 |---### 🔑 四、一句话总结| 场景 | 推荐 ||------|------|| 🧮 数学/科研推理 | **DeepSeek V4-Pro**(AIME 99.4%,FrontierMath 领先11倍)|| 💻 工程级代码修复 | **Claude Opus 4.7**(SWE-bench 87.6% 全球第一)|| 🎥 多模态(音视频) | **GPT-5.5**(原生支持音频/视频) || 📄 超长文档处理 | **DeepSeek V4**(1M 上下文,成本极低)|| 💸 性价比极致 | **DeepSeek V4-Flash**(约是 GPT-5.5 的 1/20 价格)|| 🇨🇳 中文任务 | **DeepSeek V4-Pro**(C-Eval 93.1%)|---**总体来看**:DeepSeek V4 在**数学推理和竞技编程**上已是全球最强,工程代码略输 Claude Opus,综合生态和多模态暂落后 GPT-5.5——但以约 **1/20 的价格**打出这个成绩,性价比无出其右。对于开发者来说,它是目前最值得优先考虑的开源选择。

19. #DeepSeekV4#分为V4-Pro和V4-Flash两个版本,主打百万(1M)超长上下文能力V4-Pro在Agent能力、世界知识、数学推理等多项评测中达到开源模型最佳水平,推理性能比肩顶尖闭源模型;V4-Flash则以更小的参数量提供更快速、更经济的API服务,适合轻量场景。不过,受限于高端算力,目前Pro的服务吞吐十分有限,预计下半年昇腾950超节点批量上市后,Pro的价格会大幅下调。

20. #DeepSeek v4 百万上下文# 直接就发布了,这次太炸裂,又是行业重磅!DeepSeek-V4已经正式上线并开源,其核心特点如下:拎几个重点来聊聊:1、百万上下文标配:Pro与Flash双版本均原生支持1M token超长上下文。2、领先性能:Agent能力、世界知识与推理性能达国内与开源领域领先,Agentic Coding性能登顶开源模型。3、架构革新:创新采用基于token维度的动态压缩与DSA稀疏注意力技术,大幅降低算力与显存消耗。4、双版本策略:推出Pro版(1.6T参数,49B激活)与Flash版(284B参数,13B激活)。5、开源生态:同步开源模型权重,并已完成对华为昇腾等国产芯片的深度适配。#DeepSeekV4发布##DeepSeekV4和GPT5.5谁更强#

21. #DeepSeekV4发布# 这算是千呼万唤始出来,终于发布了。DeepSeek今天正式发布V4系列预览版并同步开源,分为V4-Pro和V4-Flash两个版本,主打100万(1M)超长上下文能力,官网、App及API均已同步更新。V4-Pro在Agent能力、世界知识、数学推理等多项评测中达到开源模型最佳水平,推理性能比肩顶尖闭源模型;V4-Flash则以更小的参数量提供更快速、更经济的API服务,适合轻量场景。技术层面,V4采用全新注意力机制,结合DSA稀疏注意力,在大幅压缩计算和显存需求的同时,实现百万级超长上下文。DeepSeek表示,1M上下文将成为旗下所有官方服务的标配。此外,V4针对多款主流Agent产品进行了专项适配优化。旧版API接口模型名deepseek-chat和deepseek-reasoner将于2026年7月24日正式停用,用户需提前切换至新模型名。#老张聊科技# deepseekv4发布

22. #微博声浪计划##听见微博# DeepSeekV4发布,采用双版本架构,旗舰版V4-Pro参数达1.6万亿,轻量版V4-Flash性价比高。适配华为昇腾芯片,推理速度超英伟达H20的2.87倍,能耗降40%。推动国产算力自主,带动产业链发展,长文本处理优势显著,但暂未支持多模态。 谯华的微博音频

23. 为什么越来越多的人觉得DeepSeek不好用了?

24. #DeepSeekV4和GPT5.5谁更强#真正值得普通人关注的是:以前大多数人都对 DeepSeek 的印象都是“便宜替代品”。但从 V4 开始,它更像是在证明:中国开源模型已经不只是追赶,而是在某些场景主动定义新的竞争方式。如果后续 API、开源权重、推理成本一起放出来——2026 年国内 AI 工具生态,大概率又要重新洗牌。🚀

25. 为什么 DeepSeek V4 能比 GPT-5.5 便宜 40 倍?一文拆解 MoE 稀疏度 + FP4 量化 + 昇腾协同的"三件套"

26. 重磅!DeepSeek-V4来了,KV Cache直接砍90%!

27. DeepSeek 证明了一件事:AI 烧天价算力,是一个谎言(DeepSeek 系列 第2篇)

28. DeepSeekV4预览版发布:开源大模型新标杆,三大能力领跑行业

29. DeepSeekV4上线:百万上下文开源领跑,Agent、推理性能全面跃升

30. DeepSeek V4正式发布:技术全域跃升与全维度产业深度研判

31. 【DeepSeek V4】混合注意力技术学习:百万token背后的秘密

32. DeepSeek V4 Pro 与 GPT 5.5 对比

33. DeepSeek-V4 技术报告要点总结

34. DeepSeek-V4将至!3大硬核突破,破解大模型3大痛点

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章