DeepSeek-V4发布:百万Token推理成本骤降500倍

源自61位全网作者

06-07 20:27

内容由AI生成

精选参考来源

1. #DeepSeekV4 尺度#V4抛弃了cuda核心。国产芯片与模型改写成功:DeepSeek-V4 在昇腾芯片上完成全流程训练和推理验证核心代码已完成从英伟达 CUDA 架构向华为 CANN 架构的迁移模型在昇腾芯片上的推理速度得到了显著提升。V4-Flash版本的输出定价为每百万token 2元人民币,同期部分海外模型的定高达30 美元,成本差距显著。匹配国产,解构美产,助催美国泡沫破灭。

2. DeepSeek-v4,来了!

3. 第一时间,寒武纪原生适配DeepSeek-V4!两大国产之光再次强强联合

4. #DeepSeekV4发布#,性能比肩顶级闭源模型100万上下文模型分为两档:deepseek-v4-flashdeepseek-v4-pro在数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型...DeepSeek-V4-Pro 的 Agent 能力显著增强。在 Agentic Coding 评测中,V4-Pro 已达到当前开源模型最佳水平,并在其他 Agent 相关评测中同样表现优异。丰富的世界知识:DeepSeek-V4-Pro 在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型 Gemini-Pro-3.1。百万 tokens 输入分别为 1元 和 12元百万 tokens 输出分别为 2元 和 24元DeepSeek-V4 模型开源链接:网页链接网页链接DeepSeek-V4 技术报告:网页链接

5. #DeepSeekV4 价格屠夫##DeepSeekV4 价格屠夫#刚用上GPT-5.5,转身就得给DeepSeek-V4让路,不到半天。OpenAI加价,DeepSeek降价,双管齐下让人哭笑不得。2元/百万Token的输出价,让Pro版12元的价格都显得“昂贵”,相比之下GPT-5.5 Pro高达180美元。Flash速度经济,Pro性能比肩顶级闭源,百万上下文还标配。当友商还在纠结性价比,DeepSeek已经用1.55‰的价格把Agent大战拉入普惠元年。算力成本遮羞布,这次真被扯干净了。 #DeepSeekV4比海外模型便宜约60%##黄仁勋预言的灾难仅9天就成真##DeepSeek昇腾首发#请问老黄现在作何感想?

6. 【#DeepSeekV4Pro大幅领先其他开源模型#】4月24日, DeepSeek全新系列模型DeepSeek-V4 的预览版本正式上线并同步开源,据介绍DeepSeek-V4 拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先。模型按大小分为两个版本deepseek-v4-pro 和deepseek-v4-flash,其中DeepSeek-V4-Pro在 Agentic Coding 评测中,已达到当前开源模型最佳水平,并在其他 Agent 相关评测中同样表现优异;在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型 Gemini-Pro-3.1;在数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型,取得了比肩世界顶级闭源模型的优异成绩。(密度新闻)#DeepSeekV4深度适配国产算力##DeepSeek v4 百万上下文#

7. 港股大模型公司股价闪崩,市场担忧 DeepSeek-V4 低价策略,这对行业发展意味着什么?

8. 编程媲美闭源顶级模型!DeepSeek V4来了,价格便宜75倍!

9. #DeepSeekV4发布# DeepSeekV4终于发布了,简单总结下:1、双版本发布:推出 DeepSeek-V4-Pro(高性能)和 DeepSeek-V4-Flash(高性价比)两个版本,可按需选择。2、超长上下文:支持 1M token(约百万字) 的上下文长度,能一次性处理海量信息。3、核心能力领先:在 Agent能力、世界知识和推理性能 三方面均达到国内及开源模型的领先水平。4、具体任务表现:V4-Pro版本的代理编码能力接近顶尖闭源模型,在数学、编程等推理任务上超越所有已开源评测的模型。5、技术创新与迁移提醒:采用 DSA稀疏注意力机制 降低长上下文计算成本;原有 deepseek-chat 等模型名3个月后停止使用,需迁移到新名称。

10. #DeepSeekV4发布# 终于发了!模型按大小分为两个版本:DeepSeek-V4-Pro和DeepSeek-V4-Flash。DeepSeek-V4-Pro性能比肩顶级闭源模型,在 Agentic Coding 评测中,V4-Pro 已达到当前开源模型最佳水平,并在其他 Agent 相关评测中同样表现优异。在世界知识测评中,大幅领先其他开源模型,仅稍逊于顶尖闭源模型 Gemini-Pro-3.1。数学、STEM、竞赛型代码的测评中,DeepSeek-V4-Pro 超越当前所有已公开评测的开源模型。DeepSeek-V4-Flash由于模型参数和激活更小,相较之下 V4-Flash 能够提供更加快捷、经济的 API 服务。在 Agent 测评中,DeepSeek-V4-Flash 在简单任务上与 DeepSeek-V4-Pro 旗鼓相当,但在高难度任务上仍有差距。DeepSeek API已上线 V4-Pro 与 V4-Flash,支持 OpenAI ChatCompletions 接口与 Anthropic 接口。太强了!!

11. 最近AI大事件:DeepseekV4、GPTimage2、Mythos重磅发布

12. DeepSeek V4 预览版本上线并同步开源,哪些亮点值得关注?

13. #deepseekv4发布#DeepSeek 发布新一代大模型 DeepSeek V4,本次更新主要围绕上下文能力、推理能力以及 Agent 场景进行优化。来看一看它的核心更新如下:🔻上下文能力大幅提升 支持最长 1M tokens(百万级上下文) 可处理完整代码库、长文档、多轮复杂对话🔻强化 Agent 场景能力 优化多步骤推理能力 支持更复杂任务执行 提升长流程稳定性🔻模型性能提升 多项 benchmark 表现提升 对标主流闭源大模型🔻提供双版本 Pro:高性能版本 Flash:高性价比版本(更快、更便宜)🔻 延续开源路线 持续推动开源大模型发展 强调低成本与高性能结合目前 DeepSeek V4 已开放相关能力与体验入口,可以在Hugging Face体验,具体应用场景仍在持续拓展deepseekv4发布

14. #DeepSeek v4 百万上下文# 直接就发布了,这次太炸裂,又是行业重磅!DeepSeek-V4已经正式上线并开源,其核心特点如下:拎几个重点来聊聊:1、百万上下文标配:Pro与Flash双版本均原生支持1M token超长上下文。2、领先性能:Agent能力、世界知识与推理性能达国内与开源领域领先,Agentic Coding性能登顶开源模型。3、架构革新:创新采用基于token维度的动态压缩与DSA稀疏注意力技术,大幅降低算力与显存消耗。4、双版本策略:推出Pro版(1.6T参数,49B激活)与Flash版(284B参数,13B激活)。5、开源生态:同步开源模型权重,并已完成对华为昇腾等国产芯片的深度适配。#DeepSeekV4发布##DeepSeekV4和GPT5.5谁更强#

15. 如何评价DeepSeek V4 Pro官网限时2.5折优惠?

16. 首批DeepSeek-V4云服务已上线

17. 如何评价 DeepSeek-V4 的价格?

18. 【最高降 97.5%:腾讯云智能体开发平台DeepSeek-V4系列模型明日起大幅降价,持平官网】#DeepSeek降价# 6月2日消息,腾讯云智能体开发平台宣布将于北京时间2026年6月3日零时起,对DeepSeek-V4系列模型进行价格下调。其中DeepSeek-V4-Pro模型的推理输入与输出价格降幅达75%,缓存命中价格降幅高达97.5%;DeepSeek-V4-Flash模型的缓存命中价格降幅达90%。DeepSeek-V4系列大模型发布于2026年4月24日,包含V4-Pro与V4-Flash双版本,总参数达1.6万亿,采用混合专家架构,原生支持100万Token上下文长度。作为参考,DeepSeek官方此前已于5月22日宣布将V4-Pro模型的API价格从限时优惠转为永久降价策略,而腾讯云本次调整是在平台接入层面进一步下调了调用价格。(IT之家)

19. 【阿里云百炼首发上线DeepSeek-V4,API价格与官网一致】4月24日,阿里云百炼平台在DeepSeek-V4开源的当天,便同步上线了V4-Pro和V4-Flash两款模型,API定价与DeepSeek官网完全对齐。关键信息:V4-Flash输入最低1元/百万Tokens、输出最低2元/百万Tokens。两款均支持百万Token超长上下文。百炼近期还将开放Token Plan支持该模型。目前该平台已汇聚超100款全模态模型。观察:从“模型超市”到“零延时上新”,百炼正试图用最全的模型矩阵和最低的调用门槛,吸引更多开发者和企业将AI能力内嵌到业务中。#阿里云百炼 #DeepSeek-V4 #大模型API

20. 如何评价 DeepSeek-V4 的价格?

21. DeepSeek官方宣布,DeepSeek-V4-Pro 模型 API 价格将于2026年5月31日结束2.5折优惠活动后,正式调整为原定价的1/4,即:每百万tokens输入(缓存命中)0.025元,输入(缓存未命中)3元,输出6元,创全球大模型价格新低。

22. DeepSeek-V4终于更新了!一百万超长上下文,Agent能力大幅增强,能力接近Opus 4.6

23. #DeepSeekV4发布# 这算是千呼万唤始出来,终于发布了。DeepSeek今天正式发布V4系列预览版并同步开源,分为V4-Pro和V4-Flash两个版本,主打100万(1M)超长上下文能力,官网、App及API均已同步更新。V4-Pro在Agent能力、世界知识、数学推理等多项评测中达到开源模型最佳水平,推理性能比肩顶尖闭源模型;V4-Flash则以更小的参数量提供更快速、更经济的API服务,适合轻量场景。技术层面,V4采用全新注意力机制,结合DSA稀疏注意力,在大幅压缩计算和显存需求的同时,实现百万级超长上下文。DeepSeek表示,1M上下文将成为旗下所有官方服务的标配。此外,V4针对多款主流Agent产品进行了专项适配优化。旧版API接口模型名deepseek-chat和deepseek-reasoner将于2026年7月24日正式停用,用户需提前切换至新模型名。#老张聊科技# deepseekv4发布

24. 【阿里云百炼上线DeepSeek-V4,API价格与官网一致】4月24日,阿里云百炼平台首发上线DeepSeek-V4-Pro与DeepSeek-V4-Flash两款模型,API定价与DeepSeek官网完全一致。核心信息:Flash版本输入价格最低1元/百万Tokens,输出最低2元/百万Tokens。两款模型均支持100万Tokens超长上下文,在Agent能力、世界知识和推理性能上达到开源顶尖水平。V4-Pro在Agentic Coding评测中已达开源模型最佳水平,并对OpenClaw、CodeBuddy等主流Agent产品做了适配优化。观察:阿里云百炼作为“AI模型超市”引入DeepSeek-V4系列,进一步丰富了平台模型生态。开发者无需在官网和云平台间二选一,按需调用即可。#阿里云百炼 #DeepSeekV4 #大模型

25. DeepSeek-V4预览版本上线,官网、App可用

26. DeepSeek-V4 核心信息速览

27. Claude 官方客户端 + DeepSeek-V4:免登录,无需订阅!(保姆级教程)

28. #deepseekv4和gpt5.5谁更强#DeepSeek V4与GPT-5.5同日登场,路线截然不同、各领风骚。GPT-5.5作为闭源旗舰,通用推理、跨工具Agent、办公工作流全面领先,综合基准屠榜、生态成熟,适合全球通用场景。DeepSeek V4主打开源+百万上下文,中文理解、长文档/代码库处理、低成本私有化部署优势突出,适配国产算力,性价比碾压闭源模型。论全能上限,GPT-5.5更强;论中文、长文本、自研落地,V4更实用。二者不是替代,而是互补,共同推动AI走向普惠与专业并行的新阶段。deepseekv4和gpt5.5谁更强

29. DeepSeek-V4预览版发布:开启百万上下文普惠时代4月24日,深度求索公司正式上线并开源DeepSeek-V4预览版。该模型具备百万字超长上下文能力,在智能体、世界知识和推理性能上实现国内与开源领域领先,标志大模型长文本处理进入新纪元。DeepSeek-V4系列包含两个版本:参数1.6万亿的DeepSeek-V4-Pro和参数2840亿的DeepSeek-V4-Flash。两者均基于超大规模预训练数据,并将百万上下文作为标准配置。性能方面,DeepSeek-V4-Pro展现出世界顶级水平。官方评测显示,其在Agentic Coding评测中达开源模型最佳水平,使用体验优于Claude 3.5 Sonnet,交付质量接近GPT-4o Opus非思考模式。在知识推理、数学、STEM和竞赛型代码测评中,V4-Pro超越所有已公开评测的开源模型,成绩比肩顶级闭源模型。技术突破在于全新注意力机制,通过token维度压缩结合DSA稀疏注意力,实现全球领先的长上下文处理能力,同时大幅降低计算资源和显存需求。模型针对Agent能力专项优化,深度适配Claude Code、OpenClaw等主流产品,在代码任务、文档生成方面表现显著提升。官方示例显示,V4-Pro能生成包含复杂数据表格、营销策略和排期规划的完整PPT方案。DeepSeek API已同步支持V4-Pro与V4-Flash,兼容OpenAI ChatCompletions和Anthropic接口。定价为:V4-Pro输入每百万token 12元,输出24元;V4-Flash输入每百万token 1元,输出2元。受限于高端算力,Pro版本服务吞吐量有限,预计下半年昇腾950超节点批量上市后价格将大幅下调。深度求索已在Hugging Face和ModelScope平台开源DeepSeek-V4模型权重并发布技术报告。

30. #DeepSeekV4比海外模型便宜约60%#【#DeepSeekV4深度适配华为芯片#】DeepSeek今天正式发布V4系列预览版并同步开源,分为V4-Pro和V4-Flash两个版本,主打100万(1M)超长上下文能力,官网、App及API均已同步更新。#DeepSeekV4深度适配国产芯片#据科技博主卡兹克实测,DeepSeekV4大概比海外模型平均便宜60%左右。DeepSeek V4的报告里,透露出非常多国产化的细节1. V4在后训练和推理体系里引入了MXFP4。虽然训练还是用的英伟达体系,但是在后训练和推理上用这个基本上就意味着,DeepSeek在往开放低精度格式和多硬件适配方向走,可以适配国产卡比如华为昇腾、寒武纪、壁仞等等。2. V4的底层内核不再完全靠CUDA写,用了一个叫TileLang的DSL。DeepSeek希望底层算子开发不要完全锁死在CUDA上,而是用更高一层的语言描述计算,再尽量编译到不同硬件上,这个非常牛逼,可以大大降低迁移成本。3. V4专门搞了一个叫MegaMoE的融合内核,设计目标是减少专家并行中的通信等待,目前已经在华为昇腾上跑通。卡兹克称:“这三条放一起,方向就非常清楚了,V4是完完全全的,为了国产卡而设计的模型。”(综合卡兹克)#DeepSeek v4 百万上下文#

31. 超实用!连夜实测DeepSeek-V4,我发现它唯一的硬伤是“审美”

32. DeepSeek-V4正式上线:开源双版本+1M上下文,Pro版对标Opus,Flash版省钱神器

33. 彻底火了!多家AI巨头,上线DeepSeek-V4

34. DeepSeek-V4:华为昇腾适配、性价比王者、最新底层技术

35. DeepSeek V4 为什么还不发布?

36. 【#DeepSeek唯一遗憾无多模态##DeepSeekV4再次开出行业最低价#】DeepSeek今日宣布,拥有百万字超长上下文的deepseek-v4-pro和deepseek-v4-flash两款模型发布并开源,即日起登录官网或官方App即可与最新的DeepSeek-v4对话,探索1M(百万)超长上下文记忆的全新体验。 据官方公布基准测评,在上下文长度、知识、推理及Agent等能力上,DeepSeekv4性能比肩国际顶级闭源模型,达到国际开源模型一流水平。《BUG》栏目对比发现,在API调用价格上,去年以一己之力撬动国内大模型行业降价的DeepSeek,V4版本再次开出了行业“最低价”。 据DeepSeek官方介绍,受限于高端算力,目前Pro的服务吞吐量十分有限,预计下半年昇腾950超节点批量上市后,Pro的价格会大幅下调。 “虽然每百万Tokens调用价格国内模型均未下降太多,但超长上下文长度及不俗的性能,让其极具竞争优势!”有业内人士感慨道:“那个大模型价格屠夫,又回来了!” 遗憾的是,目前v4版本依然是一款纯文本模型,没有太多的文生图、文生视频等多模态能力。(新浪科技 文) “价格屠夫”!DeepSeekV4百万上下文打到2毛,国产卡将腰斩API价格?

37. OpenAI GPT 5.5 前脚刚发布,DeepSeek就亮出了“真家伙”。就在刚刚,DeepSeek-V4的预览版本正式上线并同步开源。据官方介绍,DeepSeek-V4拥有百万字超长上下文,在 Agent 能力、世界知识和推理性能上均实现国内与开源领域的领先

38. 终于,全球 AI 圈等待了几个月的 DeepSeek V4,它终于来了!今天上午,DeepSeek API 文档上线.此次,DeepSeek V4 按大小会有两个版本,分别是 DeepSeek-V4-Flash 和 DeepSeek-V4-Pro。上下文长度是 100 万 tokens。同时,输出长度最大为 384K tokens。 #DeepSeekV4发布# #DeepSeekV4和GPT5.5谁更强#

39. #DeepSeekV4和GPT5.5谁更强#真正值得普通人关注的是:以前大多数人都对 DeepSeek 的印象都是“便宜替代品”。但从 V4 开始,它更像是在证明:中国开源模型已经不只是追赶,而是在某些场景主动定义新的竞争方式。如果后续 API、开源权重、推理成本一起放出来——2026 年国内 AI 工具生态,大概率又要重新洗牌。🚀

40. 推理成本相差355倍:DeepSeek-V4完成华为适配,梁文锋持股大幅上升

41. 独家对话DeepSeek V4核心工程师:484天,我们如何把推理成本砍掉90%

42. DeepSeek V4震撼发布!实现全球开源领先

43. 27%的算力,跑完百万token:DeepSeek这次不讲武德

44. Deepseek V4 来了,技术简单解析

45. DeepSeek V4:Moe 模型的新突破

46. DeepSeek-V4 震撼发布,大模型推理成本底牌被彻底重写

47. DeepSeekV4预览版发布:开源大模型新标杆,三大能力领跑行业

48. DeepSeek-V4:用10%的算力,读懂100万Token

49. 大白话讲透:DeepSeek-V4大降价

50. 机构闭门会:DeepSeekV4发布,昇腾产业链爆发

51. DeepSeek-V4突然发布,百万文价格低至1块,开源模型天花板被捅破

52. DeepSeek-V4 的核心作用(通俗+专业)

53. 【信息前沿】 DeepSeekV4引起的AI推理市场变革

54. DeepSeek联手清北发新论文,5000行代码改写规则!V4 架构专治推理I/O瓶颈,性能暴增187%

55. DeepSeek-V4将至!3大硬核突破,破解大模型3大痛点

56. Deepseek V4第一波测评来了!

57. DeepSeek-V4横空出世:中国AI捅破垄断天花板

58. DeepSeek-V4:真实能力与局限

59. DeepSeek V4用Engram技术降成本,对国产算力适配有何帮助?

60. V4真要来了?DeepSeek深夜突发上新

61. DeepSeekV4闪亮登场:普惠、开放与逼近顶尖的破局者

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章