昇腾950PR与950DT核心参数对比及选型指南

源自52位全网作者

06-09 12:24

精选参考来源

1
DeepSeek V4豪赌华为昇腾950:35倍性能炸裂背后,国产AI算力真的接得住这盘“生死局”吗?DeepSeek放弃英伟达、全面拥抱华为昇腾的消息,在AI圈激起的远不止“爱国情怀”的赞歌,更是一场关乎中国AI产业未来走向的硬核博弈。当DeepSeek V4完成与昇腾950PR的全栈适配,并在CANN异构计算架构上实现35倍推理速度提升、能耗直降40%时,行业在惊叹突破之余,也不禁追问:这套看似疯狂的“国产生态底座”,在字节、阿里豪掷数十万颗芯片订单的狂热背后,真能支撑起万亿级大模型的商业化狂奔吗?一、性能炸裂:35倍提速+2.87倍算力,昇腾950PR硬刚英伟达H20这不是简单兼容,而是从底层架构重写、全栈深度优化的彻底换道。• 算力碾压:昇腾950PR(Atlas 350加速卡)FP4精度算力达1.56 PFLOPS,是英伟达H20的2.87倍;国内首款支持FP4量产推理,70B大模型单卡即可跑通。• 显存与带宽:112GB自研HBM、带宽1.4–1.6TB/s,片间互联2TB/s,支持万卡级超大规模集群。• 成本颠覆:部署成本仅为英伟达方案1/3,推理成本低至GPT-4的1/70,性价比直接击穿行业底线。• 生态跃迁:CANN兼容95% CUDA代码,一键迁移、算子深度优化,算力利用率达85%。二、全链协同:从芯片到封测,国产算力“骨架与毛细血管”已成型从“软硬解耦”到“深度咬合”,这不仅是代码迁徙,更是国产AI产业链从“被动输血”到“主动造血”的基因重组:• 芯片代工:中芯国际N+3强化版工艺扛起先进制程,支撑昇腾950PR大规模量产。• 封装材料:华海诚科(华为哈勃加持)作为GMC塑封料唯一量产方,卡住HBM先进封装上游命脉。• 高速载板:深南电路22层以下ABF载板量产,为算力卡提供高速PCB支撑。• 互联与散热:华丰科技112G高速连接器(占昇腾服务器50%–60%份额)+川润股份液冷方案,构成超节点集群“骨架与毛细血管”。三、巨头疯抢:45万颗订单锁定,国产算力迎来商业化拐点这场“换芯”不是实验室秀,而是互联网巨头真金白银砸出来的市场验证:• 字节跳动:25万颗(订单从12万颗上调)• 阿里巴巴:15万颗• 腾讯:6–7万颗• 合计:45万颗+,占华为2026年75万颗年度目标超60%• 订单金额:整机口径约475亿元,国产AI芯片史上最大规模采购四、生死拷问:产能、良率、生态,三大硬仗才刚开始漂亮数据背后,国产算力仍在“生死局”边缘:1. 产能爬坡:75万颗年度目标能否兑现?中芯国际、封测厂良率与交付节奏是关键。2. 生态壁垒:CUDA统治20年,CANN能否留住开发者、形成正向循环?3. 供应链安全:HBM、先进材料、设备仍有卡脖子环节,自主可控尚未完全闭环。五、历史拐点:从“能用”到“好用”,国产AI算力正式接棒当DeepSeek V4、字节、阿里集体放弃英伟达“阉割特供版”、转向昇腾时,标志着:• 中国AI正式摆脱海外算力垄断,地缘政治风险大幅降低。• 国产芯片从“性能追平”进入场景反超、成本碾压阶段。• 万亿AI大模型时代,中国率先实现算力自主可控。结语35倍性能、45万颗订单、500亿投入——这不是炒作,是国产AI算力的成人礼。昇腾950PR+DeepSeek V4的组合,已经证明“国产能打、国产好用、国产便宜”。真正的考验不在参数,而在未来1–2年:产能爬坡、生态繁荣、产业链彻底自主。但至少现在,我们可以明确回答:国产AI算力,已经接得住这盘生死局!
2
The Information:即将发布的DeepSeek-V4会完全适配于华为的昇腾950PR芯片,阿里、字节、腾讯等大厂已经采购了数十万颗这款芯片,用来提供给云服务以便销售DeepSeek模型。因为供需关系的变化,昇腾950PR芯片已经涨价20%,出于分摊风险的考虑,DeepSeek-V4也适配了寒武纪的芯片,基于它的分支模型也都专为国产芯片优化。DeepSeek还拒绝了英伟达提前获取新模型的要求,这通常是为了帮助芯片厂商与重要模型进行磨合,只有华为等少数中国芯片厂商获得了这个提前窗口期。昇腾950PR的性能相当于英伟达H20的2.8倍,但比不过主流的H200,主要依靠中芯国际的代工,需要克服产能挑战。
全部
来源
内容由AI生成

精选参考来源

1. DeepSeek V4豪赌华为昇腾950:35倍性能炸裂背后,国产AI算力真的接得住这盘“生死局”吗?DeepSeek放弃英伟达、全面拥抱华为昇腾的消息,在AI圈激起的远不止“爱国情怀”的赞歌,更是一场关乎中国AI产业未来走向的硬核博弈。当DeepSeek V4完成与昇腾950PR的全栈适配,并在CANN异构计算架构上实现35倍推理速度提升、能耗直降40%时,行业在惊叹突破之余,也不禁追问:这套看似疯狂的“国产生态底座”,在字节、阿里豪掷数十万颗芯片订单的狂热背后,真能支撑起万亿级大模型的商业化狂奔吗?一、性能炸裂:35倍提速+2.87倍算力,昇腾950PR硬刚英伟达H20这不是简单兼容,而是从底层架构重写、全栈深度优化的彻底换道。• 算力碾压:昇腾950PR(Atlas 350加速卡)FP4精度算力达1.56 PFLOPS,是英伟达H20的2.87倍;国内首款支持FP4量产推理,70B大模型单卡即可跑通。• 显存与带宽:112GB自研HBM、带宽1.4–1.6TB/s,片间互联2TB/s,支持万卡级超大规模集群。• 成本颠覆:部署成本仅为英伟达方案1/3,推理成本低至GPT-4的1/70,性价比直接击穿行业底线。• 生态跃迁:CANN兼容95% CUDA代码,一键迁移、算子深度优化,算力利用率达85%。二、全链协同:从芯片到封测,国产算力“骨架与毛细血管”已成型从“软硬解耦”到“深度咬合”,这不仅是代码迁徙,更是国产AI产业链从“被动输血”到“主动造血”的基因重组:• 芯片代工:中芯国际N+3强化版工艺扛起先进制程,支撑昇腾950PR大规模量产。• 封装材料:华海诚科(华为哈勃加持)作为GMC塑封料唯一量产方,卡住HBM先进封装上游命脉。• 高速载板:深南电路22层以下ABF载板量产,为算力卡提供高速PCB支撑。• 互联与散热:华丰科技112G高速连接器(占昇腾服务器50%–60%份额)+川润股份液冷方案,构成超节点集群“骨架与毛细血管”。三、巨头疯抢:45万颗订单锁定,国产算力迎来商业化拐点这场“换芯”不是实验室秀,而是互联网巨头真金白银砸出来的市场验证:• 字节跳动:25万颗(订单从12万颗上调)• 阿里巴巴:15万颗• 腾讯:6–7万颗• 合计:45万颗+,占华为2026年75万颗年度目标超60%• 订单金额:整机口径约475亿元,国产AI芯片史上最大规模采购四、生死拷问:产能、良率、生态,三大硬仗才刚开始漂亮数据背后,国产算力仍在“生死局”边缘:1. 产能爬坡:75万颗年度目标能否兑现?中芯国际、封测厂良率与交付节奏是关键。2. 生态壁垒:CUDA统治20年,CANN能否留住开发者、形成正向循环?3. 供应链安全:HBM、先进材料、设备仍有卡脖子环节,自主可控尚未完全闭环。五、历史拐点:从“能用”到“好用”,国产AI算力正式接棒当DeepSeek V4、字节、阿里集体放弃英伟达“阉割特供版”、转向昇腾时,标志着:• 中国AI正式摆脱海外算力垄断,地缘政治风险大幅降低。• 国产芯片从“性能追平”进入场景反超、成本碾压阶段。• 万亿AI大模型时代,中国率先实现算力自主可控。结语35倍性能、45万颗订单、500亿投入——这不是炒作,是国产AI算力的成人礼。昇腾950PR+DeepSeek V4的组合,已经证明“国产能打、国产好用、国产便宜”。真正的考验不在参数,而在未来1–2年:产能爬坡、生态繁荣、产业链彻底自主。但至少现在,我们可以明确回答:国产AI算力,已经接得住这盘生死局!

2. The Information:即将发布的DeepSeek-V4会完全适配于华为的昇腾950PR芯片,阿里、字节、腾讯等大厂已经采购了数十万颗这款芯片,用来提供给云服务以便销售DeepSeek模型。因为供需关系的变化,昇腾950PR芯片已经涨价20%,出于分摊风险的考虑,DeepSeek-V4也适配了寒武纪的芯片,基于它的分支模型也都专为国产芯片优化。DeepSeek还拒绝了英伟达提前获取新模型的要求,这通常是为了帮助芯片厂商与重要模型进行磨合,只有华为等少数中国芯片厂商获得了这个提前窗口期。昇腾950PR的性能相当于英伟达H20的2.8倍,但比不过主流的H200,主要依靠中芯国际的代工,需要克服产能挑战。

3. 华为 MWC2026 首秀超节点算力阵列 Atlas950,将带来哪些影响?

4. 美国高端GPU禁售政策的困境华为发布全新一代GPU-昇腾950PR,再一次显著证明了美国高端GPU禁售政策的困境:想卖的东西中国不买有替代,持续不卖将市场拱手送人。最新发布的昇腾950PR,单卡算力达到英伟达H20的2.87倍,也是国内目前唯一支持FP4低精度的推理产品。HBM容量是H20的1.16倍。基于950PR的AI训推加速卡Atlas 350,FP4算力1.56P,带宽1.4TB/s,功耗600W。有了950PR,H20的意义就大打折扣了。H20卖不出去,H200你说卖还是不卖。现在不卖,等昇腾下一代产品出来,也卖不动了。昇腾发展到980,到时候更先进的英伟达芯片也卖不成了。整个中国市场跟英伟达GPU脱钩,美国不仅没有赚到GPU的钱,也没有阻止中国AI产业的迅速发展,对中国的AI基础设施没有任何参与和存在感了。禁运GPU只是手段,不是目的,如果手段没有达到目的,那这个手段还有什么用。本来大规模使用英伟达GPU,绑定中国AI的发展,对美国科技公司来说最有利。马斯克都说了,中国将赢得地球上AI的竞争。美国科技公司如果不跟最后的赢家站在一起,那他们的成功将会是短暂的,没有持续性的。

5. 如何看待华为最新发布的昇腾系列超节点算力,是超越英伟达了吗?和阿里的平头哥算力芯片比如何?

6. 外媒采访了五位知情人士,获得了 DeepSeek V4 的一些信息:- V4 将运行在华为最新 AI 芯片(昇腾 950PR)上,搭载全新昇腾950PR的Atlas 350,单卡算力达到了NV H20的2.87倍,是目前国内唯一支持FP4低精度的推理产品;HBM 容量是H20的1.16倍;- V4 还会有两个变体版本,分别针对不同能力做了优化,均基于国产芯片;- DeepSeek 花了数月时间与华为、寒武纪合作,重写了模型底层代码的部分模块,专门适配国产芯片,这次没有按照行业惯例,给NV和 AMD 任何早期访问权限;- 阿里、字节、腾讯已提前大批量采购华为新芯片,总量达数十万颗,华为昇腾 950PR 的价格因此上涨了 20%;- V3 和 R1 发布时引发了全球科技股抛售,市场质疑美国 AI 公司是否需要花数百亿美元采购算力,V4 发布窗口预计在未来几周内。

7. 英伟达收购了Groq之后,在这次GTC大会上推出了推理专用加速器LPU。咱们来看下这个LPU的特点:1、SRAM-based内存架构。主要是不用HBM了,改用片上SRAM,带宽高延迟快。2、确定性执行机制。主要是消除了core计算等待的时间,流水线效率大幅提升。3、因为SRAM功耗低,所以能耗比也高。 但是LPU主要是内存容量小,所以不能都靠它来做推理,只能把一部分推理任务(decode)给它,这样速度快的效果就发挥出来了。在prefill的阶段还是要用GPU。英伟达的混合架构就是GPU和LPU混用。这样就不需要大量堆LPU了,也用不起啊。这个思路,华为之前已经设计了。26年华为主要是分型号推的两个AI芯片产品,950PR和950DT,分别做prefill和decode。

8. The Information 这篇独家又刷屏了,关于 DeepSeek-V4:- DeepSeek-V4 可以用华为最新的 Ascend 950PR 做推理,中国 AI 软硬一体的自主可控的新突破。- 为了在 V4 发布后提供推理服务,阿里、腾讯、字节已经向华为采购了几十万张 Ascend 950PR,需求暴涨导致这张卡的价格涨了 20%。- 除了 V4,DeepSeek 还研发了另外两个版本,都是跑在国产芯片上的。过去几个月,DeepSeek 一直在和华为、寒武纪合作,重新编写模型的底层代码,然后大量测试,以确保模型在国产芯片上实现最佳性能。- DeepSeek 没有向英伟达和 AMD 提供 V4 的早期访问权限以进行性能优化,但提供给了包括华为在内的国产芯片厂商。- 从华为公布的账面数据看,Ascend 950PR 的算力约为英伟达 H20 的 2.8 倍,当然比 H200 是比不上。怎么说呢,这篇的标题是「DeepSeek 新 AI 模型将成为华为的胜利」,其实无论 DeepSeek 还是华为,归根结底代表的是中国。另外自去年年底来 V4 的发布狼来了好几次,我想这里恐怕不是这些媒体空穴来风,软硬一体自主可控很难,实际推进起来可能比想象得还要更难一些。

9. 华为 MWC2026 首秀超节点算力阵列 Atlas950,将带来哪些影响?

10. 【华为昇腾超节点全面支持DeepSeek V4】4月24日,DeepSeek-V4预览版发布并开源。华为随即宣布,通过芯模深度协同,昇腾超节点全系列产品已适配V4系列。关键信息:昇腾950超节点将批量上市,搭载Atlas 350加速卡(FP4算力1.56P,是H20的2.87倍),支持128GB HBM内存,功耗600W。昇腾950将DeepSeek V4-Pro在8K场景下的单卡Decode吞吐提升到4700 TPS、时延20ms。华为主推芯模一体,“杀手锏”在能效。通过融合kernel和多流并行技术降低Attention计算和访存开销,大幅降低了算力开销。观察:V4在设计之初就优先对昇腾体系做适配,华为配合从芯片到软件栈层层优化。双方一旦在底层的深度绑定跑通,大模型+国产芯片将形成“模型-算力”互锁,黄仁勋预言的“生态灾难”正变成现实。#华为昇腾##DeepSeek##国产芯片##大模型#

11. DeepSeek V4全面牵手昇腾,国产算力的"最强底牌"终于亮出来了?2026年4月24日,AI圈炸了。DeepSeek正式发布大模型系列V4预览版本并同步开源,华为随即宣布昇腾超节点全系列产品全面适配支持V4系列模型。这不仅是两条分别引爆科技圈的独立消息,更是中国AI产业"芯模协同"从纸面走向实战的标志性节点。DeepSeek曾官方表示,目前Pro版服务吞吐十分有限,关键卡在高门槛的算力供应上;而突破口恰恰指向华为:预计下半年昇腾950超节点批量上市后,Pro版价格将大幅下调。换言之,AI大模型的"平权时代",钥匙正握在国产算力的手里。为什么偏偏是此刻?因为昇腾950真的把纸面上的性能砸在地上了。搭载昇腾950PR芯片的Atlas 350加速卡,FP4算力高达1.56P,是英伟达H20的2.87倍,是国内唯一支持FP4精度的推理产品。更关键的指标出在互联效率上——昇腾950在向量算力、互联带宽及自研HBM等方面全面提升,小算子访存效率提升4倍,成本卡位更加精准。这意味着什么?过去国产芯片被吐槽"单卡不错、集群拉胯"的窘境正在被撕裂,大规模模型训练与推理的性价比拐点已经到来。这背后,是一张庞大的昇腾产业链版图和一场真实的产能博弈。从这张产业链图上可以清晰地看到,国产算力底座正逐步"通衢"。中芯国际作为昇腾910/950主力代工厂,依托N+2/N+3工艺推动7nm及"类5nm"制程量产,2026年月产能力争达3.8万片有效晶圆。长电科技与通富微电则基于CoWoS-L等先进封装技术,让昇腾950的HBM集成能力与良率逼近国际头部水平;深南电路、兴森科技的ABF载板从2026年起撑起950封装的需求硬支撑;华丰科技、意华股份通过224G高速I/O连接器全面适配昇腾超节点架构;高澜股份的单柜120kW液冷CDU更让大规模集群平稳运行成为可能。【来源:图片内容结合产业逻辑】然而,机会背后隐藏着更残酷的现实:算力需求暴增,产能才是最大的胜负手。2026年一开年,八部门联合下发《"人工智能+制造"专项行动实施意见》,明确支持突破高端训练芯片,有序建设国家超大规模智算平台。国家意志的顶层呼应已经足够强烈。与此同时,字节跳动、阿里、腾讯等头部厂商合计锁定超过45万颗昇腾950订单,采购金额约475亿元。需求端疯狂抢货,供给端却苦于制程良率和产能扩张进度——中芯国际的产能上限决定了2026年国产高端AI芯片市场将总体处于"有券都抢不到"的紧平衡状态。长电科技、通富微电封测订单也已排产至2027年,两面夹击之下,升腾产业链实际卡住了算力爆发的命门。DeepSeek V4给昇腾走通了软件生态的路,昇腾950及全产业链给国产算力填充了硬件的底气,但这场AI自主化的突围战,真实结局取决于中芯国际、长电、深南们是否能在"量价齐升"中兑现承诺。融资客的蜂拥进场,看重的不仅仅是概念炒作,而是实实在在盯住了"AI芯片供需缺口还将持续扩大"这一根本逻辑。随着各地智算中心大规模落地和超节点生态加速成熟,国产算力芯片真正进入高性价比放量节点。此时此刻,产业链上拧得最紧的地方,才是真正的机会所在。

12. 【DeepSeek新模型发布后 中国大型科企争相抢购华为AI芯片】DeepSeek发布基于华为芯片的V4 AI模型后,华为昇腾950 AI芯片的需求大幅上升,中国主要互联网公司纷纷抢下订单。专注于云计算和图形处理单元(GPU)租赁服务的公司也在争相下单。华为昇腾950PR落后于英伟达的H200处理器,但性能明显优于英伟达的H20芯片,后者是英伟达此前获准在中国销售的最强型号。-

13. 如何评价 Deepseek V4 因为缺少昇腾芯片而不得不抬高价格?

14. #微博声浪计划##听见微博# DeepSeek-V4与华为昇腾适配实现全栈国产化,底层代码迁移至CANN框架,重写200多个核心算子。昇腾950PR芯片单卡算力达英伟达H20的2.87倍,V4-Flash百万Token成本低至0.2元。此次适配打破英伟达生态垄断,国产算力订单激增20%,马来西亚采用该组合建国家AI基建。华为云提供API一键调用,中小开发者可快速集成应用。 科技晓鑫的微博音频

15. 客户测完昇腾950,一周果断下单!DeepSeekV4见证硬实力

16. 华为昇腾服务器的价格确实有所上涨,涨幅预计接近40%

17. 华为云陈林:昇腾950DT 8月上线,一年一代、算力翻倍

18. 客户测完昇腾950,一周果断下单!DeepSeekV4见证硬实力

19. 华为自研HBM性能翻倍!昇腾950DT芯片8月提前问世,DeepSeek将优先部署

20. 推理能效比提2.3倍,成本仅英伟达四分之一:华为昇腾950PR实现反超

21. 华为昇腾950:国产AI算力登顶之作,重构大模型时代算力格局

22. 昇腾950DT首字延迟降90%:HiZQ 2.0如何重构AI算力

23. 华为昇腾系列AI芯片详细参数对比(2025-2028)

24. 华为昇腾AI芯片详细参数对比(2025-2028)

25. 华为昇腾950系列NPU架构白皮书

26. 华为昇腾950 AI加速器实物图曝光

27. 昇腾950DT参数公开:为什么DeepSeek敢说API要降价

28. 昇腾950PR/DT "一芯双存"差异化布局解析

29. 字节500亿订单加持,华为昇腾芯片如何搅动全球AI算力格局?

30. 华为Atlas 950 SuperPoD支持8192张昇腾卡 华为Atlas 950 SuperPoD是一款面向超大规模AI训练的智算超节点系统,其核心定位是超节点加集群架构中的关键算力底座,旨在解决万亿级模型训练中的算力瓶颈。 它搭载昇腾950DT NPU,最大支持 8192张昇腾NPU卡高速互联,单机柜 64卡,总算力(FP8)8 EFLOPS 总算力 (FP4) 16 EFLOPS,总内存容量1152 TB,总互联带宽16.3 PB每s,全液冷架构, 多个SuperPoD组成Atlas 950 SuperCluster超大规模集群,算力规模超过50万卡,预计于2026年第四季度上市。 Atlas 960 SuperPoD规模更大的下一代产品,支持15488张昇腾卡,预计于2027年第四季度上市。#华为 #人工智能 #科技 #昇腾 #科技 竟业电子IC芯片供应商 www.jingyeic.com

31. 昇腾950 FP8领先49%但带宽落后20%,与H200的差距有多大

32. 菊厂昇腾950出炉

33. 华为昇腾全系列AI算力芯片及板卡服务器对比选型指南

34. 行业专家访谈摘要:昇腾950DT芯片预计7月测试,11月开始交付

35. 华为昇腾950PR+950DT双芯齐发:训练推理全覆盖国产算力进入时代

36. 华为950芯片深度拆解:国产AI芯片淘汰赛打响 本期视频深度拆解了代表国产AI芯片标杆的华为950DT与950PR,对比了两款芯片在算力、功耗、良率以及BOM成本上的核心差异 。同时,结合当前HBM内存占据极高成本的现状,为国内其他AI芯片公司指明了错位竞争与突围的方向 。 #华为AI芯片 #国产AI芯片 #芯片成本 #HBM内存 #算力中心

37. 【AI芯片】解析华为昇腾950系列NPU架构白皮书发布:撕开高端算力垄断的"核心利刃"

38. 客户测完昇腾950,一周果断下单!DeepSeekV4见证硬实力

39. 让DeepSeek V4更强大 华为�N腾950DT芯片8月问世:自研HBM性能翻倍还多

40. 华为AI芯片新规划:950/960/970性能有何突破?

41. 调研纪要:昇腾 950 芯片全解析|技术参数、订单规模、供应链全景

42. HBM减至112GB华为昇腾950PR与规划有差

43. 华为云陈林:昇腾950DT 8月上线,一年一代、算力翻倍

44. 硅谷精英承认,华为8192超节点全球最强

45. 字节等大厂大量采购昇腾950芯片意味着什么?

46. 升腾950PR碾压英伟达!国产AI芯片性能×2.87、成本×1/4

47. 华为四季度将推出两款智算超节点:基于昇腾950DT打造高端算力底座

48. 研报点金之国产算力、北美AI电力设备

49. DeepSeek V4换芯华为昇腾,自研HBM曝光:英伟达的真正对手来了?

50. 华为MWC发布8192卡超节点,昇腾950DT正式亮相海外

51. 从跟跑到领跑,华为升腾950,改写全球AI芯片格局

52. 国产算力芯片

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章