国产AI芯片切换指南:避坑、选型与实战建议

源自198位全网作者

05-23 20:25

内容由AI生成

精选参考来源

1. 拆解CANN:当华为决定打开算力的「黑盒」

2. 2025年度AI全景报告:AI变强,人类抽象! 2025年的AI进化史,比科幻电影更疯狂 一、大模型篇:GPT-5.2、Gemini、Claude如何刷爆IQ测试 二、AIGC篇:小香蕉和GPT-Image编辑现实 三、人类怎么用AI:跟“神”谈恋爱 四、AI机器人:伴侣还是终结者 五、AI4S:人类最后的发明 #前沿科技趋势发布月 #抖音知识年终大赏 #AI新星计划 #AI #机器人

3. 如何看待网传 DeepSeek V4 即将发布并提出「去CUDA化」?

4. 黄仁勋最新访谈(一):AI商业化拐点来了,Anthropic2030年收入可能达到1万亿美元#黄仁勋 #英伟达 #AI #GTC #AI商业化

5. #阿里发布性能比肩英伟达H20的芯片#阿里平头哥推出的真武810E芯片属于全栈自研的高端AI芯片,不仅打破了国外巨头在高端算力领域的垄断,更成为国内AI发展的重要推力。真武810E是一款训推一体的高性能AI芯片,搭载平头哥自研并行计算架构与ICN片间互联技术,单卡配备96GB HBM2e内存,片间互联带宽高达700GB/s,可灵活组建万卡级集群,性能比肩英伟达H20,超越主流国产GPU及英伟达A800,已实现规模化商用。与普通芯片不同,它兼顾AI训练与推理需求,覆盖多领域应用,且软硬件全自研,彻底摆脱对外技术依赖。国内高端AI算力依赖进口,制约了大模型研发与产业落地,而这款芯片填补了国产高端AI芯片的结构性缺口,提供了高性价比的国产化算力选择,降低了企业用算成本,同时其芯云一体模式,为AI产业提供了芯片+加云加模型的一体化解决方案,加速AI技术在各行业的落地应用。阿里芯片的突破并不意味着我国芯片已能自给自足。国内芯片产业在制造工艺、部分核心零部件等领域仍有短板,真武810E的突破是重要进展,标志着国产AI芯片跻身全球第一梯队,为国内AI发展注入强劲动力。但国产芯片的前行之路仍任重道远,但全产业链自主可控仍需长期攻坚,它是国产芯片崛起的缩影,而非终点。在主流大模型适配性上,真武810E表现突出。它已大规模应用于阿里千问大模型的训推环节,深度适配主流AI框架,提供统一编程接口,开发者无需修改代码即可实现模型迁移,同时兼容多模态模型及自动驾驶等领域的主流模型,适配性与易用性大幅提升,为大模型迭代提供了强劲算力支撑。#秒懂热点就用智搜# 阿里发布性能比肩英伟达h20的芯片

6. 科技日报:深圳破解 “CUDA困局”取得突破!

7. 云涨 Token 涨,DeepSeek 偏降价?其他的企业集体上调 AI 算力价格,行业 Token 成本普涨之际,DeepSeek V4 却逆势降价,V4-Flash 输出价低至 2 元 / 百万 Token,仅为竞品的 1/40,上演价格反向操作,DeepSeek的底气在哪里?系统方面,DeepSeek通过稀疏注意力革命,在同样是百万 Token 场景下,推理算力需求降至前代 10%-27%,KV Cache 占用仅 7%-10%,这就让长文本成本不升反降。V4-Pro 1.6T 参数仅激活 49B,V4-Flash 284B 参数仅激活 13B,避免 全参数计算浪费,算力利用率拉满。小模型继承大模型能力,推理成本再降 50%。在硬件方面,DeepSeek 率先全栈适配华为昇腾 950,从 CUDA 迁移至 CANN 框架。国产芯片单卡推理性能为英伟达 H20 的 2.87 倍,采购成本更低。芯模协同优化,训练推理成本较海外方案降低 70%-85%,直接对冲云厂商涨价影响。市场方面,2026 年是AI智能体落地元年,Token 消耗呈指数级增长,低成本是规模化关键。DeepSeek 采用了V4-Flash 低价走量,V4-Pro 走高端市场的市场价格策略。开源吸引开发者,降低企业落地门槛,是能够快速抢占市场份额的。DeepSeek 逆势降价,是国产 AI 摆脱海外依赖、靠技术定义成本的里程碑。这场降价,本质是国产 AI 的成本革命与话语权争夺。

8. 别跟风买Mac Mini了!国产算力跑OpenClaw,只需5分钟

9. The Information:即将发布的DeepSeek-V4会完全适配于华为的昇腾950PR芯片,阿里、字节、腾讯等大厂已经采购了数十万颗这款芯片,用来提供给云服务以便销售DeepSeek模型。因为供需关系的变化,昇腾950PR芯片已经涨价20%,出于分摊风险的考虑,DeepSeek-V4也适配了寒武纪的芯片,基于它的分支模型也都专为国产芯片优化。DeepSeek还拒绝了英伟达提前获取新模型的要求,这通常是为了帮助芯片厂商与重要模型进行磨合,只有华为等少数中国芯片厂商获得了这个提前窗口期。昇腾950PR的性能相当于英伟达H20的2.8倍,但比不过主流的H200,主要依靠中芯国际的代工,需要克服产能挑战。

10. 难得一见:黄仁勋因为这件事,在访谈中跟主持人吵起来了,DeepseekV4可能带崩美国科技公司#黄仁勋 #英伟达 #DeepSeekV4 #芯片 #中美科技竞争

11. 国产版Ollama来了,Clawdbot终于不只属于Mac和英伟达

12. 扒完 DeepSeek V4 报告,我翻出了这个隐藏彩蛋

13. AI芯片2025:巨头血拼,权力鼎革

14. 刚刚,梁文锋被曝史上首次融资!DeepSeek V4彻底摆脱英伟达

15. #芯片# 据外媒《The Information》报道,DeepSeek即将推出的新一代模型V4已基于华为昇腾950PR进行优化,底层代码从英伟达CUDA迁移至华为CANN框架。阿里、字节、腾讯已提前为此大量下单国产AI芯片。国产AI模型+国产芯片的组合将为中国科技自主可控写下关键一页,加速打破英伟达芯片垄断格局。

16. 中国智驾芯片全景:国产崛起,三国杀格局成型

17. DeepSeek-V4:华为昇腾适配、性价比王者、最新底层技术

18. 为什么DeepSeek V4这么强?它到底更新了啥?

19. DeepSeek 计划二月中旬发布新模型 DeepSeek-V4,有哪些技术亮点?能第二次震惊世界吗?

20. 英伟达害怕的灾难发生了!DeepSeek V4-Pro在Codeforces拿到3206分,以绝对优势压制GPT-5.4;华为昇腾950 P R代替了英伟达显卡;成本方面,V4输入价低至每百万token 0.14美元,仅为竞品的数十分之一;更震撼的,是V4真正实现了从英伟达CUDA向华为CANN的架构迁移。经深度调校,华为昇腾950PR单卡算力达到英伟达H20的2.87倍,推理速度提升35倍,国产芯片首次在万亿级模型上站稳了脚跟。黄仁勋在采访时直言,如果DeepSeek先在华为平台上发布,对美国将是“灾难性的”。他最担心的从来不是中国做出好模型——从量化巨头出身的梁文锋,早在2021年就搭建了万卡算力集群,这一天的到来本就在预期之内。他真正担心的是那个围绕CUDA运转了二十年的生态共识被打破。一旦“芯片-框架-模型-应用”的国产全链路贯通,开发者们从底层就不再把英伟达当作默认起点,那失去的不是订单,而是整个行业的定价权和话语权。因此,不要只将V4视作一次开源胜利。这是国产芯片在AI决战中最有力的一次集体背书。这场反击的赢家,不只是推出V4的梁文锋,更有站在V4背后、重塑底座的华为。

21. 有个数据特别值得咂摸:没适配国产芯片的AI公司,股价当天跌了6.8%。智谱、Minimax这些名字,放在半年前还是资本的宠儿。这说明“国产替代”这四个字,已经从政策口号变成了真实的生存筛选器。我其实理解那些还没适配的公司,毕竟英伟达的生态成熟度确实高,迁移成本不低,技术团队也有路径依赖。这些都是合理的现实考量。但市场不等人,当资金开始把“是否适配国产芯片”作为定价因子的时候,骑墙的窗口期就关闭了。6.8%的跌幅不是惩罚,是警告。下一轮可能就是机构直接从持仓里剔除。 #国产芯片板块直线拉升# 国产芯片板块直线拉升

22. Live热知识:聊聊DeepSeek V4全面转向华为昇腾芯片的对话问答【直播问答】

23. 第一时间,寒武纪原生适配DeepSeek-V4!两大国产之光再次强强联合

24. 核心AI场景首超英伟达,一场国产算力的“破局叙事”|甲子光年

25. 摩尔线程上市首日开盘暴涨 468%,一签盈利近 27 万,怎样看待其表现?摩尔线程的发展空间有多大?

26. 彻底火了!多家AI巨头,上线DeepSeek-V4

27. 特朗普放行了英伟达H200芯片,有个条件是美国政府抽成25%,约等于变相涨价,虽然会对昇腾、昆仑芯等高端国产芯片的短期订单形成挤压,长期看其实还好。H200并不是英伟达最好的芯片,Blackwell、Rubin等更先进芯片仍被禁,这两者综合性能是H200的4-10倍、30倍,售价也非常的昂贵。国产顶尖AI芯片(昇腾910D、壁仞BR100等)整体性能约为H200的50%-80%,核心差距在FP8算力、显存带宽、生态成熟度,在特定场景可形成局部优势,譬如中轻量推理。最重要的是胜在便宜啊。按等效算力算,国产性价比要高40%以上,在加了25%美府抽成后,H200性价比就更低了。按照一些网络说法,H200目前的单卡性能,国产芯片在2-3年内能追上,生态全场景的话大概5年。也就是说,H200最吃香的光景也就2-3年。川普可能会持续的放行一些芯片…咱们还有本地化的政策,现在国产化率已经达到了40%,2026-2027年目标是50%-55%,感觉影响不会特别大,千亿级云端训练挺爱用它的,买家当然是最头部的那几位了。当然这些都是看的资料,挺希望业内人做分享,很好奇明后天的A股,还有未来五年的中美芯片PK情况

28. deepseek是4月24日发布V4的,两个版本,flash和pro。day0能适配的芯片就是华为昇腾、寒武纪。day1宣布适配的是英伟达。除此之外,25日,day1,海光、沐曦、摩尔线程、昆仑芯、平头哥真武、天数智芯根据智源研究院的FlagOS宣布flash版本的全量适配和推理部署。flash版本是比较容易适配的,单卡小集群就能跑,对硬件要求低,所以这些AI芯片入手比较快,但是真正考验人的是pro版本的适配。越快能适配pro版本,才说明1)技术能力强;2)是deepseek的核心朋友圈(能提前抢跑)。我查了下最新的情况,目前能适配Pro的国产芯片有:海光、摩尔线程、壁仞科技。(根据官方号自己宣布的)

29. DeepSeek V4震撼发布!实现全球开源领先

30. 真正让人震撼的是DeepSeek-V4那个“Day 0适配八大国产芯片”。你想想,过去十几年,都是芯片厂商定义生态,英伟达的CUDA绑住了全世界的开发者,硬件决定软件能做什么。现在反过来了,是一个开源大模型主动选择去适配国产硬件,用软件生态反向拉动芯片需求。这不是什么“国产替代加速”这种宏大叙事能概括的。本质上,生态的主导权从芯片转移到了模型。谁能跑通最强的开源模型,谁就能定义哪颗芯片值钱。寒武纪的订单排到2027年,不是因为它的芯片突然变强了,是因为DeepSeek选了它。这个逻辑如果成立,未来真正的“卖铲人”可能不是造芯片的,而是写模型的。英伟达统治算力十年靠的是CUDA护城河,而DeepSeek用一次开源适配,就把八家国产芯片同时拉进了牌桌。这招,比任何产业政策都狠。 #芯片产业链大爆发# 芯片产业链大爆发

31. 黄仁勋最怕中国AI的事 DeepSeek刚刚做到了 黄仁勋最害怕事还是发生了:DeepSeek V4发布,华为昇腾超节点深度适配,全球AI圈等待已久的大事落定,聊一聊背后的三大核心真相 #ai #deepseek v4 #deepseek #黄仁勋 #梁文锋

32. 午后,国产芯片直线爆发!DeepSeek、华为,大消息!

33. 英伟达亲手终结CUDA「护城河」?传奇芯片架构师引发争议

34. 这次春节AI大战,国产模型与国产芯片第一次,双向奔赴! #春节世界观察 #新年囤点专业货 #燃起来了大国重器 #大咖观察 #红衣聊AI

35. DeepSeek V4好用吗?【秋芝的AI开箱】

36. 独家丨首个「万卡国产算力集群 万亿参数大模型」开启测试邀请

37. 英伟达中国份额降至0%,A股国产芯片今日集体暴涨,寒武纪等创历史新高,对此你怎么看?

38. 华为AI强势崛起,芯片格局的反转!2025年,华为昇腾出货 81.2万颗 AI芯片,占中国整体市场 20% ,国产厂商第一、全市场第二。而英伟达份额暴跌 40% ,国产芯片整体份额升至 41% 。昇腾950 PR推理性能达英伟达H20的近3倍,910 C采用7nm工艺,FP16算力 800 TFLOPS 。deepseek深度求索新一代旗舰模型V4从CUDA迁移到华为CANN框架,阿里、字节等大厂下单数十万颗升腾芯片。构建MindSpore框架到CANN计算架构闭环,2025年全面开源,开发者达数百万。(信息综合自网络)

39. DeepSeek v4全面支持百万上下文 token,这意味着什么?到底有多厉害?

40. 摩尔线程 AIBOOK 评测:"长江"SoC来了,它会是国产AI生态的敲门砖吗?【X.PIN】

41. 华为 MWC2026 首秀超节点算力阵列 Atlas950,将带来哪些影响?

42. #DeepSeek 现在我是你爹了#Deepseek V4发布后,一直引发了一些小争议。至于原因众说纷纭,我也说一下,个人小猜测。不排除与大模型跨算力迁移有一定的联系,当然,这只是猜测Deepseek以前更多依赖英伟达算力训练和推理,这一次基于昇腾算力对V4模型做了推理适配,后训练与推理阶段V4-Flash后训练由昇腾完成,当前对外开放的API推理也运行在昇腾上。DeepSeek首次将昇腾NPU与英伟达GPU共同写入技术报告的硬件验证清单不排除平台切换模型迁移过程中,工程压力过大导致对齐缺陷,这种风格突变是否与后训练pipeline在迁移过程中的调试压力有关,目前尚无技术证据,欢迎讨论或者更简单的说,这不是华为的硬件不行,也不是Deepseek变得更差了,而是一个硬件迁移过程中的阵痛阶段。从英伟达部分向华为昇腾迁移,许多技术需要调整。随着越来越倾向国产硬件,迁移过程中的问题可以得到逐渐解决

43. 从“能用”到“好用”,中国芯PC经历了什么?搭载飞腾D3000M的轻薄本表现如何?

44. #微博声浪计划##听见微博# 2026年4月24日,DeepSeek V4正式发布并开源,华为昇腾同步完成全链路适配,实现国产大模型与算力深度融合。技术上迁移至CANN框架,昇腾950PR芯片优化性能,8K场景推理延迟低至10ms,能耗降40%。产业端打破英伟达垄断,推动国产算力规模化,全球竞争格局生变。 闫跃龙的微博音频

45. #DeepSeekV4发布# DeepSeek-V4预览版正式开源!📢 推出Pro/Flash双版本,1M超长上下文成标配,一次性可处理百万字海量信息。Pro版Agent能力达开源最佳,编码体验优于Sonnet 4.5;Flash版主打极致性价比,1元/百万token的API价格大幅降低接入门槛。采用DSA稀疏注意力技术大幅降低算力成本,原有deepseek-chat模型名将于2026年7月24日停止使用,开发者注意及时迁移。

46. “通云哥”是什么?这是一个新词,你需要了解。 2009年阿里云起步,2018年平头哥成立,2019年启动大模型研发,历经17年奋战,“通义实验室—阿里云—平头哥”组成的“通云哥”黄金三角全面成型。 当下,阿里已经成为全球极少数在大模型(通义实验室)、云计算(阿里云)、AI芯片(平头哥)三大核心领域均实现【顶级自研能力】的科技企业,真正构建起软硬协同、垂直整合的超级AI基础设施底座, 这叫什么?全栈真自研。 1月29日,平头哥官网悄然上线代号“真武810E”的高端AI芯片,宣告阿里巴巴自研PPU正式落地。这款芯片基于全自研并行计算架构与片间互联技术,搭配全栈自研软件生态,支持AI训练、推理及自动驾驶场景。其核心参数包括96GB HBM2e高带宽内存、700GB/s片间互联带宽、PCIe 5.0×16接口及400W功耗设计。 业内评估显示,“真武810E”整体性能超越主流国产GPU,接近英伟达H20水平。上线前已在阿里内部经长期验证,稳定性与性价比突出,过去一年持续供不应求,现为出货量领先的国产AI芯片之一。目前,该芯片已在阿里云完成多个万卡规模集群部署,支撑通义千问大模型训练与推理,并服务于国家电网、中科院、小鹏汽车、新浪微博等超400家机构。 #真武810E##烈焰童子说#

47. 摩尔线程上市首日开盘暴涨 468%,一签盈利近 27 万,怎样看待其表现?摩尔线程的发展空间有多大?

48. 「开源撕开市场裂缝,生态才能浇筑护城河。」DeepSeek的路径与当年Android对抗iOS有结构性相似:先用开源和极致性价比获取开发者迁移的第一步,再通过芯片适配、API定价和工具链形成迁移成本,最终让"用过就回不去"变成系统性锁定。不同的是,这次博弈的筹码不是手机操作系统的市场份额,而是算力主权这张更大的牌桌。当模型、芯片、开发者生态三者开始形成正向飞轮,单点的技术领先就不再是决胜因素,生态的厚度才是终局的壁垒。#DeepSeek V4将于4月下旬发布# deepseek v4将于4月下旬发布

49. #AI# 国产算力芯片再传好消息!近日,华为发布了全新的 Atlas 350,搭载昇腾 950PR 芯片,定位为大模型推理旗舰卡,主打 Prefill 阶段与推荐业务场景,与英伟达 H100比有什么优劣势?H100 作为 Hopper 架构旗舰,是全球 AI 训练与推理的标杆产品,两者在定位、架构与生态上存在显著差异,以下从核心参数、优劣势与适用场景进行一下分析,大家可以有更深入的了解:华为 Atlas 350 优势●低精度推理性能突出:FP4 算力专为大模型 Prefill 阶段设计,在该场景下性能可达 H100 的 1.8 倍,多模态生成速度提升 60%●内存访问优化:内存访问颗粒度从 512 字节优化至 128 字节,小算子访存效率提升 4 倍,特别适配推荐系统等高并发场景●国产自主可控:无出口限制,适配国内 AI 生态(盘古大模型、MindSpore 框架),供应链安全有保障●超节点扩展能力:2TB/s 互联带宽支持最大 192 颗芯片全互连,满足 MoE 模型专家并行需求●价格优势:成本约为 H100 的 60%-70%,适合大规模部署英伟达 H100 优势●生态垄断地位:CUDA 生态 + TensorRT 优化,适配全球 90%+AI 框架与应用,开发工具链成熟●全场景覆盖:从千亿参数模型训练到边缘推理,产品线完整,无需更换硬件平台●通用计算能力:FP8/FP16/FP32 全精度性能均衡,尤其在训练场景下领先 Atlas 350 约 40%●软件工具链:调试、优化工具丰富,支持多实例 GPU(MIG)等高级特性,开发效率高●全球兼容性:适配国际主流云服务平台与企业级软件,无迁移成本各自短板华为 Atlas 350:生态成熟度不足,适配非国产框架需额外开发;训练能力弱于 H100,不适合大规模模型训练;功耗效率在通用场景下低于 H100英伟达 H100:受美国出口管制,国内企业采购受限;价格昂贵(约 25 万元 / 卡);FP4 精度支持不足,在 Prefill 等特定推理场景性能不如 Atlas 350适用场景:优先选择 Atlas 350 的场景●国内大模型推理(特别是 Prefill 阶段),如文心一言、通义千问等国产模型部署●互联网推荐业务(如电商、短视频推荐系统),小算子密集型计算需求高●追求国产可控与供应链安全,避免外部制裁风险的企业●超大规模集群部署,需要高互联带宽与内存容量的场景优先选择 H100 的场景●全球部署的 AI 应用,需要兼容国际生态与框架●大规模模型训练(如 GPT-4 级千亿参数模型),对 FP8/FP16 算力要求高科研机构与高校,需要丰富的开发工具与全球技术支持●边缘计算与嵌入式场景,需要 MIG 等灵活部署特性

50. X86指令集+英特尔或AMD CPU+微软Windows,曾经定义了什么叫桌面数字时代;ARM指令集+高通或苹果CPU+谷歌Android或苹果iOS,曾经也定义了什么叫移动数字时代。华为的鸿蒙+MindSpore+CANN+昇腾芯片纵然还不是“世界第一”,却也毫不客气地给谷歌、Meta尤其英伟达此前制霸的AI地基TensorFlow/PyTorch、CUDA捅出了一个巨型窟窿!

51. 地平线咖咖虾不仅能部署在地平线芯片平台更能兼容多种平台,HSD+咖咖虾逻辑和FSD+Grok一样,但在本地化程度上会比后者更强,进化能力也更强。地平线芯片+智驾系统+智能体,这三个组合在一起就是完整的智能汽车三件套。#中国首个智能虾上车#

52. #腾讯QClaw内测#腾讯QClaw:把AI智能体送进社交场,生态协同再下一城。 腾讯内测QClaw,并非简单复刻OpenClaw,而是一次精准的产品化+入口化战略落地。它以本地一键部署降低门槛,告别极客式命令行操作,普通用户也能轻松启用“小龙虾”,兼容主流国产大模型与自定义配置,大幅降低AI智能体的使用成本。 更关键的是,QClaw打通微信、QQ两大核心入口,把Agent能力嵌入日常消息流,让AI从独立工具变成社交场景里的随身助手。这不是功能叠加,而是入口升级,借助高频社交场景激活AI执行价值。 底层依托开源智能体,中层封装部署与模型路由,上层绑定腾讯IM生态,三者联动直接盘活腾讯云+AI+社交的协同优势。此举既普及AI智能体,又巩固生态壁垒,为个人与企业级AI落地开辟更顺滑的路径。#how i ai# http://t.cn/AXVxsCz7 http://t.cn/AXVJ6nWH

53. 百度千帆 OpenClaw 直接打破偏见!3–5 分钟极速配置,零门槛搭建 AI 智能体,彻底解决开发者接入难、成本高、周期长的行业痛点。更炸裂的是,龙芯 3B6000M 成为首款完美适配 OpenClaw 的纯国产芯片,软硬件全国产化闭环正式跑通!有人嘲讽这只是营销噱头,也有人断言它将重构 2026 年国内 AI 赛道。低门槛普惠 + 自主可控硬件双加持,到底是弯道超车,还是虚张声势?当国外技术层层封锁,国产 AI 终于亮出硬实力。这一波,是真突破,还是伪创新?#过个有AI年##HOW I AI##微博超有用视频大赛##上微博涨知识##AI创造营# 种斌Marco的微博视频

54. 直击GTC:1万亿美元GPU、为龙虾做“CUDA”,老黄就指着你烧 token 了

55. 别再折腾小龙虾了!手把手教你部署 Hermes:接入飞书,这才是真正的全自动 AI 助理

56. #摩尔线程突破900元大关#摩尔线程股价突破900元、市值超4200亿元的暴涨,是国产替代风口下资本情绪的集中爆发。作为A股唯一实现全功能GPU量产量销的企业,其稀缺性叠加万亿级国产算力替代需求,成为股价狂飙的核心逻辑。政策红利与行业刚需为其估值护航——“科创十六条”打破“唯盈利论”,美国芯片禁令催生自主算力刚需,而摩尔线程MUSA架构实现多场景适配、AI业务营收占比超94%的业绩,更强化了市场信心。但狂欢背后风险暗藏:122倍市销率远超行业均值,累计亏损超59亿元,与英伟达的生态差距仍未弥合,且低流通盘放大了股价波动。这场上涨本质是资本对国产GPU未来的押注,而非当前价值的真实反映。短期情绪退潮、后续竞品上市或解禁压力,都可能引发估值重估。摩尔线程的破局关键,终究要回归技术突破与生态构建,唯有将资本热度转化为研发实力,才能真正撑起国产算力的估值底气。#秒懂热点就用智搜# 摩尔线程突破900元大关

57. #DeepSeekV4 尺度#V4抛弃了cuda核心。国产芯片与模型改写成功:DeepSeek-V4 在昇腾芯片上完成全流程训练和推理验证核心代码已完成从英伟达 CUDA 架构向华为 CANN 架构的迁移模型在昇腾芯片上的推理速度得到了显著提升。V4-Flash版本的输出定价为每百万token 2元人民币,同期部分海外模型的定高达30 美元,成本差距显著。匹配国产,解构美产,助催美国泡沫破灭。

58. 现在中国最接近、也最有希望做出“中国版CUDA”完整生态的只有三家

59. 华为昇腾950PR算力芯片+CANN NEXT 软件生态链,实现兼容英伟达CUDA生态,降低生态迁移成本,获得大厂采购计划。

60. 黄仁勋预警成真?DeepSeek联手华为昇腾,正撕裂CUDA二十年统治

61. 华为昇腾950PR兼容CUDA,撼动英伟达AI算力护城河

62. 56 亿订单撕碎 CUDA 垄断

63. DeepSeek V4全面拥抱华为昇腾

64. 全面拥抱华为,全球首个脱离CUDA的顶级AI大模型!

65. 黄仁勋警告成真?华为昇腾+DeepSeek将颠覆CUDA霸权?

66. 深度解析

67. 华为昇腾950引爆国产算力革命

68. 撼动英伟达护城河

69. 告别CUDA!DeepSeek V4牵手华为昇腾,中国AI技术栈迎来历史性突围

70. DeepSeek V4弃CUDA转华为CANN

71. 大模型为什么必须“适配”英伟达GPU或华为昇腾NPU或者谷歌TPU?DeepSeek V4开源适配华为昇腾,英伟达CUDA生态的护城河正在松动?

72. 国产算力芯片,即将兼容CUDA?

73. 华为升腾AI处理器

74. 华为捅破英伟达“命门”!不用学新东西,电脑里的AI程序,直接能用国产芯片跑了

75. 寒武纪成功适配 DeepSeekV4,推动AI 模型高效运行

76. 【AI行业解读】

77. 🚀寒武纪实现DeepSeek-V4全系列模型Day0适配并开源优化代码

78. 终于来了,寒武纪原生适配DeepSeek-V4!两大国产之光再次携手震撼世界!

79. 寒武纪AI一周新闻汇总(2026/4/22–2026/4/28)

80. 寒武纪AI一周新闻汇总(2026/4/22–2026/4/28)

81. 寒武纪Day 0适配DeepSeek V4!国产芯片+国产模型,A股算力板块全线拉升

82. 当寒武纪「拥抱」商汤,国产AI进入合纵时刻

83. 国产 AI 芯片产业深度调研复盘

84. 深度调研|2026国产AI芯片全面爆发!出货量大涨、局部反超英伟达

85. 全球 AI 芯片格局生变

86. DeepSeek V4换掉英伟达这件事,我觉得比"GPT-6要发布"还重要

87. 【卷卷漫谈】DeepSeek V4 背后那条没退路的山路

88. DeepSeek V4发布倒计时

89. DeepSeek V4炸场

90. 最新的DeepSeek-V4,为中国AI产业探索出了一条不依赖国外硬件的道路,致敬梁文峰

91. DeepSeek V4发布背后的关键一战

92. DeepSeek-V4于2026年4月24日发布并全面开源,其最核心突破是首次深度适配华为昇腾等国产AI芯片,实现从训练到推理的全链路国产化闭环

93. 炸裂!DeepSeek V4发布

94. DeepSeek V4即将发布

95. DeepSeek-V4打破CUDA生态枷锁

96. 2026年4月24日,DeepSeek正式发布新一代大语言模型DeepSeek-V4系列,同步向全球开源。

97. 从 PyTorch 到 MindSpore

98. MindSpore高效训练指南

99. 基于MindSpore在昇腾NPU下的自动混合精度(AMP)训练实战指南

100. 昇腾上的极速狂飙

101. 从0到1

102. 从慢得离谱到性能翻倍

103. Qwen 模型推理加速与多场景评估

104. MindSpore 进阶实战

105. 国产GPU的高光时刻

106. 国产GPU龙头加速狂奔

107. 国产GPU龙头摩尔线程(688795)基本面分析

108. 国产GPU企业摩尔线程赋能全场景AI应用

109. 摩尔线程财报拆解

110. 国产GPU龙头强势崛起

111. 见证历史!国产GPU挺进“盈利时代”

112. 扭亏为盈!摩尔线程一季度净利转正,国产GPU驶入商业化快车道!

113. 摩尔线程2026财报发布,国产高端GPU龙头步入良性循环

114. 国产GPU首次跨入家庭 摩尔线程凭何打通“云边端”算力版图

115. 天数智芯用“无感迁移”打破国产GPU生态僵局

116. 国产AI芯片的客户困境

117. 2026年AI芯片适配开发指南

118. 【行业分析】从“堆芯片”到“拼系统”

119. AI算力芯片赛道生存现状

120. 算力芯片产业专家交流

121. 字节跳动56亿美元锁定35万颗国产AI芯片,算力自主可控提速

122. 适配华为昇腾!DeepSeek-V4技术报告公开,国产大模型“芯”突破

123. DeepSeek V4 全面开源!1.6万亿参数杀穿闭源天花板,寒武纪同日适配MLU,国产算力版图拼完最后一块

124. DeepSeek-V4震撼发布!寒武纪Day 0原生适配,两大国产之光会师

125. 深度|DeepSeek 脱离 CUDA

126. 寒武纪Day 0适配DeepSeek V4

127. 天数智芯2025年推理业务收入同比大增238%,领跑AI商业化核心赛道

128. 推理业务大增238.2%,天数智芯领跑国内GPU规模化商用

129. 天数智芯首份年报拆解

130. 大模型进入“下半场”,天数智芯布局,正撞上AI算力的结构性变局

131. 【机构研报】电子行业深度分析

132. 1/3的调优精力,20%的性能优势,国产GPU的“好用”正在成为新常态

133. 天数智芯亮相AWE,展示全场景算力解决方案

134. 寒武纪新机遇

135. 国产算力放量,为什么说确定性正在变高?

136. 国产算力芯片

137. 国产芯片Day0适配闭环——底层算力账怎么算

138. 8家国产芯无缝衔接DeepSeek-V4,中国AI算力生态的拐点来了!

139. DeepSeek V4

140. 从DeepSeek-V4看国产芯片的投资逻辑

141. 寒武纪Day 0适配DeepSeek V4意味着什么

142. DeepSeek-V4发布后,企业部署真正要考虑的是什么?

143. DeepSeek-V4带动了这个行业崛起

144. DeepSeek发布当天,发生了一件我没想到的事

145. 昇腾CANN推理性能反超2.87倍

146. 替换大语言模型并非即插即用:揭秘模型迁移中的隐性成本

147. 造福or替代程序员?实测阿里新模型

148. 20cm速递|创业板50ETF国泰(159375)回调超1.6%,国产算力即将迎来破局时刻,回调或可布局

149. 科技行业周报:推理应用驱动算力投资 国产算力景气升级

150. 中信证券:看好国产算力芯片及国产系统级厂商投资机遇

151. 计算机行业点评:自主可控 时代的声音

152. (经济观察)从 “敢用”到 “善用” 算力国产化如何破局?

153. 其实国内算力主力就是两家,英伟达和华为昇腾。前者通过各种渠道总能进来,而且到货越来越及时;后者的产能问题也在陆续解决。

154. MLP代码演示--基于国产芯片

155. 国产AI芯片的翻身仗,2026年开打

156. 智源FlagOS完成DeepSeekV4八款芯片Day0 适配,实现三重技术突破

157. 华为昇腾超节点支持DeepSeek V4模型,寒武纪也适配完成

158. ‌主流AI芯片的软件生态与迁移成本差异对比

159. 国产AI芯片商战深析:昇腾950PR与寒武纪MLU690,参数之外的商用胜负手

160. 炸场!8大国产AI芯片7天火速适配DeepSeek-V4,华为百度阿里集体入局,国产算力生态要变天?

161. 第一时间,寒武纪原生适配DeepSeek-V4!两大国产之光再次强强联合

162. 摩尔线程举办MUSA开发者大会,国产GPU成焦点!详解国产算力的机遇

163. 解惑寒武纪2026年主打产品和客户

164. 一天一个昇腾Agent-Skills小技巧:轻松完成MindSpeed-MM FSDP2自动迁移

165. DeepSeek V4国产化适配核心受益公司梳理

166. 打破技术壁垒:国产架构下大模型训练与微调,让自主 AI 触手可及

167. H200 供货博弈与国产突围:2026 年 AI 芯片格局推演 —— 云大厂算力采购与技术布局决策指南

168. DeepSeek V4,强关联的8家公司

169. 国产模型发布当日即适配,考验国产芯片哪些能力?

170. 【电子-马良】国产算力崛起:内外双轮驱动下的自主生态突围

171. 实测性能超AGX Orin!天数智芯发布彤央系列 国产边端算力要变天?

172. 1600亿算力大单:国产芯片抢了英伟达的C位!

173. 寒武纪Day 0适配商汤日日新Seko系列模型,赋能客户体验多模态AI

174. 大厂算力进展交流20260423 本次会议围绕国内互联网大厂(字节跳动、腾讯、阿里、百度)2026年AI算力采购进展及国产芯片格局展开。专家透露,字节跳动2026年AI基础设施总预算约1600亿元,GPU整机采购约2300-2500亿元(此处专家为内部估算口径),其中海外采购约1200亿元(英伟达60%、AMD 30%、博通5%),国内约1100亿元,国产芯片采购约800-900亿元。国产芯片中,寒武纪订单约250-300亿元,华为昇腾约220亿元(含910C/950PR),字节自研芯片约200亿元(主要通过三星代工),其余订单分配给海光信息、天数智芯、昆仑芯、沐曦等厂商。腾讯2026年GPU采购预算至少1000亿元,其中国产芯片采购可能达700-800亿元,昆仑芯为其一供(约30万张卡),燧原为二供。阿里今年平头哥自研GPU预计出货三四十万片,同时加大国产芯片采购。百度开支相对保守(约200-300亿元),但昆仑芯已启动港股IPO,腾讯向其下单约30万张卡。专家指出火山引擎豆包大模型日均Token调用量3月已突破120万亿,4月达140-150万亿,月增超30%,MaaS收入年内有望冲击300亿元。全文核心逻辑为:国产芯片已进入满产满销的确定性放量阶段,产能而非设计能力是当前核心约束。 #算力 #机构调研 #机构电话会议 #投研报告 #国产芯片

175. 【沐曦股份】沐曦股份的“国产GPU新锐”成长之路

176. 寒武纪:国产 AI 芯片能不能走出 CUDA 阴影?

177. 锚定算力自主,国产算力芯片乘风而起

178. 海光信息、摩尔线程宣布:Day0适配DeepSeek V4

179. 寒武纪成功适配 DeepSeek-V4,推动 AI 模型高效运行

180. 从千亿大脑到指尖助手:昇腾算力上打造Java专属AI编码员的完整实战

181. 寒武纪的三个谜题:产品、客户和那张悬在头顶的牌

182. 国产GPU之‌寒武纪

183. DeepSeek-V4概念,关联公司梳理(附名单)

184. 寒武纪完成DeepSeek-V4 Day0适配 代码已开源至GitHub

185. 商汤日日新Seko系列模型适配寒武纪,打通多模态AI的国产算力关键路径

186. 湖南大学:国产 AI 芯片软件生态白皮书

187. 国产算力进入黄金发展期

188. 专家访谈摘要:DeepSeek-V4的mHC架构提升了模型性能,昇腾、寒武纪、海光等适配程度不同

189. 《DeepSeek一刀砍在英伟达大动脉!中国AI彻底实现“换道”》

190. 昇腾携手DeepSeek-V4正式发布

191. 天数智芯业绩报告出炉:推理系列收入同比大增238.2%,训推双赛道齐发力

192. 中国 AI 芯片厂商崛起,华为位居第一!

193. 中国 AI 芯片厂商崛起,41% 国内市场份额!

194. 中国 AI 芯片厂商崛起了!

195. DeepSeek脱离英伟达,黄仁勋说这是“可怕的结果”

196. 基于昇腾 MindSpeed LLM 玩转 DeepSeek-V4-Flash

197. 2026年国产GPU行业全景分析:景嘉微、寒武纪、摩尔线程全梳理

198. 寒武纪已完成DeepSeek-V4适配

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章