国产GPU厂商摩尔线程开源TileLang-MUSA,首推全功能软件栈打破CUDA依赖

源自39位全网作者

02-10 22:06

内容由AI生成

精选参考来源

1. 英伟达“护城河”要塌了?但这次是老黄自己动的手【X.PIN】

2. 3000亿摩尔线程亮家底 :我真的就是英伟达

3. 摩尔线程上市后的第一场大会,办给了开发者|甲子光年

4. #摩尔线程科创板IPO获批##国产GPU最新进展#10月30日,摩尔线程获证监会同意科创板IPO注册,预计11月下旬挂牌,募资80亿主攻AI训推一体芯片、图形芯片研发,将成“国产GPU第一股”!作为国内唯一全栈自研GPU企业,其2025年上半年营收7.02亿(同比+229%),AI智算产品占比超94%,待签订单超20亿,预计2027年盈利。技术&生态突破 • 第四代“平湖”GPU架构:万卡集群互联,算力升50%、功耗降30%,已通过头部互联网测试; • 新品落地:智能座舱“长江”SoC性能超高通8295(2026年量产),边缘计算E300对标英伟达; • 开发者生态:10月30日开首届MUSA大会,推大模型训练工具SimuMax v1.0,显存误差仅1%。产业链合作加速 • 国家级:与国家信息中心共建全国算力网; • 供应链:中芯国际(14nm代工)、长电科技(封装测试,月产能5万片)、生益科技(高端PCB)深度绑定; • 行业应用:东华软件签3年50万片采购协议,浙大网新任浙江总代理。核心受益标的 • 直接参股: ◦ 和而泰(002402):直接持股1.244%,珠海基地接30%+GPU模块代工,联合投超算中心; ◦ 山子高科(000981):产业基金间接持股1.244%,受益估值提升。 • 供应链: ◦ 中芯国际(688981):核心代工,平湖架构量产提产能利用率; ◦ 长电科技(600584):封装主力,订单增长直接映业绩; ◦ 生益科技(600183):高端PCB供应商,出货量同步增。 • 行业应用: ◦ 东华软件(002065):50万片采购+共建算力基地; ◦ 浙大网新(600797):浙江分销,拓政府/企业市场。 • 生态协同:科大讯飞(002230)基于其GPU开发AI应用,麒麟软件完成全适配。风险提示技术代差(MTT S80接近英伟达RTX 3060,距Blackwell架构有差距)、先进制程依赖海外(14nm以下流片风险)、2027年前需持续烧钱(盈利不确定)。国产GPU赛道迎来里程碑!你更关注摩尔线程哪类合作标的?👇#国产GPU核心标的##半导体产业链动态#

5. 国产算力的“伟大闭环”!DeepSeek“不起眼的一句话”可能改变整个GPU编程生态

6. 全网首测!首款国产GPU「AI算力本」现场上手

7. 摩尔线程重磅发布:新一代GPU架构“花港”能效提升10倍,系列芯片明年量产上市,推出AI算力笔记本

8. 刚刚,英伟达CUDA迎来史上最大更新!

9. 网上中签率0.02423369%,网下申购倍数近1600倍!"国产GPU第一股"摩尔线程启动申购遭疯抢

10. 国产GPU,拐点已现

11. #摩尔线程突破900元大关#摩尔线程股价突破900元、市值超4200亿元的暴涨,是国产替代风口下资本情绪的集中爆发。作为A股唯一实现全功能GPU量产量销的企业,其稀缺性叠加万亿级国产算力替代需求,成为股价狂飙的核心逻辑。政策红利与行业刚需为其估值护航——“科创十六条”打破“唯盈利论”,美国芯片禁令催生自主算力刚需,而摩尔线程MUSA架构实现多场景适配、AI业务营收占比超94%的业绩,更强化了市场信心。但狂欢背后风险暗藏:122倍市销率远超行业均值,累计亏损超59亿元,与英伟达的生态差距仍未弥合,且低流通盘放大了股价波动。这场上涨本质是资本对国产GPU未来的押注,而非当前价值的真实反映。短期情绪退潮、后续竞品上市或解禁压力,都可能引发估值重估。摩尔线程的破局关键,终究要回归技术突破与生态构建,唯有将资本热度转化为研发实力,才能真正撑起国产算力的估值底气。#秒懂热点就用智搜# 摩尔线程突破900元大关

12. 有网友问我沐曦,摩尔和寒武纪的区别。。国内的事情我一般不敢乱讲,怕惹事,我斗胆讲一讲,厂商听了如果有不爽,及时通知我删帖,好商量,别发EMS快递,谢谢。沐曦和寒武纪只做数据中心业务,2B市场,沐曦有一个MXMACA,这个东西类似CUDA,这帮人AMD出来的,有CUDA恐惧症,AMD只所以垃圾,大家都知道的,就是没有一个CUDA,发挥不出硬件的能力。。英伟达显卡上写的代码,可以很方便移植到沐曦的芯片上;寒武纪主流产品是NPU(类似GPU),是一种专用芯片,注重能耗。寒武纪主打一个:“英伟达训练 + 寒武纪推理”。英伟达用的是 CUDA,寒武纪用的是自己的 MagicMind(推理加速引擎)和 Neuware(软件栈)使得在英伟达芯片训练的模型可以跑在寒武纪芯片上做推理。如果你的原始代码是标准的 PyTorch 或 TensorFlow,寒武纪提供了专门的插件和算子库。大部分情况下,你不需要改动底层代码,只需要通过寒武纪的工具链进行模型转换(量化、编译)摩尔呢,主要是英伟达的人出来干的,处处模仿英伟达,敞开当一回地主那种感觉,消费级显卡和数据中心显卡都做,但是消费级显卡貌似黄了,摩尔也有类似沐曦的MXMACA,摩尔叫MUSA。都类似CUDA。摩尔的IPO文件中几个大金主(匿名的),消费极大,大概率都是买万卡集群的,摩尔专门干这个,为超级大客户服务的。当然,我也是AI小白,不如广大网友专业,略懂皮毛,内行可以在评论区讨论下,谢谢。

13. 英伟达退出中国市场, 如果是6年前,英伟达的撤出会让国内企业措手不及,现在我们不仅能对英伟达反垄断调查,甚至还明里暗里要求大厂跟英伟达脱钩,说明我们已经做了充足的准备。目前能够替代英伟达芯片的国产芯片有很多:一, 华为昇腾系列:如昇腾910系列,早期产品能对标英伟达A100,新款性能可叫板H100,是H20的四五倍。华为有自己的生态闭环,昇腾芯片搭配鸿蒙系统和盘古大模型,适用于互联网大厂、云计算公司等,2025年一季度华为靠国内市场冲到全球AI芯片市场第三。二,寒武纪思元系列:寒武纪思元590芯片性能接近英伟达H20,最新的MLU-690芯片,算力能对标英伟达的H100,且兼容性良好,可适配多个大模型,很多大厂都是其客户。三,海光DCU系列:采用GPGPU架构,兼容“类CUDA”环境,具备全精度计算能力,能发挥大规模并行计算能力。海光拥有CPU+DCU两大产品线,DCU可与CPU共享同一安全域,安全技术水平高。产品广泛应用于大数据处理、人工智能等领域,已占据国内市场头部份额。四,摩尔线程MTT S4000:基于自研MUSA架构,支持CUDA代码迁移,专注于全功能GPU,覆盖AI计算、图形渲染等领域。其已落地多个智算中心项目,还与字节跳动、腾讯等合作推进AI PC,有较强的生态兼容性。五,沐曦曦云C系列:属于全栈GPU解决方案中的通用计算芯片,自研指令集和IP,兼容CUDA生态。产品性能国内领先,已交付超2.5万颗GPU,应用于北京、上海等地智算集群。六,壁仞科技BR100系列:聚焦通用GPU与Chiplet异构架构,算力达英伟达A100的3倍,支持千亿参数模型训练,壁砺模组已落地多个智算中心。七,景嘉微JM11系列:性能对标英伟达GTX1050,可广泛应用于服务器、工作站、台式机以及笔记本等设备,是国产GPU领域的重要产品,目前最新一代JM11系列图形处理器已完成流片、封装。客观说,由于芯片制程的限制,我们的芯片在性能上跟人家比还是有差距的,即便我们真有传说中的高端光刻机,产量上一时半会也无法满足市场需求。好在我们已经有了坚实的基础,还有巨大的市场,没什么可担心的。

14. 国庆前放大招!DeepSeek-V3.2-Exp发布并开源,API成本将降低50%以上

15. #摩尔线程IPO过会##摩尔线程IPO成功过会#【摩尔线程首发获上交所上市委会议通过】财联社9月26日电,摩尔线程智能科技(北京)股份有限公司首发申请成功通过上交所上市审核委员会会议审议。上市委表示,摩尔线程智能科技(北京)股份有限公司(首发):符合发行条件、上市条件和信息披露要求。招股书显示,摩尔线程拟募集资金80亿元,用于摩尔线程新一代自主可控AI训推一体芯片研发项目、摩尔线程新一代自主可控图形芯片研发项目、摩尔线程新一代自主可控AISoC芯片研发项目、补充流动资金。

16. 摩尔线程开源TileLang-MUSA,以高效算子开发释放全功能GPU计算潜力

17. 开源GPU创新生态赛赛题三 | TileLang助力国产GPU算子优化

18. 摩尔线程

19. 摩尔线程开源TileLang-MUSA工具,代码量减少90%

20. 摩尔线程正式开源TileLang-MUSA项目,显著提升GPU计算开发效率

21. 摩尔线程开源 vLLM

22. 摩尔线程发布2025业绩预告:营收14.50亿元至15.20亿元

23. GPU智算卡性能领先且规模量产,摩尔线程预计全年亏损收窄34.50%到41.30%

24. DeepSeek-V3.2是这样快速实现算子的!

25. 大家关注这个掀桌子的国产GPU编程语言了没?

26. 什么是 TileLang?为什么国产算力离不开 TileLang?

27. 【民生AI体验官】DeepSeek v3.2实现国产AI的伟大“闭环”

28. DeepSeek拥抱国产芯语言 北大造TileLang

29. DeepSeek-V3.2-Exp 模型,直接带火tileLang

30. TileLang:更简单的AI算子开发

31. DeepSeek V3.2 引入TileLang算子对CUDA生态的影响

32. DeepSeek+TileLang:构建国产AI芯片新生态

33. 全网首个国芯TileLang在线体验环境,就在模力方舟!

34. GPU编程不用啃硬件!TileLang让新手也能写高性能算子

35. AI研发新范式:曦望芯片与TileLang的「软硬协同」之路

36. HyperAI超神经 x CCF ODTC丨TileLang助力国产GPU算子优化

37. 开源GPU创新生态赛赛题三 | TileLang助力国产GPU算子优化

38. DeepSeek v3.2背后的 TileLang解析:跨平台 GPU 编译新语言

39. DeepSeek突然拥抱国产GPU语言!对标CUDA替代Triton,华为Day0适配

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章