DeepSeek开源昇腾全套组件,代码无需重写直接平替英伟达
源自177位全网作者
09-30 20:56
精选参考来源
1
DeepSeek豪掷180亿买华为芯片,这账算得比谁都清醒。在美国把算力当“断头台”用的背景下,这25.6亿美元的订单不仅是买硬件,更是买一张不被随意收割的入场券。16万颗昇腾950DT,哪怕要等一年以上交付,DeepSeek也认了。这种“死磕”背后,是对全球零和博弈最冷静的回应。很多人觉得国产芯片不行,但DeepSeek选择用推理侧先扛起来。训练可以靠囤积的英伟达,但日常庞大的API调用必须有自己的基本盘。乌兰察布的吉瓦级数据中心一旦转起来,就是从“试探性适配”到“规模化押注”的质变。这世界上的事,凡是想垄断的,往往是想收智商税的。当所有人都被英伟达的生态绑架时,愿意花时间去陪国产供应链爬坡,才是真正具备独立人格的商业决策。别被那些唱衰国产算力的节奏带偏,保持清醒,才能在技术突围里守住那点不被卡脖子的自由。#彭博报道DeepSeek国产算力集群#
2
现在来看,黄仁勋之前作出的预测,十有八九是对的。
黄仁勋此前说DeepSeek首次跑在华为芯片上,对美国是个可怕的结果。当时都以为他在帮英伟达要政策。现在看,他是认真的。
DeepSeek选华为,不是退而求其次,是强强联手。
今年4月15日,黄仁勋在一档播客专访里说了句很重的话:“如果DeepSeek先在华为平台上发布,那对我们国家来说将是灾难性的。”当时听着像危言耸听,结果仅仅9天之后,这话就应验了。
4月24日,DeepSeek V4正式发布,华为计算随即宣布昇腾超节点全系列产品全面支持DeepSeek V4。
更关键的是,DeepSeek在V4开发过程中,专门花了好几个月跟华为合作,把底层代码从依赖CUDA的技术路径,转向了华为自研的CANN生态。
这意味着什么?意味着一个中国最顶尖的大模型,至少在推理端,已经可以不依赖英伟达的卡了。
黄仁勋真正怕的不是少卖几块GPU。他自己在访谈里说得很清楚——“假设它是针对华为优化的,针对他们的架构优化了,那就会让我们处于劣势”。
说白了,英伟达的护城河从来不是芯片本身,而是CUDA生态。过去所有大模型都莫认在CUDA上做首发优化,华为也好、AMD也好,性能再接近也只能当备选。因为迁移成本太高,没人愿意重写代码。
但DeepSeek这次直接把优先期给了华为,确保V4在昇腾950上高效运行。
实侧数据也很能打:8K输入场景下,昇腾950超节点跑V4-Pro的单token解码时延约20毫秒,V4-Flash约10毫秒。适配的昇腾950PR推理芯片,单卡算力比英伟达对华特供的H20提升了2.87倍,采购价却只有四分之一。
所以DeepSeek选华为,真不是退而求其次,是强强联手。这件事戳破的,是“开源模型必须以CUDA为首要优化目标”这条默认规则。一旦这条规则被打破,就会有更多工程师、更多优化经验沉淀到非CUDA路径上。
黄仁勋自己都承认,英伟达在中国市场的份额已经从2024年的70%降到了2025年的55%。
说到底,黄仁勋的焦虑不是没有道理。他看到的不是一款芯片被替换,而是一整个生态开始有了第二条路可走。
#英伟达黄仁黄#
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
-
盐焗虾的本味与做人哲理0 0 -
榴莲的极端特质与情感隐喻0 0 -
秋风起时忆外公的蒸蟹往事0 0
已收藏
去我的收藏夹