近日,人工智能企业深度求索(DeepSeek)正式发布了其新一代大模型DeepSeek-V4,这一事件因其与华为昇腾的深度绑定而备受瞩目,被视为中国人工智能产业迈向算力自主的关键一步。
DeepSeek于4月24日发布了DeepSeek-V4预览版,包含V4-Pro和V4-Flash两个版本。新模型在性能上实现了显著提升,全系支持百万级Token的超长上下文处理能力,并在代码生成、数学推理及Agent(智能体)能力上达到了开源模型的顶尖水平,部分能力已可比肩国际顶级的闭源模型。DeepSeek-V4在保持高性能的同时,也延续了其在成本控制上的优势,旨在推动前沿AI技术的普惠化。
此次发布最核心的亮点,是DeepSeek V4在华为昇腾平台上的“首发”。华为方面宣布,其昇腾超节点全系列产品,包括昇腾950和A3系列,均全面支持DeepSeek V4系列模型。这并非一次简单的软件移植,而是双方进行了深度的“芯模协同”。据悉,为了在昇腾硬件上实现最优性能,DeepSeek团队投入了数月时间,对模型的底层代码进行了大量重写和优化,从英伟达主导的CUDA架构迁移至华为的CANN异构计算架构。经过深度优化,模型在昇腾平台上的推理性能得到大幅提升。

这一合作的深层意义在于,它标志着“国产顶尖大模型+国产顶尖算力”的组合已形成有效闭环,并开始挑战长期以来由“英伟达GPU+CUDA软件”所定义的全球AI计算范式。英伟达的成功不仅依赖其强大的硬件,更在于其构建了庞大而成熟的CUDA生态系统,几乎所有主流AI框架和模型都优先在该生态上开发和优化,形成了极高的技术壁垒。DeepSeek V4选择在昇腾平台首发,打破了这一行业惯例,证明了国产算力平台已经具备支撑顶级AI模型运行和迭代的能力,为AI开发者提供了英伟达之外的另一个可行选择。
英伟达创始人黄仁勋此前也曾公开表示,如果顶尖的AI模型开始针对华为等其他硬件进行深度优化,并因此获得更好的运行效果,那将削弱美国技术生态的全球优势。DeepSeek与华为的合作,恰好印证了这一趋势的开端。它不仅为国产算力生态注入了强心剂,也向全球市场展示了中国构建自主AI技术体系的决心与初步成果。
除了华为昇腾,寒武纪等其他国产AI芯片厂商也迅速宣布完成了对DeepSeek-V4的适配。同时,百度智能云、华为云等云服务商也第一时间上线了新模型的API服务。这表明一个围绕国产算力构建的,从芯片、框架、模型到应用服务的完整产业链和生态系统正在加速形成。

展望未来,DeepSeek官方表示,目前其V4-Pro版本受限于高端算力,服务吞吐量有限,预计在下半年昇腾950超节点批量上市后,其服务价格将有大幅下调空间。这预示着随着国产算力产能的释放,AI应用成本有望进一步降低,从而推动更多创新应用的涌现。DeepSeek V4的昇腾首发,不仅是一次模型发布,更是一个产业信号,标志着中国AI产业正在从技术追赶迈向生态构建的新阶段,全球AI算力市场的竞争格局或将迎来新的变化。