近日,关于中国人工智能公司深度求索(DeepSeek)即将发布其下一代大模型V4的消息引发了广泛关注。与产品本身的技术细节相比,外界更聚焦于其在发布前的一项打破行业惯例的举措:优先与华为等国内硬件厂商进行适配测试。
综合多方消息,DeepSeek在V4模型的发布准备阶段,并未像以往一样,将预发布版本提供给英伟达(NVIDIA)、AMD等主流芯片巨头进行协同优化。相反,该公司给予了华为等国内芯片制造商数周的“优先期”,让其针对自家的昇腾(Ascend)等处理器进行深度的软件适配与性能调校。这一策略调整,被外界解读为DeepSeek在硬件生态合作上优先级的重大转变。

按照人工智能行业的普遍做法,模型开发者通常会在新模型发布前,与市场占有率最高的硬件厂商(主要是英伟达)紧密合作,以确保模型软件能在主流硬件上高效、稳定地运行。DeepSeek此次“反其道而行”,选择首先拥抱国产算力平台,释放出一个强烈的信号:在中国AI产业寻求自主发展的背景下,“国产大模型+国产芯片”的协同闭环正在加速形成。
据悉,即将发布的DeepSeek V4模型在性能上将有跨越式提升。其预览版本代号为“sealion-lite(海狮轻量版)”,据称将原生支持多模态处理能力,并将上下文窗口长度扩展至惊人的100万token,这意味着模型能够一次性理解和处理相当于数本书籍或整个代码库的超长文本内容,并进行复杂的逻辑推理。
此次DeepSeek与华为的深度合作并非空穴来风。此前,DeepSeek已在华为昇腾平台上成功完成了模型迁移,并通过协同优化,在推理速度上获得了显著提升。这次V4模型的优先适配,被认为是双方合作的进一步深化。此举旨在通过模型与芯片底层的联合调优,充分发掘国产硬件的潜力,推动国产AI算力从“备用方案”向“主力方案”转变。
这一事件的背后,是当前全球技术竞争和美国对高端GPU出口限制的宏观背景。DeepSeek的选择,被认为是应对外部环境变化、保障供应链安全和长远发展的战略考量。此举不仅有助于提升V4模型在国产硬件上的运行表现,也为其他国产大模型探索与本土硬件生态的结合路径提供了示范。
DeepSeek V4优先适配华为的举动,其战略意义已远超单一的产品发布。它标志着中国AI产业链正在从模型应用到硬件基础进行系统性的整合与协同,旨在构建一个更具韧性和自主性的技术生态。这一“模型与芯片”的深度绑定,将对未来AI产业的格局产生何种影响,正成为业界密切关注的焦点。