DeepSeek致谢腾讯技术团队:这是一次“巨大的加速”代码贡献!

2025-05-07 19:56:21 28点赞 34收藏 32评论

快科技5月7日消息,DeepSeek致谢腾讯技术团队,这是一次“巨大的加速”代码贡献。

据新浪报道,腾讯技术团队针对DeepSeek开源的DeepEP通信框架进行深度优化,使其在多种网络环境下均实现显著性能提升。

经测试,优化后的通信框架性能在RoCE网络环境提升100%,IB网络环境提升30%,为企业开展AI大模型训练提供更高效的解决方案。

该技术方案获得了DeepSeek公开致谢,称这是一次“huge speedup(巨大的加速)”代码贡献。

据了解,自今年2月DeepSeek开源包括DeepEP在内的五大代码库以来,该团队便向业界展示了如何利用有限的硬件资源实现接近万卡集群的性能。

在这些技术中,DeepEP凭借突破性的方法提升了300%的通信效率,成功解决了MoE架构大模型对英伟达NCCL的依赖问题。但该技术在成本较低、适用面更广的RoCE网络环境中表现不佳,限制了其在更广泛场景的应用。这一痛点引发了开源社区的持续讨论。

据悉,腾讯星脉网络团队在DeepEP开源后便展开技术攻关,发现两大关键瓶颈:一是对于双端口网卡带宽利用率不足,二是CPU控制面交互存在时延。

在腾讯的技术优化下,DeepEP不仅在RoCE网络实现性能翻倍,反哺到IB(InfiniBand)网络时更使原有通信效率再提升30%。

目前,该技术已全面开源,并成功应用于腾讯混元大模型等项目的训练推理,在腾讯星脉与H20服务器构建的高性能环境中,这套方案展现出出色的通用性。

DeepSeek致谢腾讯技术团队:这是一次“巨大的加速”代码贡献!

编辑:朝晖

【本文结束】如需转载请务必注明出处:快科技

展开 收起
32评论

  • 精彩
  • 最新
  • 可以简单理解为deepseek的方案另辟蹊径,短暂的领先,然后其他厂商根据其思路优化改进,凭历史积累再次超越

    校验提示文案

    提交
    不可以,理解的不对

    校验提示文案

    提交
    收起所有回复
  • 球球你们别吹 deepseek 了好吧,模型并没有碾压式的领先,你看到现在才 4 个月不到,已经一只手的模型领先 R1 了。腾讯和阿里的 ai 水平不差,c 端产品继承开源的 deepseek,商量考量大于技术考量。

    校验提示文案

    提交
    谁说领先了?你是不看文章也不了解吗?性价比懂吗?

    校验提示文案

    提交
    看完再急,现在都不讲程序直接急 [观察]

    校验提示文案

    提交
    还有5条回复
    收起所有回复
  • 商业互捧?

    校验提示文案

    提交
    腾讯的AI 一直不行。deepseek开源之后,腾讯就决定投入资源,直接推搭载deepseek的元宝。如果那段时间你点过腾讯系的广告,就发现全部都是推元宝的。所以腾讯对deepseek 的优化是真的。但是腾讯AI的发展还不好说。

    校验提示文案

    提交
    算互相成就吧。

    校验提示文案

    提交
    还有7条回复
    收起所有回复
  • 什么时候出R2有可能取决于国外巨头公司的股价够不够高

    校验提示文案

    提交
  • 哦?身子脏了。

    校验提示文案

    提交
  • 收编了

    校验提示文案

    提交
    那腾讯还真不一定够资格,deepseek不出意外现在是战略层面的公司。(且不缺钱

    校验提示文案

    提交
    人家是做量化出身的,还是国内数一数二的那种,说句不夸张的,股市就是人家的提款机。就这样的,钱是问题么 [皱眉]

    校验提示文案

    提交
    还有2条回复
    收起所有回复
  • 腾讯的混元很不错啊在加上frame,简直了

    校验提示文案

    提交
  • 千问好用不

    校验提示文案

    提交
    好用,但是本地部署的千问3我多一些上下文之后它会悄悄访问互联网被我防火墙发现了,deepseek和gemma都没有这种情况。

    校验提示文案

    提交
    收起所有回复
  • 为开源精神点赞

    校验提示文案

    提交
  • 以下是被折叠的评论 查看
已折叠部分评论
展开
收起
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
34
扫一下,分享更方便,购买更轻松