海光DCU全量适配DeepSeekV4-Flash,首Token延迟低于H20
源自7位全网作者
05-30 16:09
精选参考来源
1
【中国信通院正式启动DeepSeek V4国产化适配测试工作】中国信通院今天宣布,正式启动DeepSeek V4国产化适配测试,推动模型与国产软硬件深度协同、加速产业落地。本次测试依托工信部重点实验室与AISHPerf基准体系开展,覆盖芯片、服务器、一体机、集群、开发工具链、智算平台等全栈AI软硬件产品,聚焦DeepSeek V4全系列模型的推理、微调流程。评测从适配易用性、功能完备性、优化效果、性能、成本五大维度评估,并新增长序列处理、代码能力、智能体调用成功率、任务拆解等专项指标,形成立体化评测体系。DeepSeek V4发布当日已实现多家国产硬件Day-0适配,标志国产AI软硬件进入同频迭代阶段。本次测试将客观验证适配水平,强化国产算力支撑,加快构建自主可控AI生态。DeepSeek V4包含V4-Pro(旗舰版)与V4-Flash(轻量版)双版本,两大版本均原生支持100万Token超长上下文(约75万字),采用自研DSA稀疏注意力机制,百万上下文推理成本降低70%,显存占用减少40%。V4-Pro:总参数达1.6万亿,激活参数49B,主打顶级性能上限,对标GPT-5、Claude Opus等全球顶尖闭源模型,适配复杂推理、代码生成、科研计算等高难度任务。V4-Flash:总参数284B,激活参数13B,主打高效低成本,推理能力接近Pro版,速度更快、价格更低,适合日常交互、内容创作、企业轻量化部署等场景。
2
deepseek是4月24日发布V4的,两个版本,flash和pro。day0能适配的芯片就是华为昇腾、寒武纪。day1宣布适配的是英伟达。除此之外,25日,day1,海光、沐曦、摩尔线程、昆仑芯、平头哥真武、天数智芯根据智源研究院的FlagOS宣布flash版本的全量适配和推理部署。flash版本是比较容易适配的,单卡小集群就能跑,对硬件要求低,所以这些AI芯片入手比较快,但是真正考验人的是pro版本的适配。越快能适配pro版本,才说明1)技术能力强;2)是deepseek的核心朋友圈(能提前抢跑)。我查了下最新的情况,目前能适配Pro的国产芯片有:海光、摩尔线程、壁仞科技。(根据官方号自己宣布的)
全部
来源
来源
内容由AI生成
0
0
0评论
当前文章无评论,是时候发表评论了
提示信息
取消
确认
评论举报
最新文章
热门文章
-
百亿牛蛙产业链末梢的食安隐形窟窿0 0 -
宽带,最便宜攻略:10元1个月0 0
-
懂车帝刹车断裂视频下架,尊界一夜反转110 828 -
给喜欢拍照孩子的礼物:松典薄氪BK05超薄口袋相机343 51 -
今年,各家大白金卡杀疯了!72 34
已收藏
去我的收藏夹