海光DCU完成腾讯混元Hy3 preview大模型深度适配,国产算力迈入“发布即适配”新阶段

源自38位全网作者

05-09 05:39

内容由AI生成

精选参考来源

1. 姚顺雨带队发布混元 Hy3 preview 模型,已接入元宝,能力体验如何?

2. #小米推出Token套餐# 小米的 Token Plan 也上线啦。可以用旗舰模型MiMo-V2-Pro和全模态基座模型MiMo-V2-Omni、语音合成模型 MiMo-V2-TTS最低档一个月39元,有6000万Credits。这个Credits有点意思。目前MiMo-V2-Omni模型1 token就对应1个Credit用MiMo-V2-Pro模型且上下文小于256k时对应2个token,上下文超过256k则对应4个token。MiMo-V2-TTS免费。没有5小时使用限制,用完了事。因为同时有高性能的推理模型,又有多模态模型。倒是蛮适合小龙虾的。试了下接入QQ bot后,可以默认用Pro模型,有语音或图像输入则自动切换到Omin模型。在QQ bot里语音识别、识图都能用。还挺方便。一个任务里也可以交错式调用。识图时用MiMo-V2-Omni,回答整合时用Pro。看推上反馈在龙虾里用这个模型都反馈都还行,罗福莉还是牛的~

3. 3个月,姚顺雨爆改混元 |甲子光年

4. 黄仁勋最怕中国AI的事 DeepSeek刚刚做到了 黄仁勋最害怕事还是发生了:DeepSeek V4发布,华为昇腾超节点深度适配,全球AI圈等待已久的大事落定,聊一聊背后的三大核心真相 #ai #deepseek v4 #deepseek #黄仁勋 #梁文锋

5. 昨天晚上发布的小米MiMo-2.5,登顶全球开源大模型第一,超Claude Opus 4.6,很牛逼。对开发者来说,几个点比较实在:速度方面,TPS到100-150 token/s,做Agent交互基本不用等响应。成本直接砍半,1M和256K上下文同价,夜间8折,比用Claude便宜不少。长程任务稳定性有突破。北大编译器case,4.3小时一次满分通过,不是跑十几个小时勉强过关那种。单次近千次工具调用、十余轮上下文压缩,工程化能力是实打实的。百万级上下文两个模型都支持,马上开源。以前这种水平的Agent能力,调用成本是个大门槛,现在直接免费用。小米AI这块确实被低估了#小米首次登顶全球开源大模型第一#

6. #杨幂脸被蒸汽眼罩烫伤了# DeepSeek-V4引爆国产算力革命,这些公司迎来黄金时代!4月24日,国内AI领域迎来了一个具有里程碑意义的时刻:深度求索正式发布DeepSeek-V4预览版并同步开源。这一事件犹如一颗重磅炸弹,在国内AI产业中激起千层浪,不仅是技术层面的重大突破,更是中国AI产业生态自主化进程的关键转折点。技术突破背后的产业意义非凡DeepSeek-V4的强大之处,不仅仅体现在其拥有1.6万亿参数的规模,或是具备100万token的超长上下文处理能力。更为重要的是,它首次实现了与华为昇腾、寒武纪、海光信息等国产芯片的深度适配。这意味着中国AI产业正式从“纯软件算法迭代”迈向了“系统级软硬协同架构”的新阶段。深圳市金融稳定发展研究院副院长董耀徽指出,这种原生适配模式通过在算子层进行深度优化以及重构通信框架,能显著提升异构计算集群的执行效率。模型架构的优化与底层计算硬件的国产化替代,共同为降低人工智能应用边际成本奠定了坚实的工程基础。这将使得AI应用在成本上更具竞争力,为其大规模推广和应用创造了有利条件。A股市场迎来结构性机会DeepSeek-V4发布当日,A股市场迅速做出反应。海光信息盘中涨幅高达9.61%,寒武纪、华丰科技等概念股也同步走强。这表明市场资金正在加速从“英伟达+光模块”向“国产算力+昇腾生态”转移。一场围绕国产算力的投资热潮正在悄然兴起,相关企业迎来了前所未有的发展机遇。国产AI芯片:弹性最大的受益方向在国产AI芯片领域,多家企业因DeepSeek-V4的发布而受益匪浅。海光信息作为CPU+DCU双轮驱动的代表,成为了国产算力的“估值锚”。其深算系列产品长期对标国际主流,在DeepSeek-V4发布当日就完成了全系列模型适配,能够有力支撑模型科学计算任务运行。寒武纪作为V4首发适配厂商,其思元系列芯片完成了V4模型mHC架构适配,为模型训练与推理提供了关键硬件支持。作为华为昇腾之外少数具备自主AI芯片设计能力的企业,在大模型推理侧需求爆发的背景下,寒武纪的高弹性、高定价空间优势愈发突出。此外,摩尔线程的产品完成了V4适配验证,可覆盖大模型训练、推理全场景。沐曦股份的千卡集群商用方案也适配V4高算力需求。这些企业都将在国产算力芯片的发展浪潮中,迎来业务的快速增长。昇腾服务器/整机:订单确定性最强在昇腾服务器/整机领域,拓维信息的“兆瀚”系列AI服务器完成了DeepSeek-V4分布式训练全流程适配,有望成为V4商业化的核心硬件平台。公司凭借超大基建背景,可承接超算中心订单,还推出了预置DeepSeek模型的海若一体机等产品,未来订单可期。神州数码旗下的神州鲲泰系列服务器与昇腾深度绑定,是DeepSeek大模型部署的优选整机伙伴。高新发展控股的华鲲振宇作为昇腾服务器龙头,成为了950超节点的核心底座。这些企业将受益于昇腾生态的发展,订单确定性强,业绩有望稳步增长。AI应用端:成本下降直接利好在AI应用端,金山办公已率先将DeepSeek-V4接入WPS AI。全新原生Office智能体“WPS灵犀”集成DeepSeek等大模型,覆盖了文档、消息、会议等全办公场景。随着V4每单位Token推理成本的降低,金山办公的毛利率有望进一步提升。拓尔思自研的“拓天大模型”已集成DeepSeek V3/R1,在金融舆情、智能研报领域率先落地。随着V4推理成本的进一步压缩,拓尔思在垂直领域的应用优势将更加明显,有望获得更多的市场份额。算力基础设施:刚需持续放量算力基础设施是国产算力发展的重要支撑。中际旭创作为光模块龙头,国产算力集群建设所需的光模块、交换机需求与AI训练集群建设正相关。只要国产算力底座建成,中际旭创将因V4带动的数据中心互联硬件需求增长而持续受益,其1.6T光模块更是成为国产算力升级最快、盈利确定性最强的上游供应商。华丰科技作为昇腾连接器核心供应商,市场份额超过60%。英维克作为液冷龙头,将受益于超节点机柜功耗提升带来的液冷需求爆发。它们都将在国产算力基础设施建设中发挥重要作用,迎来业务的快速扩张。产业格局深度重构DeepSeek-V4的发布,彻底改变了中国AI产业生态格局。华为同日宣布昇腾超节点全系列完成适配,实现V4-Pro 20ms、Flash 10ms低时延推理。此次适配标志着国产大模型首次全链路脱离CUDA生态,转向华为CANN架构,重写40万个底层算子,构建了自主可控的AI算力-模型闭环。从产业链角度来看,国产大模型与国产算力的深度融合正在形成新的产业格局。计算开销的压缩与算力供给结构的改善,将直接导致应用端调用费用下降,进而加速人工智能技术向实体经济与传统软件服务体系的渗透。这场由DeepSeek-V4引发的国产算力革命,为A股市场带来了结构性的投资机会。从芯片到服务器,从应用到基础设施,一条完整的国产AI产业链正在加速成型。对于投资者而言,这不仅是短期的事件性机会,更是中国科技自立自强背景下的长期趋势性机遇。随着国产算力产业的不断发展,相关企业有望在未来实现业绩与估值的双重提升,迎来属于它们的黄金时代。

7. 第一时间,寒武纪原生适配DeepSeek-V4!两大国产之光再次强强联合

8. 全国首个!超3万卡国产AI算力上线,喂饱万亿参数大模型

9. 连续霸榜OpenRouter的MiMo终于出了Code Plan(他叫Token Plan),之前OR上的免费试用也没有过这么高的占比,核心还是模型本身好用,拿来干活的东西为了省几百块一个月的token费用上垃圾模型导致干活失败才是因小失大,最贵的Max套餐600不到,目前算下来一个月16亿Credit,性价比上非常可以,而且预计MiMo之后,国产模型套餐会跟进一次订阅覆盖全模态模型~目前Credit到Token结算规则如下,目前看来鼓励上V2 Omni,V2Pro等效8亿Token,1M上下文也有4亿Token:MiMo-V2-Omni 256k 上下文:1x(消耗 1 Token = 1 Credit)MiMo-V2-Pro 256k 上下文: 2x(消耗 1 Token = 2 Credits)MiMo-V2-Pro 256k~1M上下文: 4x(消耗 1 Token = 4 Credits)MiMo-V2-TTS:0x(限时免费,不消耗 Credit)关键是没有 token集中使用限额——支持集中消耗 token ,高强度养龙虾或编程,体验拉满,不被打断

10. 腾讯的混元 Hy3 Preview 昨天正式亮相了。这个模型由腾讯首席 AI 科学家姚顺雨主导,他说这是混元大模型重建的第一步。去年年底姚顺雨加入腾讯,负责 AI Infra 和大语言模型,今年 1 月底才启动训练,三个月就完成了从训练到上线,速度很快。但比起速度,Hy3 Preview 更值得关注的一点是:腾讯终于不追求打榜了。这可能是姚顺雨带给混元最大的变化。之前晚点的报道提到过,姚顺雨在腾讯内部会上做过一个判断:过去模型过度追逐榜单成绩,把打榜语料塞进训练集,数据被污染了。结果就是模型很会答题,但到了真实场景里反而不稳定。他的逻辑很清楚。榜单衡量的是能力上限,用户感知到的却是能力下限。你在 MMLU 上领先两个百分点,用户在实际使用中几乎感觉不到差别。但反过来,指令遵循稍差一点,格式不够稳定,幻觉率偏高,用户体验就会断崖式下降。所以在 Hy3 Preview 上,能明显看到混元把这个逻辑翻过来了:不盯着榜单卷分数,而是扎进真实场景里打磨体验。姚顺雨也说了,他希望通过这次开源和发布,持续提升正式版的实用性和综合表现,同时开始探索一些特色能力。方向算是立住了,接下来就看正式版能做到什么程度。刚才我在 OpenRouter 上跑了一下,把我们最常用的那个难题「我家离洗车店只有50米,我是步行去合适,还是开车去合适?」扔给了 Hy3 Preview ,不仅没上当,还是目前我感觉所有大模型当中回答的最全面最好的。大家可以去 OpenRouter 当中体验一下,限时两周免费token 体验API版。地址:网页链接#How I AI##科技先锋官#

11. 2025年11月12日,前DeepSeek研究员罗福莉官宣加入小米MiMo团队。她深耕MoE架构优化与端侧部署,曾参与研发DeepSeek-V2。小米AI战略聚焦软硬融合,MiMo模型主打推理能力,已开源70亿参数版本。此次加盟将助力小米AI落地物理世界,推动国产大模型从技术突破转向场景创新。#前deepseek研究员罗福莉已加入小米# 值言说的微博音频

12. 智谱发布GLM-5技术细节:工程级智能,适配国产算力

13. 2026年4月23日,腾讯混元团队交出了一份迟到了近一年的答卷。Hy3 preview语言模型正式发布并开源,官方定位为“混元重建后训练的第一个模型”,同时也是“混元迄今最智能的模型”。主导这次重建的,是去年底加入腾讯、担任首席AI科学家的姚顺雨。#姚顺雨首份混元答卷打几分# 姚顺雨的混元答卷:Hy3 preview如何重估腾讯的AI棋局

14. 腾讯放大招了!重构混元大模型团队,还直接新设AI Infra、AI Data两大核心部门,马化腾2026押注AI赛道的决心拉满!这可不是跟风操作,而是技术与业务深度绑定的关键布局。技术端直接卡死“算法+算力+数据”全链条,AI Infra破局算力瓶颈,AI Data筑牢数据根基,姚顺雨掌舵实现高效协同,让混元模型冲进行业第一梯队。业务端更狠,以“AI in All”横扫全场景!C端绑定微信、腾讯会议,900+场景解锁实用功能;产业端靠腾讯云“AI+SaaS”避开内卷,专攻场景化方案。“技术赋能业务、业务反哺技术”的闭环已成型,混元打底、元宝引流,腾讯正悄悄构建AI生态壁垒,这波操作直接改写赛道格局!#微博超有用视频大赛##上微博涨知识##AI创造营##科技先锋官# 种斌Marco的微博视频

15. 【#腾讯混元Hy3preview发布并开源#】4月23日,腾讯混元Hy3 preview语言模型发布并开源。这是一个快慢思考融合的混合专家模型,总参数295B,激活参数21B,最大支持256K上下文长度。这是混元重建后训练的第一个模型,也是混元迄今最智能的模型,在复杂推理、指令遵循、上下文学习、代码、智能体等能力及推理性能上实现了大幅的提升。 目前,Hy3 preview已在腾讯云、元宝、ima、CodeBuddy、WorkBuddy、QQ、QQ浏览器、腾讯文档、腾讯乐享等首发上线,微信公众号、和平精英、腾讯新闻、腾讯自选股、腾讯客服、微信读书等多个主线产品也在陆续上线。另外,Hy3 preview支持接入流行的开源智能体产品,如OpenClaw、OpenCode、KiloCode等,并已上架腾讯云大模型服务平台TokenHub。(IT之家)

16. 【#姚顺雨加盟后首份成绩单#出炉,腾讯混元Hy3 preview模型发布】腾讯混元“重建”后首次发布大模型。#姚顺雨带队重建混元成果如何#4月23日,腾讯混元 Hy3 preview 语言模型发布并开源。这是一个快慢思考融合的混合专家模型,总参数295B,激活参数21B,最大支持256K上下文长度。这是混元重建后训练的第一个模型,也是混元迄今最智能的模型,在复杂推理、指令遵循、上下文学习、代码、智能体等能力及推理性能上实现大幅提升。值得注意的是,这是腾讯混元在去年重建后,首次对外披露大模型。这也是年仅28岁的“AI天才少年”姚顺雨出任腾讯首席AI科学家后,对外交出的第一张“成绩单”。据公开资料,姚顺雨毕业于清华大学姚班,清华姚班是清华大学计算机科学实验班的简称,由世界著名计算机科学家姚期智院士于2005年创办,旨在培养国际顶尖的计算机科学及交叉创新人才。姚顺雨曾任姚班联席会主席,还是清华大学学生说唱社联合创始人。2024年,姚顺雨加入OpenAI,参与智能体产品operator与deep research开发,是项目的核心贡献者。在前期研究过程中,他为语言智能体方向的开启和发展做出了基础性贡献。2025年5月23日,《麻省理工科技评论》“35岁以下科技创新35人”中国区名单发布,当时27岁的姚顺雨入选,成为最年轻的入选者。据腾讯方面向记者介绍,今年2月,腾讯混元重建预训练和强化学习的基础设施,以及模型追求实用性的三个原则:第一:能力体系化: 不推崇“偏科”,因为即使是代码智能体的单一应用,也涉及推理、长文、指令、对话、代码、工具等多种能力的深度协同。第二:评测真实性: 主动跳出易被“刷榜”的公开榜单,通过自建题目、最新考试、人工评测、产品众测等多种方式评估和改进模型的“真实战斗力”。第三:性价比追求:实用性离不开商业合理性,深度协同模型架构和推理框架的设计,大幅降低任务成本,让智能用得起、用得好。根据公开资料显示,代码和智能体是 Hy3 preview 提升最为显著的方向。得益于预训练及强化学习框架的重建和强化学习任务规模的提升,混元团队以较快的速度在 SWE-Bench Verified、Terminal-Bench 2.0 等主流代码智能体基准以及 BrowseComp、WideSearch 等主流搜索智能体基准中取得了强竞争力的结果。目前,Hy3 preview 已和腾讯旗下众多产品形成联动:在腾讯云、元宝、ima、CodeBuddy、WorkBuddy、QQ、QQ浏览器、腾讯文档、腾讯乐享等首发上线,微信公众号、和平精英、腾讯新闻、腾讯自选股、腾讯客服、微信读书等也在陆续上线。另外,Hy3 preview 支持接入流行的开源智能体产品,如 OpenClaw、OpenCode、KiloCode 等,并已上架腾讯云大模型服务平台 TokenHub。多个测评结果显示,Hy3 preview 模型整体推理效率提升40%,成本相比上一代模型大幅下降。价格方面,在腾讯云大模型服务平台 TokenHub 上,Hy3 preview 输入价格最低1.2元/百万tokens,输入命中缓存价格0.4元/百万tokens,输出价格最低4元/百万tokens。同时,腾讯云联合混元推出定制的 Hy3 preview Token Plan 套餐,个人版定价最低28元/月,为Agent开发和打造“龙虾”应用的提供更具性价比选择。此次Hy3 preview发布,引发外界期待,也再次激发国内AI竞速。(澎湃新闻)

17. 英伟达、DeepSeek集体跟进!18个月前被忽视,如今统治AI推理

18. 一文讲清大模型推理框架,SGLang和vLLM的主要区别

19. 重启「混元」、挖字节 Seed 研究员,腾讯能在 AI 领域再度成功上演「敢为人后」的策略吗?

20. 國產大模型Day0適配潮:海光DCU領跑軟硬協同新賽道

21. 国产大模型Day0适配潮:海光DCU领跑软硬协同新赛道

22. 海光DCU完成腾讯混元Hy3 preview适配

23. 发布即支持,海光DCU适配腾讯混元Hy3 preview

24. 海光DCU完成Qwen3.5多模态MoE模型全量适配

25. 海光信息DCU完成对智谱GLM-5的首发同步适配与联合精调

26. 国产DCU跑腾讯混元295B模型,vLLM部署实战指南

27. Day0就适配?海光DCU这次真的支棱起来了! DeepSeek V4刚发布,海光DCU直接Day0同步适配,这速度谁顶得住? 以前都是等芯片追模型,现在国产算力直接跟模型发布同频共振,圈内人都懂这意味着什么——不用再等几个月才能跑上新模型了! 海光这次不是简单跑通,而是深度调优,计算效率直接拉到业界领先。DTK全栈生态覆盖训练、推理、AI4S全场景,DAS集成了2000+算子,Pytorch、TensorFlow、vLLM、SGLang 这些主流框架全支持。说白了,开发者拿到手就能用,不用自己踩坑适配。 最狠的是,海光DCU已经完成400+大模型联合优化,全球99%非闭源大模型全覆盖。DeepSeek、Qwen、智谱GLM,发布即适配,上线即可用。这生态壁垒,真不是一朝一夕能堆出来的。 国产算力+国产大模型,这次是真双向奔赴了。期待后续更多落地案例! #DeepSeekV4##海光DCU##国产算力##AI芯片##大模型适配#

28. 从海光信息2026年一季度报告看国产化进程

29. 腾讯混元 Hy3 preview 模型全量解读

30. 国产算力炸场!海光DCU适配365款大模型,99%非闭源生态全覆盖,告别英伟达依赖

31. AI算力需求爆发 海光信息Q1营收同比增68% DCU全面适配主流大模型

32. 海光信息发布 DCU 软件栈支撑万亿大模型

33. 【转发】海光DCU软件栈全面开放,携手产业共建“中国版CUDA”生态

34. 海光信息发布“双芯战略”

35. 海光出手,国产芯片迎来双王炸!

36. 海光DCU完成Qwen3.5多模态MoE模型全量适配

37. 国产AI生态协同:九天大模型海光DCU适配完整复盘

38. 算力“芯”战:海光信息如何卡位AI时代?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章