华为5050亿参数的盘古开源满月了:数学推理是真能打,但想拿它写代码,我劝你先看完这篇

源自150位全网作者

17:33

7月31日,华为把总参数5050亿的旗舰大模型openPangu-2.0-Pro开源了,权重、推理代码、技术报告全套放出,还上架了Hugging Face。智东西算上6月底先开源的轻量版openPangu-2.0-Flash,余承东在HDC 2026上承诺的"陆续开源7大组件",已经走到了第二步。知乎

纸面规格确实唬人:5050亿参数、512K上下文、34T tokens训练数据。但我把最近一个月知乎、B站、微博和科技媒体的讨论翻了一遍,发现社区对这模型的评价相当分裂——有人说它"够格当第一梯队守门员",有人实测后直接劝退写代码的需求,还有人压根不关心跑分,只在意它"昇腾样板间"的真实身份。

今天一次性说清楚:openPangu-2.0到底是什么水平、强在哪、弱在哪,以及它到底值得谁上手。

先搞清楚:openPangu不是来卷通用大模型的

很多人一看"5050亿参数"就拿它去对标DeepSeek、Kimi,这其实搞错了赛道。

先看时间线:6月12日HDC 2026上,余承东发布openPangu-2.0系列,放话要把盘古做到世界第一。智东西6月底轻量版Flash(总参92B、激活6B)率先开源;7月31日旗舰Pro(总参505B、激活18B)连权重带技术报告一起开源。

关键在于定位。有技术分析说得很直白:openPangu的目标不是追赶GPT-5这类国际前沿通用模型,而是为业界用好昇腾NPU提供最佳实践参考——架构选型、训练算子、推理部署全部围绕昇腾原生展开。知乎换句话说,这是华为给整个昇腾生态打的"样板间":告诉你在大模型这条路上,昇腾从训练到推理应该怎么用。理解了这个定位,后面看它的强弱项就不意外了。

它还是业界首个开源预训练代码、后训练代码、训推算子的模型,昇腾原生训练效率提升30%。智东西

华为5050亿参数的盘古开源满月了:数学推理是真能打,但想拿它写代码,我劝你先看完这篇

强项和短板,官方和社区其实想到一块去了

先说官方口径。openPangu-2.0-Pro分Thinking(带推理思考)和Non-Thinking(直接作答)两种模式,模型卡自评里,数学、科研、算法类任务分数亮眼,Thinking模式提升明显。

但有意思的是技术报告自己承认的部分:在处理复杂现实世界软件工程任务时,仍与顶尖模型存在明显差距。智东西官方自评SWE-bench得分68.5,而且开不开思考模式差距不大——这说明不是"加推理就能补",是能力本身还没到位。知乎

社区实测和官方口径罕见地对上了。B站UP主"AI产品狙击手"自费实测Pro和Flash两个版本:基础数学推理题答案全部准确,但一到代码开发场景就露怯——浏览器系统、3D赛车、Trello看板这类需要完整代码工程的任务全都没跑通。哔哩哔哩Flash版标称512K超长上下文,实测少量代码任务就出现输出强制截断,几千tokens中途中断。哔哩哔哩结论很直接:文本轻量问答能用,代码开发场景不推荐。

知乎一篇高赞回答心态更平和:第三方跑分比预期好,“做第一梯队守门员就行了,紧紧跟随国内御三家的水平就可以”。知乎这个预期管理,我觉得比跑分本身更值得参考——社区对盘古的真实定位是"够用、可看、值得跟进",而不是"遥遥领先"。

华为5050亿参数的盘古开源满月了:数学推理是真能打,但想拿它写代码,我劝你先看完这篇

下载之前,这3件事必须先知道

第一,许可证不是Apache-2.0。openPangu-2.0-Pro用的是自家的OPENPANGU MODEL LICENSE AGREEMENT VERSION 2.0,商用条款和主流开源协议不一样。知乎企业想用请先逐条看LICENSE,别想当然。

第二,部署门槛要掂量清楚。Pro是MoE架构,总参505B但每个token只激活18B,推理成本比同总参的稠密模型低很多,但权重体积依然可观,本地部署基本要告别消费级显卡。想尝鲜的可以看Flash(92B总参、6B激活),它的GGUF量化版上月在Hugging Face下载量接近4万次,本地部署热度不低。智东西

华为5050亿参数的盘古开源满月了:数学推理是真能打,但想拿它写代码,我劝你先看完这篇

第三,512K上下文先看场景再用。标称值和实际稳定性是两回事,实测里代码任务几千tokens就截断的问题,目前更适合把它用在长文档问答这类对生成稳定性要求没那么极端的场景。

到底值得谁上手

适合三类人:一是手里有昇腾算力、想跑通国产全栈的开发者,这就是为你准备的官方参考实现,架构、算子、部署一条龙;二是有数学、科研推理类任务需求的团队,这是它官方自评最强、社区实测也认账的方向;三是关注国产大模型生态的研究者,技术报告里MLA+DSA/SWA分层混合注意力、4支流mHC、3头MTP自投机、Muon优化器这套组合,是目前少有的昇腾原生完整工程样本。

不适合两类需求:想拿它当代码生产力主力的,官方和实测都劝你先缓缓;想找个通用聊天模型替代现有主力的,它的优势不在这里。

接下来值得盯的三个信号

一是官方已经明确说,未来几个月将重点迭代编程和复杂智能体任务——软件工程这个短板是官方认领的,下一版值不值得回头看,盯这一条就够了。智东西

二是"陆续开源7大组件"还剩5步没走,openPangu只是第二步,后面还有什么值得持续跟进。

三是盘古团队的人才流向。7月底,华为盘古大模型初代创始成员、第二代盘古万亿MoE大模型二号核心研发周平义参与创办的物理3D公司比特无限,被曝不到三个月估值涨了10倍。36氪8月中旬,华为云盘古大模型CTO李寅也被报道离职创业,方向是世界模型,新公司6月启动的融资轮次估值已达15亿元。知乎人才往哪流,往往比发布会更能说明下一波技术浪头在哪。

最后说句实在话:openPangu-2.0不是"国产模型终于能打了"的爽文,它是华为把昇腾生态大门推开的一条门缝。想折腾国产算力的,现在进场正当时;只想找个现成AI干活的,等它把代码短板补上再看也不迟。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章