一边2950亿参数,一边1元/百万token:Hy3能行吗

2026-07-08 09:52:22 0点赞 0收藏 0评论

一边2950亿参数,一边1元/百万token:Hy3能进店吗

7月6日,腾讯把混元Hy3正式版放出来了。我一个搞零售IT的,第一反应不是看benchmark,是算账:这玩意儿,我们这种体量的公司接不接得起、接不接得动。

7月6日发布当天甩出来的硬数[1][2]

❶ 架构:MoE,总参数2950亿,激活参数210亿,上下文长度256K

❷ Agent任务解决率:从preview版跃升到90%[3]

❸ 定价:输入1元/百万tokens,输出4元/百万tokens,命中缓存0.25元[4]

❹ 协议:Apache 2.0 开源[4];已接入元宝、WorkBuddy等腾讯内部业务[2]

这是姚顺雨(腾讯首席AI科学家,2025年12月接掌混元团队)接手后交出的首个正式版[2]。参数漂亮,但我盯着的是另外两个数:90%和1元。

一、90%解决率意味着什么

以前我们说"AI能干活",大多是陪聊。Agent任务解决率90%,意思是给它一个带工具调用的活儿——查库存、调接口、生成报表——十次有九次能真跑完。这跟"会聊天"是两码事。

我搞ERP和门店系统那几年,最怕的就是"模型接上了但答非所问"。一个补货建议如果一半是编的,店长宁可用Excel。Hy3这次据伯恩斯坦报告,把幻觉率从12.5%压到了5.4%[5],加上工具调用稳定性提升、多轮记忆增强——这三个点叠一起,才是"能接系统"的前提。

光会聊天的模型,进不了店。能调接口、答得准、记得住的模型,才接得动门店系统。

二、这事放到一个100平的便利店里

我拿便利店的账算一下。一个门店每天要处理的AI活儿,大概是这么几样:会员标签更新、智能补货提醒、排班建议、客服话术生成。这些活儿以前要么人工盯,要么写死规则,改一次累一次。

现在模型层稳了,这些能变成"一句话触发、Agent自己调接口跑"。但关键不是"能不能",是"贵不贵"。参数再好看,小公司用不起也是摆设。

一边2950亿参数,一边1元/百万token:Hy3能行吗

三、算一笔小店用得起的账

Hy3输入1元/百万tokens。我粗算:一个门店每天AI交互,撑死200万tokens输入(含上下文),按1元/百万 = 2元/天。一个月60元。100家店 = 6000元/月。

对比请一个人专门盯这些活儿,薪资加社保一年十几万。6000块/月对十几万/年——这账不用算第二遍。[6]

⚠️ 这是我的估算,实际取决于你们跑多少活、上下文拉多长。但量级摆在这:小公司接得动。

四、微信生态才是真彩蛋

Hy3不是孤零零一个模型。它已经接进元宝、WorkBuddy。腾讯的盘子是微信——12亿用户的生态。Agent解决率90%再加便宜定价,意味着以后"便利店会员运营小助手"这种东西,不用自己从零训模型,直接在微信生态里搭。

我十几年前推数据中台,最难的不是技术,是"每个系统各搞一套,标准还不一样"。现在模型层统一了,接系统的成本第一次低到小店也玩得起。这才是Hy3跟普通便利店真正有关系的地方。

大模型发布那天,大家都在比参数。真正有用的那一刻,是街角小店也能用上。


参考来源

[1] 腾讯新闻 — 混元Hy3正式上线:Agent任务解决率跃升,7月6日

[2] 新浪财经/快科技 — 混元Hy3正式版发布,姚顺雨接掌后首个正式版,7月6日

[3] DoNews — 混元Hy3正式版发布,Agent任务解决率跃升至90%,7月6日

[4] CNMO科技 — Hy3定价与Apache 2.0开源协议,7月6日

[5] 伯恩斯坦(Bernstein)研究报告 — 幻觉率12.5%降至5.4%,7月8日

[6] 虾哥按Hy3公开定价自行估算,非官方数据

👇 关注亮虾哥 👇

连锁零售IT老司机 | 非程序员用AI省80%时间

每天一篇AI干货,让AI替你打工 🦐

💬 评论区聊聊:你所在的行业,第一个想让AI接手的活儿是啥?


#腾讯混元 #Hy3 #AI Agent #零售效率 #普通人视角 #AI省钱

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松