一边2950亿参数,一边1元/百万token:Hy3能行吗
一边2950亿参数,一边1元/百万token:Hy3能进店吗
7月6日,腾讯把混元Hy3正式版放出来了。我一个搞零售IT的,第一反应不是看benchmark,是算账:这玩意儿,我们这种体量的公司接不接得起、接不接得动。
7月6日发布当天甩出来的硬数[1][2]
❶ 架构:MoE,总参数2950亿,激活参数210亿,上下文长度256K
❷ Agent任务解决率:从preview版跃升到90%[3]
❸ 定价:输入1元/百万tokens,输出4元/百万tokens,命中缓存0.25元[4]
❹ 协议:Apache 2.0 开源[4];已接入元宝、WorkBuddy等腾讯内部业务[2]
这是姚顺雨(腾讯首席AI科学家,2025年12月接掌混元团队)接手后交出的首个正式版[2]。参数漂亮,但我盯着的是另外两个数:90%和1元。
一、90%解决率意味着什么
以前我们说"AI能干活",大多是陪聊。Agent任务解决率90%,意思是给它一个带工具调用的活儿——查库存、调接口、生成报表——十次有九次能真跑完。这跟"会聊天"是两码事。
我搞ERP和门店系统那几年,最怕的就是"模型接上了但答非所问"。一个补货建议如果一半是编的,店长宁可用Excel。Hy3这次据伯恩斯坦报告,把幻觉率从12.5%压到了5.4%[5],加上工具调用稳定性提升、多轮记忆增强——这三个点叠一起,才是"能接系统"的前提。
光会聊天的模型,进不了店。能调接口、答得准、记得住的模型,才接得动门店系统。
二、这事放到一个100平的便利店里
我拿便利店的账算一下。一个门店每天要处理的AI活儿,大概是这么几样:会员标签更新、智能补货提醒、排班建议、客服话术生成。这些活儿以前要么人工盯,要么写死规则,改一次累一次。
现在模型层稳了,这些能变成"一句话触发、Agent自己调接口跑"。但关键不是"能不能",是"贵不贵"。参数再好看,小公司用不起也是摆设。

三、算一笔小店用得起的账
Hy3输入1元/百万tokens。我粗算:一个门店每天AI交互,撑死200万tokens输入(含上下文),按1元/百万 = 2元/天。一个月60元。100家店 = 6000元/月。
对比请一个人专门盯这些活儿,薪资加社保一年十几万。6000块/月对十几万/年——这账不用算第二遍。[6]
⚠️ 这是我的估算,实际取决于你们跑多少活、上下文拉多长。但量级摆在这:小公司接得动。
四、微信生态才是真彩蛋
Hy3不是孤零零一个模型。它已经接进元宝、WorkBuddy。腾讯的盘子是微信——12亿用户的生态。Agent解决率90%再加便宜定价,意味着以后"便利店会员运营小助手"这种东西,不用自己从零训模型,直接在微信生态里搭。
我十几年前推数据中台,最难的不是技术,是"每个系统各搞一套,标准还不一样"。现在模型层统一了,接系统的成本第一次低到小店也玩得起。这才是Hy3跟普通便利店真正有关系的地方。
大模型发布那天,大家都在比参数。真正有用的那一刻,是街角小店也能用上。
参考来源
[1] 腾讯新闻 — 混元Hy3正式上线:Agent任务解决率跃升,7月6日
[2] 新浪财经/快科技 — 混元Hy3正式版发布,姚顺雨接掌后首个正式版,7月6日
[3] DoNews — 混元Hy3正式版发布,Agent任务解决率跃升至90%,7月6日
[4] CNMO科技 — Hy3定价与Apache 2.0开源协议,7月6日
[5] 伯恩斯坦(Bernstein)研究报告 — 幻觉率12.5%降至5.4%,7月8日
[6] 虾哥按Hy3公开定价自行估算,非官方数据
👇 关注亮虾哥 👇
连锁零售IT老司机 | 非程序员用AI省80%时间
每天一篇AI干货,让AI替你打工 🦐
💬 评论区聊聊:你所在的行业,第一个想让AI接手的活儿是啥?
#腾讯混元 #Hy3 #AI Agent #零售效率 #普通人视角 #AI省钱
