14.7万亿Token登顶、限免9月10日收口:腾讯混元Hy4这波,先把三本账算完再冲

源自18位全网作者

03:25

这周一,腾讯混元放出一条"优化通知":WorkBuddy 全量上线了 Hy4 preview 的优化版,修的恰好是实测中被吐槽最狠的点——长思考、过度自我验证,在不损失效果的前提下显著减少任务轮次和 token 消耗。知乎

同一天,腾讯还把视觉文档检索模型 ViDoRe V3(多向量榜第一)挂上 Hugging Face,并开源了内部用了半年的 TeamAI-CLI——把团队 Agent 的 Skills、规则、文档统一塞进一个 Git 仓库,让 Claude Code、Codex、Cursor 基于同一本手册干活。

把这些拼起来,是一条十天的时间线:8 月 28 日混元 Hy4 preview 发布并开源,770B 总参、49B 激活、1M 上下文。9 月 1 日,轻量版把权重从 1.5TB 压到约 214GB。知乎 9 月 2 日,WorkBuddy 开放平台上线。36氪 9 月 7 日的 OpenRouter 周榜上,Hy4 以 14.7 万亿 token 的周调用量登顶第一、环比暴涨 379%,GPT-5.6、智谱 GLM-5.3 都排在身后。知乎 9 月 8 日,优化全量上线。而配套的"发布限免",从最初两周顺势延长到了 9 月 10 日——到今天,只剩两天。

对被嘲笑"掉队"了两年的腾讯 AI 来说,这十天足够解气。但解气不能帮你做决定:要不要把活儿交给 Hy4、要不要试 WorkBuddy、轻量版值不值得本地跑?三本账,一本一本来。

14.7万亿Token登顶、限免9月10日收口:腾讯混元Hy4这波,先把三本账算完再冲

第一本账:能力——榜单第一说明什么,不说明什么

14.7万亿Token登顶、限免9月10日收口:腾讯混元Hy4这波,先把三本账算完再冲

先说说明什么。OpenRouter 是全球开发者的调用聚合站,这份榜的"真金白银"程度高于任何跑分:Hy4 首发后第一个完整周就冲到 14.7 万亿 token,同周全球调用前五里四款是国产模型。中国模型周调用总量 56.72 万亿、环比 +2.83%,美国 16.54 万亿、环比 -3.1%,这已经是中国连续第 19 周领先。知乎 方向也对:MoE 稀疏激活——78 层、每层 256 个路由专家加 1 个共享专家,每个 token 只唤醒 8+1 个——配上 1M 上下文,摆明了吃 Agent、写码、办公分析这类长任务。B 站实测视频的两极标题很能代表社区状态:"Hy4 实测后端能力杀疯了"和"真神降临还是偏科怪兽"同时存在。哔哩哔哩

再说不说明什么,三个反证必须摆在桌面上:

  • 379% 的环比里有相当一部分是开源首发冲量,基数低、涨幅吓人,是真是稳要看下周榜;

  • 腾讯自披露的 163 名内部专家、203 个工程任务盲测里,Hy4 得 2.99 分(满分 4),GLM-5.3 是 2.92、Kimi K3 是 2.94——这是"自家出题自家考"。知乎 但腾讯把对局细节也放了:对 GLM-5.3 赢 46.8%、平 12.8%、输 40.4%;对 Kimi K3 赢 51.2%、输 40.9%。接近四成的输率说明这是"同档最强且最便宜",不是"代差碾压";

  • "偏科"有明确边界:Hy4 是纯文本模型,没有视觉能力;官方也承认复杂任务上容易想太久、反复自我验证——9 月 8 日这轮优化就是在修它,反过来印证了上一版的毛病。知乎

结论只能说到这里:Hy4 已经是国产编码/长任务场景的第一梯队选项——官方端到端 demo 已经能通过 MCP 接入 Unreal 5 引擎、纯对话从零搭出一个可玩的射击游戏原型——但不是全模态六边形战士。知乎

14.7万亿Token登顶、限免9月10日收口:腾讯混元Hy4这波,先把三本账算完再冲

第二本账:钱——免费是现在,便宜是之后

三个窗口,按离你的距离排:

  1. 限免 9 月 10 日收口。元宝、CodeBuddy、ima、WorkBuddy 这些入口目前都能直接用到 Hy4 preview,处于发布限免期。要拿它跑长文档、写码链路的,这两天是试错成本最低的窗口。注意 8 月 31 日 Hy4 刚进 WorkBuddy 时,任务队列当天排起长队、API 排队用户一度超 5000 人,腾讯不得不对推理集群紧急扩容——高峰时段该排还是得排。知乎

  2. 窗口关掉后看定价。Hy4 的 API 报价是每百万输入 token 0.834 美元、输出 2.501 美元,约为同档闭源前沿模型的十分之一,便宜正是"敢限免、敢开源"的底气。 对重度用户,49B 激活就是把账算到 token 里的地方:Agent 工作流每天吃掉大量重复输出的团队,切过去的月成本是数量级的差别。

  3. 本地部署。轻量版把权重压到约 214GB 之后,门槛从"一整套八卡高端集群"降到"单台高端工作站勉强能跑",llama.cpp、vLLM、SGLang 全支持,部署门槛砍了六倍以上——数据不出本地的私有化部署,第一次对中小团队够得着。但"跑得动"不等于"跑得快",内存带宽才是真实成本,建议等第一批实测吞吐的帖子铺开出决定。

14.7万亿Token登顶、限免9月10日收口:腾讯混元Hy4这波,先把三本账算完再冲

第三本账:生态——为什么"突然",以及还剩哪些疑点

很多人想问:闷了两年,凭什么这周突然动静这么大?其实这十天的每一步都有前传。组织上,腾讯撤销了运行十年的 AI Lab,由姚顺雨出任首席 AI 科学家兼基础模型部负责人。知乎 8 月底引入 GLM-5 前核心研究员白雨石,Hy4 主干融合了 DeepSeek 的稀疏注意力与智谱的跨层索引复用。刘炽平此前公开复盘老混元"像高中生背题应考"——靠 SFT 打榜、真实场景泛化差。知乎 战略从分散收拢到一个旗舰,这次是收拢后的第一次交付。

入口上,元宝月活 1.14 亿,WorkBuddy 的 PC 端月访问量近 2100 万。36氪 开源、限免、开放平台都是在给同一个打法让路:让模型藏在每个人每天用的产品背后,而不是站上台前。高盛 8 月 31 日的报告把"产品+模型闭环"点名为腾讯 AI 的差异化关键,认为 Hy4 预览版标志着混元家族迄今最大幅度的代际能力跃升。知乎

疑点也别替腾讯遮掩:竞品玩家直接质疑 WorkBuddy 的 2000 万月活"可疑"。36氪 生态上,WorkBuddy 连企业微信这类自家产品都还没打通,"办公操作系统"只是愿景;而它想成为继 QQ、微信之后的第三个超级入口,差的还远不止 70 倍用户量。

所以这波 Hy4 冲榜,更稳妥的读法不是"腾讯 AI 已经赢了",而是"腾讯第一次把亿级入口和开发者生态用统一的模型动员起来了"。

这两天,各自该干什么

  • 写码/Agent 玩家:限免期内拿 Hy4 跑通一个你自己的真实任务——长上下文代码库问答、多轮重构都行,重点数任务轮次:9 月 8 日优化的卖点就是省 token,同一任务比 GLM-5.3、Kimi K3 少花多少,账一算就有答案。窗口关掉后再决定日常切谁。

  • 打工人:WorkBuddy 已接入优化版 Hy4,不用部署就能试,适合拿周报、纪要、资料归集这类重复活做"AI 工作台"实验;如果你只是想找个聊天搭子,不用为此换工具。

  • 要做私有化的中小团队:214GB 让你有评估资格了,但建议等第三方实测吞吐铺开再定;如果数据合规是硬约束,这本账的权重要单独记。

  • 看股价、看大盘的:别用"登顶"下结论,盯三个信号——下周 OpenRouter 榜 Hy4 还在不在前三;9 月 10 日限免结束后开发者留没留下;腾讯 Q3 财报电话会上,AI 资本开支和混元会不会被单独讲。

证据边界放在最后说清:本文数据截至 9 月 8 日,调用榜以 9 月 7 日 OpenRouter 周报为准,盲测成绩为腾讯自披露、对局胜率已同步列出。周榜是开发者用脚投票的一周快照,不是能力终点;所有"翻身"级别的判断,请以下一周的数据为准再下。

内容由AI生成
2
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章