腾讯混元 Hy4 免费两周、Hy3 限免延到 9/30:这波 770B 的羊毛,先看路线和误区再上车

源自121位全网作者

04:49

一直蹲 WorkBuddy 羊毛的朋友,8 月 28 日这天心情应该坐了一趟过山车。

前半个月,小红书上全是「WorkBuddy Hy3 免费期快到期,怎么省积分」的攻略,有博主吐槽高级模型聊一次 100 到 200 积分就没了,一个任务直接烧一千,帖子收藏量冲到三千多。小红书大家已经做好 8 月 31 日之后勒紧裤腰带的准备。结果 28 日下午,腾讯混元一口气甩出两张牌:新一代旗舰大模型 Hy4 preview 发布并开源,总参数 770B、激活参数 49B、上下文 1M。微博WorkBuddy 和 CodeBuddy 国内、国际版同步开启 Hy4 限时免费两周。知乎原本 8 月 31 日到期的 Hy3 限免,直接顺延到 9 月 30 日。

腾讯混元 Hy4 免费两周、Hy3 限免延到 9/30:这波 770B 的羊毛,先看路线和误区再上车

翻译成人话:你研究的省积分攻略可以先放放了,比 Hy3 强一代的旗舰模型,免费送到面前了。

但先别急着冲。这波有三个误区,不搞清楚就上手,要么失望,要么白折腾。

误区一:770B 开源,不等于你能在自己电脑上跑

看到「开源」两个字,有人的第一反应是下载到本地跑起来。这笔账得先算明白。770B 参数,BF16 精度下权重约 1.5TB,就算用官方同步放出的 FP8 版本,也接近 0.8TB——几十张 32GB 的家用显卡加在一起都装不下,更别提带宽瓶颈,官方部署方案直接按 8 卡并行(TP=8)加投机解码配置,面向的是单卡显存 96GB 以上的企业级卡。

所以这次开源,真正受益的是有卡、要做二次开发、数据不能出内网的团队和企业。个人用户的正确打开方式,是免费产品入口,不是权重文件。

误区二:「开源第一梯队」是真的,「碾压」也是真的没有

Hy4 比 Hy3 的提升确实大。发布当天就有微博用户直呼对 Hy3 是降维打击,在复杂编程任务上能直接硬刚 Qwen3.8 Max、DeepSeek V4 Pro 乃至 Claude Opus 5。微博跑分数字更直观:软件工程方向的评测 DeepSWE 从 Hy3 的 28.0 拉到 64.3。知乎Code Arena 的 WebDev 榜单从 Hy3 时期的 31 名左右升到第 5 名上下,开源模型里排进前三。

腾讯混元 Hy4 免费两周、Hy3 限免延到 9/30:这波 770B 的羊毛,先看路线和误区再上车

但「国产机皇」的吹捧先别信,目前能查到的数据是另一回事。腾讯组织了 163 名内部专家、203 个真实工程任务的盲测(满分 4 分):Hy4 preview 拿 2.99,GLM-5.3 是 2.92,Kimi K3 是 2.94。知乎同一梯队,差距在 0.05 到 0.07 分之间,而且面对 GLM-5.3,Hy4 在约 40.4% 的任务上是输的。考长程代码重构的 ProgramBench,Hy4 只有 17.5 分,Claude Opus 5 是 39.5。知乎硬骨头任务差距明显,纯文本的 HLE 拿 43.4,也没够到 Claude 的 53.2 和 GPT-5.6 Sol 的 49.6。

一句话总结:稳稳挤进国产开源第一梯队,能和 GLM-5.3、Kimi K3、DeepSeek V4 Pro 坐一桌,但最硬的代码任务还不是它的强项。另外注意 preview 这个词,官方口径是「Hy4 迭代的一个早期版本」,这次也没有公布标准跑分,网上流传的各路「跑分表」别当结论。

误区三:免费不等于无限量,窗口期只有两周

Hy4 preview 的免费从 8 月 28 日起算两周,大约到 9 月 10 日前后,以官方页面显示为准。发布当天就有用户想上手试试,结果白嫖要排队。微博这种窗口期别留到最后一天。

实测也发现了问题:有 B 站测评博主在线上体验入口测试时遇到输出截断、上下文丢失。哔哩哔哩模型本身还存在过度思考、容易陷入自我验证循环的毛病。知乎用的时候把它当一个能力强、但需要你最后把关的实习生,别当自动驾驶。

四条路,不同人怎么选

办公党走 WorkBuddy,模型列表里选 Hy4 preview。官方演示很能说明问题:把 72 份票据文件和 3 份规章制度丢给模型,让它自动筛出 14 张合规报销单。知乎干过财务稽核的都知道这种活有多折磨人。数据分析、写报告这类跨文件交付,也是这一代的强化重点。

代码党走 CodeBuddy。这一代专门强化了长程开发的理解、规划、调试和验证,适合把整个代码库丢进去让它自己找关联——1M 上下文大约能一次装下中型代码库或几百页文档。

纯尝鲜党走元宝、ima 或 aistudio.tencent.com,打开网页直接聊,零配置,适合先判断合不合口味。

开发者走 API,腾讯云 TokenHub 或 OpenRouter 都能调,兼容 OpenAI 接口,原代码零改造。国内定价输入 6 元、输出 18 元每百万 tokens,缓存命中 0.3 元。知乎对比 Hy3 大约贵了 6 倍输入、4.5 倍输出,但放在同代旗舰里不算贵,比 Kimi K3 便宜,也略低于 GLM-5.3。知乎窗口期内免费,价格先记着,免费结束后拿来算账。

腾讯混元 Hy4 免费两周、Hy3 限免延到 9/30:这波 770B 的羊毛,先看路线和误区再上车

有卡团队走开源权重,Apache 2.0 协议,ModelScope、GitCode、HuggingFace 都能下,官方 FP8 版本和 vLLM、SGLang 部署方案一步到位。微博

这两周,把额度花在刀刃上

Hy4 的强项是「长」和「交付」,免费额度尽量往这三个方向花:一是完整编程任务,不是改几行代码,是规划、写码、调试、验证的全链路;二是跨文件办公,材料整包丢进去,让它一次产出文档、表格和 PPT;三是超长上下文,代码库、合同、年报整本喂,不用中途担心它忘事。

反过来,日常单轮闲聊和 Hy3 拉不开差距,不值得烧排队名额。

两周之后呢

这笔账也可以先算好。Hy3 在这两个平台的免费期也延长到了 9 月 30 日,日常办公和写代码辅助完全够用。知乎WorkBuddy 本身支持切换 DeepSeek、GLM、Kimi 等第三方模型,白嫖到期后基础体验有兜底。

真用出感情的,可以等正式版。Hy3 的先例是从 preview 到正式版,周调用量涨了 68 倍以上。知乎腾讯今年的节奏是约两个月一个大版本,Hy4 正式版应该不远。

最后一句话收个尾:这波本质上是腾讯用两周免费窗口换你的真实使用反馈,白嫖党不亏,但要薅得明白——这是目前最值得薅的开源旗舰,但绝对不是国产 Opus。干什么活、走哪条路、什么时候收手,想清楚再上车。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章