先说今天发生的事。8月28日,腾讯正式发布并开源新一代混元旗舰模型Hy4 preview:MoE架构,总参数770B,激活参数49B,上下文长度拉到1M tokens,许可证是对商用友好的Apache 2.0。微博官方给它的定位是"旗舰生产力模型",主攻软件工程、办公分析、游戏原型、科研这类真实任务,权重同步上线HuggingFace和ModelScope。微博
几乎同时,腾讯的AI桌面工作台WorkBuddy宣布首发接入Hy4 preview,并给出两个免费窗口:Hy4 preview限时免费两周(8月28日至9月10日),上一代Hy3的免费期限再延长一个月到9月30日。微博注意,这已经是第二次"延期"——Hy3限免原本8月31日就收官,当时不少人都以为9月以后只能靠每天签到领的100积分过活了。小红书

为什么突然加免?背景是三家的仗越打越热。8月27日,字节跳动正式发布"豆包工作"。哔哩哔哩而豆包实际上已经把飞书合并了进去。36氪算上8月发布的阿里千问办公,三家的AI办公产品一个月内凑齐,媒体已经开始把它们当作"三大办公智能体"同场对比。36氪
WorkBuddy目前日活用户达到百万量级,是腾讯最当红的AI应用。36氪三家抢AI办公入口,免费窗口就是最直接的拉新手段,对想薅羊毛的普通用户来说,这是好事——仗打得越凶,免费期越长。
那Hy4到底值不值得薅?先看实力。据社区整理的官方盲测数据:163名内部专家、203个工程任务盲测中,Hy4均分2.99,高于GLM-5.3的2.92和Kimi K3的2.94,强项在软件工程、多文件办公、游戏原型、科研。微博社区测评也认为,在多个Coding和Agent复杂任务场景下,Hy4 preview与当前第一梯队模型正面硬刚。微博

但要泼两盆冷水。第一,测评方的结论是Hy4"首次真正挤入国产开源第一梯队",领先幅度是"小幅领先、非代际领先"——值得试,但不用神化。第二,它终究是预览版,官方口径是早期Preview、将快速迭代,社区早期实测也发现速度偏慢、推理偏长这类不足。微博
接下来说怎么薅。分三种人:
第一种,只想零门槛白嫖的打工人。微信直接登录,不用研究模型参数。周报汇总、文档整理、会议纪要这类日常任务优先交给Hy3——它已经稳定跑了一个多月,免费期到9月30日,足够长。记住一条:关键数字和引用,AI产出后人工复核一遍再发。
第二种,想尝鲜新模型能力的。Hy4 preview限免到9月10日,每天赠送免费额度。长上下文是它的强项,"扔一份百页文档让它总结提炼"这类任务最值得试。但发布当天资源紧张,有人蹲免费额度就遇上排队,截图里前面排了四千八百多人,建议错峰使用。微博

第三种,盯着开源本身的开发者。Apache 2.0协议,权重公开,商用友好。但MoE总参770B的部署门槛摆在那里,没有自己的算力不必硬上,等社区的量化版本和衍生服务成熟再动手不迟。
最后是避坑清单,这篇的重点:
第一坑:积分消耗。有用户发现,在AUTO模式下跑自动化任务时,模型会被频繁分配到GLM、kimi,积分消耗远超指定deepseek,从晒出的使用记录看,GLM系模型单次消耗高达119到166积分,而deepseek单次只要1.7到14.6。小红书

限免期内这也许无所谓,但免费期一结束就是真金白银。重度使用者建议手动指定模型,动手前先看清积分规则。媒体的实测评测也提醒,复杂任务的积分消耗不容忽视。36氪
第二坑:排队与稳定性。Hy4 preview算力紧张,高峰期排队是常态;预览版迭代快,体验不保证一直稳定,有严格时限的交付任务,别全押在它身上。
第三坑:冲动付费。这次限免已经是第二次延期——从"8.31收官"到"延到9.30",又叠加一个Hy4的两周窗口。免费期可能继续延长,也可能突然收紧,别因为"快结束了"就冲动充值,也别把全部工作流押在单一免费产品上。
往后值得盯的信号:Hy4 preview两周限免结束后是转正还是收费,API口径已经给出参考——每百万tokens输入约6元、输出约18元、缓存约0.3元。微博腾讯CSIG负责人汤道生已在内部信里明确,要推动企业微信、腾讯文档、ima、腾讯会议、iwiki与WorkBuddy打通,WorkBuddy的能力边界还会继续扩。36氪另外就是豆包工作、千问办公后续的免费政策,三家只要有一家加码,用户就能跟着受益。
一句话判断:还没上手过AI办公Agent的打工人,现在到9月10日是试新模型成本最接近零的窗口;只想稳稳白嫖的,Hy3到9月30日完全够用。至于掏钱,等免费期尘埃落定再说。