雷神不卖游戏本改卖"本地算力"了:64G内存跑120B大模型,掏两万前先把三笔账算清

源自8位全网作者

10-02 19:33

9月30日晚上,B站34.6万粉的硬件区UP司波图发了条测试视频:一台64G内存的笔记本,断网跑起了权重59G的120B大模型,靠的是一块在资源管理器里连盘符都没有的隐藏分区。一天时间,这条视频6万+播放、687收藏、531币、104条评论。比视频本身更好看的,是评论区:有人认真蹲配置求推荐,有人直接开算,也有人一句话把销售话术顶到了热评第一——“注重信息安全的公司,会让员工用私人电脑?”B站

雷神这个牌子,大多数人印象还停在游戏本、鼠标和那波售后梗上。但这家厂子从5月底开始,悄悄把故事换成了"AI工作站"。这条新线值不值两万多,先把三笔账摆开。

四个月,雷神把"算力"端上了桌

时间线拉出来看,节奏其实很密:

  • 5月28日,雷神在北京开发布会,和AMD一起把Master系列AI工作站切成三个形态:Master T塔式、Master P迷你机、Master M笔记本。笔记本旗舰M7000用锐龙AI Max+ 395(16核32线程,8060S集显,官方称性能媲美RTX 4060),至高可选128G LPDDR5x内存,带OCuLink外接显卡口。雷科技

  • 9月21日,M7000才真正开售,国补价19999元。它的1T固态被拆成768G常规存储和85G的SLC模式AI Cache,整机性能释放160W。机器预装"牧马人"(Herdsman)本地推理引擎,底层是群联的aiDaptiv+方案,官方宣传64GB+AISSD跑通120B、开机即用。9月30日那条破圈视频里的"隐藏分区",就是这个不给盘符的85G AI Cache——59G权重的120B模型,内存装不下的部分被放进了这块专用缓存。IT之家IT之家雷神官方微博

  • 9月23日-24日,雷神又预告了STATION系列迷你AI工作站:至高可选锐龙AI Max+ PRO 495专业级处理器,支持集群弹性组网、多机串联扩算力。395款体积只有2L,132W TDP,Wi-Fi 7、双USB4、双10GbE网口,128GB+1TB预约到手价25499元。雷神官方微博IT之家

  • 更早的9月16日,热点科技把那台7.9升水冷迷你工作站的实测数字交了出来:GPT-OSS-120B单路推理综合50.4 tok/s,首字延迟中位195ms。双烤能顶住154W,0.5米噪音实测38.3dBA,这台机器叠加国补到手26499元。热点科技

雷神自己也在转口径:从海尔内部孵化、做游戏本起家,到喊出"全场景电竞和AI第一平台",这是把品牌从"电竞硬件"往"本地算力载体"上挪。而挪的理由,发布会报道里写得很直白:内存价格居高不下,大模型的Tokens开销,也已经远没有像之前推广期那样,人人都承受得起了。雷科技

第一笔:容量账——"能跑120B"有两种完全不同的含义

这是整场讨论里最容易被话术糊掉的岔路:把模型装进机器,和把模型装进显存,是两回事。

128G路线是"整包进内存"。以水冷工作站为例:128G LPDDR5X 8000四通道统一内存,靠AMD的可变显存技术,最高能从这128GB里划出96GB当专用显存用。评测里218页的半年报、131K上下文开进来,内存加显存占用超100G照样跑得动。热点科技

64G+AI SSD路线是"部分权重挪到盘上"。厂商的讲法是用超高速的固态硬盘通道充当虚拟显存,只要配64GB内存,就能在笔记本上跑120B参数的大模型。原理侧也有公开线索:评论区提到的llama.cpp上游PR #25294,思路就是把"未激活的MoE专家"留在SSD上按需加载,还有社区strata分支声称显存加内存最低38G就能跑125B级别的模型。方向没错,但它赌的是MoE模型的稀疏性——激活多少专家,决定你要从盘上读多少数据。雷科技

社区对这两条路的分歧,一句话就能概括:这电脑要是有128g的版本才可以考虑。在64G版M7000和128G方案之间怎么站队,评论区基本一边倒:容量决定你"能不能跑",但带宽决定"跑成什么样",买64G就是自愿站进第二条路。而雷神自己显然也知道这个痛点——9月24日预约的STATION迷你工作站直接给到128G,把"内存装不下"的问题整包解决掉。B站

第二笔:速度账——50 tok/s是128G的成绩,64G目前没有实测

水冷工作站那组数字是可信的:四路并发压测时,GPT-OSS-120B整体吞吐反而冲到71.60 tok/s,单路17.94 tok/s,最大首字延迟2016ms比9B还低。这是"全家共用一台机器"级别的可用性。热点科技

但被视频破圈带火的M7000 64G版,SSD卸载路线的实际吐字速度至今没有第三方硬数据。社区里能找到的最接近的判断来自"拿傲腾盘跑大模型"的那派讨论,措辞很收敛:吐字速度相比大显存会慢很多,但至少能跑。大模型靠SSD补容量的代价就出在这里:命中缓存的token流畅,需要现场加载专家权重的token卡顿。所以如果你是被"64G跑120B"这句话种草的,先把预期锚定在"能打开、能对话、别指望丝滑",等第三方量化对比出来再下手不迟——这也是双11前最值得蹲的一条信号。B站

第三笔:订阅账——本地算力回本的前提,是你肯接受"能力天花板"

"告别订阅费"这四个字,就是雷神发布会报道自己用的标题。这笔账其实是道除法题,自己就能算:机器到手价 ÷ 你每月云端开销 ÷ 12 = 回本年数。按26499的水冷机,月烧1500的重度用户两年出头回本,月烧500的普通用户要四年半——而热评里那句最扎心也最实在:两万五,什么都可以干,但是什么都干不好。四年之后,这台专用机的残值和它跑的模型能力,都很难看。雷科技B站

更关键的是,省下的订阅费和拿到的能力不等价。评论区自述长期本地部署的用户给了个保守基准:现在最强的qwen 3.8 27b我测下来最多也就是gpt 5.6 luna的水平。但也有更乐观的实战派:395上调优过的qwen 3.8 flash next,长上下文prefill能过千、decode 40以上,个人场景已经能平替便宜API。两句合起来就是本地算力的真实坐标:高频、批量、隐私敏感的小任务可以搬回家,复杂任务的最后一环仍然要交给云端。如果你买机器是为了完全替代云端,这笔账怎么算都回不来。B站

至于"企业数据安全"这个叙事,104赞的热评已经戳穿了大半:还有一个注重信息安全的公司会让员工用私人电脑?会让电脑离开公司?楼里最高赞的回复补了一刀:公司随便架设一下都比员工自己搞得强得多。本地算力真正的买单方,不是有IT部门的组织,而是自由职业者、独立开发者、和那些"资料传不上云、但每周都在手动喂模型"的人。B站

谁该付这笔钱,谁该绕道

把人群拆开,答案其实很清楚:

  • 可以考虑:数据敏感且无内部服务器的个体从业者;每天跟便宜API死磕的重度文本用户;想一台机器兼顾7×24挂机、偶尔还打两把游戏的全能本用户——水冷的38.3dBA噪音就是为挂机准备的,8060S集显在1080P下跑《赛博朋克2077》平均86.36FPS、最低69.45FPS。热点科技

  • 建议绕道:以视频制作为主的人,评论区已经给出方向——做视频优先选5090,有cuda,RDNA架构的集显生态在创作软件里不占便宜。纯游戏玩家也是:平时也就是上上网、打打游戏,那这两万多块钱千万别花在这,拿去配一台带顶级显卡的电竞台式机不香吗?B站雷科技

  • 再等等党:盯三个信号就够了——双11期间M7000的国补价会不会松动;128G的M7000或STATION系列会不会把价格打下来(25499的2L款 vs 26499的7.9L水冷款,雷神一个月内摆出两种迷你形态,本身就说明定价还没稳);以及评论区提到的同模具竞品:七彩虹灵创K16,用的也是同一个模具,高配有128G内存。这条说法未经核实,但同一块395平台、不同家的模具散热和内存配置差价,就是这台机器溢价空间最直接的参照物。

雷神这波转型,把过去堆在游戏本上的"性能叙事"换成了"算力叙事",产品本身不是智商税——128G路线的实测数据确实立得住。但64G+AI SSD这条被短视频带火的路,目前话术跑得比实测快。双11前这笔钱要不要掏,答案不在发布会PPT里,在你自己那张账单里:先算你每月交给云端多少钱,再算你能不能接受一个"比顶级云端差一档、但绝对不出门"的大脑。两个数都对得上,再谈下单。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章