张大妈

这届AI PC实测:散热翻车与本地算力真实数据揭秘

源自326位全网作者

10-10 17:49

这届AI PC把「本地跑大模型」从发布会PPT变成了可下单的页面。10月8日,华硕、微软、戴尔、惠普、联想、微星六家厂商的RTX Spark首发机型同步开启预售,10月16日陆续发货。 微软在旧金山的活动上宣布,搭载RTX Spark N1X超级芯片的Surface Laptop Ultra最高配备128GB统一内存、1 petaflop FP4算力,支持在本地运行参数规模超过1200亿的AI模型。 但实测层面,这代机器交出的答卷分成两半:容量确实解决了,散热和速度还没有。知乎智东西

已经确定的坏消息首先是热。此前流出的工程样机测试里,出现过开发版驱动不稳定、CUDA路径未跑通、Arm CPU满载接近100℃的情况。 同底子的上一代机型DGX Spark给出了长期样本:四台堆叠跑集群时,被动散热让它「散热成了最大的问题」,机架底部必须加专用风扇才能把峰值算力跑满。 速度的另一面同样不乐观:独立对比实测显示,四路3090组装的主机总价仅3827美元、比一台Spark还便宜,却在大多数模型上把解码速度甩开几倍到几十倍。 散热为什么吃紧、本地算力到底多快、官方数字里哪些需要打折——本文把散落在工程样机、上代机型与第三方引擎里的数据拼在一起。知乎知乎哔哩哔哩

散热的代价:13.9毫米机身里塞进1 petaflop

这代笔记本的规格表和机身尺寸,是两个方向相反的承诺。华硕ProArt创14把20核CPU与6144核GPU塞进厚13.9mm、重约1.48kg的机身,同时标称整机持续80W性能释放。 微软的Surface Laptop Ultra则把整机压在厚度不足18毫米、重量不足4.5磅的尺度内。知乎智东西

微软的应对方式本身就是散热压力的注脚:它为这台机器设计了一种全新散热架构,官方宣称散热能力是现有Surface笔记本的2.5倍。 个体用户的体感更直接,有用户借DGX Spark跑27B模型,一个脚本改了一小时后吐槽机器「烫得要死,吐字慢得离谱」。 甚至有人花300块给两台Spark自组双机水冷,把折腾过程发上了小红书。智东西知乎小红书

需要说清边界:以上发热证据来自工程样机流出的测试、上一代DGX Spark的长期使用和个别用户自述,RTX Spark量产笔记本的系统性散热实测,目前一例都还没有——它们要到10月16日发货后才开始出现。

本地算力的真实数据:容量富裕,带宽紧张

读懂这代机器的跑分,先要拆开两类负载:给模型喂长提示词的预填充「瓶颈在算力」,逐字吐token的解码「瓶颈在显存带宽」。 统一内存恰好把短板留给后者——N1X被媒体普遍引用的内存带宽约300GB/s,英伟达官方资料并未确认这一项数字。 有博主对比Surface Laptop Ultra与DGX Spark后总结:同一颗芯片,带宽约300对273GB/s、笔记本功耗只有一半左右,出字速度预计接近——作者自己标注这只是推测,真实性能要等独立评测。知乎知乎哔哩哔哩

已经能查到的独立数据给预期划了条底线。针对上一代DGX Spark的实测里,Qwen3-32B的Q8量化版本在四路3090主机上跑到104 token每秒,DGX Spark只有3.5。 微软在发布会上给Surface Laptop Ultra公布的具体性能数字也刻意停在预填充:本地版MAI-Code-1.1-Flash(137B总参、6.8B激活,3bit量化后53GB)在64K和128K上下文下的提示词吞吐分别达到每秒923.5和769.8个token,官方同时建议使用RAM大于120GB的设备;解码速度,未公布。哔哩哔哩智东西

补救主要押在软件上。开源推理引擎SnowLLM作者的判断写在标题里:你的锐龙AI Max只发挥出了一半性能——AI Max+395有最高128GB统一内存,但现有推理框架没针对它做过优化。知乎

按其公布的实测,手写内核优化后,284B的DeepSeek-V4-Flash在131K token上下文下仍有20 tok/s,177B模型从1K到225K上下文只从39降到36 tok/s。知乎

同一个场景里框架差距有多大?131K token时,优化引擎的首token延迟在71秒到3.2分钟之间,而llama.cpp要等30分钟。知乎

单机不够就靠集群:国外用户用四台DGX Spark环网互联跑DeepSeek-V4.1-Flash,代码类推理32并发峰值达到494 tok/s。 原帖作者特别注明,这是把DGX Spark功耗跑到最大换来的峰值数据。这些数字合起来指向同一个结论:这代AI PC的本地算力,「能用」的门槛在MoE小激活、量化和专用引擎,而不是拿密集大模型硬跑。知乎

官方话术翻译:「1200亿参数」只写给顶配

宣传里最容易被误读的一句,是容量承诺。「本地跑1200亿参数」只写给128GB顶配——官方举例的Qwen 3.8 Flash Next是125B,24GB、32GB的入门机型根本装不下。 美区2599美元的入门款对应的是18核CPU、5120核GPU、24GB内存。知乎智东西

性能倍数的口径也要先翻译。微软宣称相比M5 Pro版16英寸MacBook Pro,RTX Spark Windows PC可实现2.1倍首token时延效率、4.3倍图像生成速度、6.2倍视频生成速度。 但梳理首销信息的作者提醒,这三个倍数来自英伟达自测平台数据,不是第三方评测结论,基准测试的具体条件也未公布。智东西知乎

到手价的落差同样算得清:国行起售21,988元,明显高于按汇率折算的美版($2,599约合1.74万元),差额主要来自税费。 顶配128GB/1TB的Surface Laptop Ultra在微软中国商城标价48,388元。知乎知乎

AMD阵营里,铭凡的495迷你主机192GB版日常51,999元,可分配160GB显存跑3000亿级参数模型,散热直接给了双风扇、六热管、铜基板,性能释放最高160瓦。 对多数预算在2万到3万元之间的用户,首销信息里的提醒更实际:大概率买到的是24GB或32GB内存的机型。知乎知乎

而在盘点统一内存机型的作者看来,「来到32GB内存其实和普通笔记本没啥区别」。知乎

想要更大的本地容量上限,另一条线是国庆期间公布的64GB版DGX Spark,沿用DGX OS和英伟达AI软件栈,合作伙伴产品计划10月23日上市、起价4,999美元。知乎

硬件之外:生态账本与用户账本

Arm架构是这代机器绕不开的补课项:x86应用要靠Prism模拟运行,Windows on Arm已有7000+款验证应用,但距离「无感兼容」还有距离。 对企业用户更硬的是内核层——安全代理、行业外设驱动、硬件加密狗无法转译,这被视为企业IT采购最常见的硬阻塞。知乎微型计算机

补生态的动作也在同步发生:CUDA Toolkit 13.4开发者预览版已为AArch64的Windows原生重建,x86的CUDA二进制可以免重编译在RTX Spark上直接运行。微型计算机

AMD这边押的是x86原生,其官方称锐龙AI Max+ PRO 495是首款能够在本地运行3000亿参数模型的x86客户端处理器。微型计算机

货架和市场数据同样对得上:锐龙AI Max系列发布以来,AMD与OEM已推出超过35款产品。 太平洋科技援引AMD的数据称,其AI PC已出货数千万台、覆盖250多款设计,其中智能体PC出货超过50万台。 需求侧并非没有支撑:微软称如今超过40%的商用笔记本已是Copilot+ PC,每月有超过2万亿次推理在这些机器上本地运行。微型计算机太平洋科技智东西

但评测圈的另一派声音同样成立——科技博主在Surface Laptop Ultra首发评测里直言,普通消费者看看热闹就好,花同样的钱可以买到RTX5080游戏本,还没有兼容性隐忧。 真实用户算的则是另一本账:一位把DGX Spark搬回家跑了半年的电力行业用户交出成绩单,6个项目、13个本地模型、408G模型库。 另一位用128GB Spark搭内容生产工作流的从业者把用途说得更清楚:这台机器更多是上百个Agent并发的执行环境,而非本地模型推理机。 按同一位作者的说法,他所在行业已有客户要求签署协议,不得用在线聊天模型处理保密信息——这层数据边界,才是本地设备真正的卖点。哔哩哔哩小红书知乎

把这届AI PC的实测数据拼完,答案是分层的:容量问题已被统一内存解决,128GB到192GB的选择今年真的进了货架;热的问题有真实证据但没有定案——工程样机满载近100℃、被动散热的上代机型要靠外置风扇续命,这些疑点都得等量产机的第一波第三方实测来对答案;速度的问题被带宽锁在半程,预填充可以靠算力冲上去,解码还得看MoE、量化和专用引擎各让多少步。验证节点已经排好:10月16日RTX Spark笔记本发货,10月23日64GB DGX Spark上市,今年晚些时候还提供748GB一致性内存、20 petaFLOPS算力、号称可本地跑万亿参数模型的DGX Station for Windows会接着出题。 在这些实测落地之前,「翻车」和「碾压」的说法都只适用于证据覆盖到的部分;而对等着本地算力变成日常的用户,要盯的就三个数:量产机的持续功耗释放、原生引擎下的真实解码速度,以及13.9毫米的机身能不能把80W一直压到天黑。智东西

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章