官方演示能本地跑320B,买家却说“仅仅是能跑”:把预算交给AMD智能体PC前,先把容量、速度、生态这三本账对完

源自22位全网作者

07:35

一场沟通会和一个评论区,隔空对上了

10月5日,AMD的智能体PC线上沟通会把蓝图摆上了桌:旗舰型号锐龙AI Max+ PRO 495最高支持192GB统一内存,CPU和GPU可以共用同一个内存池,其中最高160GB可设置为可变显存;GLM 5.3 Flash 320B经4-bit量化后可以在这台Windows PC上本地运行,最高输出速度达到20 Tokens/s。知乎

硬币另一面,是B站一条4.1万播放的视频"现在怎么没有人提用AMD MAX395去跑本地大模型了"——236条评论里,有人晒"我 11000 买的,上个月 15000 卖了"自嘲白用一年还赚钱,也有人给实测党泼冷水:395跑大模型仅仅是能跑。

这两张图拼在一起才是完整的"智能体PC":硬件侧容量墙拆了,软件侧和价格侧的账还没平。这篇说给已经用着LM Studio/Ollama、常跑27B-35B、正琢磨要不要为"统一内存AI主机"掏钱的中度折腾党——钱交出去之前,先把三本账对完。

第一本账:容量——192GB解决的是"装得下",不是"跑得快"

先看代际账。PRO 495对比上一代395:统一内存128GB→192GB(+50%),可分显存96GB→160GB(+67%),NPU从50 TOPS到55 TOPS;但位宽还是256bit,内存速率只从LPDDR5x-8000走到8533,最终带宽273 GB/s,上一代是 256 GB/s——涨不到7%。知乎

这一代的真意义是跨过容量门槛:320B模型以4-bit量化跑起来,连同足够上下文大约占用160GB,恰好压在192GB机型的显存分配上限里。但要注意,可变显存是BIOS级划分,160GB划给GPU后,Windows、智能体框架、办公软件和其他程序共享剩余约32GB;而八颗 24GB 芯片焊接在主板上,容量在下单那一刻就定死了,不存在"先买小版再补内存"。知乎

日常真正舒服的档位反而是"不满配":AMD给出的公开配置里,在128GB统一内存平台上跑Qwen3.5 35B A3B,生成速度约45 Token/s,最高支持26万Token上下文,并可同时运行最多6个智能体。知乎

官方演示能本地跑320B,买家却说“仅仅是能跑”:把预算交给AMD智能体PC前,先把容量、速度、生态这三本账对完

第二本账:速度——"出字速度"和"读题时间"是两回事

官方演示里20、42 Tokens/s都是一句话提示词的生成阶段速度。真把一份长合同、整个代码库喂进去,先要付"读题"的钱:1万个输入Token的预填充约需19.5秒。知乎

社区引擎项目SnowLLM把这层窗户纸捅破了:现有主流推理框架没针对这块RDNA 3.5核显优化,同一台395用同一份模型文件跑同一个任务,最终 SnowLLM 快了 2.4 倍。知乎

差距最大的是预填充:131K token时,SnowLLM 的首 token 延迟在 71 秒到 3.2 分钟之间;同样的 DeepSeek 提示词,llama.cpp 要等 30 分钟。

同是"284B档",口径也有两条线:厂商侧给495的标称,根据铭凡的数据,运行284B 的大模型,速度为 12 token/s;引擎作者侧则在395上把284B的MoE在131K上下文压到20 tok/s。“能装下320B"和"愿意等它干活”,中间差着一个优化过的推理框架。知乎

对照价签也要摆上桌:评论区双卡党自报双5060ti16g跑nvfp4差不多50上下,质量比q8都高,而且价格还比395便宜很多——但32GB显存就是天花板;苹果的牌打在带宽上,M4 Max Mac Studio 546GB/s的统一内存带宽,几乎是 Ryzen AI Max+ 395 的两倍。哔哩哔哩知乎

这条路线的长处本来就不是速度:锐龙AI Max+ PRO 495默认TDP为55W,可配置范围最高达到120W,它赢在装得多、省电安静、能7×24常驻,代价是40CU的RDNA 3.5核显没有独立矩阵加速单元,稠密大模型速度天花板低。知乎

官方演示能本地跑320B,买家却说“仅仅是能跑”:把预算交给AMD智能体PC前,先把容量、速度、生态这三本账对完

第三本账:生态——机器已上架,驱动还在路上

官方数字很好看:AMD已经出货数千万台AI PC,覆盖250多款设计;其中智能体PC出货超过50万台,覆盖50多款设计。而铭凡、极摩客、阿迈奇等厂商已经上架了搭载495处理器 + 192GB 大内存的迷你主机。知乎知乎

但把"智能体PC"当生产力买之前,先看工具链的坑位:搭配Ryzen AI Max+ Pro 495的各类设备已经预售了,可现在Linux NPU驱动支持还未发布;性能翻倍级的SnowLLM目前支持 Linux 和 WSL2(ROCm 7.x),Windows 11 还在预览,仅支持 pip 安装,实际测试过的机器只有一台。知乎知乎

门槛标准也在被重写。Perplexity Portable Computer对本地运行的要求是至少24GB可供GPU使用的内存;微软Project Zenith把64GB以上统一内存、250GB/s以上内存带宽和30B以上本地模型列为开发者级设备的基础能力,首批设备就用的是AMD锐龙AI Halo平台。知乎

这台"常驻工位"该长什么样,厂商已经在用产品投票:1个万兆网口采用DASH专用管理网卡,独立供电回路,不依赖操作系统运行,设备关机、蓝屏状态下仍可远程开机,KVM屏幕查看或修改BIOS——给7×24不间断跑智能体留的口子,全在细节里。今日头条

官方演示能本地跑320B,买家却说“仅仅是能跑”:把预算交给AMD智能体PC前,先把容量、速度、生态这三本账对完

时机账:内存涨价和机型放量,到底该等哪一边

价格是最大劝退点:495+192GB的主机售价大概在5万元左右,极摩客EVO-X5页面价格显示51000元,宣传图里首发到手价则低于5万,海外2TB版则标价$6799 美元。今日头条知乎

反证也要摆出来:写出这套对比表的作者态度直接——“别买,没CUDA生态”;而395买家的账本是另一个味道:有牌子的卖到14999,没牌子的11000,最便宜的时候卖到 9800,涨价后11000买入的人转手15000卖出。知乎哔哩哔哩

内存行情也在搅这张桌子:TrendForce预测2026年第四季度常规DRAM合约价环比上涨10%至15%;CFM的报告则判断涨幅将会大幅收窄,移动端LPDDR内存涨幅落在0-5%。知乎知乎

行情体感是另一层:最近两周内存的价格基本上处于横盘状态,但是主流容量的DDR5内存涨幅比较明显,CPU散片里锐龙涨价也最显眼。所以"等内存降价省一笔"大概率等不到——LPDDR焊在主板上跟整机绑定,Q4合约价仍是上行;真正值得等的是另一边:近期预计将有超过20款基于锐龙AI Max+PRO495平台的新机型陆续上市,放量打价格战、驱动补全,等的这两三个月买到的是同样预算下更大的容量带宽和更少的折腾。知乎知乎

顺手蹲一个窗口:今年京东双十一开启节奏大幅提前,10月8日首轮大促正式打响,开售前先查一遍AI主机这类新品在不在国补和平台补贴覆盖里。知乎

5万档的机器也在堆产品力:CNC全金属机身可立可卧,机身正面的电源键表面,整合了指纹识别功能。今日头条

官方演示能本地跑320B,买家却说“仅仅是能跑”:把预算交给AMD智能体PC前,先把容量、速度、生态这三本账对完

给三种人的一句话

现在可以上车:数据涉密、要7×24常驻多智能体、跑100B以上MoE的中小团队或个人工作室——拿艾美奖的影视VR公司LightSail已经把基于锐龙AI Max和Radeon AI PRO的智能体系统当日常用,同时加载多个模型、比较不同上下文下的输出,逻辑就是把高频调用的Token费变成设备侧固定投入。知乎

先别动的,是只想跑27B-35B日常助手的人:你现有的独显机器加一个开源引擎就够用,等20款新机把价格锚点打出来、等Linux NPU驱动和Windows正式版落地再决定。换条路的,是只追单模型速度的玩家:双5060 Ti/9070 XT独显或Mac Studio统一内存才是速度解;偶尔才用大模型的,直接API或租算力——为"能跑320B"的名头掏5万,20个token/s的输出速度不会给你对应的体面。

沟通会给的是"300B进家门",评论区给的是"仅仅是能跑"。智能体PC的真实门槛从来不是192GB这个数字,而是装得下、读得快、驱动齐这三件事。你的本地大模型装备现在显存多大、每秒几个token?评论区报个数,看看是买统一内存小主机划算,还是给旧机器补一张独显划算。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章