AMD锐龙AI Max 400能本地跑3000亿参数大模型了

AMD锐龙AI Max 400能本地跑3000亿参数大模型了

2026-10-11 16:41:20 0点赞 0收藏 0评论

一台迷你主机,装192GB内存,在本地跑起3000亿参数的大模型。2026年9月30日,AMD开了一场媒体沟通会,把方案摆上了桌。

Gorgon HaloGorgon Halo

这是一颗什么芯片

AMD在2026年5月20日向媒体公布了这个系列,代号Gorgon Halo,是上一代锐龙AI Max 300系列(代号Strix Halo)的升级版,目标是把原本跑在云端机房的大模型搬到个人电脑上。9月30日的媒体沟通会上,AMD把它归到“智能体PC”这个品类,同时给出了一组自测的本地推理数据。

这次先上市的是带PRO后缀的商用型号,面向企业、工作站和专业用户,消费版本晚些推出,共三款型号可以选择。

锐龙AI Max PRO 400系列三款型号规格锐龙AI Max PRO 400系列三款型号规格

核心卖点就是统一内存

传统PC里系统内存和显存是分开的两块,数据需要搬来搬去;而统一内存把两者合并到同一块内存里,CPU、GPU、NPU谁要用就直接来拿数据,没有了繁复的数据流转过程。规格是LPDDR5X-8533,带宽约273GB/s,可配置功耗45到120瓦。AMD还配了VGM可变显存,最多能把160GB内存划给GPU,上一代的上限是128GB内存、96GB显存。

两代锐龙AI Max统一内存规格对比两代锐龙AI Max统一内存规格对比

AMD自己给的实测数据

官方测试平台是锐龙AI Max+ PRO 495,192GB内存,VGM设成160GB。跑GLM 5.3 Flash(320B参数,4bit量化)最高能达到20 tokens/s,跑Qwen 3.8 Flash Next(125B主参数加51B嵌入)最高能达到42 tokens/s。两组数据都是本地测试。

锐龙AI Max+ PRO 495本地推理速度锐龙AI Max+ PRO 495本地推理速度

AMD同时还公布了一组和英特尔酷睿Ultra X9 388H的数据对比,用ComfyUI测18项生成式AI任务,AMD这边是192GB内存,英特尔是64GB。18项中有17项任务锐龙AI Max+ PRO领先1.1到3倍。

3000亿参数怎么跑起来

参数越多占地越大,跑模型的硬门槛是权重和上下文都得能装进内存,一旦装不下系统就得反复从硬盘里流转。也可以说本地能跑多大的模型,很大程度是由内存容量决定的。

锐龙AI Max 400系列芯片锐龙AI Max 400系列芯片

AMD说这是全球首款能以4bit量化在本地运行超300B参数模型的x86客户端处理器。上一代配128GB内存能跑到2000亿参数级,这一代的192GB把门槛提到3000亿以上。

这一代也并非完美

这一代本质是Refresh,属于小改款。CPU还是Zen 5,GPU还是40单元的RDNA 3.5,核心并没有动,只有内存容量这一项算硬升级。

软件生态并没有跟上。开源项目SnowLLM发文表示,现有推理框架大多是为别的GPU写的,直接搬到这颗芯片上只发挥了大约一半左右的性能,实际使用体验取决于软件优化跟不跟得上。

最后

对于企业用户和团队,数据需要内网运行,本地跑大模型的,锐龙AI Max 400是目前x86平台上内存最大的选择,比英伟达RTX Spark的128GB还多64GB,确实值得关注。具体还要看首批机器的实际评测和驱动完善情况再做决定。普通玩家装机打游戏,这代跟你没关系,游戏看显卡就行。

作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

展开 收起
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松