曾被誉为大模型神器,AMD MAX395为何从火爆走向理性?

源自21位全网作者

03-17 07:53

关于AMD AI Max+ 395在本地大模型领域的讨论热度似乎有所下降,但这并非因为其失去了价值,而是因为相关的讨论已经从“它能不能跑”的基础阶段,演变为对性能优化、软件生态和市场定位的深度剖析。

曾被誉为大模型神器,AMD MAX395为何从火爆走向理性?

最初,AMD AI Max+ 395(及其PRO版本)的出现确实在本地AI社区引起了轰动。其最大的亮点是它将统一内存架构(UMA)带入了x86平台。这种架构允许CPU和集成GPU共享高达128GB的LPDDR5x高速内存,并且用户可以灵活地为GPU划拨海量“显存”(最高可达96GB)。这一特性直接打破了传统独立显卡(如RTX 4090/5090)的32GB显存瓶颈,让普通用户在本地运行百亿甚至千亿参数(如gpt-oss-120b、qwen3-235b)的大模型从不可能变为了可能。在当时,它被视为一个极具性价比的解决方案,让用户以远低于专业工作站的成本,获得运行超大模型的能力。

曾被誉为大模型神器,AMD MAX395为何从火爆走向理性?

然而,随着时间的推移和用户实践的深入,大家对AI Max+ 395的认识也变得更加全面和客观,讨论的焦点随之转移到了以下几个方面:

首先是性能瓶颈问题。尽管拥有巨大的“显存”容量,但AI Max+ 395的绝对算力(TOPS/FLOPS)和内存带宽(约256GB/s)与高端独立显卡或NVIDIA的专业AI设备(如DGX Spark)相比仍有较大差距。这导致它在处理不同类型的AI任务时表现各异。对于推理任务,特别是每次只激活部分参数的混合专家(MoE)模型,AI Max+ 395能够提供流畅的体验,生成速度可以达到每秒数十个token。但对于需要更高绝对算力的稠密模型、模型微调(Fine-tuning)或图像生成这类计算密集型任务,它的表现就明显逊色于NVIDIA的同类产品,后者往往能实现2到3倍甚至更高的性能。

其次是软件生态的成熟度。AMD的ROCm软件栈在过去一年取得了显著进步,PyTorch等主流框架已提供官方支持,像Llama.cpp、Ollama、LM Studio等工具也对其进行了良好优化,使得部署和运行大模型变得比初期容易得多。然而,与NVIDIA经营近二十年的CUDA生态相比,ROCm在兼容性、稳定性和工具链完整性上仍有差距。用户有时仍需手动编译特定版本的库,或寻找社区提供的解决方案,这对于追求“开箱即用”体验的用户来说是一个不小的门槛。此外,其集成的NPU虽然拥有50 TOPS的算力,但目前能有效利用其性能的应用场景还非常有限。

再者是市场竞争环境的变化。一方面,AI Max+ 395系列产品本身定价不菲,加上高容量内存成本上涨,使得整机价格居高不下,限制了其普及。另一方面,竞争对手也在迎头赶上。苹果的M系列芯片凭借其成熟的统一内存架构和流畅的软件体验,早已占据了部分高端用户市场。英特尔也在其新一代酷睿Ultra处理器中引入了类似的内存共享技术,并计划在未来产品中大幅提升核显算力,这为用户提供了更多高性价比的选择。而对于追求极致性能的专业开发者,NVIDIA凭借其强大的CUDA生态和硬件性能,依然是难以撼动的首选。

曾被誉为大模型神器,AMD MAX395为何从火爆走向理性?

是产品定位的模糊性。AI Max+ 395作为一个“全能选手”,性能强大,但似乎在每个细分领域都不是最优解。对于游戏玩家,它的性能虽强,但游戏体验和兼容性不如同价位的“CPU+独立显卡”组合;对于专业AI开发者,其软件生态和算力又不及NVIDIA。这使得它的目标用户群体相对聚焦于那些有明确“大显存”需求,主要进行大模型推理,同时又希望设备保持小体积、低功耗的AI爱好者和特定开发者。

曾被誉为大模型神器,AMD MAX395为何从火爆走向理性?

现在大家较少提及“用AMD AI Max+ 395跑本地大模型”,并不是因为它过时了,而是因为社区已经度过了最初的探索期。讨论不再是关于“能不能”,而是深入到“好不好用”、“效率如何”以及“性价比高不高”的层面。它作为打破显存墙的先驱,已经成功在市场上开辟了一个独特的生态位,但同时也面临着性能、软件和激烈市场竞争的现实挑战。

内容由AI生成

精选参考来源

1. 现在怎么没有人提用AMD MAX395去跑本地大模型了?

现在怎么没有人提用AMD MAX395去跑本地大模型了? 其实AMD Ryzen AI MAX+ 395 在本地大模型社区里其实一直很活跃,只是讨论的重心在发生变化。其实在去年rocm7.0发布之前,

2. AMD AI Max+ 395 CPU 本地大模型推理性能评测报告

AMD AI Max+ 395 CPU 本地大模型推理性能评测报告引言近年来,随着人工智能(AI)大模型在自然语言处理、代码生成及知识问答等领域的广泛应用,硬件平台的计算性能面临着前所未有的挑战。为了

3. 现在怎么没有人提用AMD MAX395去跑本地大模型了?

现在怎么没有人提用AMD MAX395去跑本地大模型了? 纯跑LLM的话,除DGX Spark和M5 Max(他们规模过关且有Tensor Core)的所有统一内存方案在算力上都是不及格的。放在25年

4. AMD通过Cline代理,测试了20多个本地代码生成模型,最终得出实用推荐:- 32GB内存:Qwen3-Coder 3...

AMD通过Cline代理,测试了20多个本地代码生成模型,最终得出实用推荐:- 32GB内存:Qwen3-Coder 3... AMD通过Cline代理,测试了20多个本地代码生成模型,最终得出实用推

5. 现在怎么没有人提用AMD MAX395去跑本地大模型了?

现在怎么没有人提用AMD MAX395去跑本地大模型了? 讲真,AMD这几年的运气一直都比Intel好。如果不是内存涨价,这玩意直接就被Intel一波给淘汰了。我们知道AI MAX+这套统一内存成本是

6. ROCm 7.0.2——他终于让AI MAX 395像块AI芯片了

ROCm 7.0.2——他终于让AI MAX 395像块AI芯片了 可以说Strix Halo这个芯片一直风雨飘摇当初AMD Ryzen AI Max 395,代号“Strix Halo”,号称AP

7. 【天钡AMD 395迷你工作站开卖:性能狂飙140W、要价14999元】基于AMD锐龙AI Max+ 395的迷你AI工...

【天钡AMD 395迷你工作站开卖:性能狂飙140W、要价14999元】基于AMD锐龙AI Max+ 395的迷你AI工... 【天钡AMD 395迷你工作站开卖:性能狂飙140W、要价14999元】

8. 弃用 ROCm!锐龙 AI Max+ 395 用 Vulkan 跑 Z-Image-Turbo 终极方案

弃用 ROCm!锐龙 AI Max+ 395 用 Vulkan 跑 Z-Image-Turbo 终极方案 弃用 ROCm!锐龙 AI Max+ 395 用 Vulkan 跑 Z-Image-Turbo

9. AMD AI MAX 395 编译安装llama.cpp:ROCm环境下的兼容性实测

AMD AI MAX 395 编译安装llama.cpp:ROCm环境下的兼容性实测 上次直接下载了vulkan版本的llama.cpp,还用了docker,这回我们从源码编译安装ROCM版的llam

10. 听说以前mac自信的去碰瓷4090,现在跑跑大模型有哪个mac能秀一下秒杀4090的速度吗?

听说以前mac自信的去碰瓷4090,现在跑跑大模型有哪个mac能秀一下秒杀4090的速度吗? 苹果放弃M4 Ultra,基本上意味着已经放弃跟Nvidia拼算力。而最新的M5 Max,图形性能也就RT

11. 无限Tokens免费用!OpenClaw的最佳硬件拍档:AMD锐龙AI Max+ 395平台

无限Tokens免费用!OpenClaw的最佳硬件拍档:AMD锐龙AI Max+ 395平台 无限Tokens免费用!OpenClaw的最佳硬件拍档:AMD锐龙AI Max+ 395平台微型计算机17

12. AMD能不能完美运行pytorch?

AMD能不能完美运行pytorch? 能跑,但别指望能像NVIDIA那样丝滑。你如果为了省那点显卡钱,最后买了AMD,你跑深度学习的时候会折腾到怀疑人生。2025年9月,AMD终于发布了ROCm 6.

13. AMD AI 395 显卡 LLM 推理测试:LLAMA.CPP的Vulkan 与 ROCM 后端对比

AMD AI 395 显卡 LLM 推理测试:LLAMA.CPP的Vulkan 与 ROCM 后端对比 AMD AI 395 上市已经有段时间了,正好赶上这几天 ROCM 7.1 更新。折腾了一周下来

14. 性能强过台式机处理器!这颗锐龙AI神U强到逆天

性能强过台式机处理器!这颗锐龙AI神U强到逆天 性能强过台式机处理器!这颗锐龙AI神U强到逆天中关村在线1759359084 【ZOL中关村在线原创评测】AMD锐龙AI Max+ 395处理器的性能我

15. 统一内存打破显存墙 实测AMD锐龙AI 解锁本地AI新可能

统一内存打破显存墙 实测AMD锐龙AI 解锁本地AI新可能 统一内存打破显存墙 实测AMD锐龙AI 解锁本地AI新可能科技思维1771398651 当ChatGPT还困在聊天框里写代码时,能直接操作系

16. 搭载AMD锐龙AI Max+ 395!零刻GTR9 Pro迷你AI工作站图赏

搭载AMD锐龙AI Max+ 395!零刻GTR9 Pro迷你AI工作站图赏 搭载AMD锐龙AI Max+ 395!零刻GTR9 Pro迷你AI工作站图赏驱动之家1759235482 快科技9月30日

17. 买 5090 笔记本还是 aimax+395 笔记本?

买 5090 笔记本还是 aimax+395 笔记本? 直接买5090的游戏本是合适的,幻X一方面是这个CPU玩游戏表现并不强,其次是比较尴尬,跑小模型用不到,跑大模型兼容性和性能又不如N卡了,且AM

18. NVIDIA DGX Spark vs AMD Ryzen AI Max+ 395 详细对比清单

NVIDIA DGX Spark vs AMD Ryzen AI Max+ 395 详细对比清单 NVIDIA DGX Spark vs AMD Ryzen AI Max+ 395 详细对比清单登山的

19. 在北大参加AMD举办的高校“春雨”计划启动会,为深化AI教学,创建高校创新生态,培育科技人才而赋能。来自清华、北大的教授...

在北大参加AMD举办的高校“春雨”计划启动会,为深化AI教学,创建高校创新生态,培育科技人才而赋能。来自清华、北大的教授... 在北大参加AMD举办的高校“春雨”计划启动会,为深化AI教学,创建高校创

20. 颜值性能都很能打!桌面AI超算全能选手驾到:abee AI STATION 395 MAX迷你液冷AI工作站测评

颜值性能都很能打!桌面AI超算全能选手驾到:abee AI STATION 395 MAX迷你液冷AI工作站测评 颜值性能都很能打!桌面AI超算全能选手驾到:abee AI STATION 395 M

21. 屏幕,目前最大的也就18英寸。键盘,用起来并不舒服。性能,弱于台式机。性价比,比较弱。笔记本唯一的优势是便携。数字游民,...

屏幕,目前最大的也就18英寸。键盘,用起来并不舒服。性能,弱于台式机。性价比,比较弱。笔记本唯一的优势是便携。数字游民,... 屏幕,目前最大的也就18英寸。键盘,用起来并不舒服。性能,弱于台式机。性
6
扫一下,分享更方便,购买更轻松
1评论

  • 精彩
  • 最新
  • 前段时间入手创13联名版,用于本地部署预审系统,测试了十几个模型,的确发现没有前面吹的那么好,最快的是qwen2.5,从3-32B都快,最准的是qwen3.5:35b_a3b。其他的不尽人意,不是慢吞吞就是不准,甚至胡说八道长篇大论。
    花2万应该划不来,唯一好处是便携。

    校验提示文案

    提交
提示信息

取消
确认
评论举报

最新文章 热门文章