「N卡、A卡都能用」的评论区,比视频诚实得多:7900XTX解码破105、R9700峰值160、PRO 495卖到5.2万——A卡转阵营前,先把峰值和平均分开

源自58位全网作者

12:33

两个月前还是一句反话,这个国庆被写进了教程标题

“A卡跑不了AI”——这句话在本地部署圈子里当了两年政治正确。知乎上到今年8月还有人专门发帖问"AI教程几乎全是NVIDIA CUDA,想找AMD显卡教程";B站那句"好耶,是尊贵的AMD用户能用的框架"之所以能当标题用,就是因为A卡用户平时没得用,偶尔冒出一个都得自嘲一遍。

变化集中在9月底到10月这几天:

  • 9月29日,零度解说发了一条本地部署实测,三天多播放3.3万、评论349条。哔哩哔哩

  • 10月3日,玩客笔记给出单卡极限样本,附EvalScope基准和4项调优参数。哔哩哔哩

  • 10月4日凌晨,另一位博主李不理AI-Ly在Win11上复测同一模型的日常区间,标题就是结论。哔哩哔哩

  • 10月3日,知乎也出现了8G显存跑125B的"N卡/A卡通用"部署指南。知乎

  • 往前数三周,B站"这才是单张AMD R9700跑Qwen3.8-27B的真实水平"(1.1万播放、126条评论)给出的数字是:预填充接近2000、双并发输出峰值接近160、单路峰值80以上。哔哩哔哩

连把125B搬进游戏PC的引擎自己也站到了台前:Strata开源仓库的README第一句就是"Run a 125-billion-parameter AI model on your own gaming PC",条件写得清楚。 仓库已到8741星、最后一次推送在10月3日。GitHub

但如果你看完视频就心动,建议先把那个"都能用"的评论区翻完。它比视频诚实得多。

先把这张成绩单摆全:谁、用什么、跑出了什么

把散在B站、知乎、微博上的A卡实测凑到一张表上(同一件事,单条视频只能给你自己那张卡的数字,这里一次对齐):

硬件

软件路线

数字

来源/时间

7900 XTX 24G

Strata(Win11,IQ3_XSS量化)

日常60-80 t/s

B站李不理AI-Ly,10-04

7900 XTX 24G

Strata + 4项调优(MTP投机/防断崖)

预填充峰值1319、解码峰值105 t/s

B站玩客笔记,10-03

R9700 32G(瀚铠AI PRO)

vllm-radiance + ROCm 7.14 + Linux

预填充≈2000,双并发峰值≈160,单路峰值80+

B站怀旧创新局,9-11

双R9700

张量并行+FP8 KV+碎片优化+AITER

39.1→53 t/s,提升约35%

上条视频评论区用户复现,9月下旬

9070 XT 16G

llama.cpp系,5款27B量化五连测

UD-IQ3_S融合头为16G最优解;DFlash2负优化

B站遣返千翻者,9-03

AI Max+ 395小主机

统一内存128G

“跑qwen3.6的27B最高只有20”(117赞热评);dflash版可到40+

B站橘子说科技评论区,7-19起持续

锐龙AI Max+ PRO 495主机

首发评测,跑Qwen3.8 Flash

5万档;被指"带宽对比395没涨多少"

B站白大UP,9-30(4.9万播放、361评论)

「N卡、A卡都能用」的评论区,比视频诚实得多:7900XTX解码破105、R9700峰值160、PRO 495卖到5.2万——A卡转阵营前,先把峰值和平均分开

评论区先纠正了三行字,这三行恰恰是掏钱时最容易看漏的

第一行:「峰值」不是「平均」。 玩客笔记的105和怀旧创新局的160/80都是峰值口径——后者UP主本人在评论区被粉丝拿部署结果对账时特意强调:“我视频运行的参数就是和网盘脚本里一致的,并没有改动。你的硬件配置基本和我的一样,我的也是5700x平台。你的预填充速度正常,但输出速度我不知道你是统计的是平均的,还是某一个峰值的。我视频里的数据说得很清楚,80和159都是峰值,而不是平均”。 日常体验请以60-80这一档为准。而且"数数速度"和"干活速度"不是一回事,这事N卡党早就吵过,A卡只会更明显:双R9700用户实测dflash2"容易进入乱码或无效循环",数理化80 t/s、文科只有40-50,最后换回MTP——“稳定才是王道”。哔哩哔哩

第二行:「8G显存跑125B」的真实入场券是12G显存+32G内存起步。 零度解说视频下点赞最高的硬件讨论(25赞)把可用资源和整机配置掰开算过。 因为"8G能跑"的前提是权重卸载进内存,靠的是内存硬抗,而不是显卡突然行了。7赞评论直接说"8G显存不用试了,没戏"。更扎心的追问来自一条44赞:量化后的逻辑能力衰减测过没?这条问出了A卡党目前最缺的东西——同硬件下量化版本的能力基准,目前只有9070XT那条五连测(Perplexity/MMLU-Pro/HumanEval/GSM8K+长文速度)给出了初步答案:在16G A卡上,选量化方法比选量化档位更重要。哔哩哔哩哔哩哔哩

第三行:「A卡通吃」的样本,目前约等于一张7900XTX。 “实验性质的支持7900叫支持a卡?”——这条只有2赞的评论说出了范围问题。 跑通的集中在RDNA3旗舰和Linux定制栈,主流16G卡、Windows用户、RX 6000/5000老卡还在门口排队。怀旧创新局给的答案同样限定:vllm-radiance是深度定制项目,不支持即插即用。哔哩哔哩哔哩哔哩

为什么突然"能用"了:引擎把瓶颈从显存搬到了带宽

这轮变化的功臣不是A卡变强了,而是Strata这类"内存卸载+投机解码"引擎把权重大头塞进了内存,显存只需要装活跃部分——于是GDDR6大显存卡+大容量内存突然有了性价比叙事。但它同时把天花板换成了另一根:内存带宽。R9700评论区总结得很干脆。 同一条评论串里给了参照系:R9700带宽600多,7900XTX 900多,“要是带宽也能像7900xtx那样,这张卡绝对起飞”。哔哩哔哩

「N卡、A卡都能用」的评论区,比视频诚实得多:7900XTX解码破105、R9700峰值160、PRO 495卖到5.2万——A卡转阵营前,先把峰值和平均分开

上图这种官方Monitor界面倒是把新瓶颈演示得很直白:显卡占用快顶格了,系统内存吃了几十GB,跨设备搬运却只有个位数的MB/s——决定你输出速度的早就不是"显存装不装得下",而是"内存喂不喂得起"。

生态欠账也没一次性还清:R9700那套方案要求Linux+ROCm 7.14以上;395那条54赞热评替Windows用户总结过ROCm 7的毛病。 更具体的坑在9月4日的知乎双卡实测帖里:RCCL跨卡通讯第一轮就翻车,最危险的是不报错的那种——安静地把跨卡加总算错。 折腾,仍然是A卡使用成本的一部分。哔哩哔哩知乎

涨价把"A卡便宜"的窗口掐了一半:这些数字是十月的

最反直觉的一点:等A卡生态追上来这两个月,A卡的价格也不再是当年的价了。

  • AMD官方自己先涨的:7月起Radeon全线提价10%,"A卡=性价比"的叙事从源头松了。微博

  • R9700:9月上旬入手10600元的用户等着优惠券买第二张,没等到,价格已经上去了。哔哩哔哩

  • 9070XT:和微论件9月23日那条5.5万播放的视频,标题直接发问——32G显存的卡为什么卖到了隔壁旗舰的价。哔哩哔哩

  • 连带N卡行情:8月初记者走访华强北,5060从2300-2500涨到2700-3100,"显卡跳涨"上了热搜。微博

  • AI Max 395小主机:那条4万播放的"怎么没人提395了"下面,188赞热评把涨价讲成了理财故事。 同一串里还有人提醒,“所有的统一内存的东西,都好多托,很多带货的”。哔哩哔哩

  • 迷你主机新品:10月3日刚有人把2026年新品排完,两个事实值得抄在购物页边上——钱差在内存不在芯片(2599元那台12GB、9299那台32GB、49999那台192GB);这一波内存基本焊死,出厂多大就多大;机构预判四季度内存还要再涨15%~20%。哔哩哔哩

「N卡、A卡都能用」的评论区,比视频诚实得多:7900XTX解码破105、R9700峰值160、PRO 495卖到5.2万——A卡转阵营前,先把峰值和平均分开

对照着看,小红书10月4日那篇"家用显卡千万别盲目上24G显存、8G通吃4bit-7B"的避坑笔记,只对文章的小半篇成立——它建议新手上12G,而12G恰恰是新引擎宣传里"跑125B"的最低显存档位;两头都对,但没人告诉你中间那层"内存32G起步、还得看带宽"的账。小红书

PRO 495卖5.2万:A卡阵营最新的那张牌,先替三类人算了三笔账

495这一代芯片的官方姿态很微妙:参数上就是老395的马甲,同为16大核Zen5+40CU RDNA3.5核显,内存从LPDDR5X-8000升到8533。 首发整机已经摆满货架:铭凡MS-S1 MAX-P495(192GB+2TB)定价51999元,极摩客EVO-X5 Pro开启京东预约、10月9日发售,官方宣传"能本地离线跑320B大模型";阿迈奇F9A走轻薄路线,宣称最高160GB可分配显存。知乎微博

白大UP那条首发评测4.9万播放,评论区"省流:50000一台"拿了125赞,下面紧跟的一条获得了108赞——这价格显得隔壁都极具性价比。 质疑方还有两条:一条15赞说带宽对比395"挤牙膏也不带这么挤的",回复区补刀"prefill龟速,不存在可用性";另一条看得比较毒:“其实不是设备行了,是ROCm画的饼开始兑现了,芯片就是395换皮而已。”哔哩哔哩

「N卡、A卡都能用」的评论区,比视频诚实得多:7900XTX解码破105、R9700峰值160、PRO 495卖到5.2万——A卡转阵营前,先把峰值和平均分开

35赞热评给出了个人用户的算法。 这个价位段的胜负手根本不在A还是N——是你到底有没有多人、多任务、7×24小时的负载。有的,工作室分账算得过来;没有的,5万买的是情绪,不是token。哔哩哔哩

那A卡到底能不能上车:按你手里有什么分三种

手里已经有A卡(尤其16G+):这是白捡的窗口期,该折腾。 你不用为阵营转换付任何硬件钱——Strata、Vulkan路线、MTP投机解码这两三个月集中兑现,正是"老A卡焕新"的时段。但按上面三行口径来预期:日常速度看60-80档,别拿峰值说服自己;配置按"12G显存+32G内存是入场券、带宽决定天花板"核对;量化版先看9070XT五连测那套方法论,照抄比自创省钱。另外留个心眼:有博主10月4日提到引擎配套这几天都没更新——引擎红利是动态的,观望清单里加一条"更新是否停滞"。哔哩哔哩

没有卡、被"A卡便宜"种草、准备趁国庆后下单:账已经不成立了。 32G的A卡卖到5080的价、R9700从10600涨到11600、AMD官方全线提价10%,5000+的5060Ti 16G双卡方案反而被395用户拿来当更优解——nvfp4量化速度不差、质量还更高、价格更便宜。 内存通胀面前,没有阵营只有期货。哔哩哔哩

有人晒过更省心的对照组:两台DGX Spark花5.2万,张量并行+满血DeepSeek v4跑到60 t/s,“这台除了能装下能跑,实在没啥优势”。 9赞评论那句话依然适用于大多数个人:老老实实订阅一个云端会员,这已经是你用上顶级模型的最低成本。哔哩哔哩哔哩哔哩

盯着AMD小主机(395/PRO 495)的:先确认你要的是便携还是便宜。 395的"理财产品"行情说明它已经不算便宜;PRO 495的5万定价把你直接送去和Spark、Mac Studio对桌;而两三千档的新品是12GB焊死内存——焊死意味着你永远没有反悔升级的机会,六千到一万档直接32GB起步才是那个排品视频给出的判断,四季度内存再涨15%~20%更不等人。

继续盯这四个信号

  1. Strata的A卡支持面会不会从7900XTX单卡样例扩到主流16G卡和Windows,以及它的更新频率会不会真停下来;

  2. ROCm对Windows的可用性——R9700方案强制Linux、双卡通讯还有"不报错但算错"这种暗坑,什么时候不再是默认答案;

  3. 125B量化版本的能力衰减数据——44赞的追问还在等人用五维基准给答案,出现同卡N/A对照之前,"能跑125B"和"能用125B"请分开引用;

  4. 内存报价——Q4那15%~20%的涨幅预期一旦落地,今天所有"入场券"的价签都要重打一遍。

至于A卡阵营本身——它不是变强了,是被引擎抬到了自己的带宽天花板上。而天花板这个位置,恰好是最容易让"峰值160"和"日常20"同时为真的位置。掏钱之前,先把你的卡、你的内存、你的系统这三行字填进那张表里,再决定要不要转阵营。

内容由AI生成

精选参考来源

1. 8G 显存竟能跑 125B 大模型!内存硬抗 Qwen3.8-Flash-Next,N卡、A卡都能用!本地部署实测 | 零度解说

2. 【实测】单卡24G跑84G模型!7900XTX解码破百

3. AMD显卡7900xtx 开源项目Strata win11跑Qwen3.8 Flash IQ3_XSS实测60-80t/s

4. 最低 8G 显存也能跑 125B 大模型Qwen3.8-Flash-Next 本地部署完全指南 N卡/A卡通用

5. 这才是单张AMD R9700跑Qwen3.8-27B的真实水平

6. Strata: Run a 125-billion-parameter AI model on your own gaming PC

7. 9070 XT 上,哪个量化 27B 真正能实用?Qwen3.8 五连测 + MTP 投机解码实战

8. 现在怎么没有人提用AMD MAX395去跑本地大模型了?

9. AMD决定将Radeon显卡价格上调10%,新价格于2026年7月正式落地执行。

10. 32G显存凭什么让9070XT卖到5080的价?R9700 32G本地AI实测告诉你答案

11. 【#显卡跳涨#】记者走访深圳华强北市场:5060四天最高涨约800元,5080报价超1.1万元

12. 2026迷你主机新品排完别为芯片加钱,先看内存焊

13. 2026算力避坑|家用显卡千万别盲目上24G显存

14. 解决 Radeon AI PRO R9700 不能 vLLM 双卡跑 LLM

15. AMD 锐龙 AI Max+ 495 迷你主机上市:192GB 超大内存

16. 🔥IFA 双料获奖旗舰|极摩客 EVO-X5 Pro 京东预约开启!能本地离线跑 320B 大模型的

17. 从玩具到真AI生产力,锐龙AI Max+ PRO 495首发评测

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章