ROCm 10推送一周,A卡本地AI从"平等殴打用户"被吹到"填平CUDA":9060XT出图2分钟、5090只要20秒——9070XT党、6000系老卡党、想买卡的,先把速度、路线、门槛三本账对完

源自218位全网作者

04:37

这周A卡圈的情绪是分裂的。

一边是标题已经飘上天:B站科技区的视频直接喊出"AI把CUDA的护城河填平了",理由是ROCm 10在九月中旬正式推送,配合Advancing AI 2026上MI500开放OEM那一波余温,看起来AMD的AI软件栈真要起来了。 另一边,被ROCm折腾了七八年的老A卡玩家在微博底下幽幽补一刀:“ROCm平等殴打每一个用户”。哔哩哔哩

夹在中间的,是这么一群人:手里一张9070XT或者9060XT,平时主打游戏,眼看着N卡党这半个月在本地跑Qwen-Image-2.1——9月20日前后开源的新文生图模型,int8量化版8G显存就能跑,B站教程播放量动辄三万。心里痒,又不敢动:现在上了ROCm 10,A卡本地AI到底是"真香",还是又一轮"折腾三天、跑通即巅峰"?

我把这周能翻到的实测视频、评论区、渠道报价都过了一遍,先把结论放前面:能玩了,但"能玩"和"玩得爽"之间还隔着三本账——速度账、路线账、门槛账。一本本对。

ROCm 10推送一周,A卡本地AI从

先把时间线捋直:这波热度是两层叠出来的

先澄清一个容易被标题带偏的点:Advancing AI 2026大会本身是7月23日在旧金山办的,不是这周的事。EPYC新代、Meta定制版MI450、Helios机架系统,都是那一场的东西。

九月这波二次发酵,实际是两个新变量叠出来的:一是ROCm 10真正推送到了用户手里,博主实测确认RDNA4架构的9070XT、R9700都在支持列表里;二是9月21日美股那天AMD市值史上首次破万亿,AI叙事情绪拉满。 装机猿直播间有观众感叹"完犊子了,AMD又接AI大单了"——实际上查了一圈,9月下旬并没有新签的订单公告,观众说的是OpenAI(6GW框架协议)、Meta(最高600亿美元采购)、Anthropic(2GW)这一摞存量协议叠加出来的情绪。 但这些单子都是数据中心的Instinct,跟咱游戏卡的关系,后面价格账里会说。哔哩哔哩哔哩哔哩

对本地AI党真正有关系的,就是一句话:ROCm 10推送了,而且这次轮到了消费级A卡。

第一本:速度账——"能出图"是真的,"几分钟能出图"也是真的

先看A卡这边这周最有信息量的一条实测。B站UP主"AMD算力极客社"9月22日发了Qwen-Image-2.1的AMD GPU实测,评论区吵得很典型:出图慢的吐槽直接被顶上去,还有人嘲"等于叫大家一定要用N卡",UP主随后澄清——那个数字包含冷启动时间。 更有参考价值的是评论区里拼出来的碎片:9060XT 16G配ROCm 7.14、官方ComfyUI,图生图2分多钟一张;480p分辨率、q4+w4a8量化下,速度约1.23秒/it。哔哩哔哩

再看对照组。N卡那边的爆量教程里,2070出一张图约2分钟,5090约20秒。

也就是说:A卡中端卡目前的实际出图速度,大概落在N卡上代中端"分把钟一张"这个档位——能用,能出图,能截图发群里,但离"爽"还有数量级的差距。而且冷启动在A卡这边是个绕不开的变量,每次改工作流、换模型都可能重新等一遍。

ROCm 10推送一周,A卡本地AI从

顺便泼一盆冷水给"CUDA护城河崩了"这个说法。36氪那篇《CUDA 20年护城河一个周末崩了》,讲的是Anthropic用Claude自主调试在MI355(数据中心卡,一颗顶你一台车)上跑通推理的事,跟游戏卡基本无关。知乎这周也有高赞答主在相关话题下提醒:hipify这类翻译工具一直存在,把CUDA代码翻译成HIP从来不是难点,卡脖子的从来是基础库的性能和生态。A卡现在补的是"能跑","跑得跟N卡一样快"还早。

第二本:路线账——Linux原生是坦途,Windows党还得再忍忍

B站UP主"机智罗_LX"9月23日发了《ROCm10.0与7.13实测:ComfyUI四大模型硬核对比》,这是目前中文圈对ROCm 10最硬核的一条横向对比,三千多播放、160多个赞,评论区全是干货。 几个关键情报:哔哩哔哩

一是ROCm 10在WSL下目前相当难用——有用户反馈加载要400秒,还存在双核CPU打满100%的bug(修复PR提了但还没合并进正式版)。二是sageattention这类N卡玩家习以为常的加速库,A卡上编译不过。三是有玩家干脆用AI自己写了个加速库补位——很极客,但你也闻得出这股"自己动手、丰衣足食"的味道。

好消息是RDNA4有两个补位:ComfyUI自带的kitchen attention在RDNA4上的表现,按微博博主@水鱼的说法"比sageattention还快";另外ROCm 10原生支持Linux,Ubuntu下装起来是目前最稳的路径。Windows党如果手里是AI Max 395这类核显大内存平台,路线也是绕的:装驱动→WSL装Ubuntu→装ROCm→装桥接层→装ROCm版PyTorch,UP主"北冥有鱼"有完整教程,但 ROCm 7.2.1起步的版本要求摆在那。

ROCm 10推送一周,A卡本地AI从

所以路线账的结论很清楚:想现在就玩,装个Ubuntu双系统是最短路径;只想留在Windows里点鼠标的,建议再等一两版,或者等评论区都在催的"v6整合包"落地再动手。

第三本:门槛账——你的卡在不在牌桌上,以及现在买卡贵不贵

先看名单。这轮ROCm 10的主角是RDNA4全家:9070XT、9070 GRE、9060XT、R9700。评论区有6000系用户反映官方ROCm支持停在6.4(这是社区口径,官方release notes我没核实到,老卡党动手前自己再查一眼)——6000系及更老的A卡,这波先别开香槟

再看价格,这才是最扎心的部分。想"为AI专门添一张A卡"的,现在进场成本被AI叙事抬高了:

  • R9700:32G显存跑AI确实香,但评论区原话是"狗东已涨2k、产量很低",挂牌11999的行情前几天聊过,不重复展开。哔哩哔哩

  • 9070 XT:渠道活动价从9月8日的5250元走到9月21日的5780元(魔鹰,还要淘金币抵扣),京东自营挂牌已经挂到7788元,渠道和自营的价差大到像两个世界;

  • 背景:8月初AMD就通知AIB供货价至少上调10%,装机圈普遍预期下代A卡要推迟到2028年——“AI太挣钱,消费端更新迟缓”。

这么一算,纯为跑本地AI买A卡,目前是不划算的:你要花N卡同级的钱,接受分钟级出图、Linux折腾和加速库残缺。A卡AI的正确打开方式只有一种:一张卡游戏、AI两开——白天9070XT打2K高刷,晚上Ubuntu里跑跑图、试试小模型,边际成本几乎为零,这才是这波ROCm 10给游戏党的真实红利。

进阶玩家还有更务实的邪路:有人用9070 GRE加9060XT双卡凑28G显存跑35B大模型,也有人R9700配3080Ti搞A/N混跑llama.cpp——ROCm补齐之后,A卡当"显存池"、N卡跑加速,反而是眼下性价比最高的本地大模型路线。

对完账,各回各的座位

  • 手里有RDNA4(9070XT/9060XT 16G):值得折腾一把,Linux优先,速度预期放平——跑通、能玩、能晒图,别拿5090当假想敌;等v6整合包出来再动也完全来得及。

  • 6000系老卡党:官方路线按社区口径基本到头了,要么蹲社区整合包,要么把ROCm 10当别人的热闹,别为它专门花钱升级。

  • 想买卡跑AI的:先问自己要什么。要"最快出图",N卡仍是最短路径;要"游戏+AI一张卡解决"、且能接受分钟级出图,A卡可以进清单,但现在这个溢价下,只建议本来就要换游戏卡的人顺手考虑,不建议为AI单独加钱。

  • 继续观察的信号:ROCm 10.x会不会出原生Windows支持;sageattention这类加速库能不能补齐;v6整合包什么时候发;R9700和9070 XT的现货价格会不会继续被AI需求抬——这四个信号里任何一个落地,上面三本账都得重算一遍。

一句话收尾:CUDA的护城河这周并没有塌,但A卡至少已经游到护城河中间了。对折腾党来说,这就够玩一阵了。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章