「省流表」两天就失真:P4断货、MI50的32G版涨飞、170HX破万——垃圾佬上车AI捡漏卡前,先把「涨、配、量、炸、路」五本账对完

源自135位全网作者

10-06 19:47

8月29号,B站UP主SPOTLITE发了条"垃圾佬畅玩AI,10张百元级AI神卡推荐",评论区置顶的省流清单被顶上146赞,视频本身4万播放、1622收藏——这个收藏数什么概念:垃圾佬们不是在点赞,是在把这张表当采购单存。清单写得明明白白:100元内P104-8G、200元内P102-10G、300元内P4-8G、400元内P100-16G SXM2、500元内M40-24G、600元内MI50-16G、700元内V100-16G SXM2、800元内90HX-10G解锁、900元内3060M-12G、1000元内T10-16G。哔哩哔哩

「省流表」两天就失真:P4断货、MI50的32G版涨飞、170HX破万——垃圾佬上车AI捡漏卡前,先把「涨、配、量、炸、路」五本账对完

然后这张表只活了两天。8月30号起,评论区就在纠偏:“都涨价了,有些这个价格买不到了,比如P4”;“很多卡都涨了,这个价根本拿不下来,像P100 SXM2,300多最多就裸卡,想全套是不可能的”;“3060M 800多块钱只能买到6G显存版本的了”。哔哩哔哩

另一条650元矿卡实测视频下面,9月底有人对账:“我用MI50 32G就直接上Q6了,去年900买的卡”,紧接着补刀:"看了一下16G没涨,32G的涨飞了。"还有更扎心的:“170HX我是看着从5000到现在10000+,年初它只要1000”。 省流表变回忆录,这才是垃圾佬今天真正要面对的现场:AI行情把涨价从内存、硬盘一路传导到了本来无人问津的二手计算卡上。动手之前,先把"涨、配、量、炸、路"五本账对完。哔哩哔哩哔哩哔哩

第一本账:涨价账——按挂牌价排不行,得按每GB显存重排

这张表不是纸上谈兵:更早的7月,UP主TualatinPentium就用700块配出五张P104的集群,标题起得很直白——“700大洋超低成本五卡P104集群大战大模型”,7.2万播放。省流表按"多少钱"排档位,但老卡的差距不在价格数字,在每GB显存的单位成本。拿表里的档位上限换算一下:哔哩哔哩

卡(省流档位)

档位上限

每GB显存约

社区最新价格信号(评论区实报)

P104-8G(≤100元)

100

12.5元

7月有人700元配齐五卡集群跑大模型

P102-10G(≤200元)

200

20元

评论区在问"P102能不能解锁1×16"——通道还被砍

P4-8G(≤300元)

300

37.5元

“这个价格买不到了”,第一个失真

P100-16G SXM2(≤400元)

400

25元

“300多最多就裸卡”,全套不可能

M40-24G(≤500元)

500

20.8元

暂未见集中报涨

MI50-16G(≤600元)

600

37.5元

16G与32G走势分化,32G版"涨飞了"

V100-16G SXM2(≤700元)

700

43.75元

裸核心530+转接板180+散热≈700+;"改好的"一千多

90HX-10G解锁(≤800元)

800

80元

解锁玩法热度还在,档位价已难找

3060M-12G(≤900元)

900

75元

“800多只能买6G版”,12G档名存实亡

T10-16G(≤1000元)

1000

62.5元

9月有人999收A3000,发现"魔改卡更新不了驱动"

按元/GB重排之后,两个反常识出来了。第一,省流表里"最便宜"的P104-8G(12.5元/GB)确实是单位显存最便宜的,但它同时是"无头卡"——便宜的另一面是砍掉的显示输出和被限制的精度,评论区有人实测"最终输出效果比1063差点"。第二,真正被涨价行情咬住的是大显存档位:MI50里16G没动、32G"涨飞",170HX从1000干到10000+,说明市场正在用真金白银抢"能跑27B及以上模型的显存量"。换句话说,你多花的那几百块,买的不是卡,是显存。省流表该更新的第一件事,是把每GB成本列加进去,再决定追哪档。哔哩哔哩

「省流表」两天就失真:P4断货、MI50的32G版涨飞、170HX破万——垃圾佬上车AI捡漏卡前,先把「涨、配、量、炸、路」五本账对完

第二本账:生态账——"能插上"和"能跑起来"差一个操作系统

省流表只报了价格,没报每张卡背后的隐性成本。评论区翻下来,至少三类坑。

无头卡类(P104/P102):矿卡出身没有视频输出,纯推理插上去能用,但驱动、通道(P102的1×16解锁至今是评论区提问)都要自己趟。想清楚了再上,没想清楚就是捡了张需要自己配"操作系统级教程"的卡。

AMD老架构类(MI50):这是省流表最"隐身"的坑。评论区有懂哥把gfx906架构的现状说得很死:MI50和Radeon VII属于gfx906,“Win11已经不行了,只能ROCm 5.7,但5.7已经无法编译llama.cpp;therock有人提交了Win11支持的issue,处理一年了还没有下文”,Windows上只能vulkan、实测很慢。也就是说,MI50的正确答案是Linux——评论区晒出来的成绩全在Ubuntu上:双MI50跑Qwen3.8-27B,q6量化25-30 t/s,有人用Docker+ROCm 7.1.4跑通,“魔芋接入挺省事的,照着文档配一遍就通了”。冲着省流表⑥那档600元预算进、又只想在Windows上即插即用的,这账对不上。哔哩哔哩哔哩哔哩

SXM魔改类(P100/V100 SXM2):省流表给的是"裸核心"价。评论区34赞那条算得很细:V100-16G核心530多,SXM转PCIe卡板180左右,再加散热,“差不多要将近700多以上,很接近800了”;直接买改好的一千多。底下那条回复是这轮行情里最清醒的一句话:对动手能力极强的人,魔改、刷BIOS、焊线可以压到很低;但对需要用它的人来说——“买的价格低了又容易炸,买高了性价比又低”。SXM档适合会修的,不适合想省事抄作业的。哔哩哔哩

第三本账:量化账——“跑得动"不等于"用得了”

这是两个视频评论区吵得最凶的一仗。那条650元MI50跑Qwen3.8-27B的视频,UP主晒的成绩是"速度接近30token/s,prefill速度100token/s",但因为用了q3量化,评论区被追着质疑:“跑q3就不要害人”、“Q4以下是人用的吗?就为了输出速度好看,不管质量,结果写个代码全是bug,不停的改,最后总用时不如Q4以上的量化模型”。评论区另一头把理由摆得很直白:“这显存Q4也放不下,跑不了多长上下文”“视频用q3是为了实际显存情况选的量化版本”;后来还有人补发了q4量化实测,结论同样不宽松——“Q4这显存也跑不了多长上下文了”。哔哩哔哩

两边都对,这才是这本账的关键:百元级老卡的问题从来不是"能不能跑27B",而是"跑起来的那点余量,要花在量化精度上还是上下文长度上"。同样的钱,评论区给出了两条被实测过的路:单张650元MI50,30 t/s上下、prefill只有100 t/s(“prefill速度你是基本不提啊?“这条质疑下面,回复很干脆:这卡硬伤,只有换带tensor core加速单元的卡);而加到双V100 16G SXM2,同一批人晒出的数字是prefill 1200-1400 t/s、decode 83-100 t/s、180k上下文。30 t/s和100 t/s之间隔的不是模型,是你等一段长文生成的那几分钟。想清楚了再掏钱:你是要"能对话”,还是要"能干活”。

第四本账:炸机账——省流表下面没人报价的是电源、通道和噪音

捡AI卡和捡内存不一样,一次是多卡、满功耗、24小时跑。评论区列出来的隐性清单:1250W矿龙电源180块,“真不怕炸吗”——回复是"矿龙不行,缩水太厉害容易炸"。多卡互联的功耗也被算过账:“在往上多卡互联都要1千多瓦的电功耗”;玩到后面想上大点的模型,发现"最缺的是pcie通道",有人靠1分4的PCIe扩展坞续命。双卡的改装账也有人晒得明白:小红书有人用E5 2696v4(304元)+两张2080Ti 22G(1840元+2250元)+NVLink桥(245元)整机堆到8298元,就因为第二张卡挡住第一张的风道,公版卡直接改成水冷、另一张拆掉原装导流罩自己建模打印了外置导流罩——省流表不会告诉你,双卡位之后每一分风道和线材都是钱,机箱背面走线最后"成毛线球"是这套玩法的日常。哔哩哔哩哔哩哔哩小红书

「省流表」两天就失真:P4断货、MI50的32G版涨飞、170HX破万——垃圾佬上车AI捡漏卡前,先把「涨、配、量、炸、路」五本账对完

最诚实的还是小红书那位4月就搭出5000元AI Agent桌面的SPOTLITE本人:主服务器用2012款MacPro改的(双X5675+64G D3+双MI50+2080Ti),他自己写的评价是"噪音极大,功耗极高,流放阳台让他自生自灭"。副服务器tiny5+P4整机800元,跑Gemma4 E4B,prefill 1000 t/s——小卡干小模型的活,这套分工比省流表更接近成品形态。小红书

第五本账:路线账——四条路,各有各的对不起

尝鲜党(预算≤300,Windows党):省流表前四档对你已经没有意义——P4、P100 SXM2的档位价两天内就被评论区证伪,无头卡和Linux门槛还在。想摸到本地大模型的边,评论区共识是P104档+小模型:“如果说只是尝鲜本地部署,还是P104-100是最划算的”,跑7B级模型没有问题,但要接受它是玩具;或者直接用现成的百元级小主机+API混合,别碰SXM。哔哩哔哩

主力党(预算600-1300,双卡位):双MI50是这轮实测密度最高的方案(Ubuntu+ROCm/Docker,25-30 t/s跑27B),但这是Linux方案,进门前先确认你愿意装系统。愿意折腾且吃得出长上下文价值的,V100 SXM2档买"改好的"比买裸卡划算——裸卡省的那200块,是给会焊线的人准备的。

显存党(预算2000-10000,四卡位起):T10×4组64G是条被晒过的路——9月有人用技嘉G292服务器"4卡合体64G纯血大显存",从零装配到vLLM跑通大模型实测。另一条是双2080Ti 22G+NVLink:评论区12赞晒过"2张2080ti/22g跑qwen3.8-27b fp8权重,fp16 kv mtp2解码速度能跑到40+ t/s",还有晒全套含V100"总共就花了不到1万"的。9月小红书"极客老猫"给出第三条:8张2070级旧卡总显存64G,自制开放式机架"显卡住楼房"兼顾静音散热,unsloth部署Qwen3.8-27B、Q6量化200k上下文跑30 t/s,后来改用vLLM把生成速度提到120 t/s——代价是关视觉、上下文压回131k,且普通主板的预填充还是慢。这本账的关键词是PCIe通道:平台撑不住,卡越多越白搭。哔哩哔哩哔哩哔哩小红书

「省流表」两天就失真:P4断货、MI50的32G版涨飞、170HX破万——垃圾佬上车AI捡漏卡前,先把「涨、配、量、炸、路」五本账对完

劝退清单:打算7×24挂Agent干活的,先算电费再算卡费——评论区API党的说法是"API接个Agent,半个小时,肉眼可见的15块钱就没有了",本地党反手就是"哪怕你有3000瓦,一个小时也就一度多电几毛钱",两笔账都成立,差别在你每天烧多少token:烧得少,API真省心;烧得多、还要处理公司保密数据(“你不用别人要用”),本地才有存在意义。另外,指望q3/q4老卡产出直接当生产力的,先回去读读"写代码全是bug"那条——修复bug的时间也是成本。哔哩哔哩

最后,盯这几个信号

省流表的失真速度本身就是行情仪表:每次伸手前,按表逐张重新询价,凡是评论区出现"这个价拿不下"的档位,默认已经失真;其次盯gfx906的Windows支持进度(那个提交一年没动的issue)、“A100大船"何时靠岸——评论区已经有人"只敢等A100,就怕那个时候A100还高高在上”、以及双11前后新卡渠道价对老卡大显存档位的挤压——MI50 32G"涨飞"的逻辑是新需求在抢显存,不是这批卡在变值钱。哔哩哔哩

垃圾佬的老规矩从来是"价格表是昨天的,成交价是今天的"。这轮AI捡漏区,省流表只给了你十张卡的名字,没给的是每GB显存的真实成本、一个装不上的Windows系统、和一颗不知道什么时候炸的矿龙电源。五本账对完再伸手——这个区子先涨价的不是卡,是信息差。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章