8月中旬一个周四的晚上,Qwen3.8-27B 开源,第二天一早就有不少人把它拉到自己电脑上跑——然后集体卡在同一个地方:打游戏用的 5090 24G 显存刚好够用,16G 的甜品卡直接溢出。 一个月过去,这批人里动手查显卡的会发现一个更扎心的现实:全新的 32G 专业 AI 卡,市面上正规渠道基本就两张——英特尔的 Arc Pro B70,和 AMD 的 Radeon AI PRO R9700。而 B70 这边的故事线是:京东预约价 9999,开抢当天很多人连货都没见到,闲鱼转头挂出 12999;到 8 月中旬,快科技报道它"单月最高涨幅 48%"。小红书
一边是 27B、35B 级别的模型全开源了,16G 装不下、24G 跑不动长上下文;一边是算力卡一卡难求、渠道全面涨价。32G 显存正在从"奢侈配置"变成"硬通货"。这篇就把 B70 半年的行情线、四条 32G/24G 路线的最新实测、以及评论区里那些参数表看不出来的坑,全部对完说清楚。
一、B70 是张什么卡:游戏卡 B770 的重生,但卖给了另一群人
先说清楚产品,因为它和你熟悉的 B580 时代的 I 卡不是一回事。
B70 今年 3 月 25 日发布(同场还有 B65),4 月上市,首发价 949 美元。 核心是 Battlemage 架构的 BMG-G31 大芯片——就是玩家念叨了好几年的"Big Battlemage"。微博小红书
国内首发的蓝戟 B70 TF 规格如下:32GB GDDR6 ECC 显存、256-bit、608GB/s 带宽,4096 个流处理器、INT8 算力 367 TOPS,256 个 XMX AI 引擎,双 8pin、290W,双槽涡轮配均热板,PCIe 5.0 x16,满载 GPU 温度 70℃ 上下——按 KoolShare 实测时的说法,这是"为 7×24 小时长时间跑任务准备的"。 拆解看用料也不含糊:英特尔 B70 核心搭配 16 颗三星显存,8 相 DrMOS 核心供电。小红书微博
有个微博网友的感慨很准——去年心念念的英特尔 B770,就这么重生了。 英特尔游戏卡停更之后,这颗大核心换了个身份活了过来,目标用户从游戏玩家换成了跑本地模型的人。英特尔自己给 B 系列四张卡的定位说得也很直白:B50 守边缘(病历、质检、会议纪要这类 7×24 场景),B60 做创作甜点,B65 主打"显存平权",B70 是企业级 AI 中台:70B+ 模型、20 路并发、256K 上下文,SR-IOV 虚拟化能把一张卡切给多个虚拟机用。微博哔哩哔哩
二、行情时间线:这半年 B70 的价格是怎么走出来的
3 月 25 日:B70/B65 发布,B70 定价 949 美元,两张卡都是 32GB ECC GDDR6、256-bit、608GB/s。
4 月:京东上架,预约价 9999,开售即空。B站 18 万播放的首发评测评论区里有人留言实录:开抢那天他连货都没见到,随后海鲜市场就出现 12999 了。哔哩哔哩
7 月:渠道价回归理性了一阵——蓝戟 B70 TF 实测时 9000 出头(KoolShare,7 月底),铭瑄 B70 32G Turbo 万元左右(司波图,7 月初)。小红书哔哩哔哩
7 月底-8 月初:英伟达、AMD 显卡价格大幅攀升,B70 跟着涨。8 月 18 日快科技:全球渠道单月最高涨幅 48%。微博
9 月:对面 R9700 也扛不住了。深度用了它半个多月的 UP 主怀旧创新局的原话是,这卡目前还全部涨价 1000 以上了。哔哩哔哩
涨价逻辑不玄学。需求端:Qwen3.8-27B、35B MoE、MiniMax H3、DiffusionGemma-26B 这些"甜品级"模型接连开源,Agentic AI 的长上下文和 KV Cache 把显存需求顶上去,32G 成了本地玩家的入场券;供给端:AI 算力卡一卡难求,N 卡先涨、A 卡 I 卡跟涨。博主 MebiuW 8 月 18 日的点评基本就是这轮行情的注脚——B70 价格上涨幅度也不小,说明至少还是有人买的。 评论区里还有人点破了更扎心的价差:949 美元但是京东上要卖到 1W,AMD AI PRO R9700 是 1349 美元。微博哔哩哔哩
三、实测对完:B70、R9700、B65、B60 四条路线的真实水平
把 9 月最新的几份实测放在一张桌上,结论比参数表残酷得多。
B70(满血 BMG-G31,当前行情 1 万-1.3 万)
Qwen3.8 27B 单流生成 33.9 token/s,对照组 B65 是 28+ token/s(autoround 量化,司波图 9 月测试 B65 时的对照数据)。哔哩哔哩
35B 模型单卡装下,32 人并发总吞吐量狂飙 500+ TPS(前提:Linux + vLLM,司波图)。哔哩哔哩
DiffusionGemma-26B 6 并发 TPOT 15.5ms,推理速度接近 295 token/s(英特尔官方口径)。哔哩哔哩
ComfyUI 跑生产化工作流,720P 视频一分钟稳出 5 秒片(英特尔官方口径);LTX 1080P/5 秒视频 140 秒出片(司波图)。哔哩哔哩
英特尔官方 MLPerf v6.0 成绩:AI 推理比上代 B60 快 80%。微博
R9700(AMD,1349 美元,近期国内渠道再涨 1000+)
Qwen3.8-27B 单流峰值 80+ token/s,2 并发输出峰值接近 160,预填充接近 2000(怀旧创新局 9 月 11 日,ROCm 7.14 + vLLM)。哔哩哔哩
同是 32G,LLM 推理速度明显快过 B70——但 UP 主自己给的结论是"当前的性价比还是不高"。哔哩哔哩
视频生成是短板:小红书评论区有人反馈,R9700 跑 MiniMax H3 同分辨率出片时间比 5080 多一倍,光显存大没有用,生成视频这块尤其吃亏。小红书
B65(8999,B70 同款 32G/608GB/s,核心被砍掉近四成)
核心砍到 20 个 Xe2,却又给了 B70 同款的 32G 满血显存,这就是它 8999 还能站住的原因。
27B 单流 28 token/s,8-16 路常见并发能咬到 B70 九成左右。
但 MoE 模型并发一拉大就露馅:35B-A3B 总吞吐只剩 B70 的 64%,刚好对齐核心裁切比例,Prefill 全程慢约三分之一。哔哩哔哩
视频生成速度是 B70 的 60-70%,慢,但不爆显存、也不向内存疯狂 Offload。
没缩水的部分很值钱:原生 4:2:2 10-bit H.265 硬解,达芬奇剪 4K/8K 多机位不用转代理;不开压缩单人拉满 256K 上下文,多会话共享 KV Cache 能撑到 440K 左右。
B60(不到 6000,24G)
入门票,往下有不到六千的 24G B60,往上有声量最大的满血旗舰 B70。 单芯 24G 覆盖 7B-32B 模型、3D 渲染、4K 剪辑的甜点位,双芯版拉到 48G。 核心规格和 B65 一样是 20 个 Xe2——所以"B65 的显存 + B60 的算力"这个调侃是准的。哔哩哔哩哔哩哔哩
一句话总结这张桌:论 LLM 推理速度 R9700 > B70 > B65 ≈ B60;论价格 B60 < B65 < B70 < R9700;论"用最低成本把 32G 模型装进去" B65 和 B70 并列;论出片速度,全都别跟 N 卡较劲。
四、生态实况:比参数更该看的三句评论区
小红书上那个"纯玩视频生成选 B70 还是 R9700"的提问帖,起因就是 4080S 魔改卡没保修,而且两张卡的生态支持也都不怎么样,26 条评论基本就是本地 AI 圈的一次民意调查,比任何评测的总结陈词都真实。小红书
第一句:AMD 的 ROCm 还行,Intel 还没有那么好。 ROCm 这两年对消费级卡的支持确实在补课;而 I 卡的 AI 栈(OpenVINO、IPEX-LLM、vLLM 的 Xe 后端)还在追赶,所有出成绩的测试几乎清一色是 Linux 环境——司波图那期 500+ TPS 的成绩单,前提就是"逃离 Windows 生态封印,切入 Linux vLLM"。 Windows 下双击就能跑的体验,目前只在 N 卡上成立。小红书哔哩哔哩
第二句:老老实实英伟达,别给自己找事。 CUDA 的生态位暂时没有替代品。如果你的工作流里全是别人写好的 Windows 闭源节点,I 卡 A 卡都能让你折腾到怀疑人生——B站就有"I 卡跑 AI 折腾半天放弃"的实录视频。选 B70 之前先问自己一句:装过 Linux 吗?愿意看命令行文档吗?小红书
第三句:4080S 魔改 32G 是隐藏选项。 价格便宜、显存管够,但全是二手渠道,没保修或只有店保。评论里有人店保换卡很爽快,也有人直接劝退——这是在买卡还是在赌,自己掂量。
另外两个容易踩的信息差:其一,B70 今年 4 月才拿到英特尔给适配的游戏驱动,老外实测 4K 游戏"能玩"——它是能打游戏的 AI 卡,不是能跑 AI 的游戏卡,顺序别搞反。 其二,也别觉得 32G 就到头了,评论区同样有人提醒"跑个完整流程 32G 不够,还是要用到内存",显存溢出的恐惧不会因为你上了 32G 就彻底消失。哔哩哔哩
五、算笔账:一万块的卡,和云端租用
英特尔官方算过一笔账:云端生成一个视频片段几块钱,一天几百个,一年就是几万块。 这话反过来同样成立——如果你一天只生成两三个片段,或者一个月才碰一次 27B 模型,这 1 万块够你按次付费租好几年。哔哩哔哩
所以真正的分界线是使用频率和隐私需求:每天都在跑、素材不能出门(公司数据、客户内容)、或者要长时间挂着多路并发服务,本地卡的钱花得值;偶尔尝鲜,云端永远更便宜。B70 那个 SR-IOV 的玩法,本质是把一万块的卡掰成七份云桌面——司波图实测里它"原生支持 SR-IOV 硬件级直通,无痛一卡分七",这是它比 R9700 多出来的想象空间,但前提是你真有七个用户要喂。哔哩哔哩
六、分人群结论
会折腾 Linux、以 LLM 推理为主、预算 1 万:B70 按 9999 原价抢到就是值;要加价到 1.3 万就算了——那个价位 R9700 的推理速度几乎是它两倍多,除非你明确需要 SR-IOV 虚拟化和双 Xe 媒体引擎。
要 32G 但预算卡死 9000:B65。8999 的定价到这周还没怎么动,长上下文、多会话 KV、剪辑硬解这些场景一点不虚,只是别拿它跑高并发 MoE。
预算 6000:B60 24G,别硬凑 32G。
以 ComfyUI 视频生成为主、要出片速度:这轮 I 卡 A 卡都不建议——生态和速度都在 N 卡这边,连 R9700 都比 5080 慢一倍。
什么都不想折腾:等这波算力卡荒过去,或者直接租云端。
继续观察的信号给你三个:B70 在京东的补货价格能不能回到 9999;R9700 现货能不能涨势刹车;Qwen 下一代的开源尺寸和量化方案。三个里有两个好转,再上车不迟。而在 10 月 5 日 CPU 第三轮涨价、显卡内存全线走高的这个秋天——供应链人士的原话是"暂定 10 月上旬再涨 10%"——"显存即门票"这件事,大概只会越来越贵。东方财富网