9月21日开始,一篇硬件分析稿被各家媒体批量转发,标题口径高度一致:"现代英伟达显卡内部隐匿着数十个RISC-V处理器核心,甚至已经全面接管了原本由主系统CPU执行的显卡驱动管理与硬件调度工作。"相关知乎问题一天之内挂了两个进热榜,底下的回答却和媒体标题对着干:“这不都是众所周知的事了吗?为什么2026年都快过完了还有人在大惊小怪?”cnBeta知乎
一边是揭秘,一边是旧闻。对写kernel、调驱动、跑多卡的人来说,这轮刷屏值得拆成三本账。
第一本账:哪部分是四年前的旧闻,这次真正新增了什么
GSP(GPU System Processor)不是新东西。图灵(2018)就把一颗基于RISC-V的微控制器放进了GPU,安培继续扩大用途;2022年英伟达发布开源内核模块时配套做了一个大动作:传统闭源驱动里RM(Resource Manager)的任务编排、调度、指令翻译等核心逻辑,整体以固件形式搬进了GSP——所以那套"开源驱动"其实是个接口壳子,高价值的东西在闭源固件里。知乎高赞回答说的"高价值的东西都移走了",指的就是这件事。知乎
2024年英伟达在技术博客里把路线挑明了:从数据中心Blackwell开始,GSP成为强制路径,主机驱动完全依赖它工作;GeForce上GSP默认开启、暂时仍可关闭。芯智讯近期这篇梳理还提到一个不起眼的大数字:英伟达内部自研的RISC-V微控制器2024年出货量已超过10亿颗,全部用在GPU内部的低层级控制——比任何一颗对外销售的RISC-V芯片都多。芯智讯

这次真正新增的,是"数十个"这个数量和角色细分:按这轮社区深度分析的转述,新一代芯片里的RISC-V职责已经从单颗GSP扩展到显存控制器管理、电源温度监控、安全密码学、显示输出管线等多颗专用管理核,并建立了片上硬件信任根。要说明的是,"数十"来自社区分析与媒体转述,英伟达没有公布逐代核心清单,具体数字以官方披露为准——但方向是可信的:管理面从宿主机往片上搬,这条路线八年没变过,只是这次被重新讲了一遍。cnBeta
第二本账:那几十颗RISC-V核,不跑你的一行代码
这是最容易被标题带偏的地方。GPU里的RISC-V是管理处理器,不是可编程目标:
你的CUDA kernel经过nvcc/Triton编到PTX/SASS后,照样跑在SM的CUDA Core和Tensor Core上,指令集一个字没变;
GSP接管的是驱动侧杂务:命令提交路径、电源调度、显存与显示管理,换来的是宿主机CPU占用和提交延迟的下降;
对内核态真正有影响的是驱动形态:Linux上用nvidia-open内核模块跑新卡,强依赖GSP固件blob;虚拟化直通、部分底层调试路径在GSP形态下逐步受限。
所以"RISC-V接管驱动"和"RISC-V接管你的训练任务"是两回事,CUDA/Triton/CUTLASS技能栈这次的折旧是零。社区真正的分歧也不在指令集,而在固件:壳开源了、调度逻辑在闭源blob里,nouveau这条"全开源驱动"的退路在这套架构下越来越接近口号。这是立场之争,不是RISC-V的胜利宣言。

第三本账:RISC-V想给CUDA当宿主,门槛在Hot Chips 2026就划好了
如果英伟达拥抱RISC-V真有值得记账的信号,它不在die里面,而在主机CPU那头。8月底的Hot Chips 2026上,英伟达第一次系统给出了RISC-V CPU作为GPU宿主跑CUDA的"及格线":
要求 | 具体内容 | 现状 |
|---|---|---|
ISA基线 | RVA23 + RISC-V服务器SoC/平台规范(RAS、专用安全处理器) | 规范已定稿 |
固件/OS接口 | ACPI(CUDA移植的起始关键点)+ RISC-V BRS启动与运行时服务规范 | UEFI论坛2025年5月批准RISC-V版ACPI 6.6,基金会2025年8月批准BRS |
数据搬运 | PCIe I/O一致性,免掉CPU-GPU之间DMA的反复cache刷新/失效 | 硬性要求,英伟达视其为服务器CPU标配 |
多卡直写 | PCIe点对点(P2P),一张GPU显存直写另一张,不绕CPU内存 | 硬性要求 |
进机架体系 | NVLink Fusion:在以上全部之外,还要支撑DOCA、NCCL,外加与英伟达的深度合作关系 | SiFive已宣布把NVLink Fusion集成进自家数据中心RISC-V CPU |
这张单子反过来读才是重点。英伟达副总裁Frans Sijstermanns在RISC-V中国峰会上的原话是:"其实我们不在乎具体是什么CPU——x86、Arm或RISC-V都希望能兼容。"兼容的前提是:平台的钥匙(GPU、CUDA、NVLink互连)牢牢在英伟达手里,ISA只是可替换件。 chipsandcheese对这场演讲的评价也直白:绝大多数现有RISC-V硬件达不到这条及格线,第一批能跑CUDA的RISC-V宿主会是高核心数服务器芯片,不是单板——别盘算拿RISC-V开发板接5090了。芯智讯半导体行业观察

不同人该为这轮新闻做点什么
写kernel、跑训练/vLLM的:零动作。这轮架构八卦和你的编程模型、工具链无关。
Linux多卡自建:有实际影响的只有一条——新卡走nvidia-open+GSP固件已是默认形态,装驱动选对模块形态,关注直通与调试工具链在GSP下的功能边界。
盯RISC-V算力的:换观察信号。GSP固件哪天开源或可复现构建(“半开源"的试金石)、SiFive与NVLink Fusion的设计导入新闻、GeForce是否从"默认开GSP"走向"强制”,比媒体复读更有信息量。
拿"英伟达去CUDA化"做叙事的人:这次不构成证据。被抬进生态的是指令集,被守住的还是平台。
一句话收账:这轮刷屏里,"数十个RISC-V核心"算新闻,"驱动被接管"是四年前的旧闻,而真正可能动到你账本的,是Hot Chips给宿主CPU划的那条及格线——它不改变你在SM上写的每一行kernel,但会改变三年后你买服务器时CPU那一栏的选项。