英伟达股价刚刚结束了2022年以来最长的一轮连跌。微博就在那一天,它收到了一封"战书"。
8月25日,OpenAI官宣:自研推理芯片Jalapeno在公开基准测试里跑赢英伟达现役旗舰GB300,赢的是单位功耗可处理的AI工作量、响应延迟两项硬指标,而GB300此前一直是这套测试系统里排名第一的产品。华尔街见闻小红书当晚就出现了"英伟达护城河似乎被打破了"的笔记。小红书知乎也有人开问:这会给AI算力市场带来哪些改变?知乎

再叠加英伟达上周的七连跌。微博还有"一夜蒸发万亿元"的热搜,以及8月27日凌晨就要发布的财报,很多人的心态已经写在脸上了:这次是不是真要伤到黄仁勋了?
先说结论:叫板是真的,但翻完大客户自研芯片的四轮前科,这事更像"算力通胀战的第二战场",而不是护城河崩塌。理由一条条说。
先把标题党没说的三个细节补上
跑赢是真的,但有三个前提。
第一,这是OpenAI自己跑的测试。据华尔街见闻援引彭博报道,OpenAI用公开基准测试系统,拿自家一款小型开源模型,加上DeepSeek和月之暗面的第三方模型做测试,其中在月之暗面最大的Kimi模型上优势最明显。华尔街见闻赛道是真的,但毕竟是选手自己报的成绩。

第二,对比的是GB300,不是英伟达最新一代Vera Rubin。后者刚开始出货,没有进入这次测试。所以这次是"赢了今天的英伟达",还没到"赢了下一代英伟达"。
第三,Jalapeno只做推理,不碰训练。训练大模型是英伟达的核心腹地,OpenAI自己门儿清。OpenAI芯片负责人Richard Ho的原话也很坦诚:公司对算力的需求极为庞大,多供应商策略还会持续一段时间,“英伟达是非常好的合作伙伴,我们持续需要大量英伟达产品”。华尔街见闻
但Jalapeno的真本事也别装看不见:700瓦功耗,不用在吞吐量和延迟之间做取舍,部署时间表已经明确到2026年底前。微博第二代芯片"未来几个月"流片,第三代已经启动概念设计——而且OpenAI明说,这颗芯片是用自家AI模型加速研发出来的。这个节奏,不是PPT芯片。
四个前辈:开局都很猛,结局都一样
OpenAI不是第一个想"自己造"的大客户。四轮前科的成绩单摆在这:
谷歌TPU,最早也最深。从2016年的推理芯片做到今天能大规模训练,迭代了十年,是公认最成功的自研AI芯片。但同期,英伟达GPU一直是谷歌云的标配产品,谷歌也一直是英伟达最大的客户之一。
亚马逊,从2019年的Inferentia到后来的Trainium,自研芯片迭代了好几轮,但AWS上跑的主流算力实例,今天仍然是英伟达GPU。
Meta的MTIA,2023年发布,定位非常克制——只接推荐、推理这类内部负载。与此同时,扎克伯格把英伟达GPU的采购目标越写越大,一年买几十万张卡。
特斯拉Dojo,结局最有说服力。这个自研训练芯片项目,2025年8月被特斯拉正式解散,团队各奔东西。
四个前辈指向同一条规律:自研芯片能把"自家模型自家跑"的推理成本打下来,但从没拦住英伟达账单的增长。原因不复杂,就三条:
一是算力需求的增速快于替代的增速。OpenAI坚持多供应商,恰恰说明需求大到单一来源根本喂不饱,自研芯片吃的是"增量采购",不是存量。
二是训练生态动不了。CUDA、NVLink、机架级方案加上一年一代的迭代速度,不是单个客户带一家代工厂几年能追平的。
三是自研芯片也卡在同一个供应链里。HBM内存、先进封装的产能,正是眼下让英伟达都被逼着涨价的那个瓶颈——这一点,下面还要说。
所以微博上有财经博主说得直白:看到"OpenAI自研"就想到"利空英伟达产业链",是把事情想简单了。微博
但英伟达真正该紧张的,是这三个点
话说回来,这条新闻里的真实压力也是有的,而且在很多人没盯着的地方。
第一,定价权被两头挤了。上游,内存成本飙升,英伟达AI服务器被曝明年要涨价超15%。36氪75%的毛利率都消化不动。知乎下游,最大的客户之一开始自研推理芯片。英伟达在推理侧的定价权,第一次同时被成本和替代两头挤压。这个趋势如果成立,"同样的算力卖更贵"的故事,在推理侧会越来越难讲。
第二,推理这块蛋糕本身在变大,“效率"成了新战场。Jalapeno最大的威胁不是顶替GB300,而是演示了"推理可以用更低功耗、更低延迟跑"这条路。AI进入以推理为主要开销的阶段之后,谁的每瓦性能好,谁就有议价权——竞争的单位,正在从"算力总量"变成"单位算力的成本”。

第三,所有大厂自研的背后,都是博通在接单。谷歌的TPU、Meta的MTIA、现在的OpenAI Jalapeno,ASIC设计环节都有博通的身影。大厂自研这块饼做大,"卖铲子的铲子商"不亏。想看"去英伟达化"到底有没有真升温,盯博通的AI营收增速,比盯任何发布会都直接。
接下来三个月,盯这四个信号就够了
给还在跟踪英伟达的朋友,把观察点按时间排个序:
8月27日凌晨(北京时间)的财报,2027财年Q2,机构一致预期营收在922亿美元上下。微博期权市场给财报次日定价了约±5.4%的波动。微博这次营收和指引本身,比"超不超预期"更重要。
Vera Rubin的出货爬坡。Jalapeno没敢跟它比,Rubin能不能顺利放量,是"下一代英伟达还领不领先"的直接答案。
OpenAI年底的实际部署量,加上第二代Jalapeno的流片进度。基准测试可以好看,部署量不撒谎,这是验证这颗芯片的唯一硬指标。
内存涨价会不会继续向终端传导。AI服务器涨价如果进一步传到消费级显卡——前段时间RTX50系那波涨价已经是预警——这场算力通胀,最后会摊到每一个装机和买卡的人头上。

一句话收尾:OpenAI的Jalapeno,更像最大客户递给英伟达的一张通知单——“推理这部分,我自己也能做,而且更便宜”——而不是宣战书。护城河没崩,但水位在变,变的方向是推理效率,不是训练霸权。
你觉得这颗芯片是"英伟达让利的开始",还是"谈判桌上的筹码"?评论区聊聊。