今天一早,估计不少人的信息流都被同一条消息刷屏了:OpenAI 公布自研芯片 Jalapeño 的首批实测数据,标题一个比一个猛——“击败英伟达 GB300”“每瓦性能 1.9 倍”“全面硬刚英伟达”。
我先把话放前面:这事是真的有干货,不是纯炒作。但如果你只看了那些标题就去下结论,大概率会被带偏。我把彭博的报道、硅谷半导体分析机构 SemiAnalysis 的现场实测解读,还有多篇引述 OpenAI 官方博客的报道翻了一遍,发现中文通稿里普遍漏掉了几个关键信息,而恰恰是这几条,决定了你该把这件事当成“里程碑”还是“标题党”。小红书
先快速对齐一下 Jalapeño 是什么。这是 OpenAI 和博通(Broadcom)联合开发的第一款自研芯片,名字取自墨西哥辣椒。华尔街见闻注意两个定位:第一,它是推理芯片,只负责模型训练完之后“回答用户”这个环节,不做训练——而训练恰恰是英伟达最深的护城河。小红书第二,它不是 OpenAI 的“私房菜”,而是一颗通用推理芯片,实测里跑了 DeepSeek R1、月之暗面 Kimi K2.5、GPT-OSS 这些第三方开源模型。知乎换句话说,OpenAI 不是造了个只能跑自家模型的专用件,而是真奔着“通用算力”去的。

那“吊打 GB300”到底水分多大?分三层看。
第一层,数据是真的,而且有点超预期。在 InferenceX 基准测试里,跑 GPT-OSS 120B、DeepSeek R1、Kimi K2.5 这几个模型,Jalapeño 每瓦能处理的 AI 工作量是竞品的 1.5 到 1.9 倍,端到端延迟低了 1.7 到 3.6 倍。微博SemiAnalysis 在现场看到更具体的数字:Kimi K2.5 测试里,Jalapeño 在接近每秒 700 token 的单用户速度下,大约是排在第二名那颗芯片的 9 倍。知乎单芯片功耗约 700 瓦,GB300 则是 1400 瓦,每瓦性能在同类里确实突出。小红书

第二层,是几乎所有中文通稿都没说清的——这个测试有明确边界。SemiAnalysis 自己点破了:现有成绩主要来自“8k 输入、1k 输出”的短上下文负载,而且 Jalapeño 用的是最朴素的单 token 预测,没上多 token 预测、没用推测解码、也没做 Prefill/Decode 分离,对比的友商却都开了各自最强的配置。知乎更关键的是,完整的 InferenceX 测试没跑完,AgentX(智能体任务)结果根本没出。长上下文、多轮对话、Agent 工具调用这些真正考验人的场景,还没被验证。
第三层,也是最扎心的一句:SemiAnalysis 认为,拿 Jalapeño 去比 Blackwell(GB300)本来就不公平,真正该对标的是英伟达下一代 Rubin。知乎而 Rubin 已经开始出货了。华尔街见闻所以“吊打英伟达”这个说法,严格讲应该改成“在特定短上下文推理场景下,跑赢了英伟达上一代旗舰”。含金量还在,但没那么神。
那 OpenAI 真正在赌什么?我觉得不是“峰值算力”,而是两件更实在的事。
一件是“每瓦电能不能多出 token”。现在数据中心的瓶颈早就不只是芯片,而是电——电网并网、变电站、冷却系统的建设周期,比买 GPU 慢得多。所以“1 兆瓦电力能产出多少 token”,已经比“单颗芯片峰值算力”更接近收入和成本本身。知乎Jalapeño 每瓦性能领先,直接打在这个痛点上。

另一件,也是我认为比芯片本身更重要的——是 OpenAI 把硬件、编译器、推理服务捏在一起设计的那套软件流程。他们用基于 Triton 的自研语言写内核,用内部推理引擎 Teacup 把多个操作合并成一个持续运行的大内核,还做了个叫 chilisim 的模拟器,能在真硬件跑之前预测性能,误差只有约 5%。知乎更夸张的是,早期内核靠工程师手写,后来直接让自家的 Codex 自动生成和优化。这也是为什么这颗芯片从设计到流片只用了 9 个月——OpenAI 自己都说这是“高性能先进半导体史上最快的 ASIC 开发周期”。36氪这套迭代速度,才是英伟达、AMD 真正要警惕的东西。
对几家对手的影响,也顺便说清。对英伟达,最大的威胁不是“被替代”,而是“定价权被撬动”——OpenAI 哪怕只把一部分推理流量挪到自家芯片上,以后跟英伟达谈采购就有了备选筹码。不过 OpenAI 芯片负责人 Richard Ho 自己也反复强调,英伟达仍是重要合作伙伴,短期内不会放弃现有供应商,因为他们的算力需求实在太大了。华尔街见闻对 AMD,压力更直接,要补的不只是峰值算力,还有内核工程、编译器、模型适配这一整套软件迭代能力。对 Cerebras,Jalapeño 可能构成更直接的替代——OpenAI 手里还握着 750MW 的 Cerebras 使用义务和 1.25GW 的扩展选项,未来续不续约,很大程度就看 Jalapeño 能不能在成本和速度上站稳。知乎
最后落到和你我有关的判断上,分三类人说。
如果你只是看个热闹的普通用户,或者 ChatGPT 订阅用户:别指望这颗芯片让 ChatGPT 明天就变快变便宜,它今年底才初步部署。36氪2027 年才放量。知乎但中长期逻辑是通的——推理成本降下来,订阅和 API 就有降价空间,前几天 GPT-5.6 Sol 刚把输出价砍了三分之一,其实就是这个“成本飞轮”在转。36氪
如果你关注 AI 股票,别把“吊打 GB300”直接翻译成买卖英伟达的信号。真正该盯的是三个变量:英伟达 Rubin 的放量速度、Jalapeño 2027 年的量产兑现度(CoWoS 封装产能、HBM4 供应、良率都是坎)。知乎以及博通——它作为联合开发方,是这件事里最直接的受益者。华尔街见闻
这颗辣椒确实辣,但 OpenAI 的真实目的从来不是“掀翻英伟达的桌子”,而是给自己挣一个“不用单方面接受定价”的筹码。接下来值得持续盯的信号很清楚:第二代 Jalapeño 已进入较成熟阶段。华尔街见闻2027 年放量能否兑现、英伟达会不会被迫降价应对,想跟进的,把这几个点收藏好就够了。