Nebius下月涨价17%,内存涨41%,你的账单要重算

Nebius下月涨价17%,内存涨41%,你的账单要重算

2026-09-24 08:47:21 0点赞 0收藏 1评论

3.85美元一个卡时,10月1日起变成4.50美元。Nebius 的按需算力全线涨价,H100 涨17%,H200 涨20%,最新的 B300 涨21%,配套的内存费率一次上调41%。租卡的人这笔账要重算。

这是欧洲算力服务商 Nebius 在9月中旬发给客户的通知。10月1日起,它的按需算力价格全面上调。H100 从每小时3.85美元涨到4.50美元,涨幅约17%。H200 从4.50涨到5.40,涨幅20%。B200 从7.15涨到8.50,涨幅接近19%。最新一代的 B300 涨得最多,从7.85涨到9.50,正好21%。

跟着一起涨的还有配套。AMD EPYC Genoa 处理器的费率上调25%,内存费率上调约41%。

这是 Nebius 今年第二次涨价。5月那一轮从6月1日生效,部分 GPU 租赁价格上调约30%,主要落在签了长约的大客户身上。10月这一轮不一样,涨的是按需的那部分。

按需是什么意思,做过项目的人都懂。我最早接触这种方式,是给一个模型测试项目临时租几张卡跑两周。不用签合同,想用几个小时就租几个小时,按小时结算。中小团队做模型调试、跑小批量测试,用的基本都是这一种。

比涨价更早出现的是租不到。我在群里见过临时租卡被弹回来的截图,提交订单之后提示资源已满。想跑一轮对照实验,得等前面的人释放节点。价格上升和供给紧张这两件事,在同一份通知里同时出现了。

为什么涨的是临时租卡

要看清这次涨价,得先分清两种客户。

长约客户提前锁定了未来几年的资源和价格,厂商给他们留固定的集群。按需客户没有这个待遇,只能去抢当下空出来的卡。Nebius 在通知里留了口子,大规模、多个月的预留仍然可以谈折扣。

它想保住的是大客户的稳定收入,涨的是散单的价。

Nebius下月涨价17%,内存涨41%,你的账单要重算

涨价的原因不难理解。英伟达的高端卡、HBM、先进封装、光芯片,每一个环节的扩产周期都在两到三年,供给追不上需求的时间会一直拖到2028年前后。Nebius 第二季度营收5.82亿美元,同比增长454%,其中 AI 云业务5.75亿。它手上刚签的四份合同,平均每份超过10亿美元。

需求这一侧也在变。商汤在2026全球AI芯片峰会上披露过一组数字,大装置的日均 token 服务量从2月的0.46万亿增长到8月的4.5万亿,八个月接近九倍。他们的说法是,推理需求已经取代训练,成了算力增长的主引擎。

这个变化对价格的影响很直接。以前算力紧张主要是训练大模型造成的,一拨人训完就空出来了。现在推理是每天都在发生的支出,只要有人在用,卡就不能下线。长上下文和多轮对话还特别吃内存和缓存,这也解释了为什么配套的内存费率一次涨了41%,比 GPU 本身还猛。

算力这笔账我从5月那一轮就开始跟,价目表每动一次我就记一笔。你要是也在算这笔账,关注一下,后面每轮变动我都接着记。

同样在9月,CoreWeave 也对外表示,正在以更高的价格签合同。

我打开 Nebius 的价目表算了笔小账。H100 每小时多掏0.65美元,一台八卡机器满载跑一个月,按720小时算,多出来是3744美元。换成 B300,同样的配置一个月多掏9504美元。

这不是一笔可以忽略的钱。一台八卡机一年的差价,够一家小团队再雇一个人。

以前我们在公司里做「买服务器还是上云」的对比表,三年折旧、电费、机房、运维人力都要摊进去,算下来常常是买划算。现在这张表得重算了,因为云那一侧的单价在往上走。

这个号主要写我自己动手算过的账,订阅一下,下次算到类似的地方能直接看到。

同一个9月,另一边在降价

就在算力涨价的同一段时间,模型那边的价格在往下砸。

Nebius下月涨价17%,内存涨41%,你的账单要重算

千问发布 Qwen-Audio-3.1 系列语音模型,一次上了五款,识别、合成、实时交互都有。全线同步降价,语音识别的降幅约95%,语音合成约70%,实时交互约85%。OpenAI 的 GPT-6 Sol 和 Luna 把 API 定价比上一代5.6系列砍掉一半。Anthropic 的 Opus 5.5 输入输出定在每百万 token 4美元和20美元。

我的判断是,AI 变便宜这件事是分层的。卖 token 的在降价,卖卡的在涨价,两条线根本不在同一层上。

站在这两条线中间的,是那些不调 API、要自己租卡跑模型和微调的团队。他们拿到的账单是往上的。

这类团队眼下能做的选择不多。一是把非核心的活儿改成调 API,把租卡额度留给真正需要的环节。二是提前锁长约,用承诺换折扣,代价是把自己的现金流先压进去。还有一条更难的,是重新看一遍自己的算法,想办法把每轮实验消耗的卡时降下来。

对不在这行里的人,这件事也不是完全无关。你自己未必租卡,但你用的每一个 AI 产品背后都有这张账单。推理成本如果一直往上,最先被调整的往往是免费额度和低价套餐。

多掏出来的这部分钱,最后会落到谁的头上?

我把 Nebius 那四行价目抄进了报价表,下次有朋友说要自建模型,先把这张表推给他看。

展开 收起
1评论

  • 精彩
  • 最新
  • 卖token的在降价,租卡的在涨价,夹中间的团队最难受。非核心的活改调API,把卡留给真正要跑的环节,这步怕是省不掉咯。

    校验提示文案

    提交
提示信息

取消
确认
评论举报

相关文章推荐

更多精彩文章
更多精彩文章
最新文章 热门文章
0
扫一下,分享更方便,购买更轻松