当前位置:
AIGC文章详情

DeepSeek涨价,AI NPC MOD先挨刀:缓存命中价涨幅1100%,7.9折邮件其实是变相涨价

源自9位全网作者

01:07

8月17日零点,DeepSeek API 的新价格正式生效,调接口的人第一次集体体会到什么叫峰谷计价。对游戏 MOD 圈来说,这条新闻不是别人的热闹——这两年骑砍2 里那批会聊天、有记忆、能记仇的 AI NPC,背后烧的就是这类按 token 计费的低价 API。这轮涨价里最先被挤到的,可能就是这批做 AI NPC MOD 的作者。

先把数字捋清楚。DeepSeek 官方公告,V4-Flash 与 V4-Pro 全系调价,8 月 17 日 00:00 起执行,并引入峰谷定价——每天 9:00-12:00、14:00-18:00 为高峰时段,价格是空闲时段的两倍。知乎分模型看,V4-Flash 的输出由原先 2 元/百万 token,涨到闲时 4.5 元、高峰 9 元,旗舰 V4-Pro 高峰输出直接到 27 元。小红书第一财经记者走访的开发者估算,涨价后月成本将从 3000 元直接涨至 1 万元,有专家直言大模型价格短期不会降。微博

市场的反应很直接。调价生效第一天,有中间商套餐的 V4-Flash 五小时调用量从 63300 次跌到 3800 次,暴跌 94%,中间商套餐成本直接失控,大量砍调用,需求收缩被放大。小红书涨价带来的成本压力,也已经直观地体现在普通开发者的后台账单上。

DeepSeek涨价,AI NPC MOD先挨刀:缓存命中价涨幅1100%,7.9折邮件其实是变相涨价

比涨价本身更值得警惕的,是今晚流传的一封"打折"邮件。有用户收到第三方平台 DMXAPI 发来的邮件,称 8 月 20 日起同步官方峰谷计费、统一按新刊例价 7.9 折结算,但这封信不是 DeepSeek 官方发出的。小红书

把邮件里的折后价逐项对着 8 月 19 日晚官网现价算一遍就更扎心了:V4 Flash 输出现价 2 元,折后非高峰 3.555 元、高峰 7.11 元;V4 Pro 现价 6 元,折后 10.665 元起。也就是说,非高峰输出价上涨 77.75%,高峰输出价上涨 255.5%。小红书所谓折扣只是相对新刊例价,对照现价所有时段都更贵。以后看到这类"折扣"通知,别认折扣力度,只认最终单价。

为什么我说 AI NPC MOD 会被这轮涨价先挤到?看看这类 MOD 是怎么烧 token 的就懂了。以骑砍2 的《重铸者》为例,这是 8 月中旬刚由中文站推荐、将 AI 深度融入骑砍2 的全新模组,支持本体 1.3.13 到 1.4.7 以及战帆版本。哔哩哔哩

DeepSeek涨价,AI NPC MOD先挨刀:缓存命中价涨幅1100%,7.9折邮件其实是变相涨价

它的 B 站视频评论区里,玩家问得最实际的问题就是"这个模组的 token 食用情况如何",而得到的回答很关键:开局要读世界书多一点,后续比 AI 效应少很多,大部分是命中缓存。哔哩哔哩

"大部分是命中缓存"这几个字,正是这轮涨价打在 AI NPC MOD 七寸上的原因。这类 MOD 控制成本的通用做法,是把系统提示词、几十万字的社区世界书这些长前缀固定下来,让每次 NPC 对话尽量走缓存命中;而这次涨幅最狠的一档,恰恰是缓存命中的输入价,从 0.025 涨到 0.30,涨幅 1100%。知乎MOD 作者们为了省钱做的优化,正好撞上了涨得最凶的那一档。

DeepSeek涨价,AI NPC MOD先挨刀:缓存命中价涨幅1100%,7.9折邮件其实是变相涨价

再叠加峰谷时段看,事情还有另一面:高峰是工作日的 9 点到 12 点、14 点到 18 点,恰好是 MOD 作者写代码、调试 NPC、批量跑世界书生成的时间;而玩家真正上线玩 MOD 的晚上和周末,大多是闲时价。被高峰价正面打中的,主要是开发调试和常驻服务器,不是玩家的实际游玩时段。粗算一笔账:假设一次 NPC 对话约 8000 个缓存命中 token、200 个新输出 token,按 V4-Flash 计,旧价一次约 0.0006 元,新价高峰一次约 0.0042 元,差出约 7 倍;一天 1000 次对话,就是从一天 6 毛变成一天 4 块多。对个人作者不算灭顶,但"近乎免费"的时代确实结束了。

当然,也没必要恐慌,社区里已经有冷静的反证。有开发者专门发帖提醒:大家基本都在说涨价后一天二三十,但如果只有价格波动大的人在发帖,而价格波动不大的用户成了沉默的大多数,就会出现幸存者偏差。小红书

他自己实测,一个下午一个晚上用 v4-flash 从零构建整套项目代码,总消费也才 3 块多。小红书对轻度使用的个人作者来说,这轮涨价疼,但远没到用不起的程度。

那现在做 AI NPC MOD 还能怎么办?第一条路是把重活挪到闲时。批量生成、调试、世界书预处理,尽量安排在 9 点前、18 点后和周末;已经有开发者随着这轮涨价,重新核查了自己 AGENT 里定期执行的任务,将其全部迁移到非高峰时段。微博

第二条路是继续做缓存优化,并给模型分级。缓存价涨了,但输出价涨得更多,稳定的长前缀依然是省钱主力,同时可以给世界书瘦身,砍掉低命中的内容;路人 NPC 的闲聊交给便宜档位,重要剧情角色才上旗舰档——玩家早就在用脚投票:有钱上 gemini,没钱 deepseek。哔哩哔哩

第三条路是本地后端。像《AI效应》这类框架,已经把 Ollama、KoboldCpp 本地模型列为支持的后端,单机 MOD 完全可以"重要对话上云、闲聊走本地",把高峰时段的调用量直接砍掉一大截。骑马与砍杀中文站

DeepSeek涨价,AI NPC MOD先挨刀:缓存命中价涨幅1100%,7.9折邮件其实是变相涨价

最后,别信折扣邮件的表述,一切以官网最终单价为准;同时盯着官方价目是否再调整,以及常用 MOD 的更新说明里有没有成本适配方案。这轮涨价真正的意义,是 AI NPC MOD 生态走出了 token 补贴期:NPC 会说话、有记忆、能记仇,这些曾经近乎免费的体验,现在是一项要写进设计文档、按月核算的持续成本。越早把成本模型算明白的 MOD,越能稳稳活到下一个游戏版本。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章