DeepSeek 最高涨价 1100%,“养马人”首当其冲:多亏 Hermes 零锁定,四条路让成本不爆

源自56位全网作者

17:55

8 月 17 日零点,DeepSeek 新定价正式生效。这次涨价有多狠:主力模型 V4-Pro 缓存命中输入从每百万 tokens 0.025 元涨到高峰时段 0.30 元,一下涨了 1100%。知乎但今天想聊的不是涨价本身,而是被这波涨价打得最疼的一群人——挂着 Hermes 跑 7×24 定时任务的 Agent 用户,社区里管自己叫“养马人”,而 DeepSeek Flash 一直是大多数“马”的默认饲料。

更有意思的结论先说在前面:这次涨价反而验证了 Nous Research 设计 Hermes 时的先见之明——“零锁定”不是当初的宣传话术,是现在的救生艇。

DeepSeek 最高涨价 1100%,“养马人”首当其冲:多亏 Hermes 零锁定,四条路让成本不爆

“养马人”的账单

Hermes 社区的标准配置,一直是“廉价大脑+24 小时干活”:接上 DeepSeek V4 Flash,用 cron 跑定时抓取、评论监控、日报生成,便宜、快、够用。微博用户 @电动知士大雨 在 7 月 31 日 V4 Flash 正式版上线的第一时间,就把 Hermes 所有的定时任务和主对话切了过去。微博

问题在于,这种用法恰恰是 DeepSeek 这次定价最想“调控”的对象。高峰时段(北京时间 9:00-12:00、14:00-18:00)全价,其余 17 个小时(含夜间和全部周末)半价。知乎这跟电价峰谷是一个逻辑:算力紧张,用价格杠杆把能挪的任务挤到半夜去。而 Agent 定时任务,恰恰是白天高峰里调用量最大的一类。

疼到什么程度?一位做法律文档业务的知乎用户给了个很具体的例子:几十页、上百页的 PDF 原来闭眼丢给 Hermes+V4FLASH,一个月 150 块;涨价落地当天他估算,一个月 500 块恐怕打不住。知乎

还有个更讽刺的细节:今年 5 月 22 日,DeepSeek 曾把 V4-Pro 的折扣价宣布为“永久价格”。这个“永久”只维持了 83 天。知乎

为什么 Hermes 用户最淡定:Nous 提前留了救生艇

先给不熟悉的朋友补个背景:Hermes Agent 是 Nous Research 今年 2 月 25 日开源的自进化 Agent,半年时间在 GitHub 上拿到了 191K Star。知乎发布时被讨论最多的卖点,不是自进化技能体系,而是一句听起来像凑数的话:零锁定,一行命令无痕切换 300+ 模型。知乎

DeepSeek 最高涨价 1100%,“养马人”首当其冲:多亏 Hermes 零锁定,四条路让成本不爆

涨价来了才明白这句话的含金量:Agent 里的“大脑”是可以换的,你攒下的记忆、技能、定时任务不用跟着模型一起迁移。如果你用的是深度绑定某家模型 API 的 Agent 产品,涨价意味着要么咬牙硬扛,要么连家一起搬。

DeepSeek 最高涨价 1100%,“养马人”首当其冲:多亏 Hermes 零锁定,四条路让成本不爆

涨价的时机也挺微妙:7 月中旬有报道称,Nous Research 正在敲定由 Robot Ventures 领投、估值 15 亿美元的新一轮融资。知乎公司自己不缺商业化想法,Hermes Desktop 已经内置 Free/Plus/Super/Ultra 四档订阅体系。知乎但至少在模型这一层,它没有拿用户当人质——“框架归框架,模型归模型”的设计哲学,在这波涨价里变成了实打实的腾挪空间。

四条自救路线

涨价三天,社区其实已经用脚投票了。我把讨论整理成四条路线,各自适合不同的人。

路线一:错峰,不换模型。如果你的 Hermes 主要跑定时任务,最省事的是把 cron 挪到深夜或周末。空闲时段半价,但这里有个坑:半价是相对新高峰价说的。以 V4-Flash 缓存命中输入为例,高峰时段涨了 400%,空闲时段也还是原价的 2.5 倍。知乎别指望挪个时间就回到原价。

路线二:换便宜的模型。先说清楚换走的是什么:V4-Flash 正式版本身不弱,@电动知士大雨 当时晒出的官方基准对比图里,正式版在 9 项 Agent 基准上全面领先 Preview 版,这也是当时定时任务党集体切换的原因。微博

DeepSeek 最高涨价 1100%,“养马人”首当其冲:多亏 Hermes 零锁定,四条路让成本不爆

社区目前讨论最多的替代方案:小米 MiMo V2.5 计费不分闲忙时,有知乎用户涨价后切过去实测三天,结论是“价格不分闲忙时,省心:这是最打动我的点”。知乎OpenCode Go 上的 DeepSeek Flash + MiMo V2.5 组合暂时还维持着低价:按 8 月 17 日以前的价格一个月大约能蹬 70 亿 token,涨价后会缩水到 14 亿。知乎

MiniMax 119 元档大约包含 40 亿 M3 + 80 亿 M2.7 tokens,甚至有人开发出精打细算的用法:49 元档单开,让 M2.7 专职当“探索代码”的廉价 sub-agent,重活留给主力套餐。知乎

提醒一句:换“大脑”不是一键操作,工具调用稳定性、记忆系统兼容性都得测。有位用户从 Claude Sonnet 4.6 换成 MiMo V2.5 Pro 跑 Hermes 翻了车,又翻了一圈 HuggingFace 上的微调模型才找到能用的方案。微博

路线三:混装。现在讨论热度最高的玩法:贵模型负责想,便宜模型负责干。AI 玩家 Da7em 的方案是用 Kimi K3 担任“调度员”负责逻辑和规划,DeepSeek Flash 当“执行者”快速干活,再请 GPT-5.6 Luna 做视觉和审查把关。微博Hermes 最近更新的 Bot Mode 正好强化了这个方向,每个 Bot 可以有自己的模型、记忆、Skills。微博这等于给“混搭配置”提供了原生容器。

路线四:本地。Qwen3.8 的 27B 版本已经能在 48GB 统一内存的 Mac 上跑起来,配合 Hermes 应付日常任务,token 成本为零。哔哩哔哩但这条路有另一笔成本:你自己的时间。就像一位微博用户说的,很多人省下了 Token,却浪费了更贵的东西——自己的时间。微博

两个反直觉判断

第一:成本不只看模型,还看框架。Composio 实测发现,同一个 Kimi K3,只是换了个 agent 框架,token 消耗最高能差 30 倍。微博Hermes 自己也内置了省钱机制:任务跑完会自动把过程沉淀成可复用的技能,下次遇到同类任务直接调用。知乎记忆部分结合 FTS5 实现跨会话累积。知乎所以比账单的时候,别只盯着模型单价。

第二:涨完价,DeepSeek 依然不算贵。V4-Pro 高峰输出 27 元/百万 tokens,仍低于智谱 GLM-5.2 的 28 元,更远低于 Kimi K3 的约 101.6 元,只有 Claude 旗舰的十三分之一。知乎这次涨价终结的不是“便宜够用”的时代,是“便宜到没对手”的时代。

值得继续盯的信号

  • 8 月 19 日下午,DeepSeek 再次开始灰度测试,社区讨论认为能力表现超过上一轮灰测。知乎新模型可能在路上,定价结构也可能再变。

  • Nous 那笔 7500 万美元融资的落地进展,以及后续 Hermes 官方订阅和云托管的价格动作。知乎如果框架侧也开始收费,成本账要重新算。

  • 与涨价同日开源的 DeepSeek Harness 的生态速度:发布 3 天第三方插件就破了 4300 个。知乎框架层越免费,成本战争就越集中在模型层——这对不锁定模型的 Hermes 用户是好消息。

最后说一句:这次涨价对每个“养马人”其实都是一次压力测试——你的 Hermes 现在接的是什么、哪些任务跑在高峰时段、每月账单花在了哪里?这三个问题想清楚了,那下次不管谁涨价,你一条命令就能走人。这本来就是 Nous 当初给你的底气。

内容由AI生成

精选参考来源

1. 涨幅1100%!DeepSeek调价生效,看在Harness的份儿上就先放过梁子吧

2. #DeepSeekV4Flash正式版上线#第一时间把Hermes所有的定时任务,主对话切成了V4 Flash正式版

3. 如何评价DeepSeek涨价后,OpenCodeGo套餐的Flash模型调用量削减94%?

4. Hermes Agent:Nous Research 的自进化 AI Agent 框架

5. 跑通‘自进化’Agent仅需5美元:Nous开源Hermes,支持300+模型无锁定

6. 速递|开源Agent初创NousResearch,拟融资7500万美元,估值15亿美元,产品Hermes上线付费云托管版

7. Nous Research正式发布官方桌面客户端Hermes Desktop:AI智能体迎来「原生之家」

8. DeepSeek V4 大幅涨价后,现在谁才是你心中的大模型性价比之选?

9. DeepSeek涨价后,我换到了小米MiMoPro,聊聊3天实测感受

10. 把ClaudeSonnet4.6换成MiMoV2.5Pro跑HermesAgent翻车以后,我又试了一些HuggingFace别人微调或者蒸馏的开源模型

11. 大模型混装才是真生产力:Kimi、DeepSeek、GPT协同作战

12. Hermes昨天更新了一个Bot Mode(机器人模式)

13. Qwen3.8 27B本地实测:Mac 48GB也能跑,配合Hermes甚至能替代Claude和Codex

14. 别再迷信“便宜模型”了,你的时间比Token贵

15. harness是影响成本的关键变量之一,KIMIK3只是换了个agentharness,token消耗最高能差30倍

16. 如何看待8月19日下午DeepSeek再次开始灰度测试,能力超过上次灰测?

17. DeepSeek Harness五天超越151kstar,它会带来怎样的变革?

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章