这周数码折腾圈难得有一件"工具和账单同时到位"的事。8月13日,DeepSeek 正式开源了智能体框架 DeepSeekHarness,GitHub上线12小时破5万星。知乎紧接着8月17日0点,DeepSeek-V4 系列 API 新价格生效,正式引入峰谷定价。微博一边是想往家里 NAS 上搬的新玩具,一边是立刻要面对的新账单,两件事撞在同一周,正好把"值不值得部署"这个问题逼到了台面上。

先搞清楚:装的是"壳",烧的是云端API
很多人看到"本地部署"四个字,第一反应是得先搞台算力设备,这是最大的误会。DeepSeekHarness 本质上是一个"一切皆插件"架构的智能体框架,整个 monorepo 包含40多个顶层包、200多个工作区项目、7400多个文件。36氪你在家装的只是这个运行环境,真正干活的大模型在 DeepSeek 云端,token 账单也记在 API 头上。所以硬件门槛比想象低得多:一台吃灰的迷你主机、一个群晖或飞牛 NAS,能跑 Docker 就够入场,真正要算的账是后面每个月烧多少 token。
三条部署路线,各有各的账
路线一,本机电脑直装。体验最顺,装完即用,但问题也直白:你不可能让办公本和手机都挂着一个 Agent,合上盖子任务就断了。路线二,NAS 上跑 Docker,这是折腾党最关心的路线,卡点主要在外网访问——部署在 NAS 的 Docker 上,外网默认不能访问。微博
目前社区跑得最多的方案,是用 Cloudflare Tunnel 把外网流量打进 NAS 本地 13080 端口,而 DeepSeek Harness 默认要求 https,Tunnel 顺手把证书问题也解决了。微博
路线三,飞牛 fnOS 用户有现成饭吃:有人把 DeepSeek Harness 深度适配打包成了 fnOS 原生 .fpk 安装包,无需自己配置 Node 环境、命令行、代理和跨域参数,直接在飞牛应用中心安装就能用。哔哩哔哩甚至已经有第三方的可视化管理应用,启停、升级、插件管理都能点按完成。哔哩哔哩无论走哪条路线,有一个版本坑提前说:Node 最好用 24.19.0,避免安装失败。知乎
另外把预期管理做在前面:Docker 跑起来之后,端口占用、服务启不来这类小毛病少不了,基本都要靠终端日志一点点排障,动手前先有这个心理准备。

部署完成后打开 Web 界面,选个模式、挂上 DeepSeek-V4 系列模型,就能把任务丢给它了。

接下来就是这周的重头戏:跑任务到底花多少钱。
峰谷计价落地,折腾党有折腾党的跑法
先把规则说清:北京时间 9:00-12:00 和 14:00-18:00 是高峰时段,其余 17 个小时是空闲时段,空闲价格为高峰价格的一半。微博注意这次不只是"分时段"这么简单:早在8月6日,DeepSeek 就公告计划近期整体上调DeepSeek API服务的定价,预计涨幅较大。微博
最终落地价比6月底披露的方案还狠:以 V4 Pro 输出为例,最终的空闲和高峰价格达到13.5元和27元每百万 tokens,空闲时段价格已经超过此前拟定的高峰价格。微博
Agent 类任务有多烧钱,看三个真实样本。有博主用 DeepSeekHarness 跑任务,一天烧了 4.2 亿 token、¥113.90。哔哩哔哩另一个被反复引用的案例更刺激:峰谷定价启用后,独立开发者日成本从18元暴涨至70元,被迫成为“夜行者”。微博还有一个细节值得折腾党盯紧:一位重度 Agent 用户单日 267 次请求、约 7673 万 token,其中 98.35% 是缓存命中输入,按新峰谷价格费用从2.99元涨到7.27元,是原来的2.43倍。微博也就是说,Agent 场景最大的成本项,恰恰是这轮涨幅最猛的缓存命中输入。

这恰好给了折腾党操作空间。第一,NAS 本来就是 24 小时开机的,把批量任务、长任务排到夜间和 12:00-14:00 的空闲窗口跑,单价直接减半,这是本地部署相对云端订阅的天然优势。第二,选对模式。DSH 有四种默认模式:标准(日常主力)/PTC(像RPA整套脚本连跑,省token)/极简(bash+编辑器,跑测试)/创造(造插件)。哔哩哔哩批量跑重复流程就用 PTC 这类省 token 的模式。第三,简单任务挂 V4 Flash,复杂任务才上 V4 Pro,账单还能再缩一截。
装完别急着玩,这三个坑先绕开
第一个坑是心理落差:装完的 DeepSeekHarness 是个毛坯房。界面太素了,纯聊天框,没有文件树、没有终端、没有Git面板,甚至连图片都不能识别。知乎社区的解法是把毛坯改精装:dsh-web-ui 补上任务看板、Git 图谱和 token 统计,dsh-at-file 让你输 @ 就能引用项目文件,ModLens 给纯文本界面加上识图能力,这三个是目前社区公认优先级最高的插件。
第二个坑是插件圈的"神药"。这两天刷屏的 J-Space Cognition Suite 宣称一个 Skill 就能让 V4 Pro 在多个基准上超越旗舰模型,结果社区复测的结果完全相反,非但没提高成绩,还花了更多 token。知乎作者不仅没公开完整评测记录,还被曝删除质疑 issue,一场狂欢变成了公开打假。
DSH 的插件生态现在收录上千个,热度越高,混进来的"成绩截图"越多,记住一句话:能被复现的提升才叫提升,拿不出过程的结果,数字越惊人,越应该先打一个问号。知乎
第三个坑更隐蔽:V4 Pro 的输出质量对运行环境非常敏感,同一个任务在 Standard 模式下 91 分,PTC 模式 92 分,换成工具更少的 Minimal 模式能跑到 99 分和 96 分。知乎所以跑出来的效果先别急着归因到模型或者某个插件,换个模式复测一遍再说。
值不值得现在上车
给个直接的判断:如果你家里有 NAS 或迷你主机、Docker 玩得转、本来就想体验 Agent 工作流,这周是个不错的入场点——框架刚开源、插件生态正在爆发期、飞牛已经有了一键包,部署成本是历史最低;成本上按峰谷规则排任务,把重活挪到空闲时段,账单直接砍半。但如果你只是好奇 DeepSeek 的聊天效果,网页版就够了,没必要为一时热度专门添置硬件;对价格极度敏感的,建议先小额跑一周,看看自己任务的 token 结构里缓存命中占多少,再决定要不要长期挂任务。接下来值得盯三个信号:插件生态里能不能沉淀出真正耐用的工具、峰谷调度玩法会不会被社区摸透、以及 DeepSeek 下一轮价格调整的方向。