就在今天,8月20日,DeepSeek Harness更新了v0.1.0-rc.8版本,官方称完成了多模态支持改造,DeepSeek模型适配器支持配置启用原生图片请求。微博据称此次更新包含14项改进,官方还顺势剧透DeepSeek V4视觉版即将推出。微博距离它8月13日晚发布,刚好满一周。这一周你要是没被Harness的信息糊过一脸,基本等于没混AI圈。但越热闹越要冷静看:这东西的票房和它的真实上手体验,根本不是同一个故事。我把知乎、B站、小红书、微博和科技媒体这一周的信息都拢了一遍,给你一份完整的一周战报。

一周战报:有多爆?
先摆数据。8月13日晚,DeepSeek Harness与DeepSeek V4 Pro正式版同步发布,这是DeepSeek首款Agent产品,支持管理项目、长任务协作、多Agent编排、上下文管理以及联网搜索和Skill等功能。微博架构口号是「一切皆插件」:模型、工具、技能、会话、沙箱、UI,甚至Agent的运行循环本身,全都能拔掉换成别的。知乎官方给出的定义是「Model+Harness=Agent」:模型负责思考推理,Harness负责模型之外的所有工程化工作,团队由崔添翼牵头,直接对标Anthropic的Claude Code。36氪
热度涨得有多快?开源的GitHub仓库上线不到一天就冲到7万多Star,官方整理的插件列表一天内就收录了300多个可安装插件。知乎才过两天,社区已经在数「上千个插件」了。小红书
各平台的热度也很直观:B站这周播放量第一的Harness实测视频已经93万+播放,前三名全部超过65万;小红书的保姆级安装教程拿到4000多赞、近6600收藏——收藏比点赞还多,说明是真有人存下来照着学的。第三方模型聚合平台OpenRouter统计,7月27日至8月2日这一周,DeepSeek V4 Flash以7.22万亿Token位居全球大模型调用量周榜第一——开发者基本盘早就有了,Harness是来收割的。36氪上线第5天,GitHub的star数已经到了15万量级。小红书

但评论区是分两拨的
这周技术社区最有意思的是,高赞回答几乎全是一句话段子。知乎问题「如何评价在8月13日发布的DeepSeekHarness?」下最高赞回答有1100多赞,全文只有一句:「但凡组里还有个能喘气的产品,都不至于整出这种抽象的东西」。知乎吐槽集中在产品成熟度:界面是浏览器里打开的网页,要自己装Node.js、在终端里敲命令启动,连桌面版都是社区自己做的。科技博主程墨Morgan说得更直接:「说是Toy都不为过啊。」不过他最后也补了一句,「看在DeepSeek模型价格良心的份上,就原谅DeepSeek这一回」。知乎
夸阵营的声量也不小。程序员鱼皮发布当天就发了实测:读源码画架构图、做知识动画网站、开发3D小游戏、搓全栈PPT生成器,四个任务跑下来总花费不到5块钱,缓存命中率基本都在99%以上,他的结论是「自己的模型配自己的 Harness 工具,真的强」。知乎有内测用户说自己两天高强度跑了20亿Token,「实际体验很丝滑」。哔哩哔哩也有播放量很高的实测视频给出了更克制的结论:「0.1版本总体不推荐普通用户使用,但我真的很开心看到完全不同的agent设计思路,虽然现阶段来说体验只能算及格,但未来可期」。哔哩哔哩
比起两拨对骂,我觉得这句话更值得品:「Star数曾经是个有用的指标,直到大家都知道它有用」。知乎我的看法是:15万star证明的是「这个架构配得上多少关注」,高赞一句话吐槽证明的是「产品现在有多成熟」,这是两件事。抛开争议看产品本体,它官方形态其实非常朴素:一个浏览器里打开的网页。真正把体验堆起来的,是社区自己做的插件——任务看板、Git图谱、文件面板、手机远程、实时Token统计,都塞在一个插件里。知乎

本周最大的坑:400GB文件被删了
如果只看一个坑,看这个。这周,一位Windows用户在装插件时出了严重事故:DeepSeek Harness处理符号链接时,引号和路径被错误解析,删除目标从一个链接扩大成了整个G盘根目录,约400GB文件被直接删除;更要命的是,会话开了完全权限,全程没有任何一步停下来确认。哔哩哔哩
社区后续的应对值得说道:曝光这件事的博主做了个dsh-auto-mode插件,在官方权限档位之外补了个「Auto」第四权限——项目内的读写、构建、测试尽量自动放行,删除已有数据和对外写入按上下文判断,磁盘根目录、用户目录、系统关键路径直接硬拒绝。但作者自己也说清楚了:它不是操作系统级沙箱,包安装脚本、绕过工具系统的插件、Harness外部启动的命令都不在它的控制范围内,「真正敏感的环境,该使用容器和正式沙箱时仍然要用」。哔哩哔哩公允地说,这类坑不是Harness独有的——权限给高了,Codex、Claude Code判断出错时一样会出事故。但Harness才发布一周、用户里小白占比高,这件事值得放在最前面说。
还有两个坑:「眼睛」没装上,账单也没那么便宜
第二个坑是多模态。DeepSeek V4 Pro是纯文本模型,看不了图。今天rc.8完成的多模态改造,翻译过来是:框架层准备好了,但DeepSeek自己的视觉版模型还没发布,现在想用得换第三方视觉模型、在配置里手动开启。微博有等不及的用户直接失望:「我还以为V4F和V4P支持多模态了呢,白高兴一场,继续用Cursor和Codex去了」。知乎在官方「眼睛」到位之前,社区有个叫modlens的插件可以先顶着:把图片解析成结构化JSON文字喂给模型。
第三个坑是成本。「4个任务不到5块钱」有个前提:缓存命中率99%以上。而DeepSeek的API也刚刚涨过价,有用户按自己的同类任务实测,哪怕专门放在空闲时段跑,总费用已经是涨价前的约2.2倍。微博也有用户吐槽得更直接:「我用了api两天半就花了快五十块,用的是DeepSeek pro,基本上两个多小时就要充值十块钱」。小红书社区已经有人做出了「省钱插件」:设定暂停/继续时间窗口,高峰时段自动暂停长任务、窗口结束自动恢复——本质是拿时间换钱。准备重度跑长任务的,建议先把它装上。
要入坑,先收好这份插件清单
决定要试的话,社区已经替你筛过一轮了,下面这几个是这周全平台提到最多的:
dsh-web-ui:最热门的增强插件,皮肤、任务看板、Git图谱、实时Token统计、手机远程全家桶;
DeepSeek Harness Desktop:macOS/Windows桌面应用,不想装Node.js、不想碰终端的选它;
dsh-TUI:终端党福音,Claude Code CLI风格;
dsh-auto-mode:前面说的权限安全网;
modlens:视觉短板补丁;
省钱插件:峰谷时间窗自动管理。

还有一些纯整活插件:比如dsh-ads会给你的界面加上2005年中文门户站风格的侧栏广告、对话内信息流和角落弹窗,还有各种桌宠、皮肤中心可以折腾。不得不服社区的创造欲。

最后说结论:谁该入坑,谁该观望
按人群给判断:
折腾党、自媒体人、学生党(已经有人拿它备战数模竞赛),以及本来就在用DeepSeek API、想要一个免费开源可定制Agent工作台的人——现在入坑没问题。安装就是一条命令,成本可控,玩法是真的多。
想直接接正式生产、处理重要数据的——再等等。v0.1的稳定性、400GB的前车之鉴、官方沙箱的缺位,都指向同一件事:重要活儿至少给个干净工作目录或容器,千万别开全权限。
急需「AI看图」的——等V4视觉版。在那之前,这是框架级短板,插件只能缓解,不能根治。
Codex或Claude Code已经跑得稳定、又对插件折腾没兴趣的——不用换。Harness强在开放和便宜,不是强在今天比成熟商业产品更稳。
接下来我会继续盯三个信号:V4视觉版什么时候真发布、rc版本什么时候转正以及会不会出大篓子、插件生态是精挑细炼还是野蛮生长。有进展再来聊。