42小时破10万星,被全网吹爆的DeepSeek Harness,README第一行却是大写警告:现在上车值不值

源自147位全网作者

14:59

这周关注开源社区的朋友,应该都被一个项目的涨星新闻刷屏了。

8月13日,DeepSeek 把自家内部用的 Agent 运行时框架 DeepSeek Harness(下面简称 DSH)整套开源,MIT 协议。涨星速度快得离谱:半小时破 1 万星,约 42 小时破 10 万星,多家媒体直接冠以「GitHub 史上最快涨星项目」。知乎但在一片吹爆声里,有件事很少被提起——打开这个仓库的 README,最上面有一行大写英文:THERE WILL BE COMPATIBILITY-BREAKING CHANGES。翻译过来就是:接下来会有破坏性的兼容变更。知乎一边是「史上最快」的热度,一边是官方自己贴的「今天写的代码明天可能失效」警告。我把知乎、B站、36氪、公众号和社区实测这几边的信息交叉核对了一轮,今天冷静聊聊:DSH 到底是什么、现在值不值得上手、要避开哪些坑。

先复盘这周的热闹,顺便去去水分

时间线捋一遍:

8 月 12 日夜,DeepSeek V4 Pro 正式版静默上线,没开发布会;8 月 13 日,官网横幅和开放平台公告一度被撤下,社区怀疑是前端接口和推理栈配置错位导致体验翻车,当晚重新发公告确认上线,顺手就把 DSH 开源了。36氪然后是疯狂的涨星曲线:30 分钟破 1 万,1.5 小时破 2.2 万,约 42 小时破 10 万。知乎这里有个信息需要帮大家去噪:第六天的总星数,各家口径对不上。有说 12.1 万的,有说 15.1 万的,也有说 16.5 万的,统计时点和口径各不相同。能确认的只有一件事——它用 6 天成了 AI 开源领域的现象级项目。至于「GitHub 史上最快涨星」,目前是媒体口径,GitHub 官方从来没认证过任何「最快」纪录,看个热闹就行。

为什么爆?综合各方讨论,基本是三点叠加:

一是时机。AI 编程正处在讨论峰值,「Agent 怎么干活」这一层正被 Claude Code、Codex 焊在闭源产品里,DSH 把这个「身体」开源了,踩得准。

二是姿态。MIT 协议、模型无关,第一天就支持 40 多家模型厂商,连竞品模型都能接——它把「自己的产品可以被替换」这件事也开源了。

三是想象空间。官方给了个公式:Model + Harness = Agent。模型是大脑,Harness 是身体。36氪仓库描述只有一句话——Everything is a Plugin(一切皆插件):模型适配器、工具、会话日志,甚至 Agent 主循环本身,全是可插拔的插件。有媒体称之为「Agent 界的安卓」。知乎

42小时破10万星,被全网吹爆的DeepSeek Harness,README第一行却是大写警告:现在上车值不值

DSH 本身,一段话讲明白

它不是又一个聊天壳。顺着源码看,这套东西把 Agent 运行时拆得极其彻底:底层是打磨了四年的 Cordis 插件系统,配套一篇 88 页的理论论文,packages 目录下有 219 个包。知乎知乎不同 Agent 用不同工具集和提示词,靠配置挂成不同的插件树,全程不用改框架源码。

社区实测下来,最扎实的差异化是可观测性:整个会话是一本 append-only 的账本,模型看到的每一条内容都能追溯到来源,还能按来源筛选、分叉会话。用社区的话说,「Model-visible means logged」——只要模型看得见,就一定留有记录。知乎这对调试长任务、复盘 Agent 为什么跑偏,是真刚需。

42小时破10万星,被全网吹爆的DeepSeek Harness,README第一行却是大写警告:现在上车值不值

更新速度也别忽视。8 月 17 日发 RC.7,两天后的 8 月 19 日夜里 RC.8 就来了:多模态图文输入、子代理回报机制、web_search 并发、Windows 终端持久化,一共 14 项更新。更微妙的是,Claude Code 和 Codex 在 RC.8 里可以作为独立组件安装、被 DSH 当子代理调用——竞品直接变队友,DSH 正在往「Agent 统一调度层」的方向走。知乎

上车之前,四件事必须看清

第一,它是 v0.1 开发者预览版,破坏性变更是官方明示的。README 的大写警告不是谦虚,RC 版本之间接口真的会变。现在围绕 rc.7 写的插件、做的集成,到 rc.8、rc.9 大概率要返工。有企业评估说得很克制:适合圈定范围做工程试点,还不是生产控制面——能试,别上生产。知乎

第二,Token 消耗和 API 价格都不便宜。有独立测量显示,DSH 每次交互大约消耗 4.76 万输入 token(未缓存),是同类竞品的大约 10 倍。知乎更巧的是,8 月 17 日零点起 DeepSeek API 改为峰谷定价,V4 Pro 高峰时段输入每百万 token 9 元、输出 27 元,非高峰减半。知乎框架免费,但跑起来烧的是真金白银,重度使用前建议先给自己的账户设个预算上限。社区这几天吵的「涨价是不是原罪」,本质上就是这笔账。36氪

42小时破10万星,被全网吹爆的DeepSeek Harness,README第一行却是大写警告:现在上车值不值

第三,你在 X 上看到的「V4 Pro 碾压 Fable 5」,大概率是 J-Space 带的节奏。这套叫 J-Space Cognition Suite 的社区项目声称不改模型权重、只靠外围 Harness 就能让 V4 Pro 在多个 Agent 基准上超过 Fable 5,但截至 8 月 18 日,所有提升数据都来自项目方自测,没有独立团队复现。36氪有开发者尝试后直言,没能复现其中任何一项说法,Token 消耗反而比裸跑高了 50% 到 4 倍。顺带提醒:它和 Anthropic 那个研究模型内部表征的 J-space 根本不是一回事,只是名字撞了。自测自夸的 benchmark,看的时候打八折。

42小时破10万星,被全网吹爆的DeepSeek Harness,README第一行却是大写警告:现在上车值不值

第四,插件生态很热闹,但工程上还在裸奔。带 dsh-plugin 标签的项目几天内就破了千、冲着 4000 去了,社区目录里能查到 1600 多个插件。知乎但 DSH 插件默认和主进程共享同一个 Node.js 运行时——崩溃一起崩,恶意插件理论上能碰内存、网络和文件系统,目前官方没有进程隔离或签名验证机制。

今年 2 月 Cline CLI 刚出过真实的供应链攻击,AI 工具的插件生态都不是法外之地。知乎第三方插件,装之前至少看一眼源码。另外 DSH 插件只能在 dsh 里跑,不像 MCP 那样是跨客户端的协议——这意味着生态再热闹,网络效应也锁在 DeepSeek 自己的院子里。

现在到底谁适合上车

适合现在就玩的,两类人:

一是想研究 Agent 架构、吃早期插件生态红利的开发者。DSH 把「Agent 怎么构建」这套过去锁在闭源产品里的方法论整个公开了,源码质量值得读;现在进场做插件,是流量最便宜的时候。

二是本来就在用 DeepSeek API 的人。自家模型配自家 Harness 的磨合确实最好,官方报告 V4 Pro 在 Terminal Bench 2.1 跑出 87.9。知乎社区实测标准模式的编码、计划、子代理能力也到了一线水平。

建议再等等的:想找稳定生产力工具的,等 1.0 和 SDK 稳定再说,现在 Python SDK 还是 0.0.0.dev0。知乎Windows 用户注意,标准模式可用,但极简模式此前在 Windows 下跑不起来,RC.8 刚补上 PowerShell 持久化,不妨再看一个版本。知乎

真要上手,三条纪律:不碰生产数据、第三方插件最小化安装、给 API 账户设预算告警。

接下来值得盯的信号

涨星代表期待值拉满,但一个工具行不行,要看半年后有多少真插件、真工作流跑在它上面。知乎几个观察点:RC 版本的破坏性变更什么时候收敛、官方什么时候给出安全隔离机制、J-Space 这类「跑分神话」会不会出现独立复现,以及 1.0 正式版的时间表。

星标是期待,插件才是投票。DSH 值得看、值得试,但别急着把生产环境交给一个 v0.1。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章