当前位置:
AIGC文章详情

Claude Code和Codex被DeepSeek"收编"成子代理:把工作流搬进这个开源编排层之前,先看三笔账和三个坑

源自108位全网作者

02:01

两天前深夜,DeepSeek Harness放出rc.8,14项更新里最值得一说的,不是终于能看图了,而是这一条:Claude Code和Codex现在可以作为插件包安装进Harness,被当成子代理调度。

Anthropic和OpenAI的两款闭源AI编程工具,现在能到DeepSeek搭的开源框架里"当打工人",今早36氪的标题说得很直白——竞对的产品,变成自己的零件。36氪

Claude Code和Codex被DeepSeek

先给没跟这个事件的朋友补个课。8月13日深夜,DeepSeek两小时三连击:V4 Pro正式版转正、API涨价预告、然后把Harness以MIT协议开源。官方公式写得很直白:Model + Harness = Agent。模型负责思考,Harness负责模型之外的所有工程化工作——任务拆解、工具调用、记忆管理、错误重试。这个框架开源首日Star破3万、登顶Hacker News,创下了最快破2万Star的纪录。36氪五天之后,这个数字超越了15.1万。知乎

Claude Code和Codex被DeepSeek

而且它的更新频率几乎是隔天一个版本:8月17日RC.7把Codex和Claude Code的子代理任务接进统一任务面板,两天后的RC.8直接把两家做成了即装即用的插件包。Codex还支持非交互权限模式和多个命名实例,意思是一个任务里可以同时挂几个Codex干不同的活,结果自动回传唤醒主任务。36氪

为什么"调度层"这个位置值得在意?有篇分析里说到了点子上:模型可以换,执行任务的Agent可以换,但组织模型、调度Agent、管理任务和工具的那层工作环境,一旦用顺手就很难搬。

对比一下两条路线:Claude Code绑定Anthropic系模型,Codex绑定OpenAI系模型,都是闭源成品;Harness是MIT开源、模型随便换、还能完全离线部署。有人把它比作安卓的打法——自己不造手机,但让所有厂商都跑在自己的系统上。DeepSeek的算盘是"卖水人"逻辑:你们都用我的Harness编排工作流,默认路由还是自家API,而这套API刚在8月17日改成了分时计价。

不过,决定把工作流搬进去之前,先看三笔账。

第一笔账:模型端确实贵了,但贵得分层。

8月17日生效的涨价不是吓唬人:统一计费取消,改成算力错峰分级计价,高峰时段收费比空闲时段翻倍,部分API价格比原来高出10倍以上。知乎一个高赞回答很扎心:以为大幅涨价是翻倍,没想到缓内价格直接涨了11倍,拿V4 Pro测试,一天不到就跑了60多块。知乎B站评论区还有更直白的:涨价前一星期50块够用,涨价后一天直接50。哔哩哔哩

但注意分层:涨得狠的主要是Pro档,V4 Flash的输出价还维持在2元/百万token的地板水平。所以现在的真实情况是:用Flash跑Harness确实便宜,想要Pro级的思考力,成本就是另一套算法了。

第二笔账:烧的不光是钱,还有"抽卡税"。

社区里一直有个争议:V4 Pro在不同运行环境下表现差很多——Standard模式跑分91,换到工具更少的极简模式能跑到99。哔哩哔哩同一个模型、同一个任务,环境一换差出8分。于是冒出一堆声称能"激活真实力"的增强插件,Jack-Cui那条《满血版解锁,99%的人都用错了》播放25万、收藏9600多,说明"正确用法"的需求有多大。

但UP主自己也承认:增强版效果依然不稳定,好结果需要反复抽卡。还有人实测了token账单:用V4 Flash加增强插件,消耗20亿token,额度消耗至少翻3倍,实际能力提升却有限。

插件生态里还出过假跑分事件——之前刷屏的J-Space声称,接入一个Skill就能让V4 Pro在部分基准上超越Fable 5。36氪

社区复测的结果不仅没提升,反而更费token:报告给出的成绩是87.1%,复测只有77.5%,失败任务重跑3次也没复现宣称的提升,作者还删了质疑的issue。36氪

Claude Code和Codex被DeepSeek

第三笔账:替代品也不便宜,比完再决定。

评论区已经有人在算:Kimi K3是199元一个月给10亿token,DS涨价后大约60元一亿,哪个贵得看用量;也有人说看到涨价吓得续了ChatGPT会员,70块一个月还带多模态,不香吗。这没有标准答案,关键是先搞清楚自己每月的token量级和任务类型再决定。

说完账,再说三个坑。

第一个坑:官方警告不是摆设。

官方文档用全大写字母警告:将会有破坏兼容性的变更。36氪这次rc.8,SQLite数据结构就出了不兼容变更,本地存了大量会话数据的,升级前先备份。这个项目从第一条提交到开源,64天里12293次提交,每天几百次提交,文档滞后是必然,内测开发者也直言,现在体验确实不如Claude Code和Codex完善。

Claude Code和Codex被DeepSeek

第二个坑:权限的事比你想的大。

上周有个真实事故:一位用户在Windows环境下安装插件时,DSH处理符号链接出错,会话又开着Full access,执行过程没有任何一步停下来确认。哔哩哔哩删除目标从一个链接扩大到了整个G盘根目录,400G文件直接没了。后来有开发者做了个"第四种权限"插件来补救——项目内操作自动放行,删除磁盘根目录这类危险动作直接硬拒绝。但他说得很实在:这不是操作系统级沙箱,不能承诺绝对安全。其实不管用什么Agent,重要数据目录都别给Full权限。

第三个坑:隐私上有个细节。

Harness跑起来后本机会生成一个UUID,随每次请求发送,遥测开关并不影响它。36氪这事不算大,但你有知情权。

最后,分人群给点建议。

没接触过AI编程的:别直接跳进DSH深水区。它的上手门槛确实陡——命令行、Node环境、插件配置,先从Codex App这类开箱即用的、或者社区打包好的现成客户端开始,搞明白harness是什么再谈。

已经在为Claude Code或Codex付费的:rc.8的子代理模式值得轻试——用DSH当调度器,让CC和Codex干活,模型账单走便宜的Flash。但生产工作流先别整体搬,至少等v0.1稳定版。

Claude Code和Codex被DeepSeek

已经在玩DSH的:升级rc.8前做三件事——备份本地SQLite数据;检查重要目录的权限级别;第三方插件装前看源码,跑分信复现。

后面值得盯几个信号:rc.8之后更新节奏还保不保得住、正式版什么时候出、分时计价会不会再调整、插件审核机制会不会出现。这几个只要有一个变动,这篇文章的判断就要更新。

Hacker News主贴下有句高赞评论:“这次它看起来相当原创”。36氪一家长期被指责套壳的公司,第一次在那个社区被承认原创——靠的不是新模型,是一个开源框架。

Agent时代的入口之争刚开打。不用急着站队,但可以先看懂每一方在争什么。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章