当前位置:
AIGC文章详情

Codex开源,DeepSeek Harness爆火:AI编程混战,抢的是你的工作流

源自35位全网作者

10:17

这几天 AI 编程圈是真的热闹。如果你正在用 Claude Code、Codex 这类工具写代码,大概率已经被各种标题轰炸了一轮:什么"增长神话破灭"、什么"震撼开源"、什么"一周超越 Claude Code"。

我把知乎、微博、B站、36氪这几天的信息挨个翻了一遍,把情绪化的部分去掉之后,发现这周真正发生的事其实只有一件:巨头们不卷模型了,开始卷编程 Agent 的"中间层"——业内现在管这东西叫 Harness。

先说清楚这三天发生了什么

8 月 20 日,先是 X 上一个开发者发帖说"Anthropic 完蛋了,大量用户在疯狂取消订阅",配上第三方监测机构 TickerTrends 的 ARR 数据,"Claude Code 神话破灭"的说法传了一整天。微博但数据仔细拆开看:Claude Code 的 ARR 从 2 月中旬约 25 亿美元,到 8 月上旬约 151 亿美元,月环比增速从早期的 600% 以上掉到了 5.2%。知乎增速放缓是真的,但 5.2% 依然是正增长。知乎上有个较真的回答说得挺到位:截至 8 月 21 日,公开资料最多只能证明 Claude Code 增速放缓、Codex 增长更快,证明不了用户在大规模净流失。知乎

更有意思的是,这边刚讨论完 Claude Code 降速,X 上热议的下一个话题就变成了"疑似 Codex 订阅 token 消耗异常上涨"——你看,谁也别笑话谁。

真正的动作在 21 号:

第一,OpenAI 把 Codex 的执行层全面开源了,36氪当天的报道标题很直白,摘要里那句话更扎心:“AI 编程的护城河,被亲手拆开了”。36氪

第二,开源刚一周左右的 DeepSeek Harness 彻底火了。关于它的 star 数,各渠道口径差异很大:20 日的报道还说"破 3 万、登顶 Hacker News、创下史上最快破 2 万 star 纪录",21 日的视频渠道已经在说"开源一周获 16.7 万 star"。哔哩哔哩数字先让子弹飞一会儿,但热度是真的。它新版本最有嚼头的地方不是多模态,而是:Claude Code 和 Codex 现在可以作为子代理,被装进 DeepSeek Harness 里统一调度。用知乎一篇分析的话说——竞对的产品,变成了自己的零件。知乎

Codex开源,DeepSeek Harness爆火:AI编程混战,抢的是你的工作流

而且不只是围观,已经有人真上手了。知乎上有篇《DeepSeek-Harness 上手实测》把部署过程的坑原样贴了出来:环境要求苛刻(Node ≥ 22.19)、schema 校验有坑,pnpm install 还会报 @pnpm/exe 身份校验失败。知乎火归火,这工具离"开箱即用"还有距离。

第三,DeepSeek 同期还发了多模态版本 V4-Flash-Vision-Exp。B站 UP 主的实测说法是:视觉 Agent 任务能力大幅跃升,已经接近 Opus-4.8 的水平,而且图片按 token 计费,一张最多只算 384 个 token。哔哩哔哩

第四,Anthropic 这边看着最安静,其实也在落子:之前推出了 Claude Agent SDK(把 Claude 的 Agent 能力嵌进你自己的应用),20 号又发了《The Claude Code guide for startups》,访谈 15 家快速增长的创业公司,总结出五条原则。知乎

它们在抢的不是模型,是你的工作流

知乎上这周有句话传得很广:模型决定 AI 的"智力上限",Agent 决定智力发挥的程度。知乎

模型正在变得越来越可替换——你可以给 Claude Code 接 DeepSeek 模型,也有人专门写教程教你怎么在 Claude Code、Codex、Gemini CLI 里统一调用国产模型。但你沉淀在某个工具里的东西不一样:写了几十版的 CLAUDE.mdAGENTS.md 规则、攒下来的 Skills、配好的 MCP 和 Hooks、磨合了很久的工作习惯——这些东西的迁移成本非常高。36氪评 DeepSeek Harness 那篇文章,摘要就一句话:模型可替换,工作流难迁移。36氪

Codex开源,DeepSeek Harness爆火:AI编程混战,抢的是你的工作流

所以三家的动作,其实是在三个不同的层上下注:

Anthropic 押的是"生态绑定":你已经用顺手了 Claude Code,那我就教你把它嵌进自己的产品和公司流程里,越嵌越深;

OpenAI 押的是"开放标准":把执行层开源出去,让开发者在 Codex 的底子上长出自己的东西,先把生态做大;

DeepSeek 押的是"调度层":你们现在用什么工具都行,我来当上面那个总指挥,把现成的编程 Agent 都收编成子代理。有技术拆解文章直接点出:DeepSeek Harness 把 LLM Adapter、Tool Registry、Session Log,连 Agent Loop 本身,全部做成了插件——没有什么是不能换的。知乎

有篇技术向文章总结得对:这三件事根本不是同一层面的竞品,它们解决的是不同的问题。知乎

对你来说意味着什么?分人群说

如果你是 Claude Code 重度用户:这波不用慌着迁移。传的是增长放缓,不是产品崩了,你现有的工作流就是资产。但有两件事值得顺手做:一是把 CLAUDE.md、Skills、记忆文件这些资产备份一份,将来无论换哪个工具,这都是你的底牌;二是装东西小心点——36氪 21 日报道,研究人员用一个"假工具"就攻破了 Claude Code、Cursor 等六款主流编程工具。36氪也就是说,伪装成插件或工具的恶意组件是可以骗过 Agent 的,来路不明的插件和 MCP 别乱装。

Codex开源,DeepSeek Harness爆火:AI编程混战,抢的是你的工作流

如果你是 Codex 用户:执行层开源对你是利好,意味着更多第三方扩展、更透明的底子。但盯紧你的额度——X 上正在热议 Codex 订阅的 token 消耗疑似异常上涨。知乎已经有开发者干脆自己做了个 Codex 余额显示工具,挂在任务栏盯着。哔哩哔哩如果你感觉这个月的额度不如以前耐用,大概率不是错觉。

如果你在用国产方案、或者正在观望 DeepSeek:Harness 的势头确实猛,“一周三更"的开发节奏也很凶,加上 V4-Flash-Vision-Exp"一张图最多 384 token"的低成本多模态,国产 Agent 这套栈这次是真的在补齐。但记住一点:star 数不等于生产力。一周十几万 star 代表的是关注度,不是落地稳定性,各渠道的 star 统计口径甚至还没对齐。在官方模板生态和社区实践成熟之前,把它当"值得重点观察”,而不是"马上迁移"。

如果你还没入门:反而是最好的入场时机。三巨头打架,意味着工具在开源、能力在内卷、价格在竞争。随便挑一个成熟工具先跑起来,先把"用自然语言给 Agent 提需求"这件事跑通,比选哪个工具重要得多。

比选工具更值钱的一件事

这周知乎上我觉得最值的一个问答,是"codex、claude code 真的能完全接管复杂项目吗"。里面有个回答说到了要害:很多人给项目写的规则文件越写越长,但"请保持专业""请写高质量代码"这种话没有验收标准,真正重要的三五条要求反而被淹没。真正有用的规则,应该能回答五个问题:什么情况下触发?必须做什么?禁止做什么?怎么证明做过?做不了的时候怎么报告?知乎

Codex开源,DeepSeek Harness爆火:AI编程混战,抢的是你的工作流

这套思路对 CLAUDE.mdAGENTS.md,对任何工具都通用。工具会一直换,但"把需求写成 AI 可执行、可验收的规则"这个能力,是跟着你走的。连"清洁代码之父"Robert C. Martin(Uncle Bob)最近和开发者博主 Matt Pocock 直播对谈,聊的主题都是同一个:AI 时代,怎么用确定性工具去约束编程智能体。哔哩哔哩大佬们的方向很一致:别指望 AI 自己变靠谱,要给它可验证的规则。

接下来值得盯的三个信号

第一,DeepSeek Harness 的 star 增长曲线和模板生态。如果热度稳住、社区开始产出真正能用的工作流模板,"调度层"这个故事才算立住;

第二,Codex 开源生态一两个月内长出什么杀手级集成。开源这步棋成不成,不看 OpenAI 自己,看第三方能用它玩出什么;

第三,Anthropic 会不会跟进开源。目前它是唯一还攥着封闭生态的,顶不顶得住压力,很大程度决定这场仗的终局形态。

一句话总结:这场混战说明,模型只会越来越便宜、越来越可替换,你沉淀在 Agent 工具里的工作流和规则,才是真正属于你的资产。别为了尝鲜急着迁移,先把自己的资产理清楚。

内容由AI生成

精选参考来源

1. ClaudeCode的增长神话,破灭了!「Anthropic完蛋了,现在有大量用户正在疯狂取消订阅。」开发者的一条X,引发了社区热议。最新数据显示,ClaudeCode早期的爆炸式增长期,已经宣告结束。如今,新用户呈个位数增长,老用户在疯狂倒戈。CC的不少忠实用户,已经转向老对手OpenAI的Codex。ARR...全文

2. ClaudeCode增长神话破灭,挡不住用户用脚投票

3. Claude Code增长熄火,网传现大规模退订,为啥会这样?如何看待其诸多老用户开始转用Codex?

4. 震撼,OpenAI全面开源Codex Harness

5. 【中文配音】DeepSeekHarness开源一周获16.7万Star,能否超越ClaudeCode?

6. DeepSeekHarness一周三更:把ClaudeCode和Codex收编成子代理,要当Agent时代的"调度层"?

7. DeepSeek-Harness 上手实测:177k 星项目的 3 个坑与完整部署实操

8. V4-Flash-Vision-Exp分三口气才念完,DeepSeek第一款视觉模型来了

9. ClaudeCode让人人交付后,谁来验收?

10. 同一个大模型,接入不同Agent后差距到底有多大?我把WorkBuddy、OpenClaw、ClaudeCode、Codex放在一起看

11. DeepSeek Harness一周三更:把Claude Code和Codex收编成子代理,要当Agent时代的“调度层”?

12. 理解 Agent Harness:为什么模型越来越强,还需要一层复杂的软件系统?

13. ClaudeAgentSDK、CodexOpenAgentHarness、DeepSeekHarness:三种范式解决不同问题

14. Claude Code 被轻易攻破,仅需一个假工具

15. Claude Code增长熄火,网传现大规模退订,为啥会这样?如何看待其诸多老用户开始转用Codex?

16. 我做了全网最好看的Codex余额显示工具|Windows平台|ChatGPT|AI

17. 现在codex、claudecode等真的可以完全接管写出复杂项目?

18. [双语]AI时代的软件基本功:UncleBob谈如何用确定性工具约束编程智能体

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章