DeepSeek正式开源Harness,AI竞赛进入执行层新阶段!
一个正在组装机器人的人,零件和工具环绕四周。
模型是大脑,Harness是手脚。
没有手脚的大脑,再聪明也干不了活。
DeepSeek今天做了一件可能比模型升级更重要的事:把“手脚”开源了。

8月13日,DeepSeek做了两件事。
第一件,DeepSeek V4 Pro正式版API上线,在Terminal Bench测试中以87.9分逼近全球第一的Fable 5(88.0分),差距只剩0.1分。
第二件,DeepSeek Harness开发者预览版v0.1正式发布,面向全球开发者开放测试,并以MIT协议开源。
第一件事,是模型能力的证明。第二件事,才是战略意图的暴露。
◆ Harness是什么?
脑能思且辨,手足助其行。
八法同台较,高低一夕更。
模型虽出众,框架定输赢。
若问值何价,全凭此器成。

在回答这个问题之前,先看一个实验。
8月11日,智能体工具公司Composio公布了一组对照测试:研究者把同一个DeepSeek V4-Flash接入8种不同的Harness,让它们分别完成30项多步骤任务。
这些任务不是单纯问答,而是要求智能体进入Gmail、Google Calendar、GitHub、Slack等真实应用,调用工具并改变真实的应用状态。
结果令人震惊:完成任务最多的Pi Agent通过了20项,最少的只通过了14项。
同一个模型,换了一套Harness,表现就从“垫底”变成了“第一”。
这就是Harness的价值。
潜台词:模型是大脑,Harness是手脚。大脑再聪明,没有能干活的手脚,也创造不了任何经济价值。

在AI圈有一个基本共识:Agent = Model + Harness。
决定智能体表现的,从来不只是底层模型这颗“脑子”,还有包裹在外的整套“外壳”,提示词模板、工具调用规则、记忆管理、控制流、安全护栏。
Harness是套在模型外面的一整套执行系统。
模型只负责理解、推理和生成,剩下的活,把代码库、终端和其他工具接过来交给模型,保存任务进度,出错了重试,最后验收结果,都由Harness处理。
Claude Code和Codex比普通聊天框更“能干活”,差别很大一部分就在这里。
◇ 为什么必须自己做?
无器难成千古事,自修框架始为长。
模型可付天下客,执行须握手中缰。
DeepSeek做Harness,不是心血来潮。


7月31日,DeepSeek在V4-Flash更新日志里公布九项代码和智能体测试成绩时,就在脚注里写明:公开基准里的代码智能体任务,用的是尚未发布的“DeepSeek Harness极简模式”。
5月,DeepSeek组建Harness团队,由崔添翼担任负责人,明确方向是“对标Claude Code,做DeepSeek Code Harness”。
更深层的原因,来自梁文锋的判断。
他此前谈到:下一代模型首先要帮助DeepSeek开发下一版模型。
顺着这条路线看,Harness的角色就变了,它不再是外挂的代码工具,而是模型进入真实研发任务的工作台。
任务怎么拆、工具怎么调用、失败怎么记录、结果怎么验收,都会帮助DeepSeek判断下一版模型该改什么。

网易智能的评论一针见血:“一家靠低价和模型能力立足的公司,把任务交付、失败反馈、开发者入口都长期挂在别人的系统里,肯定站不住。”
潜台词:模型可以开源,但执行系统必须握在自己手里。Harness是DeepSeek从“模型公司”走向“智能体平台”的关键一步。
一切皆插件
8月13日晚,DeepSeek Harness正式开源。
它的核心设计理念是“一切皆插件”:模型、工具、用户界面乃至智能体的运行循环都由插件组成,开发者无需修改框架源码,就能替换或扩展其中的单项能力。

当前版本提供四种运行模式:
标准模式:加载完整工具组合
PTC模式:允许模型生成代码,连续调用多个工具
极简模式:只保留Shell和文件编辑工具,主要用于模型测试
创造模式:允许智能体在运行过程中试验并组合新的插件
DeepSeek Harness还会把系统提示词、工具调用、子智能体调度和上下文注入等运行过程写入同一份仅追加日志,支持恢复、分叉、检索和回放。
用户安装Node.js后,可通过npx命令启动其网页界面。

团队表示,会向部分开发者提供API额度,帮助他们在DeepSeek Harness发布时完成接入。
▶ Harness正在成为新的竞争焦点
上联:开源Harness立行业标准
下联:深耕Agent铸生态根基
横批:双轮驱动
DeepSeek不是唯一在做Harness的公司。
2026年,Harness(工具框架)直接带动了VibeCoding,或者说“代码智能体”,成为2022年“GPT时刻”以来首个成功商业化的杀手级应用。
微软在7月22日发布了Microsoft Agent Framework Harness。各大前沿AI实验室,以及一波新入局者,都开始推出各自的框架:Hermes、Pi、OMP、Prime Agent,名单还在不断加长。
正如Composio所说:“框架正是通往实际经济价值的最后一公里。”
潜台词:当模型能力的差距在缩小,竞争的关键就从“谁的模型更强”变成了“谁的Harness更好用”。这是从“能力”到“价值”的跨越。
DeepSeek的战略卡位
DeepSeek Harness的开源,是一次精准的战略卡位。
以MIT协议开源,意味着全球开发者可以自由使用、修改和分发。
这不仅能快速吸引开发者生态,还能让DeepSeek Harness成为行业的事实标准,就像Linux在操作系统领域的角色。
崔添翼此前在社交媒体上开玩笑说,融资材料把V4-Pro的编程能力“吹”得过高。
但玩笑归玩笑,DeepSeek Harness的发布是认真的,GitHub仓库已全量开源,支持通过npm快速启动。
梁文锋在内部投资人会议中表示,在Agent方向上,公司应“全力做通用的Agent”,垂直Agent优先级较低。
《论语》说,工欲善其事,必先利其器。Harness就是那个让AI“善其事”的器。
从模型到Harness,从Harness到通用Agent,DeepSeek的路线图正在变得清晰。
翻译过来就是:模型是大脑,Harness是手脚。大脑再聪明,没有能干活的手脚,也创造不了任何经济价值。
这段适合转给关注AI技术演进的朋友看看,AI行业的竞争,正在从“谁家模型更强”变成“谁家Harness更好用”。
写在最后
Harness开源,不是DeepSeek的一次普通发布。
它标志着AI行业正在从“模型能力竞赛”进入“智能体执行竞赛”的新阶段。

当模型差距在缩小,谁能把模型“武装”成真正能干活的智能体,谁就掌握了经济价值的“最后一公里”。
模型是脑,Harness是手脚,同一模型换一套,垫底变榜首。
开源为利刃,生态筑长壕,AI竞争下半场,看谁把活干得巧。
✋ 轮到你了
DeepSeek Harness开源了,你觉得它会成为AI时代的“Linux”,还是只是又一个开源框架?你会在项目里尝试用它吗?欢迎在评论区聊聊。
点个赞、点个小心心,让更多人看到:AI行业的竞争,正在从“谁家模型更强”变成“谁家Harness更好用”。
【免责声明】: 本文部分配图源自公开渠道或CC0协议素材,仅作行业交流与产业参考使用。如涉侵权,请联系后台处理。本文仅做行业科普与实操分享,不构成任何投资、消费决策建议。文中数据及案例均来自公开信源,仅供参考,具体以实际为准。
#DeepSeek# #harness# #开源# #ai智能体# #Agent# #AI# #大模型# #技术# #开发者# #科技#
