近日,DeepSeek公司发布并开源了一款名为DeepSeek Harness(简称DSH)的智能体框架,在开发者社区引发了广泛关注和讨论。与大众普遍认知的大模型不同,DeepSeek Harness并非一个新的语言模型,而是一个为模型打造的“外壳”或“执行系统”,旨在解决AI从“思考”到“行动”的关键一环。
这一框架的核心理念可以概括为“一切皆插件”。在传统的智能体产品中,许多核心功能如任务循环、用户界面、工具调用等都是固定且难以更改的。而DeepSeek Harness则采取了极致的模块化设计,将模型、工具、会话管理、沙箱环境乃至用户界面等所有组件都实现为可独立替换和自由组合的插件。这种设计思路赋予了开发者极高的自由度,他们可以像搭积木一样,根据自身需求定制、替换或扩展智能体的任何能力,而无需修改框架的底层源码。有开发者形象地将其比喻为AI领域的《我的世界》或乐高,用户可以基于一个朴素的地基,通过各式各样的“模组”(插件)创造出形态和功能迥异的应用。

这一架构的实现依赖于其名为Cordis的内核。Cordis源自一个成熟的开源聊天机器人框架Koishi,其核心思想在于实现“时空可组合性”。简单来说,“时间可组合性”通过追踪插件产生的所有影响,并自动生成逆向操作,确保插件在卸载时能够彻底回滚其所做的修改,实现无损“热插拔”;而“空间可组合性”则负责响应式地管理插件之间的依赖关系。这套机制为智能体的动态演化提供了理论和工程基础,使得智能体在未来进行自我修改和升级时,可以不必重启系统,从而避免中断当前任务和丢失状态。
在具体功能上,DeepSeek Harness引入了“轨迹”(Trajectory)或会话日志(Session Log)的设计。它会以只增不改的方式,完整记录智能体运行的每一步,包括它接收到的所有指令、推理过程、工具调用与返回结果。这一设计确保了智能体的工作流程完全透明、可追溯和可复现,极大地便利了开发者进行调试、审计和问题排查,打破了过去AI决策过程“黑盒”的状态。
根据不同的应用场景,DeepSeek Harness提供了四种默认模式:功能完整的“标准模式”;能将多步操作合并为一次程序执行的“PTC模式”;仅保留最基础工具用于模型基准测试的“极简模式”;以及允许开发者探索和创造新模式的“创造模式”。这些模式本质上是不同的插件配置清单,直观地展示了其灵活组合的特性。

此次发布采取了非常开放的策略。DeepSeek Harness以宽松的MIT协议完全开源,允许任何人自由使用和修改。这一举动迅速点燃了社区的热情,发布后短时间内便吸引了大量开发者关注,并涌现出数百个社区自制的插件,涵盖了从美化界面、增强功能到连接QQ、微信等外部平台的各种应用。
当然,作为一个刚刚发布的开发者预览版(v0.1),DeepSeek Harness也存在一些不足。有观点指出,其目前主要面向开发者,安装和使用方式对普通用户不够友好,界面和体验尚显粗糙。同时,完全开放的插件系统也对安全性和稳定性提出了更高的要求。官方也明确表示,产品尚在快速迭代中,未来可能会出现不兼容的更新。
从市场策略上看,DeepSeek Harness的发布伴随着其API价格的调整。分析认为,DeepSeek意在通过开源Harness框架,将其打造为行业通用的智能体执行层标准,从而将市场竞争的焦点从“外壳”拉回到模型本身的能力与价格上。这种“模型是大脑,Harness是手脚”的思路,旨在让DeepSeek跳出单纯的价格战,通过定义AI工作流的“操作系统”来构筑生态壁垒。
DeepSeek Harness的发布,不仅是DeepSeek在Agent领域的重要布局,也为整个AI行业提供了一种关于智能体框架构建的新思路。它通过“一切皆插件”的开放架构,将定制和创新的权力交给了广大的开发者社区,尽管目前尚处早期,但其展现出的潜力和方向值得长期关注。