DeepSeek开源Harness,Agent拆成乐高插件自由拼装

源自337位全网作者

01:55

内容由AI生成

精选参考来源

1. 首发体验 | DeepSeek Harness 来了,它不想做下一个Codex

2. DeepSeek Harness,是今年最有野心的一次Agent开源

3. #DeepSeekHarness发布#DeepSeek正式开源发布智能体框架Harness,提出「Model+Harness=Agent」。如果说大模型是AI的大脑,Harness就是连接现实环境的执行系统,依靠“一切皆插件”架构,自由调度工具、管理长周期任务,补齐智能体落地短板。这次发布标志行业竞争进入新阶段:单纯比拼模型跑分已经过时,落地能力成为新赛道。依托自身大模型极致成本优势,Harness直面Claude Code等产品竞争,降低开发者搭建智能体的门槛。从卖模型算力,到提供完整智能体工程方案,DeepSeek的布局清晰可见。未来AI比拼不再局限推理能力,能否稳定完成端到端复杂任务,才是拉开差距的关键。

4. #DeepSeekHarness发布# 今日,DeepSeek正式发布其首款Agent产品——DeepSeek Harness。该产品支持项目管理、长任务协作、多Agent编排、上下文管理,并整合了联网搜索与Skill功能,旨在为大模型提供完整的工程化支撑。DeepSeek内部将Harness定义为“Model+Harness=Agent”,即模型专注思考推理,Harness承担工具调用、任务规划、执行调度等模型外的全部工程化工作。Harness聚焦代码智能体赛道,直接对标OpenAI的Codex与Anthropic的Claude Code,标志着DeepSeek在AI Agent领域的正式落子。

5. 【热门AI鉴定】DeepSeek Harness是什么?强在哪里?Harness实测效果如何?一口气搞懂!

6. 刚刚,DeepSeek Harness震撼开源:一切皆插件

7. 「Github一周热点127期」DeepSeek Harness、AI画图Skill、自进化编程Agent、团队工作台和可审计语义图谱

8. DeepSeek首款Agent产品,正式亮相!今天DeepSeek发布了DeepSeek Harness。通俗理解,像给大模型配了一个"全能助理"——AI负责思考推理,Harness负责所有工程化落地,比如工具调用、任务规划、执行调度、联网搜索、多Agent协作等。这次Harness重点聚焦"代码智能体"赛道,直接对标OpenAI Codex和Anthropic Claude Code,能帮开发者自动完成代码编写、项目管理、长任务协作等复杂工作。Harness,让AI不仅会想,更能真正"动手"干活。#DeepSeekHarness发布#

9. DeepSeek正式推出其首款Agent产品DeepSeek Harness开发者预览版,并同步在GitHub以MIT协议开源。这不仅是DeepSeek从“模型供应商”向“应用框架层”延伸的标志性动作,更意味着代码智能体(Code Agent)的竞争从单一模型能力比拼,升级为“模型+工程化工作台”的全栈生态角逐 #DeepSeekHarness发布# DeepSeek Harness发布:代码智能体赛道迎来“全栈工作台”范式革命

10. DeepSeek 把 Agent 拆成乐高开源了——但真正值钱的不是今天多好用

11. #DeepSeekHarness发布#终于等到 DeepSeek 首款智能体产品 DeepSeek Harness 正式亮相了。前几日行业里就传出消息,团队新开了官方公众号,不少从业者都还在观望上线时间,没想到节奏紧凑,短短数日就正式推出,这个效率着实让人意外。纵观当下行业态势,2026 年算得上 Harness 工具框架助推 VibeCoding 走向商业化落地的关键年份。目前市场认可度最高的两款标杆产品,就是 OpenAI 的 Codex 以及 Anthropic 的 Claude Code,凭借成熟的代码编写、任务统筹能力,长期稳居 AI 代码智能体第一梯队,也是很多海外开发者日常编程的主力工具。不过在我个人看来,闭源产品终究有着难以规避的局限,适配国内开发环境总会存在隔阂。DeepSeek 此次推出的 v0.1 版本仅仅只是开端,官方并未追求一蹴而就做到完美,核心主打开源开放、模块化可复用的底层架构。愿意把基础设施敞开,邀请全球开发者共同打磨优化,一起挖掘 AI 编程的潜力。和海外封闭生态对比,开源模式更贴合国内开发者的使用习惯,方便大家结合本土开发场景调整优化。不再只局限于大模型参数比拼,转而深耕工程化工作流搭建,这样的发展思路,也会让 AI 代码赛道迎来更多新鲜变数。#热点跨界共创# #deepseekharness发布#

12. #DeepSeekHarness发布# 这两天的AI圈有点热闹啊,新品层出不穷,功能也是越来越强,越来越实用的。DeepSeek Harness来了,但这次不是模型,是Agent。它更像一个能跟你并肩作战的“数字合伙人”:项目管理、长任务协作、多Agent编排,这些以前需要一整个小团队才能跑通的复杂流程,现在Harness一个平台就能搞定。最实用的是它的上下文管理和联网搜索能力,再长的项目背景它都记得住,需要实时信息时也能自己“上网查”,不用你反复喂资料。加上Skill功能的灵活扩展,相当于给AI装上了可定制的手脚。大模型发展到今天,智能体也越来越强,真的别把它当聊天机器人,它是个能把想法拆解成步骤、把步骤落地成结果的生产力工具。#ai#

13. #零态洞察百态# 【#DeepSeekHarness发布#】今日DeepSeek正式发布了首款Agent产品,DeepSeek Harness。目前支持管理项目、长任务协作、多 Agent 编排、上下文管理以及联网搜索和 Skill 等功能。DeepSeek 内部将 Harness 定义为“Model+Harness=Agent”,即大模型负责思考推理,Harness 承担模型外所有工程化工作,包括工具调用、任务规划、执行调度等。Harness 重点聚焦代码智能体(Code Agent)赛道,直接对标 OpenAI 的 Codex 和 Anthropic 的 Claude Code。#DeepSeekHarness#

14. #DeepSeekHarness发布#DeepSeek终于不只是会“聊天”了。今日正式发布首款Agent产品DeepSeek Harness,支持项目管理、长任务协作、多Agent编排、上下文管理,还能联网搜索和调用Skill。简单说,就是从“你问我答”开始进化到“你交代任务,我自己拆解、执行、协作并完成”。AI真正有意思的地方,可能从模型有多聪明,开始转向它到底能替你干多少活。

15. #DeepSeekHarness发布#今天AI圈最值得关注的事:DeepSeek Harness正式开源了。不是又一个大模型,而是一套让模型真正“干活”的执行系统。官方定义很简单:Model + Harness = Agent。模型负责思考,Harness负责调用工具、规划任务、落地执行——把“能聊”变成“能干”。最打动我的一点是模型中立:不强制绑定DeepSeek自家模型,OpenAI、Anthropic等近40家第三方接口都能接。不用被任何一家绑死,哪个模型好用就用哪个。更关键的是MIT协议全面开源,代码随便下、随便改、随便商用。加上“一切皆插件”的架构,想换工具换模型换UI都行,开发门槛被大幅拉低。AI执行层的门槛,今天被彻底拆掉了。去玩吧,别只当观众。GitHub已可获取,四种运行模式从极简测试到创造模式都有。#DeepSeekHarness发布#

16. DeepSeek每次都是晚上搞大事~刚发布了Agent产品——Harness,定位是Coding Agent,对标Claude Code。核心逻辑是“Model+Harness=Agent”——模型负责思考,Harness负责干活(调工具、管上下文、执行任务),把模型能力真正落地到编程场景。本来以为是腾讯WorkBuddy类似的通用办公Agent;不过看介绍,Harness的操作界面和主要场景,应该都是给程序员用的专业工具。Coding Agent这赛道已被Claude Code验证,年入25亿美元。DeepSeek成本只有对手1/100,这波性价比拉满。程序员朋友可以关注下了~#DeepSeekHarness发布##DeepSeekHarness##AI#

17. #DeepSeekHarness发布# 别人把 Agent 框架当护城河捂着,DeepSeek 今天把首款 Agent 产品 Harness 直接开源了——开发者预览版 v0.1,MIT 协议,一行 npm i @deepseek-ai/dsh 就能装。这东西的定位是"模型之外的一切":项目怎么管、长任务怎么接、多个 Agent 怎么编排、上下文怎么收、联网搜索和 Skill 怎么接,全打包成一套执行框架。官方那句"Model + Harness = Agent",说的是他们不把 Agent 逻辑塞进模型里,而是把脚手架单独抽出来、还开放了。对标的是 Claude Code 和 Codex,主打编程和办公。现在还是早期预览,官方自己也说很多细节要打磨。但一上来就开源,等于把地基亮给所有人看——是想借社区把框架跑快,还是真不打算靠它收口子,得看后面插件生态长成什么样。

18. #DeepSeekHarness发布#它来了它来了,Deepseek首款agent产品上线。前两天就流传了DeepseekHarness团队公众号开启没想到这么快就来了。今年可以说是Harness(工具框架)带动VibeCoding发展比较成功的商业化应用一年,最为出名的两款Harness是OpenAI的Codex和Anthropic的Claude Code。Deepseek官方说了,DeepSeek Harness目前的 v0.1 版本只是一个起点,他们期待与全球开发者一起,在开源、开放、可复用、可组合的基础设施之上,共同探索智能上限。

19. #DeepSeekHarness发布# 说真的,今天DeepSeek这波属实把我看服了。V4 Pro正式版刚落地,首款Agent产品Harness直接端上来。晚上有空我去查了写资料,详细了解了一下。以前用AI最怕“脑子会了手没跟上”,跑一半断网报错心态直接崩。Harness主打一个靠谱:自动存档+断点续传,长任务稳如老狗。对标Codex?Codex确实稳,但太贵,国内网络还折腾。Harness单任务成本两毛左右,直接打到零头,NPM插件生态全开放,随便折腾。办公场景更狠:Excel丢几万行数据,它自己写Python跑数据画图表,报错自动改代码重试;Word万字报告,自动规划大纲分步生成,输出Markdown丢进去秒排版;PPT直接提炼观点生成底层代码,逻辑梳理全包。现在就等天亮了,好好睡一觉,明天准备好好玩一玩,感受感受,看看能不能和我工作有机结合起来。#DeepSeekHarness##AI智能体##VibeCoding##科技妈咪#

20. DeepSeek Harness 开发者预览版开放测试:一切皆插件

21. 硅谷慌了。   DeepSeekHarness这只“黑鲸”正式浮出水面。公众号独立注册、全球内测招募、V4-Flash同步公测,当一家中国AI公司开始自己造“马具”的时候,大洋彼岸的巨头们还坐得住吗?   8月11日,“DeepSeekHarness团队”微信公众号完成注册。Logo是一只黑色鲸鱼,认证主体为北京深度求索公司。账号7月6日注册,次日即完成认证。   Harness到底是什么?绝大多数人压根没搞懂。   DeepSeek内部有一个核心公式:Model+Harness=Agent。模型是大脑,负责推理、理解需求、生成代码。Harness呢?是执行神经系统,负责调度工具、管理任务状态、执行闭环。大白话:模型只会“说”,Harness让AI真正“动手干”。   这玩意儿能干什么?自主读取解析代码仓库、批量修改源码文件、自动化运行单元测试、精准定位漏洞、自主修复bug。从需求对接到代码开发再到测试运维,端到端,全流程。   Harness为什么重要?因为2026年,Harness直接带动了VibeCoding成为“GPT时刻”以来首个成功商业化的杀手级应用。   最知名的两款Harness,OpenAI的Codex和Anthropic的ClaudeCode。ClaudeCode有多猛?Anthropic在2026年2月完成300亿美元G轮融资后透露,ClaudeCode年化收入已经来到25亿美元。东方证券研报显示,2026年全球智能体代码市场规模约80亿美元,CR4高达86%,远期中美总潜在市场合计达4000亿美元。   DeepSeekHarness一上来,就直接对标ClaudeCode。   更狠的是,DeepSeek资深研究员陈德里早就在社交媒体上放了话,“简单来说就是对标ClaudeCode,做DeepSeekCodeHarness”。   8月7日,FloatboatHarness在五项第三方基准上发布完整评测数据。底座用的是DeepSeekV4-Flash,输入$0.14/百万token、输出$0.28,混合价$0.175/M。对面是ClaudeOpus4.8,混合价$10/M,贵57.1倍。   结果呢?$0.175的底座,五项全部超过$10的旗舰。   赢它的不是模型,是Harness。同一个DeepSeek-V4-Flash,跑在官方自己的Harness上和跑在别人家框架上,效果天差地别。Harness做得好,模型能力就能被十倍、百倍地释放。   AnthropicClaudeCode还有一个致命问题,闭源。   上个月,部分AI社区用户发现,当用户指向非官方端点时,ClaudeCode客户端会把代理域名、系统时区等信息隐写回传给Anthropic服务器。工信部网络安全威胁和漏洞信息共享平台已经发布了风险提示。   你的代码库目录结构、系统时区,正在被悄悄传回硅谷。   而DeepSeekHarness团队秉承什么理念?开放。明确组建多个模型接口方向的工程师团队,不限于接入自家模型。模型团队与Harness团队分离,Harness可能独立运作,甚至与其他模型厂商合作。   这场仗打到这个份上,DeepSeek要的已经不是API调用量了。   行业价格战打到什么程度?国产大模型在OpenRouterToken调用量月榜前十中占据七席,DeepSeekV4Flash位列第二。但单纯卖算力的模式,天花板已经到了。   Harness的战略价值在于,从“卖算力”转向“交结果”。客户付费依据从模型调用量变成实际完成的工程任务。价值创造和收益直接挂钩,彻底跳出低价竞争的红海。   硅谷慌的不是DeepSeek又发布了一个模型。   慌的是,一家中国公司开始自己定义“模型之外的一切”。慌的是,当行业竞争从“底层模型比拼”转向“落地能力与工程体系的较量”时,DeepSeek已经悄悄把Harness这条战线铺开了。慌的是,贵57.1倍的对手被打趴下,靠的不是更贵的模型,而是一套更好的Harness。   更慌的是,如果Harness真的开源,行业统一脚手架这个位置,它就有机会先占住。 梁文锋曾经说过,DeepSeek现阶段最重要的是CodingAgent。Harness就是这句话的落地,不是模型,不是论文,是能跑、能干、能交付结果的系统。   硅谷慌了。因为这次浮出水面的,不是又一个大模型参数榜单,而是一整套能让AI真正“干活”的底层系统。黑鲸才刚露头,水面下的动静,才刚刚开始。   信息来源:界面新闻《DeepSeek智能体要来了?公众号已完成注册认证》(2026-08-12)#DeepSeek智能体要来了吗#

22. DeepSeek黑鲸鱼上线:AI编程下半场的门票已经不是模型了

23. DeepSeek,重大发布

24. 凌晨两点刷到这条,我直接从床上坐起来了。 DeepSeek那只黑鲸,8月11号深夜又搞事了——"DeepSeekHarness团队"的公众号,悄无声息地上线了。 不是新模型。是比新模型更狠的东西。 很多人还没反应过来Harness是啥,但我告诉你:这玩意儿要是做成了,AI圈的游戏规则,今晚就得重写。 说人话。 你现在跟ChatGPT说"帮我修个bug",它回你"好的已修复"——修了吗?如修。 它根本没手没脚,就是个"缸中之脑"。 Harness,就是给这个大脑装上四肢。 业内有个公式:Model + Harness = Agent。 模型负责想,Harness负责干。调工具、跑测试、出错回滚——这些脏活,模型干不了,得靠Harness。 有个特别扎心的数据:同一个Claude模型,用Anthropic自家的Claude Code跑,得分95%;换个简陋配置,直接跌到42%。 同样的脑子,不同的身子,差了一倍多。 所以你看,OpenAI推Codex,Anthropic推Claude Code,Google推Project Mariner。大厂全在抢这个赛道。 DeepSeek这次派谁去打?崔添翼。 浙大计算机出身,华尔街量化巨头Jane Street干了九年,今年3月才加入DeepSeek。5月立项,8月1号在X上发内测招募,面向全球收编"造过Harness"的开发者。 评论区直接炸了。LLaMA-Factory作者、LobeHub团队、elizaOS核心开发者全冒头。有人整理了425条回复,61个人亲手造过轮子——Rust、Go、双Loop、崩溃恢复,各路神仙都想看看DeepSeek的官方轮子长啥样。 更关键的是,DeepSeek-V4-Flash的API文档里已经白纸黑字写了:CodeAgent测试,用的是DeepSeekHarness极简模式(即将发布)。 不是PPT,已经在跑了,就差掀牌。 而且按DeepSeek一贯的尿性,这东西大概率开源。 Claude Code已经占了GitHub公开提交量的4%。这个位子,DeepSeek不可能不抢。如果真有一款国产版Claude Code,月租只要海外的几分之一,还能国内直连、私有化部署——不用翻墙,数据不出本地。 程序员效率翻倍,小公司一个人干一个团队的活,你手机里的APP迭代更快、bug更少。 这才是真正的科技普惠。 所以我想问你:如果真有一款国产AI,能帮你写代码、做表格、改文档,月租一杯奶茶钱——你敢不敢把活儿交给它干? 评论区聊聊,我看看有多少人是真敢的。 #DeepSeek #AI编程 #人工智能 #ClaudeCode #科技圈

25. DeepSeek智能体要来了?公众号已完成注册认证

26. 黑鲸出水!DeepSeek Harness公众号正式上线

27. 天变了。 DeepSeek Harness团队公众号刚刚完成注册,Logo是一只黑色鲸鱼,这是DeepSeek首次为Harness业务线单独设立官方发布阵地。从模型到智能体,DeepSeek这一步,到底要多大? 公众号注册时间是7月6日,7月7日就完成了认证,一个月过去了,账号里一个字没发。但这一个月,外面已经沸腾了。 7月31日,DeepSeek-V4-Flash正式版API悄悄上线公测,什么叫悄悄?没有发布会,没有通稿,就更新了一条API日志,Agent能力暴涨6倍。 在权威的Terminal Bench 2.1测试里,Flash正式版拿了82.7分,把自家V4-Pro预览版的72.1分远远甩开。逼近Opus-4.8的85分。 更狠的是什么?第三方评测机构Artificial Analysis当天就把Flash放上了榜单,智能指数50分。比自家V4-Pro还高6分。一个Flash版,把Pro版反超了。而Flash版的总参数2840亿,激活参数才130亿,一个轻量模型,把旗舰预览版摁在地上摩擦。 最让人细思极恐的是另一件事:模型结构和尺寸跟预览版一模一样,只把后训练重做了一遍。三个月前官方自己承认Flash在复杂Agent任务上跟Pro有差距,三个月后同一个身子把Pro给反超了。后训练的优化空间,远比我们想象的更大。 这帮人到底在憋什么大招? Harness团队负责人叫崔添翼,90后,浙大计算机毕业,大学拿了6枚ACM亚洲金牌。然后在全球顶尖量化机构Jane Street干了9年。2022年联合创办量化交易公司TSY Capital。今年3月加入DeepSeek。 他不是传统AI学术派,他是搞量化交易出身的,玩的是真实系统、低延迟交易、模型输出落到执行层会遇到什么坑。DeepSeek找他来带Harness,说明什么?说明这家公司清楚一件事,光有模型不行,得让模型真的能干活。而让模型干活这件事,需要的是懂真实系统的人,不是只会写论文的人。 现在市面上绝大多数大模型都是“嘴炮型”,你说它懂,它什么都懂;你让它干,它什么都干不了。不会读写本地文件,不会调用第三方工具,代码报错不会自己修。Harness要干的事,就是补齐这些短板。把AI从一个“会聊天”的东西,变成一个“能干活”的东西。 这一步,比大多数人想象的要大得多。 中信证券的研报点得很透:拥有成熟Harness的厂商,同时握着两项稀缺资产,一是从任务入口到结果交付的商业闭环,二是长程任务轨迹和纠错反馈这类高质量数据。这两样东西互为强化,先发者的优势很难被追上。 换句话说,谁先把Harness做出来、跑起来、形成数据飞轮,谁就在下一代AI竞争里卡住了身位。 DeepSeek这次对标的是谁?Claude Code。 Anthropic的Claude Code年化收入已经超过25亿美元,周活用户翻倍增长。OpenAI的Codex周活用户在15天内从300万涨到400万。全球智能体代码市场规模约80亿美元,远期中美总潜在市场合计4000亿美元。这不是小打小闹。 DeepSeek的Harness团队现在什么状态?缺人,非常缺人。崔添翼自己说“我每天都在面试,在各个渠道发布招聘小广告”。目标宏大,工作繁重,人手仍然紧缺。 8月1日他面向全球开启内测用户征集,优先招募有Agent开发实战经验的开发者。结果一条内测帖发出去,评论区秒变“开源Agent路演”,截至8月3日上午,769位报名者、712个开源仓库、合计超过120万Stars。 开发者们排队往里冲。 但也得泼盆冷水。Harness这个东西,DeepSeek自己都还没正式发布,V4-Flash的测试分数是在DeepSeek Harness“极简模式”下跑的,自家框架测自家模型,这分数得打个折。而且官方技术报告也承认,模型在超过128K上下文后性能就开始往下掉。从测试到产品,从内测到大规模商用,中间的坑一个都不会少。 还有一个潜在风险:崔添翼在社交平台上说过,DeepSeek招人需要能用中文工作。这话被外界解读为“不招外国人”。在全球化的AI竞争里,人才池子主动收窄,会不会影响团队的技术视野和工程速度?这事值得盯。 但无论如何,DeepSeek这一步已经迈出来了,从公众号注册到内测招募,从V4-Flash的Agent能力暴涨到Harness框架的首次亮相,这家公司正在做一件很多人想做但没做成的事,让AI真正能干活。#DeepSeek智能体要来了吗##上头条 聊热点#

28. DeepSeekHarness团队公众号上线,IP属地北京,Harness产品疑似即将发布

29. 最近 #DeepSeekHarness火了#,我觉得这件事真正值得关注的地方,是DeepSeek终于开始补自己最缺的那一块:Agent产品层。 过去很多人用DeepSeek做Agent,实际上是“DeepSeek模型+别人的壳”。 比如腾讯WorkBuddy,本身就是一个桌面AI Agent,可以调用DeepSeek、混元、Kimi、GLM等不同模型,腾讯官方文档也专门提供了DeepSeek V4 Pro的接入方式。 这个模式当然能用,但问题在于,模型的最大能力未必能发挥出来。 今天的Agent已经不是简单地问模型一个问题、模型回答一句话。上下文怎么管理、什么时候调用工具、任务怎么拆解、失败之后怎么重试、执行结果怎么验证,这些Harness层的设计都会直接影响最终效果。 甚至同一个模型,换一套Harness,Agent表现都可能差很多。 这也是为什么DeepSeek这次自己做Harness值得关注。 这对WorkBuddy反而可能是最大的威胁。 因为今天很多人用WorkBuddy,一个重要原因就是它给DeepSeek这样的模型加上了电脑操作、文件处理、工具调用和Agent执行能力。 可一旦DeepSeek自己的Agent正式出来,并且针对自己的模型做深度适配,用户很自然会问一句:我为什么还要在WorkBuddy里面套一层DeepSeek,而不直接用DeepSeek自己的Agent? 当然,WorkBuddy依然有自己的优势,比如多模型切换、QQ/企微生态以及办公场景整合,这些并不会因为DeepSeek Harness出现就消失。腾讯也把WorkBuddy定位成全场景桌面AI智能体,而不只是DeepSeek客户端。 但长期来看,Agent竞争很可能会从“谁接入的模型更多”,逐渐变成“谁能把一个模型的能力压榨得最彻底”。 如果DeepSeek自己的模型+自己的Harness真的做到1+1>2,那么今天靠“套DeepSeek”获得吸引力的Agent产品,都会面临一个问题: 当原厂开始自己造整车,第三方车厂的日子就没那么舒服了。

30. 昨天就有网友发现,「DeepSeek Harness 团队」的微信公众号已经悄悄完成注册,认证主体是北京深度求索人工智能基础技术研究有限公司。【P1】 考虑到 DeepSeek 过去几个月围绕 Harness 的动作,几乎就是暗示了 DeepSeek 的桌面端 Agent 产品即将推出。事实上,雷科技早在之前的多次报道中提出,DeepSeek 需要有自己的 Codex/Claude Code。 而 DeepSeek 的 Harness 团队,其实也早在今年 5 月就已经浮出水面。当时 DeepSeek 接连招聘 Agent Harness 产品经理和研发工程师: 参与 DeepSeek 桌面端 Agent 产品研发的全过程,定义 DeepSeek 对 Harness 的理解。【P2】 DeepSeek 研究员陈德里甚至把目标概括成了「对标 Claude Code,做 DeepSeek Code Harness」。 这里的 Harness,你可以简单理解成模型之外那套「让 AI 真正干活」的系统。 模型负责理解和推理,但一个 Agent 要读文件、调用工具、执行代码、管理上下文,还要知道什么时候继续、什么时候检查结果、什么时候纠错,这些连接模型和真实任务的东西,大体都属于 Harness。 这也决定了一个聪明的模型最后能不能驱动起一个好用的 Agent。 而 DeepSeek 对这件事的投入,也在加速。6 月,Harness 团队负责人崔添翼在 X 上多次公开表示团队非常缺人。【P3】 目前 DeepSeek 官网除了 Agent Harness 团队,还在招聘 Agent Infra、Code Agent 数据工程师以及通用 Agent 数据产品经理,方向也从代码延伸到了办公、生活和搜索。 模型本身也在为 Agent 铺路。DeepSeek 从 V3.1 开始就公开强调工具调用和多步 Agent 能力,之后的模型进一步支持思考过程中连续调用工具。 所以这次注册 Harness 团队公众号,更多还是一个阶段变化的信号。 至于 DeepSeek 最终会先推出类似 Claude Code 的编程 Agent,还是直接做更通用的桌面 Agent,目前还不明朗。但有一点毋庸置疑——在 Claude、ChatGPT 以及国内大厂都开始从「聊天」走向「干活」之后: DeepSeek 也要走上同一条路。 #DeepSeek##Harness##大模型##Agent#

31. DeepSeek开设「Deepseek Harness团队」账号

32. 深度求索开设“DeepSeek Harness团队”公众号

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章