DeepSeek开源Harness,对标Claude Code,单任务成本不到两毛

源自58位全网作者

08:24

内容由AI生成

精选参考来源

1. #DeepSeekHarness发布#DeepSeek的Agent产品Harness终于来了,代号“黑鲸”。内部公式很直接:Model+Harness=Agent。模型负责思考推理,Harness包办模型外的所有工程脏活——工具调用、任务规划、执行调度。说白了,大模型是脑子,Harness是手和脚。脑子再好使,手脚不利索也白搭。Harness就死磕代码智能体这条赛道,直接对标OpenAI的Codex和Anthropic的Claude Code。更狠的是,Harness开发者预览版已经开源(MIT协议),还开放了npm插件生态。“一切皆插件”的设计,摆明了不想做第二个Codex,要做就做自己的玩法。模型能力决定上限,Harness决定这能力最终能兑现多少。DeepSeek这步棋,抢的是模型之外的工程入口。Codex和Claude Code的好日子,可能没那么安稳了。

2. 刚刚,DeepSeek Harness震撼开源:一切皆插件

3. #DeepSeekHarness发布#终于等到 DeepSeek 首款智能体产品 DeepSeek Harness 正式亮相了。前几日行业里就传出消息,团队新开了官方公众号,不少从业者都还在观望上线时间,没想到节奏紧凑,短短数日就正式推出,这个效率着实让人意外。纵观当下行业态势,2026 年算得上 Harness 工具框架助推 VibeCoding 走向商业化落地的关键年份。目前市场认可度最高的两款标杆产品,就是 OpenAI 的 Codex 以及 Anthropic 的 Claude Code,凭借成熟的代码编写、任务统筹能力,长期稳居 AI 代码智能体第一梯队,也是很多海外开发者日常编程的主力工具。不过在我个人看来,闭源产品终究有着难以规避的局限,适配国内开发环境总会存在隔阂。DeepSeek 此次推出的 v0.1 版本仅仅只是开端,官方并未追求一蹴而就做到完美,核心主打开源开放、模块化可复用的底层架构。愿意把基础设施敞开,邀请全球开发者共同打磨优化,一起挖掘 AI 编程的潜力。和海外封闭生态对比,开源模式更贴合国内开发者的使用习惯,方便大家结合本土开发场景调整优化。不再只局限于大模型参数比拼,转而深耕工程化工作流搭建,这样的发展思路,也会让 AI 代码赛道迎来更多新鲜变数。#热点跨界共创# #deepseekharness发布#

4. DeepSeek首款Agent产品,正式亮相!今天DeepSeek发布了DeepSeek Harness。通俗理解,像给大模型配了一个"全能助理"——AI负责思考推理,Harness负责所有工程化落地,比如工具调用、任务规划、执行调度、联网搜索、多Agent协作等。这次Harness重点聚焦"代码智能体"赛道,直接对标OpenAI Codex和Anthropic Claude Code,能帮开发者自动完成代码编写、项目管理、长任务协作等复杂工作。Harness,让AI不仅会想,更能真正"动手"干活。#DeepSeekHarness发布#

5. #DeepSeekHarness发布#今天AI圈最值得关注的事:DeepSeek Harness正式开源了。不是又一个大模型,而是一套让模型真正“干活”的执行系统。官方定义很简单:Model + Harness = Agent。模型负责思考,Harness负责调用工具、规划任务、落地执行——把“能聊”变成“能干”。最打动我的一点是模型中立:不强制绑定DeepSeek自家模型,OpenAI、Anthropic等近40家第三方接口都能接。不用被任何一家绑死,哪个模型好用就用哪个。更关键的是MIT协议全面开源,代码随便下、随便改、随便商用。加上“一切皆插件”的架构,想换工具换模型换UI都行,开发门槛被大幅拉低。AI执行层的门槛,今天被彻底拆掉了。去玩吧,别只当观众。GitHub已可获取,四种运行模式从极简测试到创造模式都有。#DeepSeekHarness发布#

6. #DeepSeekHarness发布#DeepSeek在AI智能体上开始发力了,从DeepSeekHarness发布可以看出来,DeepSeek目前还是在打造大模型基础底座,只有打磨好了这个底座DeepSeek才会去发展自己的全生态。目前的DeepSeek在行业里还是被定义成一个专业大模型的角色,只有突破了这个角色DeepSeek才能在市场中真正的大展拳脚,现在一遍夯实自己的基础,一遍突破自己的角色,这个对DeepSeek来说是当下最重要的任务。对于DeepSeek不要太着急,这个是一个有着自己坚定的发展目标的企业。

7. #DeepSeekHarness发布#这次DeepSeek Harness的上线,标志品牌不再只专注大模型研发,正式布局智能体工程基础设施。产品采用“一切皆插件”设计思路,内测阶段开发者就产出数百款自定义插件,支持多Agent协同编排、联网检索、自定义Skill拓展,适配编程开发、项目管理等复杂长周期任务,本地工作台模式兼顾隐私与灵活拓展能力,对比同类Codex类产品拥有更强自定义空间。

8. #DeepSeekHarness发布#DeepSeek也杀入agent领域了。今天,DeepSeek正式发布了首款Agent产品——DeepSeek Harness。DeepSeek 内部将 Harness 定义为“Model+Harness=Agent”,即大模型负责思考推理,Harness 承担模型外所有工程化工作,包括工具调用、任务规划、执行调度等。Harness 重点聚焦代码智能体(Code Agent)赛道,直接对标 OpenAI 的 Codex 和 Anthropic 的 Claude Code。8月1日,团队负责人崔添翼面向全球公开征集内测用户,参与内测的网友给出极高评价,甚至称其为“宇宙最强”,但限于保密要求,具体表现尚无明确说法。#老张聊科技#

9. #DeepSeekHarness发布#刚看到DeepSeek Harness正式上线,简单说它不是新大模型,而是一套智能体编排框架 。公式Model+Harness=Agent算是把思路摆明白了,专门负责调度工具、管理长任务流程,补齐模型落地实操的短板。对开发人员格外友好,多智能体编排、项目运维全都能覆盖,打通了从生成代码到完整交付的闭环 。看得出DeepSeek不再只埋头做大模型,开始深耕上层智能生态了,很期待后续开发者社区能跑出有意思的应用。

10. #DeepSeekHarness发布#DeepSeek正式开源发布智能体框架Harness,提出「Model+Harness=Agent」。如果说大模型是AI的大脑,Harness就是连接现实环境的执行系统,依靠“一切皆插件”架构,自由调度工具、管理长周期任务,补齐智能体落地短板。这次发布标志行业竞争进入新阶段:单纯比拼模型跑分已经过时,落地能力成为新赛道。依托自身大模型极致成本优势,Harness直面Claude Code等产品竞争,降低开发者搭建智能体的门槛。从卖模型算力,到提供完整智能体工程方案,DeepSeek的布局清晰可见。未来AI比拼不再局限推理能力,能否稳定完成端到端复杂任务,才是拉开差距的关键。

11. DeepSeek正式推出其首款Agent产品DeepSeek Harness开发者预览版,并同步在GitHub以MIT协议开源。这不仅是DeepSeek从“模型供应商”向“应用框架层”延伸的标志性动作,更意味着代码智能体(Code Agent)的竞争从单一模型能力比拼,升级为“模型+工程化工作台”的全栈生态角逐 #DeepSeekHarness发布# DeepSeek Harness发布:代码智能体赛道迎来“全栈工作台”范式革命

12. #DeepSeekHarness发布#终于等到重磅更新!DeepSeek正式上线自家首款Agent产品DeepSeek Harness,v0.1开发者预览版面向全球开发者开放测试,同时以MIT协议开源全部代码。作为早期预览版本,还有不少细节需要打磨优化,核心插件与基础接口后续也会持续快速迭代,也十分期待广大开发者给出真实反馈。这款全新框架功能非常全面,涵盖项目管理、超长任务协作、多智能体协同编排,同时整合了上下文管理、联网搜索和各类技能工具。它采用“一切皆插件”的设计思路,模型、工具、调度、存储乃至UI全部由插件组成,支持自由替换灵活重组。我特别认可它「Model+Harness=Agent」的核心逻辑,大模型专注思考推理,Harness承接工具调用、任务规划等工程工作,精准对标海外Codex、Claude Code。在我看来,国产AI不再只比拼跑分,开始深耕落地执行,插件化架构也会给社区带来巨大的创作空间#热点跨界共创# 网页链接

13. #DeepSeekHarness发布#十多分钟斩获 5K 星标,DeepSeekHarness 的“恐怖影响力”确实令人后背发凉。但请先冷静一秒:这究竟是工程实力的降维碾压,还是流量裹挟下又一场被制造的泡沫狂欢?它最致命的卖点——简洁与强可配置,恰恰把参与门槛压到地板,连小白都能搭出专属的 AI 工作流,一切皆是插件,人人得以便宜地“见证奇迹”。这份平民化的震撼最戳心:我们既为国产开源的狂奔由衷自豪,又暗自恐慌,当工具越来越顺手,慢半拍的人会不会就此出局?真正可怕的从不是那串星标数字,而是你还没读懂,时代的页码已经悄悄翻过。

14. #DeepSeekHarness发布# 今日,DeepSeek正式发布其首款Agent产品——DeepSeek Harness。该产品支持项目管理、长任务协作、多Agent编排、上下文管理,并整合了联网搜索与Skill功能,旨在为大模型提供完整的工程化支撑。DeepSeek内部将Harness定义为“Model+Harness=Agent”,即模型专注思考推理,Harness承担工具调用、任务规划、执行调度等模型外的全部工程化工作。Harness聚焦代码智能体赛道,直接对标OpenAI的Codex与Anthropic的Claude Code,标志着DeepSeek在AI Agent领域的正式落子。

15. DeepSeek每次都是晚上搞大事~刚发布了Agent产品——Harness,定位是Coding Agent,对标Claude Code。核心逻辑是“Model+Harness=Agent”——模型负责思考,Harness负责干活(调工具、管上下文、执行任务),把模型能力真正落地到编程场景。本来以为是腾讯WorkBuddy类似的通用办公Agent;不过看介绍,Harness的操作界面和主要场景,应该都是给程序员用的专业工具。Coding Agent这赛道已被Claude Code验证,年入25亿美元。DeepSeek成本只有对手1/100,这波性价比拉满。程序员朋友可以关注下了~#DeepSeekHarness发布##DeepSeekHarness##AI#

16. 贵57.1倍的Claude Opus 4.8五项全输,赢它的不是模型,是Harness

17. #DeepSeekHarness发布# 说真的,今天DeepSeek这波属实把我看服了。V4 Pro正式版刚落地,首款Agent产品Harness直接端上来。晚上有空我去查了写资料,详细了解了一下。以前用AI最怕“脑子会了手没跟上”,跑一半断网报错心态直接崩。Harness主打一个靠谱:自动存档+断点续传,长任务稳如老狗。对标Codex?Codex确实稳,但太贵,国内网络还折腾。Harness单任务成本两毛左右,直接打到零头,NPM插件生态全开放,随便折腾。办公场景更狠:Excel丢几万行数据,它自己写Python跑数据画图表,报错自动改代码重试;Word万字报告,自动规划大纲分步生成,输出Markdown丢进去秒排版;PPT直接提炼观点生成底层代码,逻辑梳理全包。现在就等天亮了,好好睡一觉,明天准备好好玩一玩,感受感受,看看能不能和我工作有机结合起来。#DeepSeekHarness##AI智能体##VibeCoding##科技妈咪#

18. 首发体验 | DeepSeek Harness 来了,它不想做下一个Codex

19. #DeepSeekHarness发布#简单来说,如果说大模型是“大脑”,那么 Harness 就是让大脑能够真正动手干活的“执行神经系统。过去的大模型往往“手笨”,能解微积分却不会操作电脑。Harness 补齐了这一短板,它负责调度上下文、工具、任务状态,让 AI 能够自主完成从理解需求到交付代码的完整闭环简单说就是给马装上了缰绳和马鞍,可以充分释放马的性能了

20. #DeepSeekHarness发布# 别人把 Agent 框架当护城河捂着,DeepSeek 今天把首款 Agent 产品 Harness 直接开源了——开发者预览版 v0.1,MIT 协议,一行 npm i @deepseek-ai/dsh 就能装。这东西的定位是"模型之外的一切":项目怎么管、长任务怎么接、多个 Agent 怎么编排、上下文怎么收、联网搜索和 Skill 怎么接,全打包成一套执行框架。官方那句"Model + Harness = Agent",说的是他们不把 Agent 逻辑塞进模型里,而是把脚手架单独抽出来、还开放了。对标的是 Claude Code 和 Codex,主打编程和办公。现在还是早期预览,官方自己也说很多细节要打磨。但一上来就开源,等于把地基亮给所有人看——是想借社区把框架跑快,还是真不打算靠它收口子,得看后面插件生态长成什么样。

21. #DeepSeek发布V4Pro正式版#深夜,DeepSeek 悄无声息地扔出了一枚重磅炸弹。昨晚,DeepSeek 官网 API 文档悄然上线了 V4 Pro 正式版(版本号 0813)。没有发布会,没有预告,就这么直接“转正”了。性能上,它真的在向国际顶尖闭源模型靠拢。 根据官方流出的评测对比,V4 Pro 正式版在多项测试中已接近 Anthropic Fable 5 的水平。更夸张的是 Agent 能力的跃升——Terminal Bench 2.1 跑到 87.9 分,Cybergym 83.3 分,DeepSWE 62.7 分,相比预览版简直是代际提升。1M 超长上下文加上 384K 的最大输出,处理整部小说或整个代码仓库都不在话下。价格方面,Pro 版是 Flash 的三倍——输入 3 元/百万 tokens,输出 6 元。但缓存命中后输入仅需 0.025 元,性价比依然惊人。作为对比,Claude Opus 4.8 跑一次任务的成本是 DeepSeek V4 Pro 的 44 倍。把接近 Fable 5 的性能,卖成白菜价。 这或许才是 DeepSeek 真正的“大招”。#DeepSeek发布V4Pro正式版##DeepSeek发布V4Pro正式版

22. #DeepSeekHarness发布#主打全插件化智能体框架,模型、工具、任务链路全部可自定义。不再只是聊聊天,能跑复杂长流程任务,轻量化部署门槛压得很低。之前国内很多智能体框架看着热闹,实际上手改造处处受限。这次算是交出一份很有竞争力的答卷,国产智能体框架又多一员猛将。

23. #DeepSeekHarness发布#它来了它来了,Deepseek首款agent产品上线。前两天就流传了DeepseekHarness团队公众号开启没想到这么快就来了。今年可以说是Harness(工具框架)带动VibeCoding发展比较成功的商业化应用一年,最为出名的两款Harness是OpenAI的Codex和Anthropic的Claude Code。Deepseek官方说了,DeepSeek Harness目前的 v0.1 版本只是一个起点,他们期待与全球开发者一起,在开源、开放、可复用、可组合的基础设施之上,共同探索智能上限。

24. #DeepSeekHarness发布#DeepSeek终于不只是会“聊天”了。今日正式发布首款Agent产品DeepSeek Harness,支持项目管理、长任务协作、多Agent编排、上下文管理,还能联网搜索和调用Skill。简单说,就是从“你问我答”开始进化到“你交代任务,我自己拆解、执行、协作并完成”。AI真正有意思的地方,可能从模型有多聪明,开始转向它到底能替你干多少活。

25. DeepSeek Harness可以理解为国产CodeX Claude Code采用一切皆插件的开放架构非APP形式 而是整了一个开源平台未来各家都可以用#DeepSeekHarness发布# 目前不适合普通用户AI爱好者可以琢磨起来

26. DeepSeek智能体要来了?公众号已完成注册认证

27. 黑鲸出水!DeepSeek Harness公众号正式上线

28. DeepSeek不卖模型了,它要卖AI程序员的生产力

29. DeepSeek也要做Claude Code了

30. DeepSeek,重大发布

31. 官方公众号落地,DeepSeek的智能体工具团队来了!

32. DeepSeek黑鲸鱼上线:AI编程下半场的门票已经不是模型了

33. 天变了。 DeepSeek Harness团队公众号刚刚完成注册,Logo是一只黑色鲸鱼,这是DeepSeek首次为Harness业务线单独设立官方发布阵地。从模型到智能体,DeepSeek这一步,到底要多大? 公众号注册时间是7月6日,7月7日就完成了认证,一个月过去了,账号里一个字没发。但这一个月,外面已经沸腾了。 7月31日,DeepSeek-V4-Flash正式版API悄悄上线公测,什么叫悄悄?没有发布会,没有通稿,就更新了一条API日志,Agent能力暴涨6倍。 在权威的Terminal Bench 2.1测试里,Flash正式版拿了82.7分,把自家V4-Pro预览版的72.1分远远甩开。逼近Opus-4.8的85分。 更狠的是什么?第三方评测机构Artificial Analysis当天就把Flash放上了榜单,智能指数50分。比自家V4-Pro还高6分。一个Flash版,把Pro版反超了。而Flash版的总参数2840亿,激活参数才130亿,一个轻量模型,把旗舰预览版摁在地上摩擦。 最让人细思极恐的是另一件事:模型结构和尺寸跟预览版一模一样,只把后训练重做了一遍。三个月前官方自己承认Flash在复杂Agent任务上跟Pro有差距,三个月后同一个身子把Pro给反超了。后训练的优化空间,远比我们想象的更大。 这帮人到底在憋什么大招? Harness团队负责人叫崔添翼,90后,浙大计算机毕业,大学拿了6枚ACM亚洲金牌。然后在全球顶尖量化机构Jane Street干了9年。2022年联合创办量化交易公司TSY Capital。今年3月加入DeepSeek。 他不是传统AI学术派,他是搞量化交易出身的,玩的是真实系统、低延迟交易、模型输出落到执行层会遇到什么坑。DeepSeek找他来带Harness,说明什么?说明这家公司清楚一件事,光有模型不行,得让模型真的能干活。而让模型干活这件事,需要的是懂真实系统的人,不是只会写论文的人。 现在市面上绝大多数大模型都是“嘴炮型”,你说它懂,它什么都懂;你让它干,它什么都干不了。不会读写本地文件,不会调用第三方工具,代码报错不会自己修。Harness要干的事,就是补齐这些短板。把AI从一个“会聊天”的东西,变成一个“能干活”的东西。 这一步,比大多数人想象的要大得多。 中信证券的研报点得很透:拥有成熟Harness的厂商,同时握着两项稀缺资产,一是从任务入口到结果交付的商业闭环,二是长程任务轨迹和纠错反馈这类高质量数据。这两样东西互为强化,先发者的优势很难被追上。 换句话说,谁先把Harness做出来、跑起来、形成数据飞轮,谁就在下一代AI竞争里卡住了身位。 DeepSeek这次对标的是谁?Claude Code。 Anthropic的Claude Code年化收入已经超过25亿美元,周活用户翻倍增长。OpenAI的Codex周活用户在15天内从300万涨到400万。全球智能体代码市场规模约80亿美元,远期中美总潜在市场合计4000亿美元。这不是小打小闹。 DeepSeek的Harness团队现在什么状态?缺人,非常缺人。崔添翼自己说“我每天都在面试,在各个渠道发布招聘小广告”。目标宏大,工作繁重,人手仍然紧缺。 8月1日他面向全球开启内测用户征集,优先招募有Agent开发实战经验的开发者。结果一条内测帖发出去,评论区秒变“开源Agent路演”,截至8月3日上午,769位报名者、712个开源仓库、合计超过120万Stars。 开发者们排队往里冲。 但也得泼盆冷水。Harness这个东西,DeepSeek自己都还没正式发布,V4-Flash的测试分数是在DeepSeek Harness“极简模式”下跑的,自家框架测自家模型,这分数得打个折。而且官方技术报告也承认,模型在超过128K上下文后性能就开始往下掉。从测试到产品,从内测到大规模商用,中间的坑一个都不会少。 还有一个潜在风险:崔添翼在社交平台上说过,DeepSeek招人需要能用中文工作。这话被外界解读为“不招外国人”。在全球化的AI竞争里,人才池子主动收窄,会不会影响团队的技术视野和工程速度?这事值得盯。 但无论如何,DeepSeek这一步已经迈出来了,从公众号注册到内测招募,从V4-Flash的Agent能力暴涨到Harness框架的首次亮相,这家公司正在做一件很多人想做但没做成的事,让AI真正能干活。#DeepSeek智能体要来了吗##上头条 聊热点#

34. DeepSeek开设「Deepseek Harness团队」账号

35. 昨天就有网友发现,「DeepSeek Harness 团队」的微信公众号已经悄悄完成注册,认证主体是北京深度求索人工智能基础技术研究有限公司。【P1】 考虑到 DeepSeek 过去几个月围绕 Harness 的动作,几乎就是暗示了 DeepSeek 的桌面端 Agent 产品即将推出。事实上,雷科技早在之前的多次报道中提出,DeepSeek 需要有自己的 Codex/Claude Code。 而 DeepSeek 的 Harness 团队,其实也早在今年 5 月就已经浮出水面。当时 DeepSeek 接连招聘 Agent Harness 产品经理和研发工程师: 参与 DeepSeek 桌面端 Agent 产品研发的全过程,定义 DeepSeek 对 Harness 的理解。【P2】 DeepSeek 研究员陈德里甚至把目标概括成了「对标 Claude Code,做 DeepSeek Code Harness」。 这里的 Harness,你可以简单理解成模型之外那套「让 AI 真正干活」的系统。 模型负责理解和推理,但一个 Agent 要读文件、调用工具、执行代码、管理上下文,还要知道什么时候继续、什么时候检查结果、什么时候纠错,这些连接模型和真实任务的东西,大体都属于 Harness。 这也决定了一个聪明的模型最后能不能驱动起一个好用的 Agent。 而 DeepSeek 对这件事的投入,也在加速。6 月,Harness 团队负责人崔添翼在 X 上多次公开表示团队非常缺人。【P3】 目前 DeepSeek 官网除了 Agent Harness 团队,还在招聘 Agent Infra、Code Agent 数据工程师以及通用 Agent 数据产品经理,方向也从代码延伸到了办公、生活和搜索。 模型本身也在为 Agent 铺路。DeepSeek 从 V3.1 开始就公开强调工具调用和多步 Agent 能力,之后的模型进一步支持思考过程中连续调用工具。 所以这次注册 Harness 团队公众号,更多还是一个阶段变化的信号。 至于 DeepSeek 最终会先推出类似 Claude Code 的编程 Agent,还是直接做更通用的桌面 Agent,目前还不明朗。但有一点毋庸置疑——在 Claude、ChatGPT 以及国内大厂都开始从「聊天」走向「干活」之后: DeepSeek 也要走上同一条路。 #DeepSeek##Harness##大模型##Agent#

36. DeepSeekHarness团队公众号上线,IP属地北京,Harness产品疑似即将发布

37. DeepSeek大力招聘Harness团队,押注智能体 Deepseek是一家不折不扣的技术团队。 根据Deepseek的理解: AI智能体 = AI大模型 + Harness 你可以想象AI大模型是一个信马由缰的千里马,速度太快,能力太强,但是不能为人所用。Harness,就像是驾驭千里马的马具,约束这匹千里马,根据人的指挥,在人的价值路线上奔跑。所以Harness在行业中被称为约束工程。 Deepseek非常重视Harness团队,不仅重新设计了logo,一只黑色的虎鲸。而且还重新申请了一个公众号,预计会大批量招聘Harness团队。🔚

38. Anthropic 隐形水印、谷歌搁置 Gemini 3.5、DeepSeek Harness 对标 CC

39. deepseek的最佳搭档居然是zcode opencode的开发人员dax公布了一个有趣的事情。用他们家opencode go套餐来使用deepseek的客户端多种多样。 但是根据他们的数据,缓存命中率最高的居然是智谱的zcode,达到惊人的98.60%,比opencode自家的客户端还高。 dax表示他也无法解释这一现象,只能说智谱的harness确实有点东西,也表明deepseek开发自家harness的紧迫性。

40. Claude Code与Pi接入DeepSeek,成本差7倍,选谁更划算?

41. 3步把DeepSeek-V4-Flash接入Claude Code,编程账单直降80%

42. AI编程工具横评:Claude Code、Cursor、DeepSeek,到底谁更香?

43. 国产卷王来了!DeepSeek V4 Pro+Flash vs 御三家真实横评|代码/推理/成本全维度

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章