还没上架就能下:DeepSeek 桌面版偷跑
今天上午,DeepSeek Harness 的桌面版安装包在社区传开。它没开发布会,官网和 GitHub Release 都还没挂下载入口。
这东西是有人从官方仓库里翻出来的:deepseek-ai/deepseek-harness 下面有一条完整的 apps/desktop 目录,八月底就已经在了,官方代码里写着更新源是 download.deepseek.com。
能实测到的版本号是 V0.1.7-rc.2。装完 V0.1.7-rc.1,客户端自带的更新功能会提示有新版本;Mac 版过了 Apple 公证,签名主体是杭州深度求索,Bundle ID 为 com.deepseek.dsh。目前支持 Windows x64 与 macOS Apple Silicon,暂时没有 Linux 版。
这些是事实。更值得写的,是它对工具调用方式做的那处改动,以及"桌面版"三个字最容易让人产生的三种误读。

先说清 Harness 是哪一层
一句话说清:Harness 是让模型"能干活"的那一层运行时。模型只负责判断下一步做什么,真正去读文件、跑命令、搜网页、改代码、把结果带回来的,是这一层。
拆开看,一个智能体循环的流程并不神秘:把任务和已知信息拼成上下文,问模型下一步做什么,执行它指定的工具,把工具结果写回上下文,再问一轮,直到任务结束。
Harness 的特殊之处是"一切皆插件"。模型、工具、技能、会话、沙箱、存储、智能体循环、调度、界面,全部由底层插件系统 Cordis 以插件形式提供。这句话听着像架构宣传,它实际决定三件事:模型可以换,工具可以加,能力可以关。
第三件事最容易被忽略。插件面板里除了网页搜索提供方,还有智能体团队与 Subagent、本地化与执行管控、代码仓调用这些条目。它们回答的是同一个问题:这一轮里,它能碰什么,不能碰什么。
放到场景里。你让它"把这批订单表去重,按城市汇总,挑出异常金额",这不是一次问答,是一串动作:读文件、写脚本、跑脚本、看报错、改脚本。你在界面上看到的是一次任务,背后可能是几十轮循环。
顺带说一句,这篇稿子本身就跑在 dsh 上:工具调用、沙箱、会话、调度都发生在这一层。所以下面这些机制不是隔着新闻稿的推测。
PTC 模式:让模型写一段程序,而不是一步步点工具
四种模式里,标准、极简、创造都能一眼看懂,PTC 是唯一需要解释的。
先讲常规做法。工具调用的每一次,都是一次完整的 API 往返:模型说"我要读这个文件",你把结果发回去,模型再说下一步。调 10 次工具就是 10 次往返,10 份中间结果全部堆进上下文。
上下文越长,下一轮越慢、越贵,而且中间结果里的大部分内容,对最终答案并没有用。
PTC 是 Programmatic Tool Calling,程序化工具调用。它换掉的是"逐次下单"这个动作:模型不再一轮一轮地要工具,而是自己写一整段代码,在沙箱里循环、批量地调度多个工具,筛选、去重、统计、汇总都在这段代码里完成,最后只把结果送回上下文。
省下来的东西很具体:往返次数,和中间结果的 token。
代价同样具体。调度权从"框架一步步确认"变成"模型写的一段代码",权限边界、错误处理、可审计性都跟着变成代码问题。这就是它标注"适合批量调用工具"的原因:重复结构化的活收益最大,需要一步步人工判断的活反而不划算。
适合它的场景长这样:几百个页面的字段抽取、几千行日志里翻异常、一批文件的规范化命名。这些活的共同点不是难,是次数多、结构重复。
有一条边界要说清。官方口径是它能降低延迟、提升复杂流水线的稳定性,这是产品描述,目前还没有第三方跑分能验证到底快多少。
四种模式不是四个程序
把四种模式摊开摆在一起,会更容易看出它们是什么关系。
标准模式处理代码、文件和资料,按需使用检索、编辑、终端等工具,是通用档位。
极简模式只保留终端工具,官方说明的用途是测试和对比基础表现,本质是一个对照组的档位设计。
PTC 模式的重点放在批量调用工具之后的筛选与汇总,特别适合"结果需要整理"的任务。
创造模式让 Agent 写插件、添加功能和界面,也能组合工具与提示词,生成自己的模式。
注意"包含"这个词。如果四种模式是四套互斥的程序,不会出现包含关系。更准确的理解是:它们是同一条循环上的策略档位,变的是这一轮允许调用哪些工具、调度方式是什么、过程展示到什么颗粒度。
这也是"换个模式会更聪明"这个想法错在哪:换模式不改变模型,只改变它被允许怎么干活。
模式是权限档位,不是智力档位。
桌面版真正改的是安装成本
此前用 Harness 的方式是 WebUI,或者自己在终端里跑 npx 命令。桌面版把这一步变成双击安装包:不用装 Node.js,不用开终端,不用记那串 npx 命令。
官方技术文档写得很直接:桌面端用 Electron 实现,目标不是重写一套 Harness,而是复用现有的 Web UI,以及 Agent、会话、工具、插件这些运行逻辑。所以它不是第二个产品,是同一个运行时的另一个入口。界面之外的部分,包括插件面板里那套东西,还是原来那套。
这一层变化瞄准的人群很清楚:从"能配好环境的开发者",扩到"愿意装一个软件的人"。
但有三处要提醒。第一,它是 rc 预览版,官方提示注意保存重要数据;第二,只有 Windows x64 和 macOS Apple Silicon,没有 Linux;第三,官网和 Release 都还没挂入口,现在能拿到的链接来自社区传播,虽然与官方下载源能对应上,仍属非正式渠道。
回答区那点改动,暴露了它在往哪走
实测的人提到一个细节:提交问题后,界面会先出现"处理完成""执行完成"这类状态,同时标出上下文 token 数、工具调用次数和耗时。
这三项指标平时藏在日志里。把它们摆到正文上方,等于把"这次回答花了多少代价"变成可见信息。对重度使用者来说,这是判断一次任务值不值得重跑的依据。
回复内容的呈现也在变。以查询 API 价格为例,它会先给结论,再用表格对比不同模型,接着生成价格卡片和规则说明,甚至嵌入一个可拖动参数的月成本估算器。长回答因此更像一张可以操作的页面,而不是一长串文字。
这两个改动方向一致:把智能体的成本和结果都摊到台面上。往大了说,这是智能体工具从"能跑"走向"能管"的标志。用户不只需要答案,还需要知道答案是花多少换来的。
三个最常见误读
误读一:桌面版意味着模型也在本地,能断网用。
有道理的地方在于,界面确实在本地跑,写文件、跑命令这些工具执行也都在你机器上,用起来会感觉它就在电脑里。
它解释不了的是:模型推理仍然走云端接口。实测提到,这个客户端不是纯免费工具,初次进入如果账户没额度,需要充值或绑定一个有有效余额的账户,还要实名认证。
更准确的说法是:本地的是手脚,云上的是大脑。桌面版减少的是环境配置成本,不是算力成本。它支持接入自己的 API Key,但那也只是换掉大脑的供应商。
误读二:四种模式是四个不同的模型。
有道理的地方在于行为差异确实大,极简模式只给终端工具,表现会明显弱一截。
它解释不了"包含"关系。PTC 明确被描述为包含标准模式的全部能力,互斥的程序不会这样设计。
更准确的理解:变的是工具集与调度方式,模型没变。所以别指望切个模式就换了个更聪明的脑子。
误读三:插件架构是给开发者看的,和普通用户无关。
有道理的地方在于插件面板里全是网页搜索提供方、Subagent、执行管控这类工程词。
它解释不了创造模式的存在。它就是给不写代码的人用的:用对话让 Agent 写插件、加功能、改界面,不用打开编辑器。
更准确的理解是:插件决定了能力的边界。你不需要会写插件,但你需要知道某个能力是插件,能换、能关。真出问题的时候,止损靠的就是这一点。
现在该不该装
三类人现在用得上。
日常工作里已经在用智能体批量处理文件、整理资料、写脚本的人,桌面版省掉的是维护环境的时间。
想学插件和智能体循环的开发者,桌面版把入口成本降到接近零,也多了一个在本地改插件的场合。
被 npx 和终端劝退过的普通用户,这次至少能装上、能打开、能试。
不急的理由同样成立:预览版,无 Linux,要实名和余额,官方入口还没上架。如果你的工作流里有不能外传的数据,先把沙箱和权限边界摸清楚,再往上加强度。
更值得记住的是节奏。八月开源,八月底仓库里就出现了 apps/desktop 目录,九月假期前被社区翻出来。这条线指向的方向是:把 Harness 从开发者的工具,做成普通人的软件。
而一个智能体运行时能不能真的普及,看的往往不是榜单上的分数,是安装这一步有多难。
三个信号可以记一下:模型可换,工具可加,模式可写。前两个几乎所有智能体框架都在做,第三个还不多见。
你会为了一个智能体运行时去装桌面软件,还是继续留在网页里?评论区说说你的选择。
如果觉得有用,点个在看让我知道;也欢迎转发给在学 AI 的朋友。
关注我,每天陪你聪明看世界 —— 看懂热搜,玩懂AI。
作者提示含AI生成内容。作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

校验提示文案
校验提示文案