8月13日晚上,DeepSeek同时打出两张牌。
第一张牌,DeepSeek-V4-Pro模型正式版上线,Agent能力大幅增强,多项测试成绩逼近Anthropic的旗舰模型Fable 5。界面新闻百家号第二张牌,把自研的智能体框架DeepSeek Harness(下文简称DSH)以MIT协议完全开源,任何人免费可用。澎湃新闻

GitHub直接炸了:上线不到24小时狂揽7万star,到8月18日突破15万star、Fork超过1.6万,这个增速在开源史上都排得上号。澎湃新闻经济观察报小红书上,次日发出的保姆级安装教程笔记,收藏量冲到了6800以上。小红书
但翻一圈开发者社区的评论区,你会发现讨论最多的问题不是“它有多强”,而是“这玩意儿用起来得花多少钱”。
因为宣布开源的当天,DeepSeek同步官宣了API涨价:8月17日起,V4-Pro模型高峰时段的输出价格从每百万token 6元涨到27元,涨幅350%。今日头条界面新闻框架免费,“大脑”涨价。这顿免费午餐,得先算明白再吃。
一、Harness到底是什么:不是新模型,是给AI装上“手脚”
先说清楚一个最容易搞混的问题:Harness不是DeepSeek App那样的聊天软件,也不是一个新模型。
DeepSeek官方给的公式是:Model + Harness = Agent。微博模型是大脑,负责思考;Harness是“执行神经系统”,负责上下文管理、工具调用、文件读写、终端执行——推理之外的一切工程活。经济观察报两者的分工,恰好解释了为什么此前的AI“会说不会干”:脑子够聪明,但没人帮它接上手脚。
DSH的设计理念四个字:一切皆插件。澎湃新闻模型、工具、技能、沙箱、界面,全部像乐高积木一样可插拔,而且支持不重启服务“热插拔”,这是开发者讨论中公认对Claude Code、Codex等工具的体验优势。知乎它还支持多智能体协作,开多个AI“员工”分头干活,rc.8版本更新后,甚至能把Claude Code和Codex叫来当“子代理”。智东西
开源当晚,智东西就拉取源码实测:翻译88页论文、从零写一个贪吃蛇游戏,全流程跑通。智东西知乎一个高赞回答里,用户描述了自己用DSH拉起一支“AI团队”做工业设计检查的体验:队长做论证、队员分工执行、中途随时热插新工具,“有种在玩文字策略游戏的感觉,上一个给我这种感觉的东西叫文明”。知乎

上手门槛其实不算高:电脑装好Node.js,一行npx命令就能启动网页界面,再填一个模型API Key就能跑。今日头条但官方定位也很明确:v0.1开发者预览版,面向开发者,快速迭代,未来会有破坏兼容性的变更。经济观察报

二、框架开源、模型涨价:DeepSeek在打什么算盘
先看这次开源有多火。
不到24小时7万star,5天突破15万,第6天有开发者统计已达16.5万。微博招商证券国际8月17日的报告,把这一步棋称为打造“Agent时代的安卓”——不争某个应用入口,而是在框架层定标准、建生态。经济观察报
一位开发者对经济观察报点出了开源受捧的关键原因:DeepSeek的模型就是在自家框架下训练的,“理论上说,只有用DSH才能体验到真正满血的DeepSeek模型”。经济观察报
但硬币另一面,是涨价。
8月17日0点,DeepSeek API新价格正式生效,首次引入峰谷分时计价:工作日高峰时段(9:00-12:00、14:00-18:00)价格是空闲时段的2倍。以旗舰V4-Pro为例,高峰时段输入(缓存未命中)从3元涨到9元/百万token,输出从6元涨到27元,缓存命中输入从0.025元涨到0.3元,最高单项涨幅达1100%。界面新闻

翻译成人话:高峰时段完美覆盖上班打卡时间,工作日白天干活,基本都在付“高峰价”。
为什么涨?DeepSeek今年已多次服务崩溃,仅5月就崩了4次,直接原因是用户量暴涨66.7%而算力储备仅增长8.3%。界面新闻
放眼看整个行业,腾讯云、阿里云、百度智能云都已上调算力价格,智谱年内三次上调API价格——国产大模型的白菜价时代,正在收尾。界面新闻
值得一提的是,这轮涨价只针对国内,海外价格未变,V4-Pro输出0.87美元/百万token,仍比海外同级旗舰便宜数十倍。今日头条微信
三、算账环节:用Harness干活,到底要花多少钱
DSH本体0元,MIT协议,商用也不要钱。但Agent的运行方式,决定了它不是免费午餐:智能体要反复读写项目文件、重载上下文,token消耗远高于普通聊天,而每一分都算在模型API的账上。
看三笔真实的账单。
第一笔,经济观察报采访的一位视频策划从业者:调用同一个模型干同样的活,涨价前日均成本不到20元,涨价当日涨到近200元。经济观察报他明确表示不会叠加使用DSH——框架的token消耗比开箱即用的产品更凶,成本只会更高。
第二笔,一位上班族的吐槽:平时上班用V4-Pro,一天费用10元左右,按新价格估算要40-50元,公司不报销token钱,“下周一开始暂时先不用了,真的,用不起了”。今日头条
第三笔,知乎那位真的拉起AI团队跑项目的用户,被评论区追问成本时,给出的估算是:“预估至少3000一个月”。知乎还有更极端的案例:有开发者跑一个长任务,执行489步、累计输入token达到2.14亿——所幸缓存命中率100%,才没把账单跑飞。抖音
把新价格表放这儿,可以对照感受一下:
时段 | 输入(缓存未命中) | 输入(缓存命中) | 输出 |
|---|---|---|---|
高峰(9:00-12:00、14:00-18:00) | 9元/百万token | 0.3元/百万token | 27元/百万token |
空闲(其余时段) | 4.5元/百万token | 0.15元/百万token | 13.5元/百万token |
(DeepSeek-V4-Pro,2026年8月17日起执行;调价前输出仅6元/百万token)
但先别急着劝退,省钱的空间明摆着:
长任务放空闲时段跑。 峰谷价差就是整整一倍,批量任务排到晚上或午休之外的时段,成本直接砍半。
把缓存用足。 缓存命中输入只有未命中的三十分之一,Agent反复读同样的文件时,缓存是省钱主力。
简单活派给Flash。 V4-Flash系列定价约为Pro的三分之一,粗活交给Flash,硬活才上Pro。
“眼睛”暂时别花钱。 V4系列目前还看不了图,社区主流玩法是接入免费的GLM-4.6V-Flash临时当眼睛,DeepSeek自家的视觉版模型已在灰度测试。抖音微博
四、谁适合装,谁建议先别装
观察了一周各平台的实测和讨论,我的判断很明确:这是个真有门槛的玩具。
三类人可以放心装:
会敲点命令行的开发者或折腾党。这套工具就是为你设计的,插件生态的可玩性目前独一份。
有明确长任务需求的人。批量处理文档、自动化测试、固定流程的重复工作,才是Agent的主场。
本来就在付DeepSeek API的用户。反正要付模型的钱,不如用官方原厂框架试试“满血”效果。
三类人建议先别装:
想要开箱即用的人。经济观察报采访的一位营销从业者体验了半天就退出了:她需要的是聚焦流程的成品,不是“一切都要手搓的车间”,全程靠社区教程续命让她更焦虑。
在意文件安全的人。DSH本地部署,第三方插件全靠自己把关,那位从业者问得很实在:“会不会有恶意插件读我的文件上传到外部?我辨别不了。”v0.1没有官方插件商店,插件全靠自行甄别。经济观察报
没算过token预算的人。不清楚自己一个月会烧多少钱的话,先别装——真跑起长任务撞上高峰时段,账单会教你做人。
几个小坑也提醒一下:它仍是开发者预览版,官方明说后续版本会有破坏兼容性变更。今日头条最新rc.8升级时,要注意SQLite数据兼容问题。抖音Windows的持久PowerShell支持这个版本才刚落地,尝鲜可以再等一个版本。智东西

五、不装的人,也值得盯着这三件事
就算不装,这件事的信号也值得记一笔:AI的竞争,正在从“谁的模型更聪明”转向“谁更能干活”。DeepSeek免费开放框架押注生态,上调模型价格换算力换利润,一放一收,“Agent时代的安卓”这条路才刚开了个头。
接下来有三件事值得持续观察:
视觉版模型。 V4-Flash-Vision-Exp实验版已经放出,正式版落地后,智能体“看图”的短板才算真正补齐。微博
插件生态。 从UI皮肤到记忆插件,社区第一周的产出密度很高,“一切皆插件”能不能长成真正的插件商店,决定DSH的上限。
价格走势。 峰谷定价会不会长期执行、其他国产模型跟不跟,直接决定这类工具的月账单。
如果你实在手痒,建议走最低成本路线:挑个空闲时段,接一个Flash这类便宜模型,丢个小任务试试水,十几块钱以内就能摸清楚它的脾气。玩完你就知道,这座“AI员工工厂”值不值得你继续投币。