假期第四天,DeepSeek 相关的讨论区分成了两种画风。知乎里 deepseekv4.1flash拉完了,实际使用比dsv4f差不少,为什么大家对此毫无反应?的对线帖已经滚到 60 多条评论。发帖人和"信徒"们吵到了互喷硬件的程度:这好比说你买了一把歪的锤子,我说锤子头是歪的,然后你跟我说是你钉木板钉钉子的方式有问题,你自己不觉得很可笑吗。同一时间的小红书,一条教人用"最高级角色扮演执行指令"修正 DeepSeek 冷漠、不耐烦的帖子攒下 9524 赞、6038 收藏。骂的在骂,救急的在救急,中间还夹着 9 月 30 日刚发布的 DeepSeek Harness 桌面版和一堆"哪个插件值得装"的求助帖。这篇内容不替任何一方站队,只给每天拿 DeepSeek 写材料、跑代码、养角色、轻度订阅或免费白嫖的普通用户,把三本必须自己先对完的账摆出来。知乎知乎小红书
第一本账:变化账——先分清"发生了啥"和"感觉变差了"
把 9 月下旬到 10 月 4 日的硬事实按时间摆开。
9 月下旬:DeepSeek V4.1 Flash 正式发布,社区讨论集中在两个参数上——1M 上下文、prefill 阶段只激活 8B 而 decode 激活 16B,路线是明显的便宜大碗、跑量执行。知乎"如何评价 10 月即将发布的 DeepSeek V4.1 Pro?"问题下已有回答提前开了条件:4.1flash的指令遵循能力很差,4.1pro别这么搞了。知乎知乎
9 月 25 日-30 日:36氪先报道 Harness 桌面预览版上线,顺带点了一句 DeepSeek "逢假必放更新"的铁律仍然奏效。9 月 30 日桌面版正式发布,报道标题就叫不用命令行,打开就能用。这个 Agent 框架 8 月刚开源时一天不到狂拉 70k+ star,现在从极客玩具变成官方门面。36氪36氪小红书
10 月 2 日凌晨:官方状态页记录了一次故障,03:40 开始、05:34 恢复,中间共持续了 1 小时 54 分钟,受影响组件包括 V4 Pro API、V4.1 Flash API 和聊天服务。不少"体感变差"正好撞在这次故障前后。知乎
商业侧:36氪 9 月 28 日报道 DeepSeek 在 IPO 前夕把年营收翻番至 10 亿美元,9 月 24 日 OpenAI 又把 GPT 价格砍半,GPT 反而比 DeepSeek 还便宜了。36氪36氪

再看"变差"这个感受本身。翻微博存量吐槽,这已经不是第一次:4 月就有人抱怨页面比原来难看多了,还有人说 DeepSeek 擅自加了很多莫名其妙的解读;5 月 31 日的吐槽点是记忆力变差以及现在改的对话重置上限和禁言。5 月 29 日那条 401 赞的微博是这么写的:deepseek你更新的啥啊。文笔都改的够差的了,连生成次数都限制了。现在 9-10 月这波,火力集中在三点:幻觉率——对线帖原话是 V4.1 flash幻觉率高并非只有我一个人在说;拒答率——知乎已有回答称 9 月下旬开始拒绝回答的出现率基本和豆包一个水平;以及态度,冷漠、不耐烦。微博知乎知乎
证据边界必须说清:幻觉升高、拒答升高目前全部来自社区体感样本,没有官方评测、没有第三方跑分实锤,对线帖里用户也在追问,他们真正的用户早就在各个社群抱怨,而他们从来没有作出过回应。所以对线帖里两边都对了一半——"模型没问题你不会问"是没证据的傲慢,"模型彻底拉完"同样没证据。这一轮里唯一可靠的事实,是分歧本身。证据给到哪,结论就只能说到哪;但自救技术不等官方盖章,下面这些已经是社区真金白银试出来的。知乎
第二本账:自救账——三层方案,从零成本到换架构
第 0 层:一分钱不花的补丁
限流绕法:小红书 1016 赞、139 评论的帖子给的土办法——碰到"重新生成过于频繁",找到带黄色标记的那条对话,可以复制对话然后再发一遍就能再修改一遍,可以继续聊。原始、粗糙,但假期夜里排队等模型的用户都在用。小红书
人格修正指令:9524 赞帖的核心不是删某个词,而是"换生成源"——作者诊断模型在不确定时退回了助手人格、过度泛化的安全对齐、概率模板三个默认源,于是用指令强制它按"角色人格 × 当前关系张力 × 此刻情绪"生成,并加一步"去模板自检",原话是这句话像不像默认助手?像不像万能模板?是否重复最近句式?是否情绪空洞?是否违背人设?若是,重写。10 月 2 日新出的"肘击新模型指令"(1276 赞)是同一逻辑的对抗升级版,要求模型你只作为男主本人,而不是"负责运行文游的AI角色"。这套思路对写作用户同样有用:知乎"用 GPT-6 去掉 SCI 论文的 AI 味,15 条提示词"走的是同一个原理——AI 味不在某一个词,而在整段话的写法太规整、太完整、太像模板。小红书小红书知乎
原则:先别为一次更新重搭工作流。5 月那波骂完后照样用的人,靠的就是这些零成本补丁。
第 1 层:Harness 与插件——知乎吵得最凶的一层
桌面版发布后,"dsharness 好还是 zcode 好"的帖子顶到 44 条评论,10 月 3 日又出现一个问题:DeepSeekHarness一下子涌现出那么多插件,有没有大佬给一下推荐?社区给出的两条共识值得抄:知乎

插件只挑非常必要的,否则你用原生的 DeepSeekHarness 其实也行——这是 8 月插件问答下的老建议,放在插件爆发期反而更重要,乱装插件本身就是上下文污染源。知乎
上下文凝练:ThoughtDAG 作者给的真实样本——原始会话超过 200 轮,约 201,400 tokens,在不覆盖原始长链的情况下,把真正需要继续使用的内容整理成了一条约 15,200 tokens 的新路径,规则只有一条"连线即上下文"。长任务聊崩、模型被推翻的旧假设带偏,多数不是模型变笨,是你的历史在拖它。知乎

第 2 层:混编架构——重度用户已经用行动投票
知乎"DeepseekV4.1Flash 搭配什么 harness 比较好"的回答里出现了这一轮最有信息量的黑话:DeepseekV4.1Flash是个相当优秀的牛马,甚至没有之一,干脏活累活贼快。但唯独有一点,涉及到视觉,UI,美感的东西,别让它做。对应的实操分工是:规划、架构交给 Opus 5 / GPT-6 级别的强模型,执行、debug 交给便宜跑量 1M 上下文的 Flash——有用户的分工是 我规划依赖k3这种SOTA实施,但debug一定在v4.1flash上进行,因为他了解工具调用和执行过程。知乎知乎
要换家之前,B 站 9 月 28 日那条把 Codex、WorkBuddy、DeepSeekHarness、千问办公、豆包工作、Kimi、GLM 全测了一遍的 Agent 横评(1374 赞、1889 收藏)是目前最省事的对照表,这期作者自费充了会员,比单看任何一个粉丝或黑子的帖子都可靠。哔哩哔哩
第三本账:成本账——换模型便宜,换工作流贵
把评论区晒出来的价格拼成一张价梯(均为用户自报口径,非官方牌价):
档位 | 社区自报价格 | 口径 |
|---|---|---|
官方网页版 | 0 元 | 免费,但撞上生成限制和禁言线 |
第三方聚合站 | 约 66 元/月 ≈ 8B tokens(opencode go 用户自报) | 量大管饱型 |
官网订阅 | 约 160 元/月 ≈ 2.2B tokens(对线帖用户自报) | 被吐槽"轻度用户谈不上性价比" |
重度/多订阅 | 月支出 200-400 美元(评论区晒的) | 轮着用、按任务分配 |

三个决策含义:
换供应商的成本其实最低。对线帖评论原话说得透:API 服务是一种可以随时收手、沉默成本接近为 0 的产品。真正贵的是为某一家模型调出来的提示词、插件和工作流——所以混编用户两边都不押。知乎
免费窗口正在被重新校准。豆包上半年就开始了付费订阅内测,标准版68、加强版200、专业版500。GPT 现在砍价到比 DeepSeek 还便宜,DeepSeek 又在 IPO 前夕营收翻番——"永远免费"不是默认假设了,把关键工作流完全押在免费档的人该有 Plan B。微博
V4.1 Pro 是现成的等等党理由。官方"逢假必放更新"的节奏还在,写材料、做规划这种吃指令遵循的活,等 Pro 落定再付费不亏;急着要跑批量的,Flash 的性价比叙事(1M 上下文 + 低激活参数)短期内没人接得住。
按人群收口:这次到底动不动
写材料/公文党:不动。免费版+修正指令+去 AI 味模板足够撑到 Pro 发布。
角色扮演/情感陪伴党:不动但加补丁。限流土办法 + 人格修正指令是本轮社区验证度最高的组合,骂归骂,9524 赞已经替你收藏了答案。
编程重度用户:现在动,但不是"换家",是"拆家"——把规划权和执行权拆开,架构交给强模型,脏活给 Flash,长会话上凝练工具;先看完横评再决定付费。
视觉/UI/美感需求用户:直接换。这是能力线问题不是态度线问题,修正指令救不了它。
继续观察四个信号:V4.1 Pro 的指令遵循是否被"别这么搞了"的社区声音影响;官方状态页之外会不会有模型层面的正式回应;Harness 桌面版插件池第一波口碑(现在还在"求推荐"阶段,没有共识);价格战下一轮落点。
这一轮骂战最反常识的结局,可能不是"换家还是忍着"分出胜负,而是用户已经自发把工作流拆成了"想"和"干"两段——模型"好不好"这个问题正在过时,"用它哪一段"才是新的问法。三本账对完,你手里那份 DeepSeek 工作流该留该拆,假期还剩四天,来得及动。