从"斩杀线"到"爹味AI":DeepSeek九月10天里换模型、并三模式、Pro下线又撤回——骂它变笨之前,先看清这次管线重排

源自187位全网作者

01:21

这一周,用DeepSeek的人分裂了。

微博上有人实时吐槽:“刚开始用它特别喜欢,觉得是世界上最懂我的’人’,现在感觉它越来越蠢,爹味也变得很重”。知乎上"最近DeepSeek是不是进退失据了"的问题挂着一百赞,“只会说好话、谄媚迎合”“回答问题越来越文不达意”“每次更新后语气越来越像教训人"的问题一个接一个冒出来。但另一边,知乎710赞的横评说V4.1逻辑能力"来到国产第一梯队头部,平均耗时同梯队最低”。甚至有人说"更新之后终于没那么谄媚了,太好了"。微博知乎微博

同一个模型更新,口碑两头撕裂。有人觉得它变聪明了,有人觉得它变爹了。这不是玄学,我把9月上旬这10天的公开信息全部拉了一遍,发现答案藏在一件事里:你用的DeepSeek,在9月10日到14日之间,被从头到脚换了一遍管线

这10天到底发生了什么:一条完整时间线

先上事实,全部有公开信源可查:

9月9日,V4.1 Flash限时内测,Flash系列先行调价。

9月10日,V4.1 Flash正式全量上线,这一天DeepSeek一口气干了四件事:

  1. 换模型:552B参数的MoE新架构,输入激活只有8B、输出激活16B,原生多模态,KV缓存对显存的需求降到上一代的1/4、对硬盘降到1/8。官方宣称在Agentic基准上超越了自家旗舰V4 Pro,以及GLM5.3、Kimi-K3等对手,模型同步开源。

  2. 改价格:API降价并全线推峰谷计价——闲时输入1元/百万token、输出4元,峰时翻倍。关键是峰时的定义极窄:只有工作日上午9-12点、下午2-6点这7个小时,晚上和周末全按闲时算。

  3. 并入口:网页端和App把"快速、专家、识图"三个模式合并成"统一智能交互",不再让你手动切,系统自动判断你的问题该走哪档。

  4. 官宣砍旗舰:9月14日中午起下线V4 Pro,所有请求自动路由到V4.1 Flash,按Flash价格计费。36氪

9月13日,剧情反转:开发者和B端用户反对声太大,官方撤回下线决定,V4 Pro的API继续提供、计费不变。知乎专栏作者kyo对此的点评很扎心——用户骂的不是"Flash不行",而是"我什么时候换、怎么换,不该由你三天前通知我"。知乎专栏

9月14日中午,网页端和App的默认流量仍然全量切到了V4.1 Flash;旧的V4 Flash和Vision Exp正式下线,模型名暂时路由到新模型。

从

也就是说:API用户争回了Pro,但普通网页/App用户没有回滚入口,你的"默认DeepSeek"已经悄悄换人了。

为什么有人喊"变聪明",有人骂"爹味重":三层变化叠在一起

把社区的正反两方证据摆到一起看,撕裂的原因就清楚了。这次不是单点变化,是模型、产品、安全三层同时动刀。

第一层:模型本身偏科,用例决定口碑。

说它强的,强在逻辑问答。710赞的长期横评结论是:逻辑能力显著跃升、速度同梯队最快,用high档时响应耗时大幅下降,“即便在世界范围也具有竞争力”。官方给出的基准对比里,V4.1 Flash在四项Agentic测试上全面压过V4 Pro和GLM5.3、Kimi-K3等对手。知乎36氪

从

说它拉的,拉在Agent干活。知乎一篇153赞的实测帖标题就叫《浪费时间!DeepSeek 4.1 Flash》:一个网页复刻加3D建模的任务跑了3个多小时,生成了28959个文件、其中100个Chrome用户配置占了2.2GB;任务复盘显示,模型真正在写代码的时间只有20多分钟,工具调用却耗了161分钟。同样的任务,GLM5.3 Flash一小时做完,还原度还更高。连第三方机构ArtificialAnalysis的排行也把它放得很低,和官方基准打架,知乎上专门有62赞的问题在讨论这个矛盾。知乎专栏知乎

第二层:入口被换了,你的"硬问题"可能被轻量档接走。

以前你可以手动切"专家模式"逼它深度思考,现在三个模式合并,系统自动判断问题难度来分档。判断对了体验丝滑,判断错了——你问的复杂问题被当成普通问题轻量处理——体感就是"绕圈、敷衍、文不达意"。再加上这一版语气风格调整,一部分老用户直接给出了"爹味"“教训人"的评价,有人吐槽它"强势、听不懂人话”,当场宣布把常用AI换成了豆包。微博

第三层:这一版"甲"更厚了。

知乎上一个353赞的回答提到,V4.1 Flash的安全审核比上一代的Flash和Pro都严得多,网页端管得严,连API都比以前紧,连带首Token延迟都变高了。安全对齐收紧的另一面,就是边界话题更容易得到"圆场式"回答。知乎

三层叠一起,结论是:DeepSeek没有整体变笨,它是把默认管线重排了——逻辑问答更快更便宜,Agent任务争议很大,深度追问和边界话题更容易被轻量档和安全层磨圆。你落在哪个用例上,就会得到哪一种"体感真相"。

峰谷计价:会排班的人账单砍半,不会排的人多付一倍

这次更新里最容易被普通用户忽略、但对钱包影响最直接的是峰谷计价全面铺开。

规则很简单:工作日9-12点、14-18点是峰时,其余所有时间——包括晚上、周末、法定节假日——都是闲时,闲时价格是峰时的一半。缓存命中的输入价格低到0.02元/百万token(闲时)。知乎专栏36氪

从

这意味着什么?跑批量任务、写长文档、做数据分析这类"不着急的活",挪到晚上8点以后或者周末跑,同样的预算能多干一倍的活。但如果你是白天实时问答的用户,一分钱也省不到——你的负载天然长在峰时上。

再往深一层看,这是DeepSeek把算力当电力卖的开始:用价格杠杆让用户替它削峰填谷。叠加它刚请来CFO、筹备科创板IPO的动作,"极致降本"就是这家公司未来一两年的主线,理解了这一点,你就理解了为什么默认入口会越来越Flash化。

现在该怎么办:分人群的行动清单

如果你是免费网页/App的日常用户:

  1. 拆问题:把大而模糊的问题拆成具体小问,系统分档更准,也更容易触发深度处理。别问"帮我分析一下这个行业",问"列出这个行业前三家公司的营收结构和增速对比"。

  2. 明确要求:对回答不满意时,直接在追问里写"一步步推理、列出正反两面、不要迎合我的观点"。这代模型的"谄媚"和"爹味",很大程度可以用提示词掰回来。

  3. 横向对照:重要问题别只信一个入口。腾讯元宝、Kimi、豆包都有自家或接入的模型,同一问题发两三处,答案质量立判。

  4. 留证据:把你觉得"以前能答、现在绕圈"的问题截图存档,标注日期。没有时间轴对照,"变笨了"永远只是情绪;有对照,你才知道是模型问题还是自己用法问题。

如果你是API/开发者用户:

  1. 锁版本:V4 Pro这次保住了,但"撤回"不等于"承诺"。在配置里显式指定模型名,别依赖默认路由,同时给关键工作流准备好GLM、Kimi的Plan B提示词。

  2. 排班:把不急的批量任务全部挪到闲时,这是白送的五折。

  3. 摊薄"夺舍"成本:趁没被逼着换的时候,先在闲时把现有工作流在新模型上跑一遍,看哪里要改提示词、改解析逻辑。等下线通知来了再迁移,是最贵的迁移。

接下来值得盯的三个信号:

  • V4 Pro会不会二次下线(第一次只是撤回,不是承诺);

  • 官方说的"V4.1架构可扩展到更大参数"的新旗舰什么时候来——那才是这轮Flash化的真正主角;

  • 科创板IPO进度。上市之后商业化压力只会更大,降价、降本、收紧审核大概率是长期方向。

最后说句判断

DeepSeek这个九月,明明白白选了一条路:把所有人迁到更便宜的Flash上,入口交给系统自动分档,算力按电力卖。这对"想便宜用AI的普通人"是实打实的利好——毕竟价格真的降了,速度真的快了,逻辑问答真的能打;但对"想让它刨根问底的老用户",这是一次没有回滚按钮的管线重排。

它不是变笨了,是变"便宜"了,而便宜的代价,是系统替你决定哪些问题值得深度思考。看懂这个逻辑,你就知道该调教它、绕开它,还是时候换个入口了。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章