28天享年:旗舰被自家小弟顶了班,V4 Pro流量交给V4.1 Flash,API用户先对三笔账

源自21位全网作者

05:11

28天享年:旗舰被自家小弟顶了班,V4 Pro流量交给V4.1 Flash,API用户先对三笔账

9月9日晚,DeepSeek开放平台挂出一则措辞平静的公告:9月10日起V4.1 Flash正式上线,在此之前,所有发给V4 Pro的请求统一路由到V4.1 Flash,并按Flash的单价计费。知乎

知乎网友很快替这台旗舰算好了享年:Deepseek V4 Pro,2026.08.13 - 2026.09.09,享年28天。知乎

这不是一次普通的版本迭代。接班的不是新旗舰,而是低一档的走量款——在大模型行业里,这几乎是头一回:厂商亲手把旗舰的线上流量,交给小弟。知乎 如果你手上跑着DeepSeek API、Bot、Agent或者RAG链路,从明天起你的每一次调用都在悄悄换人,只是模型名一个字符都不用改。这篇不复盘新闻,直接对三笔账:账单、行为、站位。

先把时间线钉死:这不是突袭,是一场48小时的公开公测

  • 8月13日:V4 Pro正式版(DeepSeek-V4-Pro-0813)上线API,支持非思考与思考双模式、ToolCalls,上下文窗口100万token,最大输出38.4万token。微博 这是个1.6万亿参数的大杯,价格是Flash的三倍。

  • 8月17日:DeepSeek执行第一轮峰谷定价,V4-Pro高峰输出价从6元涨到27元/百万token,涨价直接点燃开发者群。知乎

  • 9月8日下午:官方交流群放出临时模型deepseek-v4.1-flash-expires-on-0910,名字自带过期日期,9月10日自动下线,新架构、原生多模态,计费与V4 Flash持平。知乎

  • 9月9日:Flash系列降价公告与V4 Pro路由公告同日落地,正式版本尚未挂档,内测信息已经满天飞。

当时大家都在猜,一个内测接口为什么把名字起得像处刑倒计时。随内测一起发出的反馈问卷里,DeepSeek只问了一件事:这个新模型,能不能全面替换线上的V4 Pro?知乎 现在答案揭晓:到期日就是登基日。

第一笔账:账单——“降60%”是给缓存党看的,大头没怎么动

先给结论:这次对V4 Pro用户是自动大降价,对Flash老用户只是输入端回血。

9月10日12点起,Flash系列两款模型一起调价,缓存命中输入直接砍到0.02元/百万token,最高降幅60%。知乎 对照一下V4 Pro原来的价位:空闲时段输入4.5元、输出13.5元、缓存命中0.15元——同一个模型入口,从此按Flash新价收费,输出账单砍约七成,缓存命中从一毛五降到两分钱。

但"最高降60%"要看清降在哪:缓存命中砍60%,未命中输入降三分之一,而输出只降了11%——输出才是多数账单里占七成的那一项。知乎 更扎心的对照:输入价回到了8月涨价前的原点,输出价(4元)仍是当初(2元)的两倍——这轮更像把涨多了的输入价回调,再挤一点诚意,不是无差别血降。

所以真实体感完全分人。RAG、多轮对话、Agent工作流这种同一段上下文反复喂的场景,缓存命中率一高,有开发者按实际token占比粗算综合成本能降约四成,是真降本。知乎 反过来,每次都是新输入、短对话的用户,感知很弱,属于情绪价值。还有一招最笨但有效:把不急的批处理挪到夜间和周末跑,高峰空闲差一倍价。有个做内容生成的开发者把日报任务挪到凌晨两点,月成本直接降了四成——钱不多,但这是一个人的用量,月调用上千万token的团队,错峰一个月省几百上千很正常。

第二笔账:行为——模型名没变,底下的车换了,这是最容易翻车的地方

公告里最危险的不是降价,是那五个字:统一路由。你的代码里`deepseek-v4-pro`这个字符串一个都不用改,返回结果的已经是另一个模型。官方给的理由罕见地直白:自测超过不算什么,公测也超过,并且直接拿来替换线上的Pro,这才是实锤。知乎

社区两天的反馈基本站在官方一边:有团队压测后反馈高并发下首token等待更短、输出更跟手,公开实测有开发者跑到每秒五百token上下。知乎 原生多模态是最大增量,截图、图表、图文混排直接喂,不用再挂视觉扩展包。B站这两天已经被这个临时模型刷屏:鹈鹕骑自行车SVG、4小时用鼠标键盘操控《我的世界》、一句话逆向老游戏拿无限生命。哔哩哔哩 “鹈鹕骑车”从2024年的一个玩笑,到2026年已经成了新模型首测的文化符号——每次有模型出炉,大家第一件事就是先画个鹈鹕。

但反面的声音也必须摊开。V4 Pro"名不副实"的传闻传了快一个月,社区最流行的解释是后训练出了问题:首轮提示词里工具占比越高,用户指令被稀释得越厉害,模型的注意力被工具带偏,产生低效的垃圾思维链,把后续所有轮次的推理轨迹都带歪。知乎 注意,这是社区推测,不是官方结论——但至少说明一件事:同版本号下行为时好时坏,本身就是风险。另一边,V4.1"如有神助"的口碑也有阴影:agent大喊一声we can,半句话不问用户,直接开干——只喂成功轨迹训出来的模型,缺的是"我可能会错"的那根弦。知乎 还有一条硬提醒:截至9月9日晚,官方公开API文档和价格页还没挂出V4.1 Flash条目,内测版数据不代表正式版。

对你的实际动作只有一条:别信“官方说超过”,9月10日中午之后,拿你自己的回归集(代码评测、工具调用链路、长文摘要)先跑一遍。 尤其检查三处:思考模式的输出结构有没有变、reasoning_content字段还抽不抽得到、tool_calls的调用习惯有没有漂。切换一个模型名成本是零,回滚一次线上事故成本不是。

第三笔账:站位——谁今天就该切,谁该按住等V4.1 Pro

公告里其实埋了下次见面的时间:V4.1 Pro上线之前。翻译过来:Pro没死,是回炉——把Flash上验证成功的新架构搬回大杯需要算力,下线Pro省出来的卡,就是下一代Pro的粮草,用今天的Pro,换明天的Pro。知乎

按人群拆开站:

你是这类用户

建议

代码/Agent/多模态为主,吃响应速度

大概率净受益,按新价直接跑,回归测试跟上

高频RAG、长上下文反复喂

0.02元的缓存命中是这轮最大红利,值得重算你的缓存策略

重度长文、复杂推理、对输出稳定性极度敏感

别把核心链路押在这次的“临时方案”上,观望V4.1 Pro

上周刚按Pro价格升级的团队

流量自动切、账单自动降,但去翻一下你SLA里写没写死模型版本

两个继续观察的信号:V4.1 Pro的上线节奏,以及价格页的正式挂档——13.5~27元的Pro价位表被撤下之后,新旗舰挂什么价,是自用用户和渠道商共同的悬念。

最后说点圈层谈资

这事真正扎心的地方,不是DeepSeek左右横跳——先涨价、不到一个月降价、再拿小杯顶大杯——而是它公开动摇了一条行业默认假设:想要最强,就得用最大。 过去模型折旧还能以年计算,GPT-4o被自家mini“斩杀”用了一年多;现在,28天。知乎 而这条路上倒下的不只是Pro:deepseek-chat、deepseek-reasoner这两个老名字7月底就正式弃用,R1的推理能力已经由V4 Flash的思考模式整体承接——曾经定义了"推理模型"这个词的名字,正在变成别名。知乎 同日,腾讯云也宣布了DeepSeek-V4系列降价,坊间流传的说法是最高降幅97.5%(以官方页面为准);而在国内性价比战场,GLM-5.3 Flash、Qwen 3.8 Flash已经接棒V4 Flash,成了新的“斩杀线基准”。知乎 卷王们的时间表,是互相咬着的。

一句话收束:这一轮,Pro的身份不再是入口,价格表也不再是年度合同。 你的模型选型清单,保质期请以“天”为单位重新标注。

你家线上跑的V4 Pro,回归测试打算什么时候跑?评论区聊聊你实测的吞吐和账单。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章