DeepSeek 把 Pro 变 Flash,引发用户争议
DeepSeek 在开放平台发出通知,Harness 团队负责人崔添翼当天也在 X 上同步了同一件事。内容有两条,一是 V4.1 Flash 计划在北京时间 9 月 10 日前后正式上线,二是在 V4.1 Pro 上线之前,所有发给 deepseek-v4-pro 的请求会被转到 V4.1 Flash,并按 V4.1 Flash 的单价计费。
用 API 的人不用改代码,账单会自动变便宜。

🔀 为什么这么做
官方原话是,经内部和外部多方测试,V4.1 Flash 在性能、费用、速度、总用时上全面超越 V4 Pro。理由是「以更高的价格、更慢的速度、更多的算力消耗提供原有的 V4 Pro 不太合适」。
V4.1 Flash 用的是全新结构加重新预训练,原生支持图文,不是给纯文本模型外挂一个视觉编码器。9 月 8 日开过一轮限时内测,模型名叫 deepseek-v4.1-flash-expires-on-0910,到期日直接写进名字里,单账号限 20 并发。
💰 价格降多少
V4.1 Flash 的计费和这次调整的 flash 系列一致,空闲时段每百万 token 为缓存命中 0.02 元、缓存未命中 1 元、输出 4 元,高峰时段翻倍,9 月 10 日 12 时生效。高峰时段是工作日 9:00 到 12:00、14:00 到 18:00。
社区按这个新价对比整理出的降幅是输出约七成、输入缓存未命中约八成、缓存命中接近九成。V4 Pro 一侧的价格口径在不同来源里不一致,有的按标准价计,有的按促销价计,官方没给统一对照表,具体数字建议自己去账单验。
🗣️ 争议在哪个点上
反对的声音不在技术,在「替用户做决定」这件事。
Apache OpenDAL 的作者 Xuanwo 提出,用户已经调好的提示词很可能依赖 V4 Pro 的某些行为,直接替换会破坏业务;他建议发退役公告鼓励迁移,不要单方面替用户决定。另一位开发者 colmugx 拆成两层,一是以后 model_id 不再可靠,少看一天公告就不知道背后跑的是什么;二是 ToB 场景里,推理突然变快老板会以为是优化成果,等 V4.1 Pro 上线又慢回去,这个落差没人负责。
这条规则是临时的。通知里写的是 V4.1 Flash 上线之后、V4.1 Pro 上线之前这一段时间。
📌 背景
V4 Pro 这个版本不太顺。8 月 13 日上线当天公告被撤回,第三方评测机构给它的评分只比 Flash 高 3 分,定价却是数倍。这些来自社区和媒体梳理,官方没有正面回应。
⏱️ 现在该做什么
路由之后建议做两件事,第一是翻账单,同样调用量费用应该明显下降,没降说明请求没被路由到;第二是跑一批真实任务做对比,尤其是依赖 Pro 高推理强度和超长输出的业务,别等线上出问题才发现。
被换模型也能顺带省钱,你觉得这笔账怎么算?
#DeepSeek #API #大模型 #开发者 #科技新闻
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
