DeepSeek价格一个月变三回:Codex用户换国产模型的真实账单,算完发现换错了反而更贵

源自10位全网作者

06:24

如果你在用Codex或者Claude Code干活,大概率经历过这个场景:任务跑一半,配额没了,只能干等token重置。微博上有位用户把自己的实操说得很实在:等重置的日子里,把DeepSeek V4 Flash通过CC Switch接进Codex接着干活,等token重置后,再让Codex把DeepSeek干的活审查一遍,查漏补缺。微博这不是个例。小红书上"CC Switch"相关的教程和踩坑帖,收藏量普遍比点赞还高——收藏高说明大家是真准备动手换,不是看个热闹。

DeepSeek价格一个月变三回:Codex用户换国产模型的真实账单,算完发现换错了反而更贵

一、这一个月,三件事撞在了一起

而这一个月,价格信号密集到让人眼花,至少有三件事撞在了一起:

第一,DeepSeek的价格进入"高频变动模式",降价和涨价的叙事同时存在。 社区流传最广的一条是"永久降到原价1/4":DeepSeek Pro模型API在结束2.5折优惠后,永久调整为原定价的1/4——输入3元/百万tokens、输出6元,缓存命中的输入低至0.025元。但就在本周,多个账号在报道另一条线:7月中旬引入峰谷定价之后,8月初又传出"整体大幅上调"的公告,理由是Agent场景把单日token消耗推到了8万亿的量级,算力扛不住。知乎两条线并不矛盾:降的是基准价,加的是高峰附加和新一轮调整。这恰恰说明,按任何一个"看到的单价"做预算都不可靠。

第二,给国产模型"量身定做"的Harness扎堆冒头。 第三方开源编程Agent项目Pi宣称接入DeepSeek后缓存命中率达99.93%,GitHub星标冲到8.6万。微博另一个叫Reasonix的终端Agent也拿到3.2万星、日增近千星,卖点同样只有一个:把DeepSeek的前缀缓存"榨"到极致。同时有消息称DeepSeek官方也在研发对标Claude Code的自家Harness。

第三,换模型的人多了,一个隐藏坑被集中问爆: 切换Provider之后,Codex里的历史聊天记录"全没了"。B站专门出了视频讲这事,评论区全是刚换完模型发现记录消失的人。

三件事合起来,其实就是一个问题:现在到底该不该换、怎么换?

二、先算账:决定账单的不是单价,是缓存

以ChatGPT每月20美元的订阅为基准,换成DeepSeek按量付费差距有多大?引用知乎博主"飞哥数智谈"自己的真实用量测算(一天约500万tokens,70%输入、30%输出),三种用法下的日成本能差出近10倍。知乎

用法

日成本

月成本(约)

无缓存原价(输入12元/输出24元每百万tokens)

78元

2340元

基准价调整后,无缓存(输入3元/输出6元)

19.5元

585元

调整后+98%缓存命中(缓存输入0.025元)

9.3元

279元

注意两个关键点:

1. 缓存才是省钱的大头,不是单价。 从78元到19.5元靠的是基准价调整,从19.5元到9.3元靠的是KV缓存命中。这位博主实测缓存命中能到98%。你的使用模式越"重复"(固定的系统提示词、稳定的项目上下文),省得越多;天天开新项目、上下文每次都变,缓存红利就吃不满。

2. 社区横向对比也印证了这一点。 8月10日一份CodingPlan平台综合对比里,按"含缓存命中"折算的有效综合单价:DeepSeek Flash虚拟套餐约0.08元/百万tokens,Codex Pro、Claude Max这类订阅折算约0.14—0.16元,Claude Pro约0.33元,OpenCode Go约0.47元。各家名义价差距是几倍,算上缓存和用量模式后的有效价差能拉到十倍以上——"怎么用"比"订哪家"更决定账单。

DeepSeek价格一个月变三回:Codex用户换国产模型的真实账单,算完发现换错了反而更贵

所以做成本预估时,别按宣传的最低价算,按你自己的缓存命中率算,再叠加高峰时段翻倍这类附加规则,留足余量。知乎(以上单价均为社区博主整理口径,动手前请以DeepSeek官方价格页为准。)

三、但是:直接"换大脑",省的钱会被三笔隐性成本吃回去

这是我最想提醒的部分。知乎上写过Codex接国产模型教程的博主"土著哥聊AI",7月发了篇《为什么现在我绝不会用Codex去绑国模使用了》,等于亲手拆自己的台。他的核心观点值得每一个准备换模型的人听一听:

Codex不是一个聊天机器人,它是一套围绕GPT模型量身定做的「自动驾驶系统」。知乎换模型不是换个电池,是把法拉利的发动机换成家用车的发动机。他列了五个会打折扣的地方:

  1. 工具调用:Codex给模型一堆工具(读写文件、执行命令、搜索、MCP),模型要自己判断"现在该用哪个"。工具一多,不够强的模型容易选错。

  2. 多步推理:Codex的活儿是"读文件→拆任务→改代码→跑测试→看结果→再改"的长链条。单步都没问题,链条一长,容易"装到一半忘了装到哪"。

  3. 记忆管理:长任务会积累几万字的上下文,GPT有专门的记忆压缩机制,这是OpenAI的独门能力。

  4. 通信格式:Codex和模型之间的协议格式极严格,多一个空格都可能"听不懂"。国产模型的"OpenAI兼容",更多是"大部分情况下对得上"。

  5. 缓存加速:OpenAI服务器端的缓存机制,换到国产模型上可能完全失效——每次任务从头算一遍,又慢又贵。

除了模型本身,中间的转接层(CC Switch、OpenCodex、Codex++这类工具)也是风险点:转换过程是黑盒,出了问题你分不清是模型的锅、转接头的锅还是配置的锅;而且Codex更新很快,转接工具永远慢半拍,你今天能用的配置,可能下个月就失效。知乎他的总结很扎心:“省下来的那点订阅费,可能会被反复调试的时间、莫名其妙的Bug、和逐渐积累的不信任感加倍偿还。”

有意思的是,这位"劝退派"和开头那位"实践派"微博用户,最后走到了同一个答案——不是不换,是分工

DeepSeek价格一个月变三回:Codex用户换国产模型的真实账单,算完发现换错了反而更贵

四、社区收敛出的省法:国产模型当"手",官方模型当"脑"

把正反两方的实践放在一起看,收敛出的用法高度一致:

  • 规划、决策、审查:留给Codex/Claude Code + 官方模型。这部分token消耗占比其实不高,但决定了活的方向对不对。

  • 批量执行:生成代码初稿、写文档、做翻译、跑重复性的修改,交给DeepSeek这类国产模型,按量付费随便造。

  • 最后验收:国产模型干完的活,回到官方Agent里做一轮审查查漏补缺——就是开头那位微博用户的真实工作流。

更工程化的版本已经有人做出来了。Reasonix那个3.2万星的项目,点破了一个反直觉的成本规律:单价越便宜,越容易用超。知乎通用Agent框架的上下文压缩会在字节层面破坏前缀缓存,导致一个跑了3小时的编码任务越往后每轮计费越高。它的解法之一是"双模型协作的会话隔离":用DeepSeek-V4-Pro做规划、V4-Flash做执行,两个模型放在两个独立的缓存稳定会话里——“两个干净的前缀,好过一个被污染的前缀”。分工不只是"人和模型分工",还是"模型和模型分工"。

土著哥也给了个参考:“Kimi K3做前端已经很不错,GLM-5.2处理后端”,各取所长,别勉强一个模型干它不擅长的事。

另外提醒一句:国产模型自家的Harness(Kimi Code、ZCode、MiniMax Code等)也在快速进化,但现阶段体验还参差不齐——知乎上"为什么国产自家的codex没什么人用"这个问题有60多万浏览,评论区吐槽集中在产品体验而不是模型能力。所以现阶段"海外成熟Harness + 国产模型API"的组合,反而成了很多人的过渡最优解。

DeepSeek价格一个月变三回:Codex用户换国产模型的真实账单,算完发现换错了反而更贵

五、换之前,三个坑先避开

坑1:聊天记录"消失"。 Codex按Provider区分会话可见性,切换到DeepSeek后,旧会话看不见了——但数据并没有丢。哔哩哔哩B站有UP主专门出了教程:用Codex Provider Sync可以批量同步历史会话,操作前先备份,支持回滚。总之,换Provider之前,先把会话备份了再动手。

坑2:教程标题里的"V4 Pro"。 这两天B站已经出现"Claude Code + DeepSeek V4 Pro安装教程"这类标题,但知乎上今天的讨论还在说V4正式版的发布节奏跟不上Flash的热度、服务器压力大。名字先别全信,配置之前去DeepSeek官方渠道核对一下你接的到底是哪个模型、什么价格,上下文窗口和计费规则都以官方页为准——这周的价格新闻你也看到了,慢一天看到的都可能是两个价。

坑3:灰产充值。 社区里流传"闲鱼25元买408元API额度"这类渠道。便宜是真便宜,风险也是真风险:来路不明的额度随时可能失效,API Key经过他人之手还有安全隐患。按量付费本来就便宜,没必要为了再省一杯奶茶钱把项目搭进去。

六、三类人,三种动作(决策卡)

你是哪类人

建议动作

每天高强度跑长任务、频繁撞限额,项目上下文稳定

值得认真搭一套"国产模型执行+官方模型审查"的分工流。先备份会话,再用CC Switch类工具切换;预算按自己的缓存命中率估,别按宣传最低价

用量不大,一个月20美元的订阅用得完

暂时别折腾。降价红利吃不到多少,换模型的学习和调试成本反而更高,等DeepSeek官方Harness出来再评估

主要跑短平快的小任务(脚本、文案、小工具)

可以激进一点:小任务直接全切国产API,单价低、缓存好命中、试错成本小;重要项目仍然留在官方订阅里

最后说一句:当价格一个月能变三回,"用不用国产模型"就从立场问题变成了纯算账问题。账算清楚了,答案其实不复杂——省钱靠分工,不靠换脑。你换不换、怎么换,欢迎在评论区聊聊你的真实账单。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章