今天(8 月 17 日)0 点,DeepSeek 的新定价正式生效了。知乎如果你的 VS Code 里接的是 DeepSeek 的 API 在跑 AI 编程,账单马上会有明显变化。
先说变化有多大:V4 系列全面改成峰谷两档计价,高峰时段是北京时间 9:00–12:00 和 14:00–18:00,闲时价格是高峰的一半。微博V4-Pro 结束测试转为正式商用,涨幅最高的项目超过 11 倍:高峰时段缓存命中输入从 0.025 元/百万 tokens 涨到 0.30 元/百万 tokens。知乎高峰输出价格到了 27 元/百万 tokens。知乎

社区实感来得很快:知乎有人说「V4 Pro 今天九点之后问了一个问题花了 4.95,涨价的体感太强了」。知乎微博有人晒出「问了 2 个问题,8 毛钱」。微博还有人吐槽照这个涨法,V4 Flash 都快比别家便宜模型贵了。微博上甚至有个段子:「梁圣正在变老梁」。微博
再叠加这周 Copilot 计费规则的变动,VS Code 里的 AI 编程党这周在集体问同一个问题:还有没有 0 元的方案?有,而且这周的社区生态刚好齐了。我把目前讨论度最高的方案整理成 4 条路线,每条路的「0 元」逻辑不一样,坑也不一样。
【路线一:Cline 免费模型】
Cline 是目前 VS Code 里最火的开源 AI Agent 插件之一,能自动建文件、跑命令、改 bug。

重点是它自带免费模型通道:按教程实测,GLM 5.2、DeepSeek V4 Flash 这类免费模型可以直接选用,不用 API Key,不用绑信用卡,装完就能开工。哔哩哔哩适合 5 分钟入门党。注意:免费额度有限;Agent 会替你执行终端命令,执行计划要看牢,别开自动批准;有真实用户吐槽 Agent 玩法「特别耗费 token」。微博
【路线二:Kilo Code + 免费网关】
Kilo Code 是 Cline/Roo Code 家族最大的 fork(Roo Code 300 万安装量 5 月停运,Kilo 融了 800 万美元接棒);多模式、并行 agents、git worktrees、并排对比都有。哔哩哔哩0 元路子:Kilo Gateway 自带免费模型;Google Gemini 免费 API Key(不用绑信用卡);NVIDIA build.nvidia.com 免费模型端点(如 MiniMax M2.7)、OpenRouter 上的免费模型(腾讯 Hy3)都有社区实测。哔哩哔哩注意:插件开源免费,但模型调用仍可能产生费用,接免费通道才是 0 元;免费额度本质是厂商拉开发者的补贴,规则随时会变。
【路线三:Continue.dev + Gemini 免费 Key】
不需要 Agent 自动改文件、只要补全+问答+行内编辑的轻量路线:装插件、申请 Gemini 免费 API Key、填入即用,支持 Claude/Gemini/GPT/本地模型。哔哩哔哩注意:补全体验与 Copilot 有差距,大项目慢一些,但 0 元可以忍。
【路线四:Ollama 本地模型】
被涨价伤到直接转本地:入门组合 Ollama + Continue + Qwen3-Coder 8B,Windows 能跑、断网可用、代码不出本机。哔哩哔哩

知乎有硬核玩家在 4090 上本地部署 qwen3.8-27b 量化版接 DeepSeek Harness(dsh),「丝般顺滑」。知乎注意:8B 主流独显能跑,更大模型看显存,速度慢于云端;0 元但费电。
【愿意花一点钱的话:记住峰谷表】
闲时是高峰的一半,大任务挪出 9:00–12:00 和 14:00–18:00 直接省一半。知乎

知乎有人照做,V4 Flash 闲时跑的评价是「还算能接受,而且 V4 Flash 在 Harness 里是真的快」。知乎涨幅最狠的是 V4 Pro 高峰档,日常代码活儿 V4 Flash 或中转平台的 Flash 预览版往往够。微博摩根大通解读:DeepSeek 在高能力模型里仍有价格竞争力。微博对个人的启示:便宜 token 的价格屠夫时代大概率过去了,免费额度 + 峰谷窗口就是新的打折方式。
【三个避坑提醒】
1)Cline/Kilo 的「自动批准」开关别全开,免费额度烧完事小,动你的文件事大;2)免费额度是促销不是承诺,关键流程留付费备选;3)公司/敏感代码走免费云端模型数据会出本机,拿不准走本地。知乎
这篇值得存一下。这周恰好是重建 AI 编程配置的好时机:旧秩序(便宜的 DS API + Copilot 包月)在松动,新秩序(免费网关 + 本地模型 + 峰谷薅羊毛)还在补贴窗口。趁着补贴还在赶紧上车,但别把全部工作流押在任何一个免费入口上。知乎