Kimi K3引爆全球AI价格战:Opus 5连夜砍价一半,但最便宜的AI现在最难买到

源自7位全网作者

06:40

过去两周,AI行业打了一场两年来最猛的价格战。Kimi K3 登顶代码评测榜之后,Anthropic 同一周端出 Opus 5 直接砍价一半,OpenAI 跟进降价 20%~80%,美股 AI 板块市值在七月下半旬蒸发约 4700 亿美元。表面看这是宏观产业新闻,但对每个月都在为 AI 编程、长文档和 Agent 工具付费的人来说,它直接决定这个月的钱往哪儿花。我把各家的定价表、购买渠道和实测账单梳理了一遍,结论先说:红利是真的,坑也是真的。

一、价格战打到什么程度?先看这张定价表

Kimi K3 官方 API 按量计价为缓存未命中输入 20 元 / 百万 token、命中 2 元,输出约 100 元,输出价格只有 GPT-5.6 Sol 的 46%、Claude Fable 5 的 28%。知乎海外这边,Anthropic 的紧急应对是推出 Opus 5,把输入/输出直接压到每百万 token 5 美元 / 25 美元,砍到当时评测第一的 Fable 5 的一半。36氪

一周多后,OpenAI 官宣 GPT-5.6 降价,并上线了速度快 2.5 倍、价格仅 2 倍的"快速模式"。36氪

Kimi K3引爆全球AI价格战:Opus 5连夜砍价一半,但最便宜的AI现在最难买到

这波降价不是资本输血换来的,而是成本结构使然。按 Kimi K3 官方模型卡,模型共 2.8 万亿参数,但每处理一个 token 只激活约 1040 亿参数,占总量的 3.7%。36氪第三方测算里,K3 单任务综合成本约 0.94 美元,略优于 GPT-5.6 Sol 的 1.04 美元,仅为 Claude Opus 4.8 的一半,国产模型缓存命中单价更是海外同类产品的三十分之一。36氪这就是 K3 敢把顶级能力打折卖的底气:它在架构层就把成本压下来了,不需要靠烧钱打价格战。

二、但红利的另一面是:有钱也未必买得到

就在 API 单价跌到历史最低的同时,国内订阅套餐进入了"困难模式"。7 月 19 日 Kimi 公告,K3 上线仅 48 小时请求量就超出预估、算力集群濒临上限,紧急暂停 C 端新用户订阅,直到 8 月初新用户订阅仍在受限。微博智谱则反向操作,GLM-5.2 编程套餐调价,热门 Pro 档月费涨到五百多元并改成积分制。微博而就在半年前,9 家平台 28 款编程套餐里最便宜的只要 7 块 9 一个月。微博

海外渠道也不算顺。GitHub 在 8 月 6 日宣布 K3 在 Copilot 一般可用,托管定价为每百万 token 3 / 15 / 0.30 美元。知乎但同日就因 GitHub Actions 事故暂时暂停 rollout,Business / Enterprise 版默认关闭、需管理员开启,想借 Copilot 薅 K3 的人还得再等一等。

也就是说,价格战的红利目前主要集中在按量 API 和少数第三方渠道,而订阅套餐要么受限、要么涨价、要么暂停。"便宜"和"买不到"同时存在,是这轮价格战最反常识、也最真实的一面。

三、这个月的 AI 钱怎么花:三种用法三套打法

偶尔改代码、总结文档的轻度用户,建议先别急着买包月会员。按量计费下 99 元大约能买 99 万输出 token,或者 495 万未命中缓存的输入 token,偶尔用能撑很久。知乎想蹭免费额度的,可以等 Copilot 恢复 rollout 后看看自己的账号是否放量,或试试国家超算互联网这类低价渠道,核心是别在价格动荡期把自己锁进年费会员。

每天写代码的编程主力,K3 按量计费是当前性价比最稳的选择,但付钱前先算两个数。官方宣传编程场景缓存命中率 90%,而多轮对话、重复分析同一批代码的实测命中率只有 30%–60%,这个差距会直接改写账单。知乎如果你的用法多是全新长文档、没有上下文复用,输入就全按 20 元 / 百万的未命中价算,折扣会明显缩水。

跑 Agent 和长上下文项目的重度用户,是账单爆炸的地方,也是 K3 护城河所在。一个完整 CRUD 后台输出 4.5 万 token、成本 4.73 元,一天跑 20 个类似任务就是 94.6 元,99 块一天见底。知乎百万级上下文同样:5 万字代码对 K3 只占 5% 窗口,对普通模型已接近上限,能力是真的,烧钱速度也是真的。这类用户与其 all in 一家,不如按任务路由:简单总结交给轻量模型,复杂代码和长文档交给 K3,数学推理交给 Sol,让账单保持弹性。K3 权重已全量开源,社区甚至有人用不到 200KB 的 C 语言代码就完成了它的 CPU 推理,选择弹性本身就是开源红利。36氪

Kimi K3引爆全球AI价格战:Opus 5连夜砍价一半,但最便宜的AI现在最难买到

四、付钱之前的三盆冷水

第一盆,别把"8GB 内存跑 K3"当成消费级体验上头。那是一次严肃的工程验证:作者用 Linux cgroup 把进程限制在 8GB 内存、测得峰值 8.24GB,但测试机是 124 核的双路服务器,并没有在一台普通 8GB 笔记本上实测过。36氪

Kimi K3引爆全球AI价格战:Opus 5连夜砍价一半,但最便宜的AI现在最难买到

代价也很直观:8GB 档位平均 32.69 秒生成一个 token,还要至少 1.7TB 的 NVMe 空间放 1.56TB 权重和整理后的主干文件。36氪与此同时,本地部署的硬件成本不降反升:内存大涨价、Mac mini 断货、DGX Spark 建议零售价从 3999 美元涨到 4699 美元起。普通人真正该盯的还是 API 和渠道价格,而不是上头买服务器。

第二盆,别把声量当用量。GitHub Copilot 的 GA 是迄今最强的开发者分发信号,却因事故暂停 rollout;唯一能连续对照的生产侧入口 OpenCode Go,8 月 6 日 token、用户、会话同步下降,滚动周份额降到 0.45%。知乎K3 的"好用"已经验证,"大规模用上"还在发酵,红利可以领,焦虑不必买。

第三盆,就是前面说的缓存命中率落差。官方 90% 和实测 30%–60% 之间,隔着的是同一个任务几倍的账单差距;付钱前先看看自己的上下文复用率高不高,再决定按量还是包月。

五、接下来值得盯的三个信号

一是 Copilot 恢复 rollout 的时间和企业版管理员开启率,这决定 K3 进入海外开发环境的节奏;二是 Kimi 算力扩容完成、C 端新订阅恢复放开的时点,一旦放开,订阅层的价格战才会真正开始;三是 GPT-5.6 降价后的实际账单和 Opus 5 的真实表现,海外巨头的"被动防御"才刚开始,这张定价表下个月可能还要重写。

价格战里,用户的最优解从来不是囤货,而是保持弹性:能按量的按量,能等降价的等降价,别把数据和习惯一次性交给任何一家年费会员。便宜的永远是 AI,贵的从来是"被锁定"。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章