Kimi K2.5明天退役:急着换K3之前,先把"交接"做了——给啃长文档的人的一份迁移自检

源自230位全网作者

05:03

明天(8月31日)早上,如果你的代码或工作流里还在调 kimi-k2.5,它会直接下线。8月24日月之暗面官宣:发布并开源刚满七个月的K2.5"本月底正式退役"。微博更早的8月4日,开发者通知里写得很具体——kimi-k2.5 API于8月31日下线,同期的元老moonshot-v1系列一起退。接棒的是K3:2.8万亿参数、100万token上下文、全球参数最大的开源模型。知乎

这两天全网都是"K3更强了放心换"的攻略,官方口径也确实这么说:不但没变弱,反而更强了。知乎但我翻完知乎、小红书、微博、B站这轮的讨论,发现几乎没人在管一个真问题:对靠Kimi啃合同、读论文、消化研报的人来说,过去几个月喂进去的文档、和K2.5吵清楚的上百轮结论,怎么办?

退役的不只是模型,还有你攒下的上下文资产

用了两年Kimi的用户总结过它的三块看家活儿:啃几十页的PDF长文档、多文件交叉问答(把方案、预算表、会议纪要一起丢进去问"这三个说法有没有冲突")、链接阅读加联网溯源。知乎这三件事的共同点是——都建立在"重复喂、持续问"的积累上,而这些积累大部分躺在对话里,不在你手上。

Kimi K2.5明天退役:急着换K3之前,先把

官方通知只给了迁移目标:建议开发者转向 kimi-k3、kimi-2.6,编程场景用 kimi-k2.7-code 系列。微博旧对话和上传文件怎么处理,一个字没提。

指望换完模型"它还记得我们聊过什么",更不现实。8月20日一篇Kimi「项目」功能实测说得很直白:「项目」目前不支持一键将既有对话转过来,迁移需要手动完成知乎而且Kimi单轮上下文约128K token(大约5–6万汉字),一条超长对话本来就不可能被完整重读。换句话说,K3接手的是模型,不是你的历史;对话里的过程,只有你自己搬走的那部分还在。

三步交接,今晚做得完

第一步,别导聊天记录,导"交接文档"。 这是Kimi官方帮助中心推荐、也是实测者验证过的做法:回到那条旧对话,直接说——"请把本次对话的关键结论、代码要点、未解决问题整理成一份交接文档。"生成后存下来。知乎实测者对比过全文导出:几万字的对话要分多段导出再手工拼接,成本极高、收益有限。对话的价值在结论,不在过程。

第二步,产物优先于过程。 脚本、条款清单、改过批注的合同版本这些结果文件传原件;讨论过程只留结论。然后值得趁这次迁进「项目」功能:文件、多轮会话、项目指令归进同一个工作空间,新对话自动携带背景、文件按需读取,不用每轮重新上传。有个真实的槽点先说清:「项目」和Kimi Work桌面端的同名功能数据不互通,两边别混着用,认定一个主阵地。知乎

Kimi K2.5明天退役:急着换K3之前,先把

第三步,离"资格代办"远一点。 退役这几天,小红书上一堆帖子说K3"预约已满"“连订阅按钮都找不到”,也有人支招"只给手机号就行"。小红书请记住:K3的订阅资格会员费是两回事——资格决定你能不能看到订阅入口,钱应该自己付给官方。任何开口要账号密码的"代办",直接拉黑,账号里可躺着你要迁移的全部文档资产。

信K3之前,先做两个验收

验收一:效果不稳,先怀疑"壳",再骂模型。 8月30日当天有博主翻官方限制页发现一个多数人不知道的细节:K3是按"保留完整思考历史"模式训练的小红书

如果你用的客户端(harness)没有把历史思考内容完整回传,或者同一个会话里从别的模型中途切到K3,官方明确提示生成质量可能明显不稳定,并建议优先用已验证兼容的Kimi Code。小红书 同一篇文章里还有人反馈:同样的简单题,Kimi Code正常、另一个harness失败;也有人觉得别家壳里很好用。社区反馈目前两极,样本很少,只能当线索。但比较公平的姿势是现成的:全新会话、同一任务、同一思考强度、中途不换模型,再看正确率和token消耗。至少这解释了一件事——"K3变笨了"未必是模型的锅。

验收二:装得下,不等于读得对。 100万token是K3最大的卖点,一篇近期知乎长文汇总的多方研究恰好给这个卖点泼了冷水:当关键信息位于超长提示的中间区域(40%–60%位置)时,模型准确率比放在开头结尾时下降可达34%,这就是业内说的"Lost in the Middle"(中间遗忘)。知乎 超过50万token后,逐字忠实复现原文细节的概率急剧下降。

结论很实用:喂合同、年报给K3之后,自己做两个抽查——第一,把文档中间的关键条款、核心数字藏起来提问,看它捞不捞得着;第二,它给出的"来源页码",抽两三个回原文核对。同一篇汇总里还有个值得记住的数字对比:纯靠长上下文塞全文的事实准确率约72%,先检索再塞窗口约89%——行业共识已经转向"RAG检索+长上下文推理"的混合作用法,"全文丢进去一劳永逸"不是免费午餐。知乎

法律圈的信号也该两面看。Kimi官方账号8月28日发文:在最贴近真实律所工作的Harvey LAB基准上(1200多个真实律所任务,每道题几十条专家评分点必须全过才算通过),K3拿到26.7%,而前代K2.6是0分。知乎

跨度确实吓人:OpenAI投资、估值110亿美元的法律AI公司Harvey直接基于K3发布了自己的行业模型Tenet,国内多家红圈律所也给员工配了Kimi企业版。知乎

Kimi K2.5明天退役:急着换K3之前,先把

按官方的描述,K3这类审阅任务的交付形态也变了:丢进去一份文档,拿回来的是带批注和修订痕迹的Office文件,而不是一段聊天记录——风险点标在对应条款旁边,修改建议以修订模式呈现;官方演示里,一轮审阅跑完,连发送用的邮件草稿都一并生成。知乎 律师的活儿,从"逐字找问题"变成"逐条判断采纳哪条批注"。

Kimi K2.5明天退役:急着换K3之前,先把

但换个读法:这是严格全得分口径下的26.7%——四道题里仍有三道做不完整。律所合伙人的好评、小红书"断层领先"的实测帖,都带着宣传或幸存者滤镜,当成"值得进工作流"的信号就好,别当"可以替我交活"的证据。

谁今晚就该动手,谁可以再等等

  • 把Kimi当主力啃长文档的人(法务、研究生、投行/券商研究员):先做完三步交接再谈升级,否则在K3里你是"裸迁",过去几个月的追问和结论全部归零。

  • 代码和企业流程里还在调K2.5 API的:8月31日是硬截止,官方迁移清单摆在那儿(k3/2.6通用、k2.7-code编程)。微博 但成本别听信任何一方的顺口话——这轮攻略里,"K3的API价格更低、性价比更高"和"K3输出单价约为Qwen3.8-Max的2.5倍"两种说法同时存在,先拿小流量跑一遍自己的真实文档量,账自己算。

  • 偶尔问答的轻度用户:升级App就行,网页版基础功能照常,不用在退役公告的刺激下恐慌性付费。

顺带一提,8月31日这个"换模型之夜"不是Kimi一家:OpenAI的Codex里GPT-5.4系列同日下线,WorkBuddy那边也有升级吃掉自定义Agent的抱怨帖。小红书微博 模型服役期从"以年计"卷到"以月计"(K2.5满打满算七个月),定期做交接文档正在从"技巧"变成"刚需"——别指望任何平台给你提供"一键导出一切"的按钮。

K3更强,这是事实。但"上下文是你自己的",得你亲手搬回来。今晚趁最后完整的窗口,把最重要的几条旧对话生成交接文档存进文件夹,比看十篇"K3杀疯了"都实在。

内容由AI生成
0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章