如果你这周打开过小红书,大概率刷到过这类帖子:多年不翻的收藏夹,被 AI 一次性整理,「电子垃圾山」秒变知识库。
最火的一条发于 8 月 23 日:作者 5 年收藏 3300 条,点收藏时约等于学了,实际全在吃灰,最后用 AI 把它们重新变成了知识库。小红书这条帖子 3700 多赞、5800 多收藏,评论区更是名场面——最高赞评论是「你这条也扔收藏」:大家一边学怎么清理收藏夹,一边把这篇清理收藏夹的教程本身,也扔进收藏夹吃灰。
别笑,这正是这波热潮的入口:这一周里,「收藏4000多篇笔记后,我用 AI 搭学习库」「小红书收藏夹吃灰?Codex帮你轻松搞定」接连出现,都是让 AI 接手那些「存得爽快、整理头大」的收藏夹。小红书小红书把它们的套路拆解开,你就能判断自己要不要跟。
都是三步,但风险集中在第一步
这些帖子的流水线相同:第一步,把收藏夹「搬出来」——要么跑脚本批量导出,要么让 AI 直接操作浏览器,把你的收藏夹一页页翻过去抓取;第二步,喂给 AI 分类、打标签、摘要、合并重复项;第三步,生成产出——一个可搜索的「知识库」,甚至一份学习计划。

评论区里满是「求脚本」的人,但大家实际都卡在第一步。而第一步,恰恰是三步里唯一有真实风险的一步。有知乎用户晒出的真实对话记录:他让 AI Agent 一步步安装全网采集脚本,脚本跑起来的那一刻,AI 就开始替他的账号干活了。
三个事实。
第一,小红书没有官方的收藏夹批量导出功能,也没有公开 API,所有脚本都是第三方途径。知乎做同类导出工具的开发者在帖子里写明,就是因为「小红书没有公开API」才自己动手;现在流传的各类浏览器插件、油猴脚本、网页解析站,走的都是这个路子。
第二,真实案例已经出现。今年 5 月,一位知乎用户发帖称,自己让 AI Agent 帮忙搜集素材、监测舆情,结果账号被永久封禁,申诉基本无门。知乎值得注意的是,他爬的甚至不是自己的收藏夹,而是舆情数据。

第三,时机敏感。就在本周,「小红书爬虫上GitHub热榜」成为话题,有技术博主公开讲解爬虫怎么跑、怎么不被封、怎么用得稳。知乎这类讨论越热,平台侧的收紧往往越狠。
还有一个容易被忽略的隐性风险:那些「仅粉丝可见」的脚本,你运行的那一刻,等于把账号的登录态交给了一段来路不明的代码。在上面那个案例里,采集工具的配置页上明明白白写着「小红书——搜索阅读(需要登录 Cookie)」,Cookie 交出去之后,它拿你的账号干什么,全凭发帖人的良心。

就算安全整理,AI 也有两件事做不到
假设你安全地把数据搬了出来。AI 分类、去重、建索引的速度非人力可比,但有两件事它做不到。
它读不了图。小红书笔记的主体是图文:正文只有标题加几行字,AI 读到的只有这薄薄一层。所以整理出来的成品更接近「收藏夹目录索引」——找东西变快了,但内容本身不会变成知识。
它判断不了「还有没有用」。你 3 年前收藏的菜谱、早已停更的 App 教程、去年就结束了的活动,AI 都会认认真真分类,但不会告诉你「这条已经是垃圾」。实际打捞率,远低于帖子给你的「电子垃圾变宝山」的感觉。
真想整理,三条更稳的路径
路径 A(最稳):不动数据。直接在小红书站内整理:按主题建子收藏夹,主收藏夹里只留「3 个月内会用」的条目。几百条以内的收藏量,手动分 2-3 次,不比学脚本慢。
路径 B(可用):AI 只碰「标题清单」。把收藏的标题和链接复制出来,或者手动逐条打开分享链接、导出少量你真正想留的内容——这种低频操作风险低得多。把这份轻量清单喂给 AI 分类打标,再回 App 内归档,全程不碰批量抓取接口。
路径 C(别做):主账号直连来路不明的脚本全量导出。这是三条路径里最危险的一条,上面的永久封禁案例,走的就是这条路。
如果坚持用脚本,至少做到:不用主账号、分批、低频,并且绝不把密码或 Cookie 交给任何工具。
最后一句实话
那 3300 条收藏里,多数就算整理完,你也不会再打开。这次整理真正的收益,不是「拥有一个知识库」,而是让你确认一次:你需要的从来不是 3 年前存下的那条内容,而是需要时能搜到它。
所以与其求脚本,不如边整理边删掉一半;下次点收藏之前,先问自己一句「我什么时候会用」,答不上来,就别存。
后续值得盯两个信号:小红书会不会上线官方的个人数据/收藏导出入口(这是需求的根本解法),以及这波「AI 整理收藏夹」脚本会不会被官方点名整治。这周相关帖子还在增加,我们会继续跟进这个话题。