这个夏天,古籍圈被同一个问题搅动了两头。
一头在海外。7月21日,美国媒体404 Media报道称,欧美多家旧书店收到批量、随机、不问价格的收购订单,买家是AI公司:专收2022年以前出版的书籍(那几年的纸书里还没有AI生成的文字),买回去切掉书脊高速扫描,扫完的实体书被粉碎销毁。微博这个收购计划在圈内流传的代号叫"巴拿马计划",有自媒体口径称累计处理书量达约200万册、里面"可能有绝版古籍"。微博8月,美国法院进一步认定:购买纸质书后进行破坏性扫描,属于合理使用。微博相关报道的微博译文帖最高一条拿了6280个赞,#AI焚书#、#禁止将本书用于人工智能训练#两个话题从7月底一直吵到9月。
另一头在国内。8月22日,B站一条古籍扫描件分享视频拿到40463个赞、34.4万次播放:UP主说,网友都建议他"别上交,上交会被改",所以他决定不上交,把家里的古籍全部扫描分享,“大家一起守护”。哔哩哔哩
真正说明问题的,是这条视频的评论区。最高赞的一条(3950赞)不是在夸UP主,而是在补一个"背后真相":“现在有公司专门从事旧书收购,然后扫描,最后销毁的。强行制造孤本”。哔哩哔哩下面紧跟一条(928赞):"上次看AI公司专门买古书扫描喂给大模型,后续销毁书籍。“还有一条2001赞的评论说,上交过的书"因为各种原因被改了”,点名了几部流传很广的道医类著作。
两件事被拼接成了同一个恐慌故事:AI在满世界买旧书、扫描、焚毁,下一步就是要来收我们的古籍;知识马上要被垄断,家里、网盘里的古籍要赶紧"守护"。
但把两边的原始信源摊开看,这个故事在三个地方断了。
一、被烧的不是古籍:从"旧书店异常订单"到"强行制造孤本",哪一步是推测
先把"被确认的事实"和"被加工的部分"分开——这是两件事拼在一起后最容易混的地方:
环节 | 状态 | 依据 |
|---|---|---|
欧美旧书店收到AI公司批量、不问价的收购订单 | 已被报道 | 404 Media 7月21日报道,经微博译文帖扩散 |
切书脊高速扫描、扫后销毁实体书 | 已被报道 | 同上,法庭相关物料图片佐证 |
"购书后破坏性扫描属合理使用"的裁定 | 已被报道 | 中文科技媒体8月报道,涉及相关AI训练诉讼 |
被销毁图书包含中文古籍 | 仅网友猜测 | "可能有绝版古籍"出自自媒体表述,报道中无对应内容 |
国内存在"收旧书—扫描—销毁—制造孤本"产业链 | 无证据 | 检索未见任何可核实的报道、裁定或旧书平台数据 |
销毁是为了"垄断知识抬价" | 与报道矛盾 | 销毁动机是切断二手流通、压缩法律风险,不是制造信息稀缺 |
关键错位在于收购目标。被扫描销毁的对象,是带ISBN的批量工业印制现代书——印量大、存世多,烧掉一批不损失任何文本,扫描PDF和原书在语料层面等价,所以"卖扫描版"的生意根本不需要销毁原件来保价。
而古籍的定价逻辑恰好相反:它的价值主体从来不是文本,是实物——底本、纸墨、版式、题跋、藏印、递藏。把宋刻本扫成PDF,PDF不会因此变贵,刻本也一秒都没少。用"销毁古籍来抬价"来描述AI公司的行为,等于烧了房子去抬户型图的价钱:逻辑上就不成立,更没有出现过的主体。

所以,截至发稿,没有任何可核实的证据显示AI公司的收购订单伸向了中文古籍。这个恐慌真正的杀伤力,不在书,在人。
二、稀缺方向反了:AI扫了中国古籍,结果是七万部免费
更反直觉的一点是:AI确实大规模扫描了中文古籍,结果是免费。
字节跳动与北京大学数字人文研究中心共建的公益平台"识典古籍",今年6月的口径是免费开放超6万部古籍、月均超240万人次在线阅读;到7月,数字已涨到超7万部。中国新闻网中国新闻网《永乐大典》高清影像数据库免费开放;今年7月上线全国首个体育古籍专题数据库,8月上线首批汇集1982部典籍的"中国科技典籍数据库",9月1日又上线收录196部典籍的"食典汇藏——中华饮食文化典籍数据库"。中国新闻网

爱如生"中国基本古籍库"——2001年启动的国家重点电子出版物——今年3月起也开放了免费访问。知乎
也就是说,"AI把书扫完就要垄断知识、坐地起价"这个叙事的现实对照版,恰恰是反的:中文古籍的公开全文供给正在快速增加,普通人能免费读到的古籍文本,比历史上任何一个时代都多。文本,已经不再稀缺;稀缺的从来是"可验证的版本"本身——实物古籍的载体价值,反而因为扫描普及而更清楚地浮出水面。
三、真正的坑:4万赞的"守护",第二步是引流
恐慌本身不伤人,恐慌的变现才伤人。这一轮检索里,古籍电子版交易的几个真实形态值得逐一点出来:
资源包帖。小红书9月3日仍在新增"古籍资源全部文献大合集"这类帖子,标题下的清单开门见山:“国家图书馆古籍藏书2.8T、150678册……需要请咨询”。小红书 B站有3TB馆藏绝版古籍、1.7TB古籍合集、道家资料410本等资源包在传播。所谓"馆藏2.8T"从何而来、与原件是否相符,帖子里没有任何回答。
引流链路。拿4万赞的那位UP主,置顶评论是"需要古籍电子版的朋友看我动态置顶"。哔哩哔哩而评论区质疑他"编故事,卖来源不明真假不知的PDF"(202赞)的同时,同文案的仿号已经成片出现——有的已被封禁,作者名显示"已注销"。"守护"叙事的流量第一步是涨粉,第二步才是链接。
脱底本的扫描件。小红书上有一条1788赞、528收藏的帖子,标题是"古籍善本就是比电子书版本靠谱"——圈内对纯排印PDF的不信任由来已久:OCR转排的过程会剥离页码、版框、题跋,错字连原页都无法回查,你拿到的是"某人对古籍的转述",不是古籍。小红书一份合格的底本记录长什么样?1961年中华书局上海编辑所影印《十一家注孙子》的刊记写得明明白白:“据上海图书馆藏本影印,版匡尺寸悉准原书”——版本、藏所、影印依据,一句话交代干净。微博网盘里那些"2.8T合集",没有一句这样的话。

站外转账。闲鱼、小红书上的扫描版倒卖常年存在,旧书店店主已经公开预警:盗图引导交易、以"微信限制"为由要求站外加好友、报出好几个支付宝账号等你转账的,不是卖家,是骗子。小红书
一句话:被AI"烧"掉的只是现代书的二手文本流通;而有人正借这个恐慌,卖你一份来源不明、底本缺失、随时跑路的老书PDF。
四、普通古籍爱好者现在该做什么
想读文本:先免费,再谈钱。顺序是——识典古籍(7万部+,含《永乐大典》高清影像)、中华古籍资源库等图书馆开放平台、爱如生免费访问期;这些渠道覆盖不到的冷门领域(方志、医籍、道藏),再考虑付费的中华古籍库或影印本。在网盘资源帖里"花钱守护文化"之前,先问一句:这书在识典古籍里是不是本来就有。
看到扫描资源帖:三查再动手。一查底本:有没有写清版本与藏书机构;二查形态:是原叶书影,还是纯排印文字;三查渠道:是否引导站外转账。三样缺一样,直接划走——你付出的不只是钱,还有一份会被你引用、转述、传给下一代的坏文本。
想入手实物:恐慌不改变行情,行情在拍卖行的征集节奏里。古籍的实物价值恰恰建立在"可验证"上,与AI焚书传闻零相关。眼下正是2026秋拍征集期:西泠拍卖9月5日至6日在福州公开征集中国书画、古籍善本等品类,中国嘉德"嘉选"九月拍卖会9月17日启幕。雅昌艺术网雅昌艺术网 新人最划算的动作不是囤PDF,是去预展现场摸一次真书:摸过一次实物,你自然分得清扫描件和底本的差距,也自然知道钱该花在哪。

想参与"守护":学真正在守书的人。就在今天(9月4日),《光明日报》报道了重庆铜梁安居古城奎文阁的古籍守护人唐智勇:2023年,他把私藏的全部古籍搬进修葺一新的奎文阁陈列,使阁中珍藏古籍达到3万余册,常态化向公众开放展览与研学。光明网 他2000年偶得清嘉庆十一年汪昌序木活字本《太平御览》时缺了6册,十年补配才凑齐,这部书早已入选第一批《国家珍贵古籍名录》;年近花甲,他每天伏案揭、补、压平、衬纸、钉线,抢救《肖氏族谱》《铜梁县志》这批濒危文献,自己说"修古籍不是想着它值多少钱"。"守护古籍"的正确答案从来长这样:查版本、修实物、放进规范的典藏环境,而不是扫描进网盘然后焦虑。
继续盯四个信号:AI扫描诉讼的和解与上诉进展("合理使用"边界是否收紧,决定这场"焚书"会不会继续);旧书平台是否出现异常批量收购数据("强行制造孤本"论如果为真,首先会体现在采购数据上——目前没有任何可核实证据);识典古籍们的上线部数与书影完整性(6月超6万部→7月超7万部还在涨,但圈内已有对个别扫描件页数波动的抱怨);仿"守护"账号的封禁与复活节奏。
文本免费的时代,古籍真正值钱的不是"里面写了什么",而是"这一本是那一本"。分得清这句话,4万赞的恐慌就割不到你。