8月上旬,有读者翻华夏出版社《新译黄庭经阴符经》等书的版权信息页,发现赫然印着一行此前只在合同里见过的警示文字:“禁止将本书内容用于人工智能训练,违者必究”。界面新闻晒到微博上,一条“第一次在纸质书上看到这句话”的帖子转了1348次。微博最实在的回答来自出版社自己:8月4日,华夏出版社相关负责人对媒体承认,这是引进外版书时权利方在合同里附带的条款,“如果书籍内容在未被授权的情况下用于人工智能训练,这很难维权”。知乎
一句话戳破了幻觉:这行字是君子协定,不是城墙——“难维权,但要有态度”。而这场版权拉锯战的两头,一头正把你书架上的书吃掉,另一头正往你书架上塞书,两边挨着的都是读书人。

输入端:AI吃掉了什么
被“吃”的链条从书本身开始。Anthropic被曝运营秘密项目“巴拿马”:在数百万本书上训练人工智能后,为规避知识产权诉讼将其全部销毁。微博早期模型靠盗版电子书喂出来,作家们随即发起集体诉讼;2025年9月提交的法庭文件显示,该公司将支付至少15亿美元来解决上述诉讼,覆盖约50万部书、每部赔约3000美元——这是“AI吃书”事件里迄今最贵的一张账单。界面新闻
赔钱之后玩法变了:盗版电子书有诉讼风险,那就批量收购二手实体书——员工将买来的实体书逐本切开书脊,页页扫描,再把切碎的纸页送去回收。果壳约200万册纸质图书在这套数据采集流程中被损毁。“买了书、毁了书、把知识喂给机器,全程合法,一点毛病没有。”——知乎相关问题下这条回答说的就是这个。知乎
先替大家去两个噪。一是疯传的“AI公司焚书”仓库画面,多来自WorldofBooks等二手书商仓库(不是Anthropic自有)。微博二是反方观点同样拿到了412次赞同:“美国人工智能大公司们批量采购来扫描的书们本来是被长期堆放在书店或仓库里无人问津的”,“这对文化传承没有可测的影响”。知乎两派在同一个问题区吵了整整一个月,到现在没有共识。
但争议挡不住规则在长。2026年5月,旗下拥有《柳叶刀》《细胞》等刊物的头部出版集团爱思唯尔(Elsevier)与其它四家出版社联合起诉Meta,指控其未经许可获取海量受版权保护的图书、期刊内容用于Llama系列大模型训练,起诉书显示其从盗版网站下载传播了数百万本受版权保护的书籍和付费学术期刊文章。界面新闻而在2025年6月的Kadrey诉Meta案中,法官恰恰判了Meta胜诉——原告当时拿不出的,是一份“市场被稀释”的实证。36氪
输出端:AI“吐”出来的书,正在稀释你的书架
这份实证两个月后被补上了:哥伦比亚大学研究者选取了亚马逊上14419本自助出版的类型小说,时间跨度从2023年到2026年,逐本用检测器扫描全文。36氪
结果是:含大量AI内容的书占了整个书目的两成,却只贡献了12.1%的销量和11.3%的收入——看起来并不可怕。
可怕的是分母。从2023年一季度到2026年一季度,这个书目累计膨胀了38.3倍,季度收入却只增长了8.9倍。研究者把那些卖不动的AI书全部剔除后发现,人类作品的单本收入都比两年前更低——他们给这种现象起了个名字:稀释(dilution)。AI书不需要打败谁,只要足够多就够了。

产量还高度集中:收入最高的一个笔名,用八本书就拿到了扣除平台费用之前的170万美元。36氪
那位叫CoralHart的言情作者,一共用21个笔名出版了216本小说,前九十六本还是一个字一个字写出来的,此后便全交给了AI;在一次视频采访里,她当着记者的面用四十五分钟生成了一整本书,顺手还在卖每月80到250美元的写作课。36氪
国内是同款镜像:DeepSeek-R1发布后,番茄小说男频的单日首秀量从平日的一千本左右,一路冲到3549本。36氪到2026年8月底,起点彻底和AI撕破了脸——整治大批AI小说时,对自家的爆款和大牛们也下手了。知乎更早的时候,刺猬猫的氪金读者忍耐力彻底爆炸,连刷最高一档的黄金宝箱就为了骂AI文,一晚上刷了几十个。知乎
对读者最不公平的一条是:在亚马逊,作者通过KindleDirectPublishing出版时确实必须申报是否使用了AI,但平台并不会把这条信息转告买家。你付了钱,看到什么成色的字,全凭运气。36氪出版社则开始把“是人写的”变成卖点:上海书展上,广西师大出版社给书贴上手写的推荐便签。小红书

现在能做的三件事
先按品类下菜。研究显示,最先被AI接管的是那些早已高度工业化的类型——“言情之于欧美,爽文之于国内”,套路越重,沦陷越快。36氪
反过来,奇幻、超自然与恐怖类的AI渗透率最低,这一类里检测不出AI内容的人类书,单本收入不降反升,大约涨了35%。36氪九月开新坑,先对套路品类里的陌生新书降一档预期。
再学三个识别信号。一是“高产但低互动”:更新量碾压同期、真实书评却稀薄,尤其同一账号体系多个笔名互推。二是“圆滑但模板”:AI书内部收入每翻十倍,与既有出版书罕见表达的重叠就上升7.6个百分点——获奖作品里这个比例只有19.1%,AI头部书却接近一半。36氪读起来哪儿都见过、找不出一句“毛边”的,警惕。三是平台侧政策信号:目前编辑们的实际要求已经贴近“AI可以提供灵感、搭建大纲,但不准用AI来动文字”。知乎正文段落有AI味又无标注的爆更书,可以直接走举报入口。
最后,“只读2022年以前出版的书”这个流行起来的想法,可以当情绪出口,别当答案。它的逻辑源头其实在数据买方:美国有公司专门向AI企业推销批量采购实体书的服务,重点只收2022年以前出版的版本,因为那之前的语料“没有AI污染”、作者身份可确认。微博读者照抄这个清单,等于主动把过去四年撤出书架。真正值得推动的是知情权:知乎讨论里,“连B站都知道给AI作品加上AI生成的标签,这些网文平台的举措居然只是限制更新量”已经被拿来反复对比。知乎如果电子书平台跟进,把“AI申报”透传到买家侧,才是治本。
接下来盯什么
四个信号,决定你未来两三年书架的成色。一,Elsevier诉Meta等新案会不会引用“稀释”研究——它补的正是上一案缺席的证据链。二,司法边界何时落地:最高人民法院方面已透露,国家正在积极推进涉人工智能、数据产权司法政策文件的起草制定。知乎三,国内电子书平台会不会给AI内容做读者可见的标注。四,版权页上那行“禁止AI训练”的君子协定,有没有哪天长出牙齿。
版权页上这行字的刷屏,其实是普通爱书人第一次摸到“数据战争”的边:一头,你读的书被吞进碎纸机;另一头,机器吐出来的书正排着队上架。规则定下来之前,读者的鉴别力,就是你书架最后的护城河。