华夏出版社加印“禁止AI训练”声明,维权难但态度明确

源自39位全网作者

08-06 02:06

精选参考来源

1
#禁止将本书用于人工智能训练# 想起来前一段时间被曝光的Anthropic,为拿到没有AI文字污染的老旧书籍语料,购入数百万册旧书。直接用切书脊的破坏性高速扫描,扫描完成后把这批实体书粉碎销毁。马斯克都看不下去了,直接声明要求Space X AI 团队在图书馆中保留所有稀有书籍,并采用困难但保护性的方式进行扫描,而不是直接切掉书脊进行扫描。
2
#AI公司销毁原版书籍# 最近曝光的一件事,让人后背发凉——据多家媒体报道,AI公司Anthropic(Claude的开发商)曾秘密推进一项代号为“巴拿马计划”的项目:通过中间商在全球批量收购二手书、绝版书,用液压切割机切开书脊高速扫描,然后将实体书粉碎销毁。据称涉及数量高达数百万册。为什么要这么做?· 2022年前出版的纸质书,内容纯净、未经AI污染,是训练模型的“优质饲料”· 实体书扫描后销毁,被认为可以规避部分版权风险· 整个流程通过保密协议和中间商层层隐藏这件事最刺痛人的地方在于:很多稀有书籍、地方性文献、绝版著作可能就此永久消失,而扫描后的内容被锁进私有数据库,公众无法访问。技术可以进步,但文明的载体不该被悄悄抹去。当“合理使用”变成销毁实体的通行证,我们是否需要重新审视这条边界?你怎么看?#人工智能##科技伦理##微博AI创作季#
全部
来源
内容由AI生成

精选参考来源

1. #禁止将本书用于人工智能训练# 想起来前一段时间被曝光的Anthropic,为拿到没有AI文字污染的老旧书籍语料,购入数百万册旧书。直接用切书脊的破坏性高速扫描,扫描完成后把这批实体书粉碎销毁。马斯克都看不下去了,直接声明要求Space X AI 团队在图书馆中保留所有稀有书籍,并采用困难但保护性的方式进行扫描,而不是直接切掉书脊进行扫描。

2. #AI公司销毁原版书籍# 最近曝光的一件事,让人后背发凉——据多家媒体报道,AI公司Anthropic(Claude的开发商)曾秘密推进一项代号为“巴拿马计划”的项目:通过中间商在全球批量收购二手书、绝版书,用液压切割机切开书脊高速扫描,然后将实体书粉碎销毁。据称涉及数量高达数百万册。为什么要这么做?· 2022年前出版的纸质书,内容纯净、未经AI污染,是训练模型的“优质饲料”· 实体书扫描后销毁,被认为可以规避部分版权风险· 整个流程通过保密协议和中间商层层隐藏这件事最刺痛人的地方在于:很多稀有书籍、地方性文献、绝版著作可能就此永久消失,而扫描后的内容被锁进私有数据库,公众无法访问。技术可以进步,但文明的载体不该被悄悄抹去。当“合理使用”变成销毁实体的通行证,我们是否需要重新审视这条边界?你怎么看?#人工智能##科技伦理##微博AI创作季#

3. #禁止将本书用于人工智能训练# 一本书的扉页,印上一行字,就真的能挡住AI的数据抓取吗?我认为是几乎不可能的。因为即使AI企业不主动抓取,用户也有可能会喂给AI。但是,这却不代表这行字没有意义。就像一个果农在自家果园门口插个牌子,写着禁止偷摘,偷果子的人看不看得到,全凭自觉。如果被抓到了,就能够有效的维护自身权益。而且出版社自己也知道,取证极其困难,AI大模型一锅炖了海量数据,你怎么证明它恰好读了你这一本?技术上几乎是个死局。但这一句声明,其实就是一种“立此存照”。它最重要的意义,不是法律上的即刻回击,而是意识上的敲钟。它告诉整个行业,也告诉每一个作者:沉默不代表默许。我们的智力产出,不是天上掉下来的免费馅饼。古籍原文虽已无版权,但现代学者的注译、解读,是当代人活生生的劳动。这些内容被AI无偿吸入时,付出心血的人连个响儿都听不到。长此以往,谁来为深度内容的生产买单?虽然声明挡不住机器的抓取,但能唤醒人的主张。这粒争取权益的种子,必须现在种下。不管风往哪边吹,姿态本身,就是边界。#热点观点##热点解读#

4. 看到一个离谱的事件,AI 巨头 Anthropic(Claude 的母公司)正在大量购买2022年以前出版的实体书籍,通过切掉书脊的高速扫描机进行扫描,然后将原件彻底粉碎。这种做法真的是太野蛮了,书籍和文字是人类文明传承的基础,这种不受监管的破坏性的训练AI的方式,造成的是全人类的损失这么做的原因非常值得讨论,因为训练Ai属于商业行为,如果在网络上下载盗版书会构成版权侵权,而购买了实体书自己进行扫描则在之前的案例中被法官判决为合理使用,因为毁灭了原件,市场上并没有增加副本。相比下载盗版电子书,买实体书撕掉反而完全合法不构成侵权。说实话这判决真的是太离谱了,只从商业利益的角度考量,给出这判决的法官真的....而文化界强烈抵制的原因是这些采购被完全隐瞒并且匿名进行,卖家完全不知道卖出去的书被如何使用,想象一下你是一个稀有书的收藏家,有人花一个不错的价格来买你的书,你以为对方也是买回去收藏的,结果是拿去训练AI,训练完了就一把火烧了。所以数百万的实体书籍中可能包含印量极少、几乎绝版的 18-19 世纪学术文献和稀有图书,也被一并切脊粉碎,这种“文化误伤”是不可逆的,这也是最让人气愤。还有比较讽刺的一点是,之所以购买2022年之前的实体书,是因为随着 2022 年后生成式 AI 大爆发,网络上充满了大量 AI 生成的垃圾文本。如果 AI 拿 AI 生成的数据继续训练,会导致“模型崩塌”。因此,2022 年以前出版的纸质书被视为未被污染的“纯人类高质量数据集”。#AI 焚书# #AI公司为训练模型销毁原版书籍# #AI能不能别发展了#

5. #Anthropic为训练模型焚书坑儒# 当代版“焚书坑儒”的判决出来了,拉扯了快两年的 Anthropic 盗版书训练集体诉讼案,终于结束了。法院最终批准,Anthropic 向原告支付15亿美元的天价和解金。而 Anthropic 前两年的实际营收,也只有50亿。这一刀,快砍到大动脉了。#AI 焚书# 还是先简单介绍下前情。很多企业都用 The Pile 数据集训练模型,里面有个 Book3 子集,包含近20万本没有版权的电子书。这玩意儿明面上早就被下架,所以懂的都懂。媒体对此发起了大规模调查,最终 A/ 的发言人承认 Claude 确实干了。于是,三名作家代表数十万版权人,朝着 A/ 就 A 了上去,告出了这起史上最大的 AI 版权案。立案以后调查才发现,Books3 那几十万本算个啥,还有 LibGen、PiLiMi,加起来至少有七百万本书,都是没版权非法下载的!同时,也牵扯出了这起案件中槽点最大,却唯一合法的操作:A/ 花数百万美元收购纸质书籍,书被扫描入库,制成数据集以后立即销毁,数据集也只能在公司内部用于模型训练,不得外传。。。这个操作完美符合美国的版权法的“首次销售原则”。其实隔壁 Google Books 也扫书,但纸书原件没有销毁,法院依然认为是合理使用。A/ 这事儿干的实在太不地道了,谁也说不准他毁掉的书里,有没有什么珍稀孤本。还要永远封存,咋地,你是要独占人类文明?而且你小子懂版权,为了规避法律风险就把书毁了,那之前下载盗版书不就是明知故犯?所以15亿美金也算杀A儆猴了,但 AI 和版权的争议远远没有结束。

6. #AI公司为训练模型销毁原版书籍# 最近,Anthropic被曝启动“巴拿马计划”,斥资数千万美元批量收购二手纸质书,切掉书脊扫描后直接销毁实体书——首批约200万册图书已化为纸浆。#AI 焚书#几个值得关注的点:· 法院认定“买书扫描再销毁”属合理使用,但盗版数据库让Anthropic赔了15亿美元· 二手书商透露,今年4月起大宗订单暴增5倍,买家对价格完全不敏感· 绝版书、珍本可能在不知情中被销毁,公众再也无法获取原始版本更深层的问题:当AI可以低成本“吃掉”人类文字成果,创作者却拿不到对等报酬,长期谁还愿意深耕写作?原始记录消失后,AI生成的内容谁来核对?技术的进步不该以牺牲文化传承为代价。你怎么看?#AI版权争议##微博AI创作季#

7. #AI公司被曝大量收购旧书# 最近二手书市场突然涌入一批神秘买家——不挑题材、不还价,甚至溢价照单全收,唯一要求是2022年之前出版的纸质书。调查媒体404 Media披露,幕后推手竟是多家海外AI公司。为什么AI巨头盯上了旧书?· 互联网上“AI垃圾内容”泛滥,继续用网络数据训练,模型会越学越“傻”· 2022年前的纸质书是人类原创的“纯净语料”,几乎没有AI污染· 买书扫描后销毁实体书,被部分法院认定为“合理使用”,可规避版权谈判成本但争议同样尖锐:绝版珍本可能被永久销毁,扫描后的知识锁进企业私有数据库,公众反而读不到了。Anthropic曾因700万本盗版书被判赔15亿美元,马斯克则表态要求团队保留稀有书籍、采用无损扫描。当技术进步与文化遗产保护碰撞,你觉得AI用书本内容训练,应当向创作者付费吗?#AI训练数据##科技伦理##微博AI创作季#

8. #AI 焚书#真是有意思,其实“AI焚书”并非字面焚烧书籍,而是硅谷部分AI企业的争议操作。为获取纯净、未经AI污染的文字语料,企业批量收购旧书甚至绝版书籍,裁切扫描提取文字训练大模型,随后直接销毁实体书本。尽管现有法规判定该行为合规,却引发巨大争议。文字能够数字化,但书籍承载的装帧、批注等实体信息会永久消失,不少小众图书就此彻底退出流通。技术发展需要高质量数据,但文明传承不该二选一。数字化采集不等于要毁灭原件。如何平衡AI产业发展、创作者版权与纸质文献留存,是当下亟待思考的难题。

9. #大模型吃掉了我的写作##作家起诉AI公司获赔15亿美元# 今天,AI大模型已成为我们的日常工具。它敏捷、易得、善解人意,但少有人关注的是,AI不断进化的能力到底从何而来?人类的创造,是它最宝贵的原料。在2026年的美国,有超过50起关于AI的版权诉讼案件正在进行。过去5年里,AI大模型狂飙突进,吃掉了许多好东西——人类的文字、声音、图像、代码、合同……它们的成功,造就了这个时代最耀眼的AI公司和科技新富。而作为「开采」对象的创作者们,也逐渐意识到,「AI所承诺的未来,是用偷来的文字写成的」——他们本不该是免费的原料。作家、歌手、摄影师、记者……都在通过诉讼维权。这不仅仅是发生在美国的故事。今年2月,中国的多位配音演员公开维权,他们曾经为《甄嬛传》《甜蜜蜜》《无间道》《疯狂动物城》等经典作品配音,而现在,他们在短视频中听到了自己的声音。今年4月,30多位演员集体发布声明,抵制AI短剧换脸。当人成为原料,当机器开始直接与人竞争,未来将会怎样?一切靠知识、经验谋生的人,都会面临威胁。我们决定从一起最「成功」的维权案写起。三位美国作家对AI公司Anthropic提起诉讼,最后撬动了15亿美元的和解协议。希望在AI狂飙的时代,提供一些背面的声音,一些可能的警示。 当被大模型吃掉的人开始反抗

10. #AI公司被曝大量收购旧书# 最近调查媒体404 Media曝光了一件事:多家AI公司正通过中间商大规模扫货二手书,订单从几千本到百万本不等,不少书商销量翻了五倍。为啥盯上旧书?核心原因是互联网上的“AI垃圾”越来越多,模型越学越“傻”。而2022年之前出版的纸质书,基本都是人类原创的“纯净语料”,成了稀缺资源。但这事争议很大:· 不少书被破坏性扫描后直接销毁,绝版文献可能永久消失· 扫描内容进入企业私有数据库,公众反而无法访问· 原作者拿不到任何收益,Anthropic此前已因版权问题被判赔15亿美元一边是AI对高质量数据的渴求,一边是文化传承和创作者权益的冲突。你觉得,用旧书训练AI,该不该给原作者付费?#AI训练数据##科技伦理##微博AI创作季#

11. 一家AI公司花钱买下数百万册实体书,不是摆进书架,而是切掉书脊、逐页扫描,纸张随后回收。这正是“AI焚书”争议背后的真实场景:Anthropic想给Claude补高质量文字,法院认为合法购买后做内部扫描可算合理使用,但盗版来源要另算。书买了能不能拆,内容进了模型算不算新用途,争的不是情怀,是数据从哪来、谁授权、出了问题谁负责。老板用AI也别只看生成得快不快。客户资料、合同、内部文档往系统里一塞,来源和权限没留痕,省下半小时,可能埋下一颗雷。我从2011年做网络营销到今天,越是新工具,越不能拿“大家都在用”当免责牌。能追溯、敢说明,才是真本事 #AI焚书#

12. #禁止将本书用于人工智能训练# 每一本书都是作者智力劳动的结晶。随着AI大模型的爆发,大量书籍被科技公司未经授权地爬取并作为训练数据(“喂给”AI)。这种“白嫖”行为让创作者感到自身的知识产权被侵蚀,却未获得任何收益。而且AI在训练时会将文本切碎、转化为海量数据,投喂的内容和最终输出的内容可能完全不同。一旦数据被抓取,很难追溯到具体的某本书,维权难度极大。可以预见的是,高质量的语料库即将成为稀缺资源。建立合理的“版权许可+收益分成”机制,可能是解决这一矛盾的长久之计——既保护了创作者的积极性,又为AI发展提供了合法的“燃料” 郑州

13. #禁止将本书用于人工智能训练#AI训练过程中,如果模型只是从大量文本中学习统计规律,比如词汇共现、语法结构、风格倾向等,而不直接输出原文片段,很多司法管辖区,包括美国的部分判例和欧盟AI法案的相关讨论,都倾向于认为这是合理使用。
简单写一句“禁止用于AI训练”,并不能自动改变版权法对“使用”和“复制”的界定。实体书上的这句声明,更多是态度和预警,而不是已经具备强执行力的法律武器。但它至少说明,内容创作者开始主动发声了——这本身就是一个信号。

14. #AI 焚书#这件事最好分三本账来看。第一本是物权账:企业合法买下普通纸书,是否可以拆解处理;第二本是版权账:扫描后的内容怎样保存、怎样用于模型训练,盗版来源是否侵权;第三本是文化账:某个版本一旦稀缺,纸张、装帧、题记本身就是历史材料,不能只按一摞旧纸估价。Anthropic的15亿美元和解主要落在第二本账,并不等于法院认定所有破坏性扫描都违法;目前也没有证据证明它批量销毁的全是珍本。但“暂未发生”不代表无需设防。马斯克这次把第三本账摆上台面,意义就在这里。行业完全可以建立书目筛查、版本鉴定、馆藏备份和无损扫描标准,采购前先查存世量,扫描后至少保留一套实物,并向版权人公开用途。技术跑得快没有错,规则也得跟上。最好的AI,不该靠透支文化遗产换速度。 #AI 焚书#

15. #AI公司被曝大量收购旧书#最近,多家海外AI公司被曝正通过中间商大规模收购二手旧书——单笔订单从几千本到百万本不等,不少书商销量暴涨五倍。算力充足的AI巨头,为啥盯上了旧书?核心原因:互联网正被大量“AI垃圾内容”污染,继续用网页数据训练模型,AI可能越学越“傻”。而2022年之前出版的纸质书,几乎是未被AI污染的“纯净语料”,成了稀缺资源。但争议也随之而来:· 扫描后实体书被销毁,绝版珍本可能永久消失· 内容进入企业私有数据库,公众反而无法访问· 版权边界模糊,Anthropic此前已因盗版书数据库被判赔15亿美元知识数字化了,却没有公共化。人类换来更聪明的AI,代价是什么?你怎么看AI用旧书训练这件事?#AI版权争议##科技热点##微博AI创作季#

16. 天尚法评 | 从模型训练到内容生成:AI著作权侵权的行为识别与归责逻辑——以上海首例AI大模型著作权侵权案为例

17. Anthropic 15亿美元和解,AI训练到底算不算侵权?

18. 【版权资讯】剑网2026首亮剑、AI侵权第一案落槌:AI版权“野蛮生长”时代宣告终结

19. 买了你的书,切碎了喂AI,合法

20. 耗时两年的AI版权大战7月落幕:15亿美元和解划定训练数据红线

21. 大模型训练数据版权风险:企业如何规避“数字泔水”侵权纠纷

22. AI版权和解新标杆:Anthropic 15亿美元集体和解获法院最终批准

23. AI 训练数据侵权:你的作品被AI白嫖啦!

24. 案例 | AI窃取盗版书训练,赔15亿美元!

25. 规则还在写——AI训练数据的知识产权全流程

26. 华夏出版社标注“书籍内容禁用于AI训练”,负责人回应:很难维权,但要有态度;曾有AI公司破坏性扫描书籍,约200万本实体书被销毁

27. 德国法院击穿Suno的合理使用盾牌。54亿美元AI音乐独角兽,倒在六首歌面前

28. 雪律说丨生成式AI训练大模型,会侵犯著作权吗?——下篇:模型训练著作权合法化的制度设计建议

29. 【AI公司被曝大量收购旧书】   调查媒体404 Media 最新报道显示,多家 AI 公司正通过中间商大规模收购二手图书,核心目的是获取高质量训练数据用于 AI 模型训练,同时规避公众舆论反弹。   AI 模型发展依赖海量数据,数据质量是关键影响因素。当前互联网充斥大量 AI 生成的低质量内容,对数据环境造成污染,降低了 AI 后续学习效果。因此,领先的 AI 公司转向寻找人类原创内容,重点收购2022年之前出版的纸质书籍,这类内容未受 AI 生成内容污染,更具原创性。   AI 公司利用纸质图书训练模型已有相关案例。Anthropic 曾投入数百万美元采购大量纸质图书,提取内容训练 Claude AI 模型后将图书销毁,其主要采购渠道为 Better World Books。法院认定将正版图书用于 AI 训练属于版权法中的“合理使用”,但该公司因长期保存包含700万本盗版图书的数据库,侵犯作者与出版商版权,最终被判赔偿15亿美元。此外,近期有出版商联盟对谷歌提起诉讼,指控其未经授权使用数百万本受版权保护的图书训练 Gemini AI 模型。   据404 Media 报道,相关图书采购订单规模不等,单次采购量在1000本至100万本之间。

30. 新环球脉搏|英伟达AI重构芯片研发 AI版权天价判例出炉 2026游戏服务平台实测榜单

31. 欧洲第一例判了:AI音乐公司Suno败诉,拿版权歌训练不算合理使用

32. 华夏出版社标注书籍内容禁用于AI训练,负责人称难维权但要有态度

33. 全球AI版权审判割裂,印度选择了另一边

34. 曝多家AI公司大量收购旧书训练模型后销毁,此前先例被法院认定合理,这会成为常态吗?可能带来哪些影响?

35. 德国法院裁定Suno侵犯版权,驳回合理使用抗辩

36. AI作品版权归谁?短视频创作者别踩坑

37. 不是不报时候未到:德国法院裁定 Suno 未经授权训练音乐 AI 构成侵权

38. AI公司把图书馆当数据矿挖了:当训练数据告急,知识版权战争正式打响

39. 全球裁判为什么完全相反

40. 国狮法研 | AI研究院系列——AI艺人库授权全过程的法律风险分析及合规路径

41. 全球首例AI生成音频的训练数据著作权案:德国GEMA诉Suno案宣判

42. AI公司偷学设计师作品训练模型 这3个版权保护技巧必须知道

43. 全球判例持续落地,AI作品版权规则加速清晰化

44. AI作品版权到底归谁(中国大陆现行法律+司法实务总结)

45. AI版权争议新判例:印度德里高院裁定OpenAI使用新闻素材训练模型不构成侵权

0
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章