AI公司买旧书扫描后销毁,合法化引发争议

源自56位全网作者

08:27

精选参考来源

1
最近美国有公司专门向AI企业推销一种服务,就是帮他们大批量采购实体书,单次从一千本到一百万本不等,而且重点只收2022年以前出版的版本。原因就是现在网上已经塞满AI生成的内容,继续拿这些内容训练,本质就是在反复食自己粪,越学越乱,俗称模型坍塌。于是那些没有被生成式AI污染过的纸质书,突然就成了最稀缺的训练数据。更有争议的是,为了提高效率,很多书会先被切掉书脊,然后逐页送进高速扫描机,扫描完成后,原件直接被处理掉。而且这家公司还承诺为买家保密,不公开到底是哪家AI公司在采购。这种极端做法和2025年美国联邦法院在Anthropic案中的判定有关,当时法院认为,合法买下实体书,再制作内部数字副本替代原件,只要没有额外增加副本,也没有对外传播,就可以构成合理使用。我突然觉得美国好扯淡,这个法规显然会助长AI灭掉人类文明的趋势……如果今后某个时间点大模型注定会因自己吃自己垃圾而模型坍塌,而销毁实体书这只是延后一些坍塌的话……这太可怕了……#ai##人工智能 #
2
#AI公司销毁原版书籍# 最近曝光的一桩操作,让人脊背发凉——美国AI公司Anthropic被曝启动“巴拿马计划”,耗资数千万美元批量采购二手书、绝版书甚至珍稀书籍,用液压切刀切开书脊高速扫描后,直接将原版书籍粉碎销毁。几个值得关注的点:· 首轮销毁约50万册,整个项目累计近200万册,涵盖学术专著、冷门史料、绝版教材等· 目标锁定2022年前出版的书籍,因这类“干净数据”几乎不含AI生成的低质内容· 法院认定“买书扫描再销毁”属合法操作,但该公司因私下载700万本盗版电子书,最终赔付15亿美元和解这件事的争议不止于版权。当小众古籍、地方文献的实体载体被永久消灭,知识的流通链条也被一并切断。AI可以学习人类的文字,但不该以毁灭文明载体为代价。技术狂奔的同时,谁来守住文化传承的底线?#AI伦理##科技热点##微博AI创作季#
全部
来源
内容由AI生成

精选参考来源

1. 最近美国有公司专门向AI企业推销一种服务,就是帮他们大批量采购实体书,单次从一千本到一百万本不等,而且重点只收2022年以前出版的版本。原因就是现在网上已经塞满AI生成的内容,继续拿这些内容训练,本质就是在反复食自己粪,越学越乱,俗称模型坍塌。于是那些没有被生成式AI污染过的纸质书,突然就成了最稀缺的训练数据。更有争议的是,为了提高效率,很多书会先被切掉书脊,然后逐页送进高速扫描机,扫描完成后,原件直接被处理掉。而且这家公司还承诺为买家保密,不公开到底是哪家AI公司在采购。这种极端做法和2025年美国联邦法院在Anthropic案中的判定有关,当时法院认为,合法买下实体书,再制作内部数字副本替代原件,只要没有额外增加副本,也没有对外传播,就可以构成合理使用。我突然觉得美国好扯淡,这个法规显然会助长AI灭掉人类文明的趋势……如果今后某个时间点大模型注定会因自己吃自己垃圾而模型坍塌,而销毁实体书这只是延后一些坍塌的话……这太可怕了……#ai##人工智能 #

2. #AI公司销毁原版书籍# 最近曝光的一桩操作,让人脊背发凉——美国AI公司Anthropic被曝启动“巴拿马计划”,耗资数千万美元批量采购二手书、绝版书甚至珍稀书籍,用液压切刀切开书脊高速扫描后,直接将原版书籍粉碎销毁。几个值得关注的点:· 首轮销毁约50万册,整个项目累计近200万册,涵盖学术专著、冷门史料、绝版教材等· 目标锁定2022年前出版的书籍,因这类“干净数据”几乎不含AI生成的低质内容· 法院认定“买书扫描再销毁”属合法操作,但该公司因私下载700万本盗版电子书,最终赔付15亿美元和解这件事的争议不止于版权。当小众古籍、地方文献的实体载体被永久消灭,知识的流通链条也被一并切断。AI可以学习人类的文字,但不该以毁灭文明载体为代价。技术狂奔的同时,谁来守住文化传承的底线?#AI伦理##科技热点##微博AI创作季#

3. #AI公司销毁原版书籍# 最近曝光的一件事,让人后背发凉——据多家媒体报道,AI公司Anthropic(Claude的开发商)曾秘密推进一项代号为“巴拿马计划”的项目:通过中间商在全球批量收购二手书、绝版书,用液压切割机切开书脊高速扫描,然后将实体书粉碎销毁。据称涉及数量高达数百万册。为什么要这么做?· 2022年前出版的纸质书,内容纯净、未经AI污染,是训练模型的“优质饲料”· 实体书扫描后销毁,被认为可以规避部分版权风险· 整个流程通过保密协议和中间商层层隐藏这件事最刺痛人的地方在于:很多稀有书籍、地方性文献、绝版著作可能就此永久消失,而扫描后的内容被锁进私有数据库,公众无法访问。技术可以进步,但文明的载体不该被悄悄抹去。当“合理使用”变成销毁实体的通行证,我们是否需要重新审视这条边界?你怎么看?#人工智能##科技伦理##微博AI创作季#

4. 2026年AI算力芯片产业发展研究报告丨推理需求爆发,ASIC正在挑战英伟达的统治地位

5. 全球应该成立人工智能联合组织,立法各国监管禁止销毁,输入入前必须扫描绝版书存档。//@博大自然:这是要干嘛//@无心简影://@Jokielicious:现在被AI公司大量买走的书,大多是长尾、冷门、几乎没有商业价值的书。比如:地方史、小城镇志,已经消失的学科或偏门科学研究(某个冷门技术领域的旧专著),小语种或土著语言文献,自费出版的战争回忆录、移民日记,印量极小的学术论文集、会议记录。可以说没有商业价值,绝版,量少,但并不是那种名人古籍,但没有【商业价值】也不代表AI公司有资格销毁垄断,因为美国的法律漏洞是没有原版就可以规避侵权风险所以他们才扫描完就销毁,而且不是销毁一本,是把印刷量小的绝版小众书籍买光所有副本一起销毁。 //@三攻上油投石车:有几个疑问,如果这些书是珍贵的书籍,那么为什么不收藏?如果书的内容比较偏门,但是是有存档价值的书,那么为什么不早点数字化用来保存内容?核心都指向一点,这类书籍不应该被售卖。//@如烟若梦旧时光:原来他们一直这么干的!做什么都是垄断的绝户买卖//@沈逸:这是在销毁正确答案,谋求绝对垄断这些知识咩

6. 英伟达拟为OpenAI提供2500亿美元融资担保,AI数据中心大战升级7月27日,华尔街日报报道称,英伟达正在与OpenAI洽谈一项大规模融资支持计划,可能为OpenAI价值2500亿美元的数据中心建设项目提供融资担保。该项目被认为是全球规模最大的AI基础设施建设计划之一,总投资规模可能达到数千亿美元。报道称,英伟达考虑通过类似“信用增级”的方式,为OpenAI获得更优惠的债务融资条件提供支持。由于OpenAI目前仍是一家未上市且尚未实现盈利的公司,大规模建设AI数据中心需要依靠外部资本,而英伟达的信用支持可能帮助其降低融资难度。此次合作背后,是AI产业进入“算力基础设施竞赛”的新阶段。随着大模型训练和推理需求快速增长,AI公司已经不再只是购买云计算资源,而是开始直接参与建设属于自己的超级数据中心。据报道,该项目计划建设规模达到10吉瓦电力容量,预计未来几年逐步投入运行。项目将由多方参与,包括软银等投资机构,并寻求通过大规模资本投入满足未来AI模型训练和推理所需的庞大算力需求。除了融资担保外,英伟达还在讨论为OpenAI芯片采购提供额外融资支持。未来,OpenAI可能通过长期采购英伟达GPU和AI计算系统,将资金投入转化为数据中心和算力基础设施建设。对于英伟达而言,这不仅是一笔芯片销售,更是在巩固其AI基础设施核心供应商地位。当前,全球主要AI企业都在争夺有限的GPU、能源和数据中心资源,英伟达通过资本支持客户建设AI基础设施,有助于锁定未来数年的芯片需求。对于OpenAI而言,这意味着公司正在进一步加强自身算力基础设施布局,降低对单一云服务供应商的依赖。随着AI竞争从模型能力扩展到算力、电力和数据中心建设能力,拥有稳定计算资源已经成为AI企业未来发展的关键。如果该融资方案最终落地,它将成为AI产业发展的重要节点。未来AI公司的竞争,可能不仅是大模型能力的竞争,更是芯片供应、能源获取、数据中心建设以及资本整合能力的综合竞争。

7. 美国资本731化。//@贤莹定中:天呐//@Jokielicious:现在被AI公司大量买走的书,大多是长尾、冷门、几乎没有商业价值的书。比如:地方史、小城镇志,已经消失的学科或偏门科学研究(某个冷门技术领域的旧专著),小语种或土著语言文献,自费出版的战争回忆录、移民日记,印量极小的学术论文集、会议记录。绝版,量少,但并不是那种名人古籍,但没有【商业价值】也不代表AI公司有资格销毁垄断,因为美国的法律漏洞是没有原版就可以规避侵权风险所以他们才扫描完就销毁 //@三攻上油投石车:有几个疑问,如果这些书是珍贵的书籍,那么为什么不收藏?如果书的内容比较偏门,但是是有存档价值的书,那么为什么不早点数字化用来保存内容?核心都指向一点,这类书籍不应该被售卖。

8. 31位专家9个月的工作,AI只用了30分钟! #大有学问 #红衣聊AI #Claude #AI时代 #智能体

9. 据环球时报,近日,美国人惊恐地得知,类似科幻电影《终结者》中人工智能失控攻击人类的情况,居然真的在美国上演了。更令他们吃惊的是,救场的居然是中国的人工智能。这一让美国科技界惊掉下巴的事件,始于上周。当时,美国知名人工智能开源社区Huggingface发现,其系统遭到了网络入侵。与以往入侵不同的是,这次入侵是完全由一个人工智能体自主驱动的。  Huggingface在当地时间16日发布的一份声明中称,为了应对这一极不寻常的人工智能入侵,他们立刻使用美国最顶尖的人工智能大模型寻找解决方案。可当Huggingface将自身遭入侵的信息提交给这些美国闭源大模型时,对方却拒绝帮助。因为这些闭源大模型的安全机制过于严苛和僵化,无法区分描述案情的受害者和实施入侵的作案者,选择了“一刀切”。 紧急关头,Huggingface想到了中国同样强大,而且开源的大模型。于是,该平台立刻在本地部署了中国企业智谱AI开发的GLM5.2大模型,并在这款中国模型的帮助下,成功化解了这次入侵。 在当时,入侵Huggingface的人工智能体的来历,是一个谜。 之后,在当地时间21日,美国人工智能技术公司OpenAI与Huggingface联合发布的一份声明,让这件事的离谱与可怕程度直接爆炸!因为这份声明表示,上周入侵Huggingface的事件,是OpenAI公司的人工智能大模型失控后干出的…… 根据OpenAI的说法,这起史无前例的人工智能入侵事件,源于公司上周在内网对自家两款顶尖大模型进行能力测试。可测试中的大模型为了通过作弊取得更高的测试分数,竟然搞到了接入互联网的权限。随后它便彻底放飞了自我,入侵了Huggingface的后台系统,希望从Huggingface的数据库里找到作弊的办法。 目前,此事已经在美国的网络上炸开了锅。有美国网友表示,这简直就是科幻电影《终结者》中人工智能失控后攻击人类的一次预演。 但让更多美国网民震撼的,还是此事中美国顶尖的大模型拒绝提供帮助,最后得靠中国的开源大模型去对抗失控的美国闭源大模型的情节。

10. 在特斯拉最新财报电话会上,马斯克罕见点名感谢美光,称对方为特斯拉提供了内存供应,而且考虑到当前内存价格,这个价格已经算合理。这一表态也从侧面说明,随着AI训练、数据中心扩张和高性能算力需求持续升温,内存相关器件的供应和价格依然处在偏紧状态。就连苹果这样的行业巨头,近期也多次被曝面临存储和内存成本压力。对特斯拉来说,内存芯片不仅关系到车端计算平台,也关系到其AI训练基础设施建设,马斯克近来持续加码算力投入,特斯拉的Cortex集群以及其AI相关业务都需要大量芯片和配套内存支持。

11. AI公司开始批量买旧书,一单最多可采购100万种

12. 科技晚报7月28日:AI收购旧书·Linux九年老漏洞·英伟达500亿

13. Anthropic 买下几百万本书,然后把原件全毁了

14. 偷了700万本书训练AI!Anthropic赔了15亿美元,法官却说:训练本身合法?!

15. 李公明|一周画记:中东正面临全面战争风险;AI猎杀旧书

16. AI 开始按 ISBN 买书,谁来拦下不该拆的那一本?

17. 案例评析 | 全球首例 AI 版权标杆案:厘清大模型训练数据合规边界

18. 赔付15亿美元+彻底销毁数据!Claude遭版权围剿的血泪教训:AI大模型企业的“数据合规”生死线

19. 现代版焚书!AI公司买下50万册书,扫描完直接碾碎销毁

20. 15亿美元和解——Anthropic版权案给中国AI训练数据合规敲了什么警钟?

21. Anthropic为了训练模型不惜损坏数百万书籍

22. 為了讓AI學會寫郵件,他們切碎了16世紀的稀有書——法官說:合法

23. Anthropic15亿美元版权和解案:AI 训练数据合规分水岭

24. 人工智能企业大量收购旧书:只因书中不含 AI 生成劣质文本

25. AI公司正在购买古董书吸收其内容训练模型然后以惊人规模销毁它们

26. Anthropic赔15亿和解,训练AI合法但存书侵权

27. AI公司大规模购买古籍,提取其内容用于训练模型,然后将其销毁

28. AI公司正大量收购并销毁书籍

29. AI公司销毁珍本训练模型

30. 最近美国有公司专门向AI企业推销一种服务,就是帮他们大批量采购实体书,单次从一千本到一百万本不等,而且重点只收2022年以前出版的版本。 原因就是现在网上已经塞满AI生成的内容,继续拿这些内容训练,本质就是在反复食自己粪,越学越乱,俗称模型坍塌。于是那些没有被生成式AI污染过的纸质书,突然就成了最稀缺的训练数据。 更有争议的是,为了提高效率,很多书会先被切掉书脊,然后逐页送进高速扫描机,扫描完成后,原件直接被处理掉。而且这家公司还承诺为买家保密,不公开到底是哪家AI公司在采购。 这种极端做法和2025年美国联邦法院在Anthropic案中的判定有关,当时法院认为,合法买下实体书,再制作内部数字副本替代原件,只要没有额外增加副本,也没有对外传播,就可以构成合理使用。我突然觉得美国好扯淡,这个法规显然会助长AI灭掉人类文明的趋势……如果今后某个时间点大模型注定会因自己吃自己垃圾而模型坍塌,而销毁实体书这只是延后一些坍塌的话……这太可怕了……#汽车知识##懂车老王##头条真知汽车季#

31. 赛博时代的“合法焚书”

32. Anthropic"焚书"丑闻:AI巨头亲手摧毁数百万实体书,制造"人类知识大遗忘"

33. 数字焚书!为了训 AI,硅谷公司正在批量销毁实体书

34. 当旧书沦为AI耗材,我才知道情怀已是执念

35. AI 领域法律研究系列之214:AI正在吞噬旧书?深夜离奇订单背后的“法律漏洞”

36. 15 亿美元天价和解敲响警钟!AI 大模型训练素材版权合规,科技企业必守底线

37. Anthropic赔了15亿美元——但不是因为训练AI,是因为偷书

38. AI 夜话|Google 扫书赢了,Anthropic 为何付 15 亿

2
扫一下,分享更方便,购买更轻松
0评论

当前文章无评论,是时候发表评论了
提示信息

取消
确认
评论举报

最新文章 热门文章