让 AI 替你搬书:WorkBuddy 批量下载电子书实战
收藏电子书这件事,一旦入了坑,就再也停不下来。
香港中文大学出版社的开放图书、Springer 的 Access Books、古腾堡计划、OpenTax,还有最喜欢的zlibrary——网上从来不缺高质量的免费电子书资源。真正的问题是:怎么把它们高效地弄到手?一本本手动点下载,几十上百本书下来,手都点酸了。
最近用 WorkBuddy 试了一把批量下载,效果出奇地好。分享一下过程。
以前是怎么干的
最早想走捷径,找个浏览器插件嗅探页面的 PDF 链接。但 Chrome 插件市场鱼龙混杂,想找个靠谱的下载插件好比大海捞针。
自己写脚本也行。原理不复杂:用 requests 抓页面,正则或 XPath 把 PDF 链接筛出来,挨个下载。问题是,让AI写代码简单,真用起来,又得调试半天。
说到底,很多方法费时费力,还不可复用。
AI 大模型把门槛踩平了
2025 年初 DeepSeek 开源以后,大模型彻底出圈了。它最厉害的地方不是能写诗画画,而是补短板——你不会写代码?没关系,把需求说清楚就行。
codex、Claude Code 这些工具,用自然语言就能指挥电脑干活。WorkBuddy 也是这个路子,用了一段时间,确实顺手。
一句话,书就来了
香港中文大学出版社的开放图书计划(https://openbookshongkong.com/book/)上有不少繁体中文好书,质量很高,而且采用 CC BY-NC-ND 4.0 许可,可以合法下载分享。

打开 WorkBuddy,新建任务,输入指令:
我需要下载链接 https://openbookshongkong.com/book/ 页面下所有的电子书,保存到 D:电子书22。请用 requests 读取网页信息,解析其中的 PDF 或 EPUB 链接,并使用多线程加快下载速度。有些标题全是数字的 pdf 文件,需要根据图书的名称重命名。
这个提示词的每个限定都有其用意:requests 是成熟的爬虫库,多线程保证速度,文件重命名避免一堆数字编号让人抓狂。
WorkBuddy 收到指令后自动执行了三步:
扫描页面,识别所有 PDF/EPUB 链接
生成下载脚本,用多线程同时拉取
自动运行,无需人工干预
等任务跑完,打开 D 盘的「电子书22」文件夹,书已经整整齐齐按书名排好了。
下一步
书越来越多,已经在琢磨让 WorkBuddy 或者 Claude Code 帮我搭个电子书管理网站了。这个下次再聊。

以前折腾半天的事,现在一句话搞定。大模型不是在替你做决定,而是在替你省时间。省下来的时间,刚好用来读那些好不容易下载回来的书。
附:
1. 香港中文大学出版社开放图书(开读 Open Books Hong Kong)
全称:Open Books Hong Kong,由港中文、港大、城大三校出版社联合开放图书平台,包含香港中文大学出版社全部开放著作
2. Springer Access Books(施普林格开放 / 订阅电子书)
主检索平台(所有 Springer 图书、开放图书入口):https://idp.springer.com/authorize?response_type=cookie&client_id=springerlink&redirect_uri=https%3A%2F%2Flink.springer.com%2F
Springer Nature 开放图书专题页:https://www.springernature.com/cn/open-science/journals-books/books
说明:Access Books 指机构订阅全量电子书,开放 OA 图书可直接在link.springer.com免费下载。
3. 古腾堡计划 Project Gutenberg(公有领域免费电子书)
全球原版官网:https://www.gutenberg.org/
简介:全球最早免费公版书库,七万 + 无版权外文经典,无需注册直接下载 EPUB/Kindle 格式。
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

roc634
校验提示文案
职业盲流
校验提示文案
光屁股的兔子
校验提示文案
果酱超人
校验提示文案
RogerHan
校验提示文案
Linkel
校验提示文案
xxd3
校验提示文案
Linkel
校验提示文案
RogerHan
校验提示文案
果酱超人
校验提示文案
职业盲流
校验提示文案
xxd3
校验提示文案
光屁股的兔子
校验提示文案
roc634
校验提示文案