电子书转有声书这个Docker容器很强大
我又来分享一个 AI 工具:athomasson2/ebook2audiobook,这个工具的主要玩法是文本电子书转有声书,而且可以通过 Docker 容器化部署,非常方便。
首先介绍如何通过 Docker 部署 ebook2audiobook。ebook2audiobook 支持 CPU 运行或者 GPU 加速。官方给了 2 条运行命令分别是 GPU 模式:
docker run -it --rm --gpus all -p 7860:7860 --platform=linux/amd64 athomasson2/ebook2audiobook python app.py
和 CPU 模式:
docker run -it --rm -p 7860:7860 --platform=linux/amd64 athomasson2/ebook2audiobook python app.py
我个人推荐用 GPU 模式(因为 GPU 模式部署后也可以选择纯 CPU 运行),将 docker run 命令转换成 docker-compose.yaml,然后通过 docker-compose 部署。
services:
ebook2audiobook:
deploy:
resources:
reservations:
devices:
- driver: nvidia
count: all
capabilities:
- gpu
ports:
- 7860:7860
platform: linux/amd64
image: athomasson2/ebook2audiobook
command: python app.py
AI 类的镜像都非常大而且很占空间,这个 athomasson2/ebook2audiobook 部署完成后镜像占用了 12.7G。

部署完成后访问 IP:7860 ,就可以看到 ebook2audiobook 操作界面。我做了个图简单介绍一下操作:ebook2audiobook 最简单的操作只需要上传文本文件,然后选择语言,选择 GPU 或者 CPU 模式然后点击生成即可。

不过 ebook2audiobook 还可以克隆音色或者上传自定义的 XTTS 模型的玩法。
克隆声音也非常简单,准备一个 6秒以内的语音(WAV 格式)。在转换前先把这个文件上传,然后再点击转换就可以得到克隆声音朗读的效果,非常好玩。大家可以自己尝试一下。
Audio Generation Preferences 页面可以对语调和语速做微调,大家可以根据效果自己去做调整。

就介绍到这里,大家可以自己测试一下,很强的一个工具!
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~
