比喜马拉雅还强!畅听全网书源,告别会员!
生活节奏越来越快,阅读时间却越来越少。平时通勤、做家务或锻炼时,想看书却腾不出手来。
有声书成为了解决这一问题的理想方式,让我们能够在各种场景下继续 “阅读”。
然而,市面上的有声书往往价格不菲,选择也相对有限,许多小众或新出版的书籍并没有对应的有声版本。
最近发现了一个名为 Audiblez 的开源工具,它能够将 EPUB 格式的电子书转换为 M4B 格式的有声书,使用了 Kokoro 的高质量语音合成技术。
无需订阅任何服务,也不必担心语言限制,我们可以自由地将喜欢的电子书转换成优质的有声书。
Audiblez GUI on MacOSX主要功能
Audiblez 功能强大,让电子书转有声书变得简单高效:
多语言支持:覆盖英语、西班牙语、法语、意大利语、日语和中文等多种语言,满足不同阅读需求。
高质量语音合成:采用 Kokoro-82M 模型,虽然只有 82M 参数,却能生成非常自然流畅的语音效果。
转换速度快:在支持 CUDA 的 GPU 上,每秒可处理约 600 个字符,《动物农场》这样的小说只需 5 分钟即可完成转换。
双重使用界面:既提供命令行工具,也有图形界面,适合不同使用习惯的用户。
丰富的语音选择:每种语言提供多种不同的声音选项,包括男声和女声,让有声书听感更加多样化。
灵活的速度调节:可将语速调整为 0.5 到 2.0 倍,根据个人喜好和内容类型选择最舒适的聆听速度。
章节自由选择:支持手动选择需要转换的章节,方便针对性地处理书籍内容。
image-20250411141730228安装指南
安装 Audiblez 非常简单,只需几个命令就能完成。根据操作系统的不同,安装步骤略有差异:
对于 Ubuntu/Debian 系统:
sudo apt install ffmpeg espeak-ngpip install audiblez
对于 Mac 系统:
brew install ffmpeg espeak-ngpip install audiblez
如果想使用图形界面,还需要安装一些额外的依赖:
pip install audiblez pillow wxpython
Windows 用户可以按照以下步骤在虚拟环境中安装:
打开 Windows 终端
创建新文件夹:
mkdir audiblez进入文件夹:
cd audiblez创建虚拟环境:
python -m venv venv激活虚拟环境:
.venvScriptsActivate.ps1安装依赖:
pip install audiblez pillow wxpython
安装完成后,就可以开始使用这个强大的工具了!
使用指南
Audiblez 的使用非常直观,下面是一些基本操作:
命令行模式下,转换电子书只需一条简单命令:
audiblez book.epub -v af_sky
其中 -v af_sky 指定了使用的语音类型,这里选择的是美式英语女声。
如果想使用图形界面,只需运行:
audiblez-ui
调整语音速度也很容易,使用 -s 参数即可:
audiblez book.epub -v af_sky -s 1.5
这会将语速设置为 1.5 倍,适合快速浏览内容。
对于有 GPU 的用户,可以使用 CUDA 加速转换过程:
audiblez book.epub -v af_sky --cuda
如果只想转换书籍中的特定章节,可以使用 --pick 选项进行交互式选择:
audiblez book.epub -v af_sky --pick
程序会在同一目录下生成临时的 WAV 文件,最后合并为一个完整的 M4B 格式有声书,可以在任何支持该格式的播放器中收听。
写在最后
Audiblez 这款开源工具真的解决了我们获取有声书的痛点,不仅完全免费,而且支持多种语言,声音质量也相当不错。
特别适合以下几种使用场景:
对于通勤党来说,可以将电子书库中积压的好书转换成有声书,充分利用碎片时间;
对于需要学习外语的朋友,可以选择相应语言的语音模型,帮助提高听力能力;
对于视力不便的亲友,这款工具也能帮助他们更方便地获取知识和享受阅读乐趣。
最让人惊喜的是,整个转换过程完全在本地完成,不需要上传文件到云端,既保护了隐私,又避免了网络延迟。
如果你也有大量电子书想要转换成有声书,不妨试试这款强大的开源工具!
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

wayward713
校验提示文案
点磊成鑫
校验提示文案
lz5v
我说一下我自己使用Audiblez 这个工具的实际体验吧。我转了两本书,第一本是Rust 程序设计语言。Rust 程序设计语言 epub 583k,纯cpu转,使用的声音是cn_zf_xiaobei。显示剩余时间两小时,结果实际转了九小时,转出来2.4G。总的cpu使用率在30%-60%跳,感觉没用尽cpu资源所以转得慢,工具本身也没相关设置。转出来后听了一下感觉不太行。一是我的这本书有中英文,大部分的英文单词甚至单个英文字母也没有识别到。说明一种语言的模型只能识别只含有该单种语言的书籍。然后当有超过200个字的中文长段落时,Audiblez 只识别到100个字符,之后就会跳过文本不读,开始直接读下一个段落,比如说我图里的这个页面,第一个大段跳过了"进行"后面的部分,第二个大段跳过了"难以"后面的部分。对于句子里的多音字的识别也没做好,比行(hang)会读成行(xing)。好不好听这个更高要求的阶段我就不说了。我看Issues有人反映意大利语等小语种也有这种情况。转的效果不满意,于是上官网看了一下它采用的Kokoro-82M模型的情况,表面上普通话的声音是除英语外最多的,有8个声音。但实际上这8个声音训练时间都是MM minutes 10到100分钟,目标质量都是C ,最终成绩都是D。表面只有1个声音的法语,训练时间写着小于11小时,目标质量B,最终成绩B-。最后我选了一个训练时间超过100小时、最终成绩A的美式英语us_af_heart转了一本coleridge-poems,效果比国语好多了,整体还算满意。虽然我没用过喜马拉雅,但是毕竟付费服务,我觉得应该不会有缺漏问题。总结:英语书源是可以选择这个开源工具,模型要选对,有些英语模型训练时间是1到10分钟比国语还少。如果后面没有升级版本,想听免费中文书源还是等国人专门为国语设计的开源项目吧。
校验提示文案
瞧痔一世
校验提示文案
v黑洞a
校验提示文案
bombjue
校验提示文案
大玉山庄
校验提示文案
我的曾曾曾曾祖父
校验提示文案
土豆这一家
校验提示文案
1江湖浪子
校验提示文案
呆蔸儿
校验提示文案
土豆这一家
校验提示文案
MabyF
校验提示文案
思念成殇
校验提示文案
都快忘了怎样恋一个爱
校验提示文案
张大妈首席平章
校验提示文案
lz5v
我说一下我自己使用Audiblez 这个工具的实际体验吧。我转了两本书,第一本是Rust 程序设计语言。Rust 程序设计语言 epub 583k,纯cpu转,使用的声音是cn_zf_xiaobei。显示剩余时间两小时,结果实际转了九小时,转出来2.4G。总的cpu使用率在30%-60%跳,感觉没用尽cpu资源所以转得慢,工具本身也没相关设置。转出来后听了一下感觉不太行。一是我的这本书有中英文,大部分的英文单词甚至单个英文字母也没有识别到。说明一种语言的模型只能识别只含有该单种语言的书籍。然后当有超过200个字的中文长段落时,Audiblez 只识别到100个字符,之后就会跳过文本不读,开始直接读下一个段落,比如说我图里的这个页面,第一个大段跳过了"进行"后面的部分,第二个大段跳过了"难以"后面的部分。对于句子里的多音字的识别也没做好,比行(hang)会读成行(xing)。好不好听这个更高要求的阶段我就不说了。我看Issues有人反映意大利语等小语种也有这种情况。转的效果不满意,于是上官网看了一下它采用的Kokoro-82M模型的情况,表面上普通话的声音是除英语外最多的,有8个声音。但实际上这8个声音训练时间都是MM minutes 10到100分钟,目标质量都是C ,最终成绩都是D。表面只有1个声音的法语,训练时间写着小于11小时,目标质量B,最终成绩B-。最后我选了一个训练时间超过100小时、最终成绩A的美式英语us_af_heart转了一本coleridge-poems,效果比国语好多了,整体还算满意。虽然我没用过喜马拉雅,但是毕竟付费服务,我觉得应该不会有缺漏问题。总结:英语书源是可以选择这个开源工具,模型要选对,有些英语模型训练时间是1到10分钟比国语还少。如果后面没有升级版本,想听免费中文书源还是等国人专门为国语设计的开源项目吧。
校验提示文案
MabyF
校验提示文案
土豆这一家
校验提示文案
呆蔸儿
校验提示文案
1江湖浪子
校验提示文案
土豆这一家
校验提示文案
张大妈首席平章
校验提示文案
我的曾曾曾曾祖父
校验提示文案
wayward713
校验提示文案
都快忘了怎样恋一个爱
校验提示文案
思念成殇
校验提示文案
大玉山庄
校验提示文案
bombjue
校验提示文案
v黑洞a
校验提示文案
点磊成鑫
校验提示文案
瞧痔一世
校验提示文案