GitHub上的宝藏TTS引擎,易魔声带你玩转声音世界!
EmotiVoice是一个强大的开源TTS引擎,完全免费,支持中英文双语,包含2000多种不同的音色,以及特色的情感合成功能,支持合成包含快乐、兴奋、悲伤、愤怒等广泛情感的语音。免费开源,功能强的离谱!
EmotiVoice(易魔声)
是一款来自 GitHub 的强大开源 TTS 引擎(Text To Speech,即文本转语音)。它支持多角色、多语言和多种情绪的语音合成。易魔声(EmotiVoice)是一款由网易有道自研的TTS引擎,具备强大的功能,支持中英文双语,并且拥有2000多种音色。最令人惊喜的是其独特的情感合成功能,通过在文本中加入情感描述提示,开发者和内容创作者可以自由合成符合需求的情感语音。

这款工具完全免费、无广告,支持中英文,并内置了2000多种不同的音色,情感合成:支持合成包含快乐、兴奋、悲伤、愤怒等多种情感的语音。适用于Windows、MacOS、Linux等平台。今天我们将重点介绍它的 Windows 本地部署包,大小约为 5.3GB。
通过 EmotiVoice,我们可以在自己的电脑上合成 2000 多种不同音色及 7 种情绪的语音,效果极为出色,带有情感,几乎可媲美真人。

每种音色(说话人)都支持自定义普通、生气、开心、惊讶、悲伤、厌恶、恐惧等 7 种情绪。

注意:为了达到最佳使用体验,请使用拥有 Nvidia GPU 的 PC。GPU 性能将会影响该工具的语音合成效率。
使用方法非常简单:解压软件压缩包后,双击运行【Start.bat】即可启动软件。

软件本地服务将在 CMD 命令行窗口中运行:

服务启动成功后,将会打开一个 WebUI。在此 WebUI 中,我们可以根据自己的需求开始合成语音:

选择说话人、情绪、语言后,输入合成语音所需文本,点击【合成音频】即可生成语音:

合成音频的速度取决于 GPU 的算力、GPU 的性能释放、选择的语音模型(说话人)的效率以及输入文本内容的长度。对于故事创作爱好者来说,易魔声还提供了剧本模式。你可以编写剧本,为每个角色设置不同的情感和配音员,从而让整个故事更加丰富多彩。
合成成功后,我们可以在线试听合成的语音。点击语言进度条右侧的【···】即可将语音文件保存到本地(WAV 格式):

除了合成单句语音外,EmotiVoice 还支持故事剧本的多人合成。我们可以自定义剧本中各个角色的名称、语音模型、说话内容和情绪:


如果我们在使用过程中勾选了自动保存生成的语音,可以进入软件文件夹,打开wav_file文件夹查看合成的语音文件:

退出软件时,只需关闭 CMD 窗口和网页窗口(WebUI)即可。
作为一款功能强大的开源文本转语音引擎,EmotiVoice在多个领域具有广泛的应用前景。例如,在语音助手、在线教育、有声读物、广告配音等领域,EmotiVoice都能够提供高质量的语音合成服务,满足用户的多样化需求。
总之,EmotiVoice(易魔声)是一款功能丰富、使用便捷、应用广泛的开源文本转语音引擎,值得广大用户和开发者关注和使用。
EmotiVoice 合成的语音听起来相当不错(注意输入文本内容的标点符号),带有情绪,非常逼真。大家感兴趣的话可以下载试用!
下载地址:
https://xcjygzs.cn/archives/42276
https://pan.quark.cn/s/faa390ab6bef
https://pan.xunlei.com/s/VO28ubGpdLVQNUgChLkMlhQiA1?pwd=up3t#
EmotiVoice(GitHub):https://github.com/netease-youdao/EmotiVoice
搬运:https://www.123pan.com/s/6ZFcVv-4ufzH.html
使用注意事项
确保CPU或显卡性能:虽然EmotiVoice-Plus可以在CPU上运行,但拥有独立显卡会加快处理速度,提高生成音频的效率。
安装路径不含中文:为了避免因路径中的中文字符导致的适配问题,建议用户在安装时选择不包含中文的路径。
试听与调整:由于声音种类众多且没有试听环节(在封测阶段),用户可能需要花费一些时间来筛选出自己喜欢的声音。在生成音频后,建议及时试听并根据需要进行调整。

子迪哥
校验提示文案
子迪哥
校验提示文案