给小龙虾装上声音!像真人一样说话|极空间OpenClaw发送语音教程

你收到的飞书消息还是这样的么?
❌ 冷冰冰的文字
❌ 干巴巴的链接
❌ 没有感情的提示
—— 该给 AI 加点温度了!
语音消息可以传递更多信息:语气、情绪、甚至还能用克隆音色!

想象一下:
早上起床,AI 用温柔的声音叫醒你
基金亏了,AI 用安慰的语气哄你
文件下好了,AI 用欢快的语气告诉你
这就是语音消息的魅力——让 AI 不再是冷冰冰的文字,而是有温度的"人"。
今天这篇,就是手把手教你在极空间上部署的 OpenClaw 配置语音功能~

其实也很简单,咱们这就以极空间Z4 Pro+性能版上部署的OpenClaw为例,看看这么有趣的飞书语音消息该怎么部署。(Docker、应用商店部署的也能使用~)
核心原理&配置过程
AI发语音消息的原理其实很简单:
文本 → TTS引擎(语音合成) → 音频文件 → 上传到飞书 → 发送消息 → 用户收到语音
在OpenClaw中,这个过程被封装成了一个简单的tts工具,AI只需要一行代码就能发语音。

但是我们都知道TTS语音合成大部分都是要付费的,免费的TTS效果非常一般。那咱们这使用的是minimax的token plan套餐,里面就包含了TTS语音合成的额度,满足一天的情绪是完全足够的。

那当然如果你订阅的不是minimax的token plan套餐也可以去注册Noiz AI,申请API Key,新用户赠送100000免费字符额度,正常低频次使用是完全足够的。

如果你实在是不想付费,那也能直接使用免费的edge tts服务,这是微软edge浏览器的TTS引擎是,是完全免费的。(安装过程很简单,直接告诉OpenClaw:咱们需要配置TTS服务,有一个免费的edge-tts工具,你去获取一下就行)
拿到了API Key之外,就是给咱们的龙虾安装上Skill了。

如果你使用的是minimax的语音生成额度,其实不需要安装额外的skill,只需要将minimax的Token Plan文档链接发给OpenClaw,并告诉它,我们现在使用的minimax的api key就是token plan的api key,这样它就能直接使用minimax的语音生成了。

这里建议让OpenClaw记一下使用minimax api生成tts的过程,最好是记录到memory或者构建skill,这样下次就能直接使用了。

如果你是使用的Noiz AI,则需要让OpenClaw去安装一个skill—Noiz AI-skills,再将咱们前面获取的api key发给你的小龙虾,这样它就能去使用Noiz AI生成TTS了
那如果你用的就是edge-tts,那在安装好之后就能直接生成语音了,不需要额外的操作,可以说非常的简单方便。
TTS 方案对比:

发送语音
语音能生成了,下一步就是发送语音。这里需要分为两部分说明:飞书官方插件 vs OpenClaw自带插件。

咱们先来说飞书官方的,配置好TTS之后,它就能直接调用飞书的api接口发送这样的语音消息。

但如果你使用的飞书插件是OpenClaw自带的,那有可能OpenClaw发送给你的是这样的文件形式,那体验上肯定是没有飞书官方插件那种样式好,不过也不是没办法修!

其实关键就在于需要让OpenClaw将音频用 ffmpeg 转换为 opus 格式(ogg容器)再来发送音频,不然极有可能发送了,但是播放不了。(操作很简单:直接说用 ffmpeg 转换为 opus上传到飞书发送音频消息这样你的龙虾就能明白了。)
这样你在极空间上部署的OpenClaw也能给你发送语音消息了!但默认的音色不满意咋办?能不能克隆音色呢?克隆音色也是没问题的,但需要注意克隆音色在大部分平台都是属于付费的功能,咱们这就拿minimax来演示一下(因为我的minimax账户里面还有代金券)。

克隆音色

直接将需要模仿的声音发给你的OpenClaw,告诉它模仿这个音色(如果你的账户里面有钱,它就能直接去克隆了)

克隆后的音色,如果还有哪里不满意,也能让它帮你稍加调节一下。(这里我本来发的是东北口音,结果克隆出来是天津口音,就让OpenClaw去修改了一下音色为东北调)


另外只有克隆音色的时候需要付费,后续再用克隆之后的音色去生成tts,则不需要付费,你可以让你的OpenClaw去记一下使用克隆音色生成语音的流程,这样就不用每次都去配置了。

那需要注意,克隆音色需要获取被克隆人的授权,不得用于违法行为中!自己玩玩就行啦~
🎉 以上就是本篇文章的全部内容 希望对你玩龙虾有一定的帮助 让我们下篇文章 再见 👋
作者声明本文无利益相关,欢迎值友理性交流,和谐讨论~

橘生330
校验提示文案
橘生330
校验提示文案