Wiki / Core Features / 语音对话

语音对话

更新者 Maxime_48 · 2小时前 · 浏览量:38

语言: English Français Deutsch Español Português (Brasil) Italiano Nederlands Polski Türkçe Русский 日本語 한국어 中文

语音对话让成员可以对着机器人大声说话。它会加入一个语音频道,聆听,并用语音回答,使用的模型、背景设定和记忆都与 AI 回复相同。

**实验性功能。**这个功能是新的,仍在磨合中。请预期会有不完善之处,并把你的发现告诉我们。


🎙️ 工作方式

机器人会加入一个语音频道,把听到的内容转写成文字,像处理文字消息一样把它交给 AI 回复,然后用文字转语音把回答说出来。它在开始聆听之前,总会先在一个文字频道中发布一条通知,并且如果没有一个可以发布这条通知的频道,它绝不会聆听。

它加入的方式有两种,通过机器人如何加入来设置。


🙋 按需

成员用 /voice-chat start 邀请机器人进入自己的语音频道,并用 /voice-chat stop 让它离开。

设置 作用
每次对话的分钟数 达到这个时长,或在频道里独自待了一分钟之后,机器人就会离开。
可以邀请它的身份组 限制谁可以发起对话。留空则任何人都可以邀请它。
可以邀请它加入的语音频道 限制可以把它叫进哪些频道。留空则允许所有语音频道。

🏠 常驻

机器人会一直停留在你选定的某个语音频道中,那里的任何人都可以直接和它说话,无需先邀请它。

设置 作用
常驻的语音频道 它所驻留的那一个频道。
用于通知的文字频道 当机器人无法在语音频道自带的聊天中发言时使用。没有它可以发言的频道,它就不会聆听。
每天的聆听分钟数 它每天总共被允许聆听多久。

一旦达到每日额度,机器人会留在频道中,但在 UTC 午夜之前停止聆听:它不会离开,第二天也不需要重新邀请。今天已用的聆听时间由面板保存,因此重启机器人不会让当天的额度重新开始。


🔊 语音

设置 作用
在回答中使用服务器记忆 在 AI 回复中启用记忆时,读取 AI 回复的记忆。语音对话绝不会写入记忆,只有文字对话才会。
用于聆听和说话的 OpenAI API 密钥 为转写(语音转文字)和语音(文字转语音)提供支持,与生成回复本身所用的 AI 回复 API 密钥是分开的。
聆听模型 / 说话模型 哪个模型负责转写、哪个模型负责说话,从你的端点中选择。
声音 机器人说话所用的声音,从固定列表中选择(Alloy、Ash、Coral、Echo、Fable、Nova、Onyx、Sage、Shimmer)。
使用你自己的语音端点 关闭:api.openai.com。开启:你自己的、兼容 OpenAI 的服务器,且同时提供转写和语音功能。
该端点上的语音名称 仅当你自己的端点对声音的命名不同时才需要,它必须认识你发给它的声音。留空则原样发送上面选择的声音。

⌨️ 命令

/voice-chat 仅限斜杠命令:即使设置了前缀,它也不能作为文字命令使用。

子命令 作用
/voice-chat start 邀请机器人进入你当前所在的语音频道(仅限按需模式)。
/voice-chat stop 让机器人离开。

🔗 与其他功能配合

  • AI 回复:回答语音对话的模型、背景设定和记忆,都是 AI 回复自己的。请在那里配置它们。
  • 音频录制:一台服务器只有一个语音连接,所以机器人无法在录制一个频道的同时,在另一个频道进行语音对话。这两个功能不需要一起配置,但同一时间只能有一个占用该连接。

✅ 权限

机器人在它可以加入的语音频道中需要 View Channel、Connect 和 Speak,并且在接收其通知的文字频道中需要 Send Messages,没有这一项,它就完全不会聆听。


💡 最佳实践

  • 先从按需模式开始,看看你的社区实际上是如何使用它的,再决定是否让某个频道采用常驻模式。
  • 一开始让每天的聆听分钟数保持适中,一旦了解了真实的使用情况,随时都可以调高。
  • 先查看 AI 回复的背景设定和记忆设置;语音对话的质量,取决于它能读到的内容。