大家好,我是磊哥哥。

今天给大家介绍,如何在 SillyTavern 酒馆中为角色卡配置 TTS 语音,让你的角色真正开口说话。不再只是冰冷的文字——她们会说话,有声音,有温度。

DeepSeek Tavern 现已内置 TTS 语音合成功能,登录 deepseektavern.com 即可体验。

DeepSeek Tavern TTS 定价展示
定价说明

单次合成不到一毛钱,重度使用一个月也就几块钱。比买语音包、请配音便宜太多了——而且每个角色都能有自己的专属声音。

一步步配置教程

1注册账号并获取 API Key
访问 deepseektavern.com 注册账号,登录后台后生成一个 API 密钥。如果还没有账号,请参考 API 密钥获取教程
2打开 SillyTavern 扩展面板
打开 SillyTavern 酒馆,点击顶部的"扩展"图标(三个小方块堆叠的按钮)。
SillyTavern 扩展面板入口
3配置 TTS 连接参数
在扩展面板中,找到并展开「TTS」选项,按下方截图填写配置:
TTS Provider 选择 OpenAI Compatible
Endpoint 填写 https://deepseektavern.com/v1/audio/speech
Model 选择 tavern-v1-tts
TTS 配置参数截图
4填入 API Key
点击绿色的「API Key」按钮 → 选择「添加密钥」→ 将你在 DeepSeek Tavern 后台获取的 Key 粘贴进去 → 点击确认。
API Key 配置截图
5选择角色音色
在「Voice」一栏中输入你想要的音色名称即可。目前支持 9 种预设音色,包含中英文男女声。
Voice 音色输入框

以下是完整的音色列表:

TTS 预设音色列表
进阶玩法:VoiceDesign 和 VoiceClone

除了预设音色,还支持音色设计(文字描述创造全新音色)和语音克隆(30 秒音频复刻人声)。详见 TTS API 文档

6开始对话,聆听角色声音
返回聊天界面,和角色正常对话。点击聊天框左上角的「小喇叭」按钮,稍等片刻,角色就会用你选择的声音说出回复了!
聊天界面小喇叭按钮
7进阶:API 独立调用
除了在酒馆中使用,TTS 模型也支持标准 OpenAI TTS API 调用,可用于批量合成口播文案、播客等场景。调用方式请参考 TTS API 接口文档

希望大家喜欢,我们酒馆里见。