# 专门为对话场景设计的文本转语音模型ChatTTS

*Published:* 2024-06-04
*Author:* 客服001

#### 温馨提醒

如果文章内容或图片资源失效，请留言反馈，我们会及时处理，谢谢

本文最后更新于2024年6月4日，已超过 180天没有更新



ChatTTS 是专门为对话场景设计的文本转语音模型，例如 LLM 助手对话任务。它支持英文和中文两种语言。最大的模型使用了 10 万小时以上的中英文数据进行训练。在 HuggingFace 中开源的版本为 4 万小时训练且未 SFT 的版本。

**亮点：**

- 对话式 TTS: ChatTTS针对对话式任务进行了优化，实现了自然流畅的语音合成，同时支持多说话人。
- 细粒度控制: 该模型能够预测和控制细粒度的韵律特征，包括笑声、停顿和插入词等。
- 更好的韵律: ChatTTS在韵律方面超越了大部分开源TTS模型。同时提供预训练模型，支持进一步的研究。

GitHub地址：https://github.com/2noise/ChatTTS

ChatTTS 整合包打开即用：https://pan.quark.cn/s/2a4fcacd1d8a