ChatTTS
不活跃简介
面向日常对话的生成式语音模型,为 AI Agent 提供自然流畅的语音合成能力,支持细粒度韵律控制。
核心特性
- 对话式语音合成 — 针对 LLM 助手等对话场景优化,支持自然表达的语音合成
- 细粒度韵律控制 — 预测和控制笑声、停顿、语气词等细微韵律特征
- 多说话人支持 — 采样随机说话人音色,支持多角色对话场景
- 流式音频生成 — 支持实时流式语音输出
- 中英文支持 — 基于 10 万+小时中英文音频数据训练
- WebUI 和命令行 — 提供 Web 界面和命令行两种使用方式
适用场景
💡 为 AI 对话助手添加自然的语音回复能力
💡 生成播客或有声读物的多角色语音内容
💡 在语音消息应用中集成 TTS 功能
💡 为无障碍应用提供文本转语音支持
💡 构建交互式语音 IVR 系统
分类
快速开始
```bash
pip install ChatTTS
```
```python
import ChatTTS
import torch
import torchaudio
chat = ChatTTS.Chat()
chat.load(compile=False)
texts = ["你好,我是 ChatTTS。", "今天天气真不错。"]
wavs = chat.infer(texts)
for i, wav in enumerate(wavs):
torchaudio.save(f"output{i}.wav", torch.from_numpy(wav), 24000)
```