ChatTTS

不活跃
GitHub Python AGPL-3.0

简介

面向日常对话的生成式语音模型,为 AI Agent 提供自然流畅的语音合成能力,支持细粒度韵律控制。

核心特性

  • 对话式语音合成 — 针对 LLM 助手等对话场景优化,支持自然表达的语音合成
  • 细粒度韵律控制 — 预测和控制笑声、停顿、语气词等细微韵律特征
  • 多说话人支持 — 采样随机说话人音色,支持多角色对话场景
  • 流式音频生成 — 支持实时流式语音输出
  • 中英文支持 — 基于 10 万+小时中英文音频数据训练
  • WebUI 和命令行 — 提供 Web 界面和命令行两种使用方式

适用场景

💡 为 AI 对话助手添加自然的语音回复能力
💡 生成播客或有声读物的多角色语音内容
💡 在语音消息应用中集成 TTS 功能
💡 为无障碍应用提供文本转语音支持
💡 构建交互式语音 IVR 系统

快速开始

```bash
pip install ChatTTS
```
```python
import ChatTTS
import torch
import torchaudio

chat = ChatTTS.Chat()
chat.load(compile=False)

texts = ["你好,我是 ChatTTS。", "今天天气真不错。"]
wavs = chat.infer(texts)

for i, wav in enumerate(wavs):
    torchaudio.save(f"output{i}.wav", torch.from_numpy(wav), 24000)
```

相关项目