ChatTTS-ui 本地部署实操:从克隆仓库到生成第一段语音
【免费下载链接】ChatTTS-ui一个简单的本地网页界面,使用ChatTTS将文字合成为语音,同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui
ChatTTS-ui 是一个基于 ChatTTS 的本地网页界面,在浏览器里输入文字即可合成语音,同时对外提供 API 接口。它解决的是一个具体痛点:文字转语音全程在自己电脑上完成,文本无需上传任何在线服务。读完本文,你能在本地完成 ChatTTS-ui 的部署,并生成第一段中文语音。
🚀 最快速手:5 步完成本地部署
对新手最省事的路径是源码部署,共 5 步:
- 克隆仓库到任一空目录
- 创建并激活虚拟环境(需要 Python 3.9–3.11)
- 安装依赖
- 启动程序,首次运行会自动下载模型,耗时较长,完成后浏览器自动打开
- 在 http://127.0.0.1:9966 页面输入文字,点击生成
git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui chat-tts-ui cd chat-tts-ui python -m venv venv source venv/bin/activate pip install -r requirements.txt python app.py服务器场景用仓库根目录的 docker-compose.cpu.yaml 或 docker-compose.gpu.yaml 一条 Docker 命令即可拉起,无需手动配环境。
🎙️ 它能帮你做什么
把文案转成配音音频
打开网页输入文案,选择 2222、7869、4099 等预设音色值之一,即可得到音频文件。它支持中英文和数字混杂的文本,数字会自动转成对应读法,生成的音频保存在本地,可直接下载用于视频剪辑。
给现有系统加语音输出
服务内置 /tts 接口,自己的脚本或工具发一次 POST 请求就能拿到可下载的 wav 地址:
curl -X POST http://127.0.0.1:9966/tts -d "text=你好&voice=2222"请求还可以指定 temperature、top_p、top_k、语速,并插入笑声、停顿等控制符,适合批量生成配音。
固定一个音色长期使用
默认情况下同一个音色值每次都会随机生成不同音色。把一个固定音色文件(csv 或 pt 格式)放进speaker/文件夹,之后选中对应音色值,输出音色就保持一致,适合固定主播角色。
⚙️ 实际用会碰到什么:常见问题与解决
下载模型时报代理错误模型默认从 modelscope 下载,该下载不允许开代理。关闭系统代理,重新运行python app.py即可。
GPU 不生效,仍在 CPU 上跑原因是 pip 默认装的是 CPU 版 torch,或显存不足 4G 会被强制走 CPU。显存 4G 以上的英伟达显卡,执行pip uninstall -y torch torchaudio后重装 CUDA 版pip install torch==2.7.1 torchaudio==2.7.1 --index-url https://download.pytorch.org/whl/cu128,且机器需已装 CUDA 12.8+ Toolkit。
报错 Missing spk_stat.pt 或 path.yaml原因是模型下载中断,文件不完整。去 ModelScope 的 pzc163/chatTTS 模型页下载缺失文件,复制到models/pzc163/chatTTS/目录下(spk_stat.pt 放进asset子目录)。
报 triton 错误 cannot find a working triton installation原因是 torch.compile 与当前环境不兼容。把项目根目录.env文件里的compile=true改为compile=false,再重新python app.py启动。
👥 适合谁,不适合谁
适合:需要批量生成中文配音、又不想把文案交给在线服务的个人创作者;希望用几行代码给自己的工具加语音输出的开发者。
不适合:追求多语种混合播报的用户,该模型以中文(含中英混杂)为主,其他语种支持有限。
📌 接下来可以做的
- 阅读 faq.md 查看其余常见报错与解决办法
- 阅读 README.md 中 /tts 接口的完整参数说明
- 多试几种音色值、温度与语速组合,对比哪种配出的声音最自然
【免费下载链接】ChatTTS-ui一个简单的本地网页界面,使用ChatTTS将文字合成为语音,同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui
创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考