资讯动态

ChatTTS-ui 本地语音合成实战:3 条部署路径、音色种子与 /tts 接口全拆解

发布时间:2026/9/20 22:01:40 来源:尧图企业网站定制
ChatTTS-ui 本地语音合成实战3 条部署路径、音色种子与 /tts 接口全拆解【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-uiChatTTS-ui 是一个本地部署的语音合成工具内置 ChatTTS 模型提供网页界面和 /tts 接口文字转语音全程离线运行适合不想把文本交给第三方接口的内容创作者以及想给自有程序接配音能力的开发者。一、先把服务跑起来按你的情况选一条路新手Windows 预打包版从项目 Releases 下载压缩包解压后双击app.exe即可。首次运行会自动拉取模型约 2GB之后浏览器会直接打开操作页默认地址http://127.0.0.1:9966。个别安全软件会对预编译包误报遇到这种情况就换下面的方式。服务器环境Docker 容器git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui cd ChatTTS-ui docker compose -f docker-compose.gpu.yaml up -d # 无独显就改用 docker-compose.cpu.yaml容器启动后访问服务器 IP 的 9966 端口日志里出现启动:[0.0.0.0, 9966]即部署完成。GPU 版本基于Dockerfile.gpu构建需要宿主机装好 NVIDIA 驱动。想改代码源码部署Python 版本限定 3.9~3.11不支持 3.12 及以上。建好 venv 后执行pip install -r requirements.txt再按 requirements.txt 安装对应平台、对应 CUDA 版本的 torch最后python3 app.py启动。模型默认从阿里魔塔下载连通 huggingface 则改走 huggingface两边都不需要走代理。二、核心玩法实测从输入到产物的完整过程网页合成。在文本框里粘贴文案中英数字混杂可以直接写界面有中英分词选项选中后中文和英文被拆开分别合成数字按目标语言读出来123 在中文语境读作一二三。选一个音色点生成产物是 24kHz 的 WAV落在static/wavs/页面上可以直接试听、下载。固定音色。speaker/目录里存放的 csv 文件就是可用音色界面下拉框会列出它们。想要一个自己的声音在高级选项里填一个自定义音色值系统据此合成出音色并回存到speaker/目录之后在 API 里用custom_voice传同一个值就能锁定这个音色。情感标签。文本里插入[laugh_0]、[break_2]、[emph_1]这类控制符分别对应笑声、停顿、强调它们会被拼进合成 prompt 里出来的语音会带着对应表现不用后期再剪。/tts 接口。这是程序对接的入口POST 到/tts传text、voice、prompt、temperature默认 0.3、top_p默认 0.7、top_k默认 20等参数返回 JSON里面带 WAV 绝对路径和可下载的 URL。接口同时兼容 pyVideoTrans 的调用格式视频翻译工具可以直接把它挂进去做配音。三、真实用法举例做视频的人最省事的流程每集文案直接 POST 给/tts固定 voice 值保持全剧配音统一需要停顿或强调的位置写进[break_2]、[emph_1]批量出片不用反复进录音棚。做课件的老师挑一个音色存成固定值整门课的音频用同一嗓子讲句中用[break_2]留出思考停顿生成后导出 WAV 即可嵌入 PPT 或课程平台。无障碍阅读场景把文档文本直接交给本地服务转成音频内容只在本机流转不经过任何外部接口涉及隐私的素材也能放心处理。四、避坑指南现象首次启动卡在模型下载或报 ProxyError。原因模型源按网络环境分流——大陆 IP 直连走阿里魔塔国外 IP 走 huggingface开代理反而会让两边都不通。解法关掉代理重试若启动时报Missing spk_stat.pt或path.yaml缺失说明模型包不完整手动补齐对应文件到models/pzc163/chatTTS/下。现象显卡显存大于 4G实际却在用 CPU 跑。原因装的是 CPU 版 torch显存低于 4G 时项目也会强制走 CPU。解法先pip uninstall torch torchaudio再从 cu128 源重装 GPU 版 torch并确认系统装了 CUDA 11.8 及以上。现象同一个 seed音色对不上。原因ChatTTS 按 seed 采样音色向量采样本身带随机性不同设备、甚至同一设备多次运行都可能偏。解法别依赖 seed 跨环境复现把满意的音色存成.pt文件放进speaker/以后直接加载文件。现象启动直接抛Dynamo is not supported on Python 3.12。原因torch 编译优化不支持 3.12。解法降到 Python 3.10 左右重建环境macOS 上额外brew install libsndfile否则 soundfile 装不上。不想把文本交给第三方 API 的创作者、需要长期稳定配音服务的开发者这套东西能直接顶上。部署细节以仓库 README 为准报错和离线部署方法都整理在 faq.md 里改端口、绑定设备则编辑根目录的.env调整WEB_ADDRESS和device两项即可。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考

读完文章,也想定制专属网站?

尧图设计师 24 小时内与您沟通定制方案

免费获取报价