ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

ChatTTS-ui:本地语音合成部署与API集成实战指南

ChatTTS-ui:本地语音合成部署与API集成实战指南 ChatTTS-ui本地语音合成部署与API集成实战指南【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui按条购买在线语音合成TTS接口的生成额度时费用和数据隐私都要权衡。ChatTTS-ui 是一款免费开源的本地语音合成服务它把 ChatTTS 模型包进一个 Web 页面输入文本即可生成语音同时对外暴露 /tts 接口。整个流程在自己机器上运行文本不出设备。 本地语音合成快速启动源码、容器与Windows预打包版主路径是源码部署Linux 下共五步macOS 相同先执行brew install libsndfile即可git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui.git cd ChatTTS-ui python3 -m venv venv source venv/bin/activate pip install -r requirements.txt python3 app.py首次启动会自动下载 ChatTTS 模型约 2GB浏览器自动打开 http://127.0.0.1:9966。容器部署则指定 gpu 或 cpu 的 compose 文件docker compose -f docker-compose.gpu.yaml up -dWindows 用户可直接用发布版中的预打包 app.exe双击启动体验与源码部署一致。 ChatTTS-ui 能力全景与关键参数说明模块内容解决什么问题Web 界面输入文本、选音色、生成 WAV浏览器直接使用无需编程REST APIPOST /tts返回带音频路径与下载地址的 JSON程序化批量配音、嵌入现有系统音色体系speaker/ 目录预设音色文件或按数值取随机音色不克隆音频也有多种音色文本预处理中英数字混合输入、数字自动转读、中文规范化混合文本直接可读控制符prompt 指定口气、笑声、停顿语气更自然参数不必逐个记真正常用的是三个voice / custom_voice音色编号如 2222或自定义种子种子决定音色temperature0.1–1.0控制韵律变化幅度prompt如[oral_2][laugh_0][break_6]控制口气、笑声与停顿时长 场景实演网页配音与API批量调用网页批量配音输入文案分几行贴进文本框一行对应一段音频。操作选择音色 2222点击生成。输出WAV 存入 static/wavs/ 目录浏览器里直接试听也可下载进剪辑软件。API 接入自有服务需要批量配音时从自己的脚本直接调用import requests res requests.post(http://127.0.0.1:9966/tts, data{ text: 明天上午十点会议室见请带好相关资料。, voice: 2222, temperature: 0.3 }) print(res.json())成功返回 code 0audio_files 含 wav 路径与下载网址失败返回 code 1msg 给出原因。 高频报错排查与调优模型下载报代理错误ProxyError现象是首次启动 https 连接报错原因是从 modelscope 拉取模型时走了代理解法是关闭代理重试能直连 huggingface 时程序会自动换源。GPU 未生效、跑在 CPU 上现象是有英伟达显卡仍走 CPU原因是显存不足 4GB或未安装 CUDA 版 torch要求 CUDA 12.8解法是装好工具包后重装 cu128 版 torch。Python 3.12 报 Dynamo is not supported现象是启动 app.py 即报此错原因是仅支持 Python 3.9–3.11解法是改用 3.10 环境重跑。报 Missing spk_stat.pt现象是启动提示缺少该文件原因是模型文件不完整解法是手动把文件放入 models/pzc163/chatTTS/asset 目录。CPU 推理偏慢现象是长文本等待时间长资源紧张时可传skip_refine1跳过文本精修refine阶段用少量质量换速度。 目录结构组织与二次开发扩展点ChatTTS/ 是模型核心gpt.py 是语言模型dvae.py 是声码器vocodermodel/velocity/ 是推理引擎。app.py 加 templates/ 构成 Flask 服务与页面新接口写在 /tts 路由旁speaker/ 放入新音色 CSV/PT 即可在页面直接选用中文规范化规则在 uilib/zh_normalization/.env 控制地址、设备与编译开关多数调整不动代码。上手前建议先通读 faq.md仓库更新较频繁值得持续关注变化。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表