ARTICLE DETAIL

资讯详情

深耕郑州网站建设与运营推广的一线实战洞察。

ChatTTS-ui 本地语音合成部署完全教程:从网页界面到 API 使用

ChatTTS-ui 本地语音合成部署完全教程:从网页界面到 API 使用 ChatTTS-ui 本地语音合成部署完全教程从网页界面到 API 使用【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui写视频口播稿、念长文档时在线语音合成服务存在按次计费、文本要上传到别人服务器的问题。ChatTTS-ui 是一个开源的本地语音合成工具它在你自己的电脑上运行 ChatTTS 语音模型处理全部在本地完成可以免费生成语音。它同时提供网页操作界面和 RESTful API标准的 HTTP 请求接口既适合手动操作也适合程序调用。快速上手预打包版部署Windows 三步跑起来从项目 Releases 页下载预打包压缩文件解压后双击 app.exe。首次启动会自动下载模型文件等待下载完成即可。浏览器自动打开操作页默认地址为 127.0.0.1:9966。英伟达显卡显存大于 4G 且安装 CUDA 12.8 时会自动启用 GPU 加速。Docker 部署两条命令拉起服务克隆仓库git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui进入项目目录用 docker compose 指定对应配置文件CPU 版或 GPU 版后台启动。浏览器访问部署设备的 IP:9966本机即 127.0.0.1:9966局域网内可用服务器内网地址访问。源码部署四步从零安装安装 Python 3.9–3.11不支持更高版本和 Git把仓库克隆到一个空目录。执行python -m venv venv创建虚拟环境并激活。用pip install -r requirements.txt安装依赖需要 GPU 加速时再安装 CUDA 版的 torch 2.7.1要求 CUDA 12.8。运行python app.py浏览器自动打开默认地址 127.0.0.1:9966。功能速览中英混杂文本文本规整与中英分词界面接受中文、英文和数字混杂的输入由 uilib/zh_normalization/ 模块完成数字、符号等内容的规整。直接输入文字、选择音色即可生成勾选中英分词后中英文会拆开分别合成数字按对应语言读出。适合直接粘贴文案、字幕批量出片的人。生成更稳的音色三个可调参数temperature 控制语音多样性top_p 和 top_k 控制采样的随机范围prompt 还能加入 [laugh_0]笑声、[break_6]停顿这类控制符。默认值为 temperature 0.3、top_p 0.7、top_k 20音色偏单调时调高 temperature波动太大时调低。适合对音色稳定性有要求的场景。音色复用预设音色库与自定义音色种子speaker/ 目录自带一批预设音色0.92 版本起还支持把 csv 或 pt 格式的音色文件放入该目录长期使用。在页面选择音色值或设置 custom_voice 参数为正整数种子可获得可重复生成的自定义音色。适合需要固定播音声线的批量内容。适用场景视频与音频内容制作把口播稿快速转成配音生成的音频文件保存在本地可直接导入剪辑软件。个性化阅读与无障碍辅助为视障或有朗读需求的用户调整音色与参数内容不离开本地环境。程序集成与批处理通过 API 接口现有系统或脚本可批量生成语音并自定义参数。排障与调优模型下载卡住、报 proxy 类错误模型下载默认走国内模型社区关闭代理后重试仍连不上时按提示切换镜像源。GPU 加速不生效需要英伟达显卡、显存大于 4G 且安装 CUDA 12.8源码部署仍走 CPU 时卸载后重装 CUDA 版 torch显存不足 4G 会回退到 CPU。模型文件缺失重新下载模型或手动把缺失文件补进模型目录各报错的详细解答见常见问题。进阶用法批量调用或接入第三方系统时直接请求 /tts 接口POST地址 127.0.0.1:9966/ttsimport requests res requests.post(http://127.0.0.1:9966/tts, data{ text: 你好这是本地语音合成, voice: 2222, temperature: 0.3 }) print(res.json())返回为 JSON成功时 code 为 0audio_files 中带有 wav 文件路径和下载地址voice 填音色编号不填则使用默认音色。如果需要一个不依赖云端的本地语音合成方案可以选择 ChatTTS-ui。后续的新功能与修复建议定期查看项目更新日志。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表