尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

ChatTTS-ui 本地语音合成:三条部署路径,5分钟从文字到语音

ChatTTS-ui 本地语音合成:三条部署路径,5分钟从文字到语音 ChatTTS-ui 本地语音合成三条部署路径5分钟从文字到语音【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui给短视频批量做旁白不想按量付 API 费ChatTTS-ui 是一个本地部署的语音合成工具网页输入文字直接产出 wav 文件。模型跑在你自己的机器上生成次数不设限数据不出本机。 项目速览本地语音合成能干什么合成全程在本机完成文本不经过任何外部服务器模型下载一次之后生成不收任何费用模型就位后即可断网使用笔记本、办公机都能跑中英文、数字混排可直接输入内置/tts接口供程序调用 选一条部署路径Windows一键安装 / Docker部署 / 源码安装新手Windows一键安装从项目 Releases 下载预打包版解压。双击app.exe首次启动自动下载模型浏览器随即打开。个别安全软件可能误报忽略即可或改用源码方式。服务器用户Docker容器部署git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui.git chat-tts-ui cd chat-tts-ui docker compose -f docker-compose.cpu.yaml up -d容器自动构建并监听 9966 端口。本机访问127.0.0.1:9966局域网用服务器 IP 即可。有 NVIDIA 显卡可换docker-compose.gpu.yaml用docker compose logs -f跟踪启动日志。开发者Linux / macOS 源码安装git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui.git chat-tts-ui cd chat-tts-ui python3 -m venv venv source venv/bin/activate pip3 install -r requirements.txt python3 app.py注意两点Python 用 3.9-3.113.12 会报 Dynamo 错误首次下载模型默认走魔塔 modelscope期间关闭代理否则会报 proxy 类错误。 首次使用从输入到出音启动后浏览器自动打开http://127.0.0.1:9966。操作顺序固定输入文本 → 选音色 → 调参数 → 点合成。中英数字混排可直接粘贴系统按语言分行处理数字会自动转成对应语言的读法。生成的 wav 保存在static/wavs/目录文件名带时间戳和本次参数方便回溯。三个关键参数及其默认值参数作用推荐值temperature控制语音多样性0.1-1.0默认 0.3top_p影响语音质量0.5-1.0默认 0.7top_k优化生成效果10-50默认 20音色编号对应speaker/目录里的 csv 文件挑 3 个常用的2222沉稳商务风适合正式场合7869活泼青春感适合娱乐内容4099温柔亲和适合教育场景 三类高频使用场景内容创作短视频、播客作者把文案贴进界面几分钟拿到整段旁白wav 文件拖进剪辑软件就是成片配音。长脚本分段输入单段控制在 50 字内拼接后停顿更自然。无障碍辅助为视障读者提供本地文本转语音把网页或书本文字粘进来换音色、调语速听感比默认音色的机械感好不少且内容不经过第三方。开发集成业务系统通过/tts接口调用传 text、voice 等参数拿回音频文件路径和下载地址。批量任务在程序里循环请求即可无需额外中间件。❓ 高频问题速答模型下载失败多为代理拦截。关闭代理重跑魔塔源缺个别文件时手动补到models/pzc163/chatTTS/对应目录。GPU加速不生效需 NVIDIA 显卡、显存大于 4G 且装好 CUDA 12.8。显存不足 4G 会强制回退 CPU装了 CUDA 版 torch 仍无效时先卸载 torch 再重装。启动报错怎么办Python 3.12 不兼容降到 3.10 或 3.11报 triton 缺失时把.env里compile改成false。断网能用吗模型会缓存在本地models/目录下载完整跑通一次后启动不再依赖网络。同一个音色值两次声音不一样相同种子在不同机器、甚至同一台机器上合成的音色会有差异音调尤其明显。要固定音色把 csv 或 pt 文件存进speaker/目录即可。⚡ 提速与进阶性能上记住三件事NVIDIA 显卡显存大于 4G 并配好 CUDA 12.8 后GPU 加速自动启用速度提升 3-5 倍显存低于 4G 会被强制切到 CPU。长文本建议分段合成每段 50 字以内效果比一次塞整篇更稳。首次下载的模型缓存在models/目录之后启动直接复用不再走网络。进阶玩法custom_voice参数传一个大于 0 的整数作为种子同一种子能稳定得到同一音色方便音色复用试听满意后可把该音色存成 csv/pt 放进speaker/目录长期保存。接口侧prompt支持[laugh_0]、[break_6]这类控制符来插入笑声和停顿。API 调用长这样import requests r requests.post(http://127.0.0.1:9966/tts, data{ text: 你好这是本地合成的语音, voice: 2222, temperature: 0.3 }) print(r.json())返回code: 0即成功audio_files里给出 wav 文件路径与下载链接。本地部署一次之后生成不再产生任何费用。挑一条部署路径把服务跑起来再花五分钟走一遍输入到出音的流程跑通后把127.0.0.1:9966配进你的业务直接调用/tts。后续留意项目更新日志新音色格式和性能优化会持续放出。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表