尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

ChatTTS-ui 离线部署完整指南:没有网,也能 7×24 小时把文字变语音

发布时间:2026/9/20 6:52:12

资讯中心
01
ARTICLE

ChatTTS-ui 离线部署完整指南:没有网,也能 7×24 小时把文字变语音

ChatTTS-ui 离线部署完整指南:没有网,也能 7×24 小时把文字变语音
ChatTTS-ui 离线部署完整指南没有网也能 7×24 小时把文字变语音【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-uiChatTTS-ui 是一款把文字合成为语音的工具自带网页界面也对外提供 API 接口。本文讲它的离线部署方案在完全断网的机器上不依赖任何外部下载就能稳定跑起本地语音合成。一、先想清楚什么情况必须离线不是所有部署都需要离线但下面这类场景联网方案要么跑不起来、要么有隐患内网隔离的产线与机房服务器被防火墙圈在里面装模型、拉依赖时根本连不出外网只能靠 U 盘或内网介质搬运。️外场与弱网环境野外作业、车载设备、信号不稳的区域网络时断时续。一旦卡在首次下载模型这一步整个功能就废了。合规与安全要求涉密或审计场景明确要求数据与计算不出内网连顺手连一次外网都不被允许。这三种情况的共同点是网络不可靠或被禁止。所以正确的思路不是断网时再想办法而是把整套运行所需的东西一次性备齐让程序在本地自给自足。二、原理速览离线到底是怎么跑起来的一句话概括只要本地模型文件齐了程序启动时就地加载从头到尾不碰网络。拆开看整个过程只有四步全部发生在本机文本进来你在网页或 API 里提交一段文字。本地分词程序用自带的分词器把文字切好、做同音字归一不需要联网查词。模型推理GPT 主干 声码器在本地把文本算成音频波形。音频输出生成 wav 文件网页直接播放API 返回下载地址。它和在线模式唯一的差别就卡在模型从哪儿来。在线模式首次启动会去下载模型离线模式则是你提前把模型放好程序发现本地已有就跳过下载。理解了这点后面所有操作其实都是围绕把模型和依赖搬到本地这一件事。三、动手前自检一份可勾选的清单 动手之前先把这几项核对一遍能省下后面大量返工。环境类Python 版本在3.9 3.11之间不支持 3.12 及以上否则推理加速会报错磁盘剩余空间 ≥ 5 GB模型 依赖 运行目录内存 ≥ 8 GB有 NVIDIA 显卡且显存 ≥ 4 GB 可启用 GPU 加速否则强制走 CPU若用 GPU已装好CUDA 12.8工具包文件完整性类源码已就位见下文 clone 步骤模型目录models/pzc163/chatTTS/完整里面应包含asset/与config/两个子目录asset/下关键文件一个不缺Vocos.safetensors、DVAE.safetensors、Decoder.safetensors、Embed.safetensors、gpt/、tokenizer/目录以及spk_stat.ptconfig/path.yaml存在缺它启动会直接报FileNotFoundError网络类针对准备模型的那台联网机器用于下载模型的机器能连外网且下载 modelscope 时已关闭代理代理会导致下载失败说明spk_stat.pt容易被漏掉——部分模型源里没有这个文件而它在随机取音色时被读取。缺失时建议单独补一份放到asset/目录。四、部署全流程下载 → 放置 → 配置 → 启动整个流程分四段代码块都尽量精简能用白话说清的就用白话。第 1 步获取源码在有网或有 git 可用的机器上把仓库克隆下来git clone https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui第 2 步准备离线模型与依赖这一段的目的是把联网才能拿到的东西搬齐。模型在有网机器上先跑一次项目或从模型仓库拉取 ChatTTS 模型让模型完整落到models/pzc163/chatTTS/。确认第三节的文件清单齐全后把整个models/pzc163/chatTTS/目录拷贝到离线机器的同一相对路径下。依赖在有网机器上生成依赖清单和离线包pip freeze requirements-offline.txt pip download -r requirements-offline.txt -d ./offline_packages把requirements-offline.txt和offline_packages/一起拷到离线机器再执行安装。注意pynini、WeTextProcessing、nemo_text_processing这几个包只有 Linux 需要Windows 环境会自动跳过pip install --no-index --find-links./offline_packages -r requirements-offline.txt白话解释--no-index --find-links告诉 pip别上网只从本地这个文件夹里找包这正是离线安装的关键。第 3 步本地化配置打开主程序 app.py把联网下载模型改为直接用本地路径。原代码会先尝试在线拉取离线模式下我们只保留本地加载即可核心是让模型目录固定指向本地CHATTTS_DIR MODEL_DIR /pzc163/chatTTS模型目录的相对关系由 uilib/cfg.py 统一管理其中MODEL_DIR就是项目根目录下的models。模型内部各文件的相对路径则定义在 ChatTTS/config/config.py一般无需改动。接着在根目录的.env里按需调整WEB_ADDRESS0.0.0.0:9966 # 想被局域网访问就改成内网 IP:端口 devicedefault # 可填 cpu / cuda / mps默认自动选 compiletrue # 若报 triton 相关错误改为 false把WEB_ADDRESS设为0.0.0.0:9966或某个内网 IP其他机器就能通过网络访问到这台语音合成服务。第 4 步启动python app.py启动成功后会自动尝试打开浏览器默认地址是http://127.0.0.1:9966。局域网内的其他设备则用你配置的 IP 加 9966 端口访问。五、上线验证三步确认真的能用 ✅不需要堆一堆测试表按这条最短路径验证即可打开网页浏览器访问http://127.0.0.1:9966局域网用对应 IP能正常打开界面说明 Web 服务已起。点一次合成随便输入一句中文点击合成。能听到声音、并能下载 wav说明模型加载与推理都通了。调一次接口用一条 curl 走 API确认程序化调用也 OKcurl -X POST http://127.0.0.1:9966/tts \ -d text离线合成自检 \ -d voice2222返回里出现code:0和一个可下载的 wav 地址即代表整条链路在离线状态下可用。若返回code:1看msg字段定位问题。六、排错速查症状 → 原因 → 解法 症状可能原因解法启动报FileNotFoundError: .../config/path.yaml模型目录不完整重新拷贝整个models/pzc163/chatTTS/确认config/与asset/都在报Missing spk_stat.pt模型源缺该文件单独补一份spk_stat.pt放进asset/Dynamo is not supported on Python 3.12Python 版本过高降到 3.10 再装cannot find a working triton installation编译加速不可用.env中compile改为false装了显卡却仍走 CPU、速度慢CUDA/torch 版本不匹配卸载后按 GPU 版重装 torch并确保 CUDA 12.8下载模型时ProxyError开了代理关闭代理modelscope 不允许走代理同一段文字音色每次都不一样随机种子机制使然固定text_seed与voice或改用固定.csv/.pt音色合成到一半崩溃内存/显存不足加内存或降低并发改走 CPU更细的报错对照可查项目自带的 常见问题清单。七、调优与运维一节约全 ️硬件配比按使用强度选个人使用8 GB 内存 4 核 CPU 即可企业内网16 GB 内存 8 核 CPU高并发32 GB 内存 独立 GPU显存 ≥ 4 GB 才会启用加速参数微调影响合成质量与速度的旋钮主要在 app.py 的/tts接口默认值里例如temperature随机性、top_p/top_k采样范围、speed语速、skip_refine是否跳过文本精修设为 1 可加快推理。新手建议先用默认值确认稳定后再逐项调。巡检与备份建议每月一次核对models/pzc163/chatTTS/关键文件是否完整必要时重新备份一份看一眼logs/下的运行日志留意是否有ERROR备份speaker/里的自定义音色和.env配置避免音色资产丢失把模型、依赖、配置这三样搬到位后ChatTTS-ui 就能在断网环境里长期、稳定地把文字转成语音不再受外网波动影响。【免费下载链接】ChatTTS-ui一个简单的本地网页界面使用ChatTTS将文字合成为语音同时支持对外提供API接口。A simple native web interface that uses ChatTTS to synthesize text into speech, along with support for external API interfaces.项目地址: https://gitcode.com/GitHub_Trending/ch/ChatTTS-ui创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。