尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

Duix.Avatar 免费AI数字人本地部署教程:10秒视频生成口播视频

发布时间:2026/9/11 17:24:53

资讯中心
01
ARTICLE

Duix.Avatar 免费AI数字人本地部署教程:10秒视频生成口播视频

Duix.Avatar 免费AI数字人本地部署教程:10秒视频生成口播视频
Duix.Avatar 免费AI数字人本地部署教程10秒视频生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar 是一款免费开源的 AI 数字人本地部署工具。上传一段 10 秒左右的说话视频就能同时克隆你的形象和声音之后直接输入文案即可自动生成口播视频全程离线运行素材和模型都不离开你自己的电脑。我朋友之前做 5 条宣传视频被报价三万用这套方案后成本只剩电费所以想把我踩过的坑一次讲清楚。一段10秒视频这套工具能做到什么Duix.Avatar 支持 Windows 和 Ubuntu 22.04 两种系统定位是一个全离线视频合成工具核心能力可以归纳为四点外貌 声音双重克隆从视频中提取五官、面部轮廓等特征建立虚拟模型同时克隆声音的语调、语速等细节文字或语音驱动输入文案会自动转成语音驱动数字人也可以直接上传音频文件口型自动对齐合成时视频画面与声音高度同步唇形匹配由模型自动完成多语言文案支持英语、日语、韩语、中文、法语、德语、阿拉伯语、西班牙语共 8 种语言客户端界面就是两个入口Create Video 生成视频、Create Avatar 创建数字人模型作品统一放在 My Works 列表里管理。界面背后跑着三个本地服务分工很清晰guiji2025/fun-asr语音识别把声音转成文本guiji2025/fish-speech-ziming语音合成把文本转成你的克隆音色guiji2025/duix.avatar视频合成引擎负责最终的画面与口型合成客户端如何调用这三个服务可以直接看 src/main/service/ 目录下的 model.js、video.js 和 voice.js。部署前硬件检查清单你的电脑能不能跑这个项目所有算力都在本地硬件不达标时三个服务根本起不来所以这一步值得先做项目要求系统Windows 1019042.1526 及以上或 Ubuntu 22.04其他 Linux 版本官方未做兼容测试显卡必须有 NVIDIA 显卡且驱动正常跑一下nvidia-smi能显示显卡信息就算通过内存建议 32G 及以上16G 可能连语音识别服务都启动不了磁盘镜像需要 100G 以上空闲空间Windows 用户还要留 30G 给 D 盘存模型和作品推荐配置i5-13400F / 32G 内存 / RTX 4070官方实测组合两个容易忽略的点提前说C 盘会爆Docker 默认把镜像存在系统盘。如果 C 盘余量不足 100G装完 Docker 后可以在设置里把镜像存储目录挪到别的盘不然后面下载 70G 镜像会直接占满。50 系显卡5090 用户以及装了 CUDA 12.8 的 30/40 系用户要换用专门的服务端配置文件deploy/docker-compose-5090.yml它基于 PyTorch 预览版构建。30分钟一键部署装好服务端与客户端Windows先备好 WSL 和 Docker在 PowerShell 里依次确认执行wsl --list --verbose查看 WSL 是否已安装没有就运行wsl --install再用wsl --update更新到新版到 Docker 官网下载 Docker Desktop按 CPU 架构选安装包首次启动时接受协议、跳过登录即可启动三个服务端git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar/deploy docker-compose up -d这条命令会开始拉取镜像大约消耗 70G 流量耗时半小时左右建议连 WiFi 后放着跑。Docker 里看到三个服务都是 Running 状态就算成功了。另外还有个精简版执行docker-compose -f docker-compose-lite.yml up -d只跑一个Duix.Avatar-gen-video服务。如果镜像一直下载失败多半是网络到 Docker Hub 不稳定在 Docker Engine 设置里加一组国内镜像源再 Apply restart 就能解决Ubuntu 用户用sudo apt update加sudo apt install docker.io docker-compose装好 Docker然后照 deploy/docker-compose-linux.yml 启动docker-compose -f docker-compose-linux.yml up -d。区别在于还要额外装 NVIDIA Container Toolkit 并执行sudo nvidia-ctk runtime configure --runtimedocker完整命令在 README_zh.md 的 Ubuntu 安装章节里。安装客户端Windows从项目发布页下载安装包双击Duix.Avatar-x.x.x-setup.exe装好Ubuntu下载 Linux 版后双击Duix.Avatar-x.x.x.AppImage直接启动如果 root 用户双击没反应在终端里加--no-sandbox参数运行跑通第一次克隆自己并生成口播视频素材是关键变量拍之前对照这三点时长 10~20 秒太短提取不到足够特征太长白等必须有人声视频里要清晰地在说话程序要用这段声音做声音克隆纯无声视频会直接报错正面 光线充足背景尽量简洁方便面部特征识别操作流程只有三步点 Create Avatar 上传视频系统自动分析并建立模型通常需要几分钟在 My Avatars 里选中刚建好的模型输入文案8 种语言都支持或上传一段音频点生成完成后视频出现在 My Works 里如果你想像流水线一样批量出片也可以绕开界面直接调 API语音合成在http://127.0.0.1:18180视频合成提交任务是http://127.0.0.1:8383/easy/submit进度查询是http://127.0.0.1:8383/easy/query参数结构参考 src/main/service/video.js。故障排查清单本地部署常见卡点社区总结过一套提问前的自查顺序照着过一遍能解决大部分问题三个服务是否全部 Running缺一个都跑不通显卡驱动是否生效nvidia-smi无输出就直接排除在软件问题之外客户端和服务端是否都是最新版这个项目更新很频繁很多问题在新版里已经修掉了几个高频卡点的处理方式克隆时报Connection refused服务端刚启动时语音识别服务还在预热等几分钟再操作即可内存只有 16G 时也会出现这种启动慢创建模型失败回头检查视频是否带人声这是最高频的失败原因视频生成中途卡住客户端右上角设置菜单里有 Open Log能看到本地日志服务端的问题则点进 Docker 里对应的服务把 Logs 面板的报错复制出来更多案例整理在 doc/常见问题.md 里。最后留三个动作照着做就能跑起来先执行nvidia-smi确认显卡驱动就绪在 deploy 目录跑一次docker-compose up -d等镜像下载的半小时里准备好一段 10~20 秒的说话视频三个服务变绿后打开客户端点 Create Avatar 建出你的第一个模型【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。