尧图网络科技YAOTU DIGITAL 获取报价
获取报价
首页 / 资讯中心 / 文章详情

Duix.Avatar 完整指南:离线克隆数字人形象与声音,零成本生成口播视频

发布时间:2026/9/11 2:47:43

资讯中心
01
ARTICLE

Duix.Avatar 完整指南:离线克隆数字人形象与声音,零成本生成口播视频

Duix.Avatar 完整指南:离线克隆数字人形象与声音,零成本生成口播视频
Duix.Avatar 完整指南离线克隆数字人形象与声音零成本生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar录一条 1 分钟的口播视频要化妆、布光、录音、剪辑半天Duix.Avatar 是一个完全开源、可离线运行的 AI 数字人工具箱用一段真人视频就能克隆你的形象和声音之后只需输入文字就能产出说话视频全程不联网三个服务跑在一块 NVIDIA 显卡上即可。一分钟读懂Duix.Avatar 能做什么它解决的是一件事把你的形象和声音变成一台 7x24 小时在线的数字分身你用文字或语音驱动它说话它自动生成口型对齐的视频。适合谁内容创作者不想反复出镜用文字批量产出口播视频企业团队需要内部培训、课程录制数据不能上云开发者想拿一套开源 API 做自己的数字人产品。关键数据官方把数字人制作成本从传统 3D 方案的高额投入压到约 1000 美元级别并已支撑 1 万 企业、50 万个个性化形象脚本支持中、英、日、韩、法、德、阿、西 8 种语言。核心机制拆解一段视频如何变成你的数字人整个仓库是桌面客户端 三个本地 AI 服务的结构代码入口在 src/main/。声音克隆让 TTS 服务学会你的嗓音打个比方就像给配音演员做嗓音采样。你上传的视频里有人声客户端先用 ffmpeg 把音轨抽出来见 src/main/util/ffmpeg.js再通过127.0.0.1:18180/v1/invoke交给 fish-speech 语音克隆服务生成一个专属说话人。之后任何文字都能用你的声音念出来。相关调用封装在 src/main/service/voice.js 和 src/main/api/tts.js。形象克隆从一条视频拆出脸 声打个比方像把一枚硬币扫成 3D 存档。你在客户端新建 Avatar 时src/main/service/model.js 会先把原视频统一转成 H.264再用 ffmpeg 分离出无声视频和 wav 音频前者交给 face2face 视频服务做人脸建模后者走上一条的语音克隆流程最后把两条产物的 ID 一起写进本地 SQLite 数据库src/main/dao/。视频合成文字怎么变成口型对齐的视频打个比方文字先变成你的声音声音再驱动你的脸张嘴。src/main/service/video.js 负责编排整个流水线文字 → 本地 TTS 生成音频 → 调127.0.0.1:8383/easy/submit提交视频合成任务 → 轮询进度直到完成。任务状态存在本地数据库即使中途重启src/main/interval/interval.js 的定时轮询也会把没跑完的任务续上。横向对比本地部署 vs 在线 API 数字人维度在线 API 数字人Duix.Avatar 本地部署网络依赖必须联网数据出内网完全离线素材不离开本机硬件要求无买算力即可需 NVIDIA 显卡推荐 RTX 4070 / 32G 内存定制化只能用对方接口改不了算法源码全开放可改模型、换 TTS、扩展 API成本结构按调用量付费长期成本高一次部署长期使用零调用费用商业授权随服务付费支持全球免费商用超大规模企业需签商业授权结论很直接数据敏感或长期高频使用本地部署的总成本优势明显只是临时尝鲜在线 API 更快。从 0 到 15 步生成第一条数字人视频以 Windows 为例Ubuntu 22.04 流程类似配置见 deploy/ 目录下的多个 docker-compose 文件。装好 Node.js 18 和 Docker DesktopWSL2确认nvidia-smi能显示显卡信息拉取三个镜像guiji2025/fun-asr、guiji2025/fish-speech-ziming、guiji2025/duix.avatar进入deploy目录执行docker-compose up -d首次下载约 70GB 流量耐心等待约半小时看到 3 个服务全部 Running 即部署成功安装 Electron 桌面客户端并登录本机服务上传 1 段正面真人视频新建 Avatar训练形象与声音再进Create Video输入文字等待合成即可导出视频。想自己改代码跑客户端先克隆仓库git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar然后npm install npm run dev。本地部署的 5 个常见坑与正确做法**误区没有 NVIDIA 显卡也硬装服务起不来。**正确做法三个服务全部依赖 GPU 计算部署前先跑nvidia-smi确认驱动正常这是官方 FAQ 的第一自检项。**误区把服务跑在 C 盘空间不足。**正确做法Windows 下 D 盘预留 30GB 存数字人数据、C 盘预留 100GB 存镜像Docker 数据目录可手动改到其他盘。**误区客户端报错就重装。**正确做法先按 doc/常见问题.md 的模板取日志——客户端日志在设置面板可导出服务端日志看对应容器的 Logs 页再对照 Issues 提问。**误区客户端和服务器版本不一致。**正确做法项目更新频繁遇到先升再查——服务端在deploy目录重跑docker-compose up -d客户端拉最新代码重新 build。**误区50 系显卡直接用旧版 compose 文件。**正确做法5090 等 50 系 GPU 要用官方 PyTorch 预览版方案对应deploy/docker-compose-5090.yml30/40 系搭配 CUDA 12.8 也可用。谁适合用接下来会发生什么适合有两类人要零成本批量产出口播视频的创作者以及素材不能上云、要掌控全链路的技术团队。接下来可以关注三件事客户端已支持 Ubuntu 22.04 桌面版并加入英文界面跨平台覆盖在扩大50 系显卡适配已完成硬件门槛继续下探模型训练与视频合成均已暴露本地 HTTP API127.0.0.1:8383/:18180方便把它嵌进自己的业务系统。Duix.Avatar 把数字人克隆从买服务变成装软件开源、离线、全链路可控。装好它你的第一条口播视频只需要一段文字。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
02
RELATED NEWS

相关资讯

更多网站建设与数字化升级内容

03
WHY YAOTU

想打造同款高转化官网?

懂行业、懂生意,从建站到增长一站式陪跑

场景化定制

不做模板站,围绕你的业务场景量身设计,小众不撞款。

营销型架构

以转化目标组织内容与路径,让官网真正带来询盘。

全周期服务

设计、开发、运营、运维一体,上线只是开始。

免费获取你的建站方案

留下需求,专属顾问 24 小时内为你输出方案建议。