
Duix.Avatar 本地数字人克隆完整指南10秒视频生成口播视频【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar给自媒体或产品讲解做数字人口播视频很多人的第一反应是上传到在线平台但把人脸视频和文案交给第三方并不安心。Duix.Avatar 解决的就是这件事把服务部署在自己的电脑上克隆出自己的数字人再把一段文案直接变成口型对齐的口播视频。整个过程本地运行视频和文案数据不出机器。它是什么全离线数字人克隆工具包Duix.Avatar 是 Duix.com 团队开源的数字人视频生成工具包。它的思路是提交一段 10 秒左右的说话视频克隆你的外貌和声音形成一个数字模特之后输入文案或上传音频就能驱动这个模特对口型输出口播视频。模特训练、语音合成、视频合成是三个 Docker 服务全部跑在本地英伟达显卡上。项目说明运行环境Windows 10 19042 或 Ubuntu 22.04 桌面版需要英伟达显卡内存 32G 起适合人群需要数字人口播视频的用户、自媒体与企业内容创作者、想通过 API 接入数字人能力的开发者核心能力外貌与声音克隆、文字/语音驱动的口型视频生成、8 种语言文案、本地开放 API依赖Nodejs 18、Docker 及三个模型镜像ASR、语音合成、视频合成许可证仓库内 LICENSE 开源协议全球免费商用大型企业需签商业许可跑起来三步完成数字人本地部署第 1 步拿到仓库并装好 Docker。克隆代码git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar。平台差异一句话说清Windows 先装 WSL安装后用wsl --update更新再装 Docker DesktopC 盘留 100G 以上、D 盘 30G 以上Ubuntu 22.04 用 apt 装 docker.io 和 docker-compose并额外装 NVIDIA Container Toolkit 让 Docker 调用显卡macOS 不在官方安装文档范围内。第 2 步启动三个服务。在仓库的deploy目录执行docker-compose up -d。首次会拉取三个模型镜像约 70G 流量耗时看网速半小时左右。Docker 里 asr、tts、gen-video 三个服务都变成 Running服务端就算就绪。第 3 步装客户端并首次运行。Windows 双击官方构建的安装包exe安装Ubuntu 双击 AppImage 直接启动root 用户如果打不开在终端加--no-sandbox参数运行。客户端连上本地服务后进入下图主界面。核心玩法从形象克隆到视频产出口播视频生成输入文案自动对口型出片这是最常用的入口。主界面「Create Video」里选定一个模特输入文案中、英、日等 8 种语言都支持也可以直接上传自己录好的音频。客户端把文案交给本地语音合成出音频再由视频合成服务逐帧匹配口型成片进入「My Works」列表可以播放和导出适合批量产出讲解类素材。全离线本地推理人脸视频和文案不出电脑三个核心服务全部跑在本地显卡上你上传的模特视频、输入的文案不经过任何外网容器日志也能直接在 Docker 里查看。对企业制作内部培训片、创作者在意素材隐私的场景这是它和在线数字人平台的关键区别。场景演示10秒视频做出一段成片官方文档里的真实用法按编号走一遍主界面点「Create Avatar」上传一段 10 秒左右的视频视频里必须有人声且在说话。系统完成形象建模和声音克隆给模特命名它存入「My Avatars」。在「Create Video」选中这个模特输入文案。合成结束后在「My Works」查看并导出成品口播视频。另一个场景是把流程接到自己的程序里官方开放 APIDocker 启动后本地暴露端口先调用模特训练接口记录返回的声音参考参数。调用音频合成接口把文案变成 WAV 音频。把音频和模特视频传给视频合成接口按任务编号查询进度拿到成片。具体字段可参考 src/main/service/。进阶设置三个影响体验的选项lite 轻量版磁盘或显存有限时在 deploy/ 目录执行docker-compose -f docker-compose-lite.yml up -d只部署一个视频合成服务功能简化、要求更低。Docker 镜像源拉镜像慢就在 Docker Engine 配置里加registry-mirrors指向可用的国内镜像重启后重新拉取。50 系显卡RTX 50 系30/40 系装 CUDA 12.8 也可用执行docker-compose -f docker-compose-5090.yml up -d该文件使用 PyTorch 预览版。避坑清单三个高频问题的处理1.docker-compose up -d报超时三个服务都失败原因是 Docker Hub 官方源连接不稳定。处理在 Docker Engine 配置里加国内镜像源重启后再拉。2. 新增模特时报错原因是模特视频没有声音或没有人说话程序要靠这段声音做声音克隆。处理重录一段有人清晰说话的短视频再传。3. 定制模特报 Connection refused原因是 ASR 服务启动慢或内存不足16G 可能起不来。处理等服务端起满几分钟再操作克隆条件允许把内存升到 32G。更多问题和排查路径见仓库里的 doc/常见问题.md。Duix.Avatar 把数字人克隆和口播视频生成整条链路放在本地离线跑完部署细节和使用问题去官方仓库的 README 与 FAQ 文档里找答案。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考