尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

10秒克隆AI数字人:Duix.Avatar本地部署教程

10秒克隆AI数字人:Duix.Avatar本地部署教程 10秒克隆AI数字人Duix.Avatar本地部署教程【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarDuix.Avatar是一个免费开源的AI数字人项目你准备一段10秒视频就能在本地克隆出你的外貌和声音再用文本或音频自动生成口播视频。它面向需要零成本产出口播视频的内容创作者、教育者和企业用户——完全离线运行部署耗时约30分钟。先搞懂它能做什么三个能力与实际效果部署完成后你能拿到这三样东西先说清楚它们各解决什么问题外貌声音一次性克隆上传一段你对着镜头说话的10秒视频程序同时提取五官轮廓和音色训练出的数字人长你的脸、用你的嗓子说话口型与声音对齐。两种驱动方式输入一段文字稿系统用你的克隆音朗读并驱动口型也可以直接丢一个音频文件数字人按音频的节奏和语调表演。两条路产出的都是带口型同步的口播视频。全程本地离线所有计算跑在你自己的NVIDIA显卡上部署完成后不依赖网络素材和声音样本不出本机。主界面左侧Create Video生成视频右侧Create Avatar训练新数字人下方列表管理已有作品与模特部署前环境自检清单先对照下表确认机器达标。这个项目的算力全部消耗在本地GPU上没有NVIDIA显卡就完全跑不起来所以显卡和驱动是硬性门槛。检查项标准系统Windows 10 19042.1526及以上或 Ubuntu 22.04显卡NVIDIA RTX 30/40/50系列5090已实测50系列要用专用部署文件显卡驱动终端执行nvidia-smi能显示显卡信息内存32GB16GB起不来服务属于最低要求CPUi5-13400F及以上官方参考配置磁盘WindowsC盘剩余100GB以上存Docker镜像 D盘剩余30GB以上存数字人和作品Ubuntu空闲空间100GB以上网络首次拉镜像约消耗70GB流量建议连WiFiWindows有两个额外注意点必须有D盘存放数字人和作品数据如果C盘不足100GB装好Docker后可以在设置里把镜像存储位置改到其他盘。Docker设置中的Disk image location点Browse可把镜像目录指到空间更大的盘三步完成部署第一步环境准备Docker 显卡驱动这一步装两样东西Docker负责跑后端三个服务语音识别、语音合成、视频生成NVIDIA驱动和容器工具包让容器里的程序能调用你的显卡。Windows在PowerShell里执行wsl --list --verbose查看WSL是否已装没装就执行wsl --install过程中会要求设置用户名和密码。执行wsl --update把WSL更新到最新版。到Docker官网下载Windows版安装包安装首次启动接受协议、跳过登录即可。Ubuntudocker --version # 已安装则跳过下面两步 sudo apt update sudo apt install docker.io sudo apt install docker-compose再装NVIDIA驱动用nvidia-smi验证然后安装NVIDIA Container ToolkitDocker调用GPU的必备组件按NVIDIA官方文档添加仓库后执行sudo apt-get install -y nvidia-container-toolkit最后配置并重启Dockersudo nvidia-ctk runtime configure --runtimedocker sudo systemctl restart docker第二步服务端部署这一步把三个后端服务拉下来并挂到Docker里后台运行。先把代码clone到本机仓库地址 https://gitcode.com/GitHub_Trending/he/Duix-Avatar 进入/deploy目录Windows完整版启动3个服务cd deploy docker-compose up -d硬件吃紧可以用lite版只启动视频生成一个服务docker-compose -f docker-compose-lite.yml up -dUbuntucd deploy docker-compose -f docker-compose-linux.yml up -dNVIDIA 50系列显卡30/40系列装CUDA 12.8也可用此方案docker-compose -f docker-compose-5090.yml up -d接下来等约30分钟主要耗时在70GB镜像下载。Docker里看到三个服务都是Running状态即成功lite版是一个。第三步客户端安装这一步装你每天用的桌面程序它负责上传素材、展示结果并与上面三个服务通信。Windows从项目Releases页下载官方构建的Duix.Avatar-x.x.x-setup.exe双击安装。Ubuntu下载Linux版Duix.Avatar-x.x.x.AppImage直接运行无需安装。如果你是root用户进桌面、双击打不开就在终端执行./Duix.Avatar-x.x.x.AppImage --no-sandbox第一个数字人实操10秒视频克隆上传素材在客户端点Create Avatar上传你对着镜头说话的视频。素材有三个硬性要求时长10~20秒10秒起步人脸清晰完整必须带说话声——声音克隆就是靠这段音频完成的静音视频会直接报错。模型训练上传后系统自动把视频拆成两部分无声音轨留给外貌语音轨交给声音克隆几分钟内训练出你的数字人模型。注意一个坑服务端刚启动时ASR语音识别服务还没就绪如果立刻克隆报Connection refused等两三分钟再试。生成视频在My Avatars里选中刚训练好的数字人输入文字稿或上传音频文件点生成。等几分钟就得到一条数字人用你的音色说话、口型对得上的口播视频。踩坑与排障提问前先按下面五条自查多数问题都能对上号1. 拉镜像失败报Client.Timeout/request canceled原因Docker Hub官方源连不上。 解决在Docker的registry-mirrors配置里加国内镜像源镜像源会失效自行搜最新可用的保存后重跑部署命令。Docker Engine设置页添加registry-mirrors镜像源2. 服务起不来Docker里看不到Running状态原因没有NVIDIA显卡或显卡驱动没装好——没卡这个项目无法启动。 解决先跑nvidia-smi不显示显卡就先装驱动。3. 新增模特失败提示视频没有声音原因素材视频是静音的或画面里的人没在说话。 解决重录一段10~20秒、口齿清晰的视频。4. 训练时ASR报Connection refused原因ASR服务启动慢服务端跑完还要再等两三分钟内存只有16GB时服务可能起不完整。 解决启动服务端后稍等再克隆16GB内存需升到32GB。5. 视频生成卡在20%原因卡在音频合成环节最常见是音频文件路径不存在。 解决打开Duix.Avatar-tts服务的Logs页找File does not exist之类的报错重启该服务后重新生成。在Docker中打开tts容器的Logs页查看错误堆栈其他问题定位日志的位置客户端在设置菜单点Open Log日志文件在AppData下的logs目录里服务端则点开三个Docker服务分别复制Logs内容。客户端设置菜单中的Open Log入口日志文件为main.log提升质量清单拍摄时面部光线均匀、正面角度、背景干净、口齿清晰这几点直接决定克隆相似度。分辨率按你的发布需求选不必追求4K。一次要生成多条视频时拆成批次提交避免队列堆积。定期清理数据盘Windows的D盘里积累的临时文件。进阶玩法API、多语言与批量不想走桌面界面、要接进自己系统的话Docker起来后本地就开放了三组API走http://127.0.0.1调用模型训练音频预处理、音频合成18180端口/v1/invoke、视频合成8383端口/easy/submit提交任务、/easy/query查进度。参数结构直接看仓库里 src/main/service/ 下的 model.js、video.js、voice.js 三个文件即可照此写个脚本就能批量跑视频。文案方面支持中文、英语、日语、韩语、法语、德语、阿拉伯语、西班牙语共8种语言设置菜单可切换界面语言也能用不同语言出片。收尾一张NVIDIA显卡加32GB内存你就能免费在本地产出口播视频这是Duix.Avatar的核心价值。更多坑位参考仓库里的 doc/常见问题.md 和 Issues 区把上面的环境自检清单逐项确认完就可以开始部署了。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表