尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

从一段10秒视频到口播成片:Duix.Avatar 数字人本地部署实操

从一段10秒视频到口播成片:Duix.Avatar 数字人本地部署实操 从一段10秒视频到口播成片Duix.Avatar 数字人本地部署实操【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar把一段 10 秒的小视频拖进去几分钟后屏幕上就出现一个会说话、口型对得上的“你”。Duix.Avatar 是一款免费开源、完全本地离线运行的数字人工具部署完成后不依赖网络人脸和声音素材不出本机。它到底能帮你干什么人脸 声音克隆输入一段 10 秒左右、带说话声的视频产出一个可反复使用的模特同时包含形象和声线。文本直接出片粘贴一段稿子数字人替你念出来并自动匹配口型脚本支持中、英、日、韩、法、德、阿、西 8 种语言。音频直接驱动手里已有录音的话上传音频文件直接驱动模特合成跳过文字转语音这一步。多模特与成片统一管理可以建多个模特随意切换历史成片按列表查看、导出或删除。环境与部署硬件与软件门槛项目要求系统Windows 10 19042.1526 及以上或 Ubuntu 22.04显卡NVIDIA 显卡且正确安装驱动推荐 RTX 4070项目所有算力都在本地内存32GB内存偏小可能导致 ASR 服务起不来磁盘100GB 以上空闲Windows 另要求 D 盘存数据、留 30GB软件Docker、Node.js 18两条命令拉起全部服务克隆项目到本地git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar cd Duix-Avatar在 deploy 目录一条命令拉起服务镜像会自动拉取约 70GB 流量、30 分钟左右cd deploy docker-compose up -dDocker 里看到三个服务都是 Running 状态即为成功只想跑视频生成的话改用docker-compose -f docker-compose-lite.yml up -d只起一个服务。装客户端Windows 用户从 Release 下载 setup 包双击安装Ubuntu 用户双击 AppImage 直接运行。核心能力拆解一段视频怎么变成模特主逻辑在 src/main/service/model.js视频先被转成 H.264再用 ffmpeg 把音轨分离出来音频送去 TTS 服务做音色训练形象和声音两条信息一并写进本地数据库。模特的增删查改走 src/main/dao/f2f-model.js删除时会连同视频、音频文件和数据库记录一起清掉。一段文字怎么变成成片流程在 src/main/service/video.js文本先经 TTS 合成 wav再和模特视频一起提交给 face2face 合成服务loopPending每 2 秒轮询一次任务状态状态成功时用 ffmpeg 读出成片时长并落库界面上看到的进度条就来自这个轮询。直接上传音频的任务会跳过 TTS省去一步。所有请求都落在两个本机端口上src/main/config/config.js 把端点全部写死为 127.0.0.1视频合成在 8383语音合成在 18180。数据默认落在D:\duix_avatar_dataWindows或~/duix_avatar_dataLinux。客户端本身是 Electron Vue 应用界面代码在 src/renderer/src/。离线不是宣传词链路里没有对外的出口。拿它干活培训视频不用等人企业内训课程更新一次按老流程得约讲师、订场地、再录一遍。让讲师录 10 秒自我介绍生成模特把课程脚本粘进文本框提交合成下次内容改版只换脚本重新生成模特不用重录。成片可直接导出接到内部培训系统里就能放。把文章变成口播视频自媒体账号要稳定更新但每次都架着设备录口播费时费状态。先克隆一个自己的模特做一次管很久把文章正文当脚本粘贴进去提交合成等状态变成成功挑出成片导出发布。一篇千来字的文章就变成一条口播视频全程不用出镜。踩坑记录docker-compose up -d拉镜像超时、报 connection 错 → Docker Hub 官方源不稳定在 Docker 里配置镜像源或开全局代理模式再试。新增模特时报错看着像音频异常 → 克隆用的视频必须带人声程序拿这段声音做音色训练纯静音视频不行。第一次克隆形象报 Connection refused → ASR 服务启动偏慢服务起来后等几分钟再操作内存只有 16G 时可能根本起不来。Ubuntu 下以 root 登录时双击 AppImage 没反应 → 改用命令行./Duix.Avatar-x.x.x.AppImage --no-sandbox启动。参与项目使用遇到报错或有功能想法直接在仓库提 issue改代码可以提 PR。想跳过客户端直接调模型训练、视频合成这些接口的参考 src/main/config/config.js 里的本机端点常见报错和原因在 doc/常见问题.md 里有整理。先把三个服务跑起来再谈第一条成片。项目获取git clone https://gitcode.com/GitHub_Trending/he/Duix-Avatar【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表