尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

HeyGem.ai 本地部署完整指南:5 分钟上手 AI 视频生成,从零做出你的数字人

HeyGem.ai 本地部署完整指南:5 分钟上手 AI 视频生成,从零做出你的数字人 HeyGem.ai 本地部署完整指南5 分钟上手 AI 视频生成从零做出你的数字人【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-AvatarHeyGem.ai 本地部署就是在这套 AI 数字人视频生成平台里用一段说话视频克隆你的形象和声音再把文字或音频变成口播视频全程离线。适合想批量做数字人视频、又不想把素材传到网上的你。 先看看它能干什么用自己的视频克隆形象与声音上传一段 10 秒左右的视频程序会同时克隆两样东西你的脸五官、表情之后都由这段视频还原你的声音语调、语速后续念稿都用这个声音克隆一次以后反复用。不用每次重新上传素材。把文字、音频变成口播视频形象克隆好之后你想让它说什么就输入什么。视频里口型跟着声音走画面、口型、声音自动对齐。适合这些场景短视频口播、知识科普产品介绍、课程讲解不想露脸、但需要一个固定出镜人的自媒体支持的输入方式输入说明纯文字直接输入文案平台自动转成语音音频文件自己录好或找别人念好上传即用脚本支持8 种语言中、英、日、韩、法、德、阿拉伯、西班牙语。 安装与启动环境准备先对照一下你的电脑缺了哪样就补哪样NVIDIA 显卡 驱动必需。装完驱动在命令行运行nvidia-smi能显示显卡信息才算装好内存 32G 及以上官方推荐配置硬盘服务端镜像约 70G数字人数据约 30G建议给足 100G 空闲空间Node.js 18和Docker客户端和服务端各依赖一个获取项目代码打开命令行执行git clone https://gitcode.com/GitHub_Trending/he/HeyGem.ai cd HeyGem.ai安装依赖包npm install这一步会自动装客户端依赖并编译底层模块。等它跑完、末尾不报红色错误就行中途卡住一般是网络问题重新执行一次即可。启动并验证客户端要连本地的服务端所以先启动服务端在deploy目录里执行详见下文部署方式一节。两个信号代表全部就绪Docker 里出现 3 个服务状态都是 Running——语音合成、语音识别、视频生成各一个在项目根目录执行npm run dev弹出客户端窗口首页能看到Create Video和Create Avatar两个大按钮看到主界面就说明 HeyGem.ai 本地部署完成了。‍ 上手实操做出你的数字人第一步准备一段合格素材素材质量直接决定克隆效果记住两条硬标准清晰正面正对镜头、光线充足别侧脸、别逆光人在说话、有声音大约 10 秒背景别带背景音乐或杂音程序要靠这段声音做声音克隆没声音的视频会直接报错。第二步创建你的数字人角色点首页的Create Avatar上传刚才那段视频填个名字等待训练完成头像出现在My Avatars列表里就算成功第三步输入文字或音频生成视频点Create Video选刚创建的角色输入文案或上传一段音频提交任务。生成速度取决于显卡40 系显卡上几十秒到几分钟不等第四步检查输出效果在My Works列表里点开视频播放重点看口型对不对得上、声音是否像本人不满意就换素材重克隆而不是反复生成⚙️ 部署方式与性能调优方式一直接跑客户端npm run dev从源码直接启动改完代码立刻能看到效果适合会写代码、想魔改界面或逻辑的开发者方式二Docker 容器化服务端推荐docker-compose up -d在deploy目录执行镜像里预装好了全部模型不用自己装环境。适合不想折腾依赖的普通用户一条命令起服务显存较小8G 左右可以改用轻量版docker-compose -f docker-compose-lite.yml up -d只起视频生成一个服务配置细节见 Docker 配置文件直接运行Docker 容器化启动命令npm run devdocker-compose up -d适合人群开发者普通用户环境负担需 Node 18、手动装依赖镜像预装开箱即用改代码立即生效是否三条性能调优点显卡全部算力都在本地nvidia-smi看不到显卡时先修驱动再谈别的内存视频生成服务在配置里预留了 8G 共享内存shm_size别随意调小显存紧张时保持默认的分块设置即可磁盘首次拉取约 70G 镜像数据落在duix_avatar_data目录定期清理旧作品避免把盘塞满️ 常见坑与解法坑一镜像拉取超时现象执行docker-compose up -d后服务报错request canceled或Client.Timeout。原因Docker Hub 官方源网络不稳定拉镜像中途断掉。解决办法在 Docker 设置里给 Docker Engine 配置国内镜像源registry-mirrors然后重新执行命令或者挂上代理再试。坑二三个服务起不来现象Docker 里服务反复重启或直接停掉客户端连不上。原因本机没有 NVIDIA 显卡或驱动没装好Docker 调用不到 GPU。解决办法先装显卡驱动用nvidia-smi验证Linux 用户还需装 NVIDIA Container Toolkit 让 Docker 能用显卡。坑三创建模特时报错现象上传视频创建角色时提示Connection refused或处理失败。原因两种常见情况——上传的视频没有声音或没人说话或者服务端某个服务没处于 Running 状态。解决办法换一段人在说话的清晰视频重新上传再确认 3 个服务都是 Running。还报错就打开对应容器的日志定位别凭感觉猜。更多报错场景可以翻 常见问题文档按现象对照查。最后环境搭好、素材备齐现在就可以创建你的第一个数字人角色跑通第一支口播视频。卡住的地方先查服务状态和日志十次里有九次能自己解决。【免费下载链接】Duix-Avatar Truly open-source AI avatar(digital human) toolkit for offline video generation and digital human cloning.项目地址: https://gitcode.com/GitHub_Trending/he/Duix-Avatar创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表