尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

如何用 Open Generative AI 把一张静图变成 10 秒口型视频:14 个工作室实战指南

如何用 Open Generative AI 把一张静图变成 10 秒口型视频:14 个工作室实战指南 如何用 Open Generative AI 把一张静图变成 10 秒口型视频14 个工作室实战指南【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AIOpen Generative AI 是一个免费、开源的 AI 视频与图像生成工作室它帮内容创作者把一段文字、一张静图或一段录音变成口型视频和电影级宣传片。内置 400 模型、无内容过滤、可自托管数据和创意都握在你自己手里。把产品照片变成 10 秒口型宣传片先从一个具体任务开始手头有一张产品照想让它动成 10 秒短视频。打开「视频工作室」把产品照作为「起始帧」传上去。上传的刹那模型列表会自动从 40 个文生视频模型切到 60 个图生视频模型比如 Kling I2V、Veo3 I2V、Wan I2V。写一句提示词描述你想要的运镜选个模型点生成几分钟后就能拿到一段可下载的成片。第一次用先把这三件事办了想装到本地直接下桌面版macOS 拖进应用程序文件夹、Windows 点安装、Linux 有 AppImage 和 .deb不用装 Node.js。想省事浏览器打开在线版核心功能都在。首次使用进设置贴上你的 MuAPI API Key只打算用本地模型的话这步能跳过。给现有视频重新配中文口型换个场景你有一段英文讲解视频想改成中文口型。「唇形同步工作室」专做这件事内置 9 个口型模型分两种模式肖像图加音频生成会说话的短视频现有视频加音频重新对口型。选视频模式传上原视频和中文音频挑一个模型比如 LTX 2.3 Lipsync点生成。口型会跟着音频走配音和本地化特别顺手。用镜头参数调出电影质感想要专业影视感就进「电影工作室」像调相机一样调画面。选相机模块化 8K 数字、全画幅电影机等选镜头创意倾斜、暖调电影原色、旋涡光斑人像再定焦距8mm 超广到 85mm 特写和光圈f/1.4 浅景深到 f/11 深焦。这些参数会被自动翻译成优化过的提示词修饰符成片因此带上统一的电影色调适合对画面有要求、需要连续镜头质感的创作者。想批量跑任务、接入自己的流水线「工作流工作室」让你用拖拽把多个模型串起来上一步的输出接到下一步做出图、视频、配音这样的自动化流程还能套模板、用 Playground 直接试跑。要在自己的程序里调用逻辑其实就两步先 POST 把提示词和参数提交到模型端点再轮询结果直到状态完成。这套两步模式封装在 src/lib/muapi.js照着它就能对接任何后端。所有模型集中在 packages/studio/src/models.js加新模型或改参数改这一处桌面版和在线版同时生效。想完全离线生成桌面版内置两套互不干扰的本地推理引擎都在「设置 → 本地模型」里配置sd.cpp捆绑式本机直接跑Apple Silicon 走 Metal GPULinux/Windows 走 CUDA、Vulkan、ROCm适合图像模型Mac M 系可用。Wan2GP自备服务器在另一台带 CUDA 或 ROCm 显卡的机器上跑服务桌面版只发提示词、收结果适合 Wan 2.2、Hunyuan、LTX 这类视频模型。硬件上最低 8GB 内存Z-Image 这种大模型建议 16GB 起8GB 的 M 系 Mac 稳妥起见只跑 SD 1.5。想自托管整站git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run electron:dev你可能会遇到视频生成卡住或失败先确认网络正常、API Key 贴对了再把分辨率调低或换更轻量的模型。本地推理慢确认真的在走 GPUApple Silicon 应启用 Metal而不是掉回 CPU不行就降分辨率。找不到之前生成的内容所有生成记录都存在浏览器本地历史面板里能回看、重新下载上传过的图也留在本地不会重复上传。一条提示词、一张静图、一段录音就是这个工具的全部原料。打开设置贴上你的 API Key你的第一条口型视频 30 秒后就能出。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考
返回列表