
Open Generative AI400 模型的 AI 图像视频生成工作室本地也能跑起来【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI当你需要把一句文字变成图片、一张图变成视频、一张静态人像变成口型对得上的说话视频时不必再分别订阅几个商业平台——Open Generative AI 把 Flux、Midjourney、Kling、Sora、Veo、Wan 2.2 等 400 个图像与视频生成模型装进同一套开源工作室里可自托管在你自己的机器上无内容过滤、无订阅费用桌面版还能挂两套本地推理引擎全程不花一分钱 API 调用费。 项目速览它本质是一个 MIT 协议开源的生成式 AI 工作台Web 端是 Next.js 应用桌面端用 Electron 打包云端模型统一走 Muapi.ai 网关本地模型则由桌面版内置或外接推理引擎完成。仓库用 npm workspaces 组织成一个 monorepo所有工作室 UI 与 400 模型定义都集中在共享的packages/studio组件库里。关键事实内容定位开源 AI 图像 / 视频 / 唇形同步生成工作室商业订阅平台的自托管替代协议MIT可自由修改、二次分发技术栈Next.js React Tailwind CSSElectron 桌面壳npm workspaces monorepo运行方式桌面安装包 / 源码启动 Web 版 / Docker 自托管三选一上手成本下载安装包零门槛源码运行需 Node 18执行一次npm run setup即可️ 能力拆解按你要完成的任务分应用首页不是一个大而全的输入框而是十几个按任务划分的工作室页签完整清单见 components/StandaloneShell.js 的导入列表分为图像、视频、音频、代理自动化四大类画图与改图Image Studio默认是文生图模式选模型、填提示词即可一旦上传了参考图模型列表会自动切换到图生图集合换背景、局部编辑、放大、抠图。两个模式下的模型都超过 50 个。它还有一个容易忽视的细节多图输入。选中支持多参考图的模型时上传框会变成多选模式图片按你勾选的顺序带编号发送给模型。上限因模型而异模型最多参考图数Nano Banana 2 Edit14Flux Kontext Dev / GPT-4o Edit / Seedream Edit v410Vidu Q2 Reference to Image7Qwen Image Edit Plus / Wan 2.5 Edit3所有上传过的参考图都会以缩略图形式存在本地localStorage下次直接用不用重复上传。做视频Video Studio规则与 Image Studio 完全对称不传图就是文生视频传一张首帧图就自动切到图生视频两边各有 40 与 60 个模型Kling、Sora、Veo、Wan、Seedance 2.0、Hailuo、Runway 等。时长、宽高比、质量档位这些参数不是写死的而是随所选模型的能力动态显示——模型不支持的选项根本不会出现。让图片说话Lip Sync Studio9 个专用模型分两种输入人像图 音频 → 说话视频Infinite Talk、Wan 2.2 Speech to Video、LTX 2.3 / 2 19B Lipsync分辨率 480p 到 1080p已有视频 音频 → 对口型视频Sync、LatentSync、Creatify、Veed、Infinite Talk V2V。生成历史独立保存在lipsync_history里页面刷新后未完成的任务会自动续上。多步任务自动化Workflow / Agent / 其他工作室这一组页签解决一次性操作太重复的问题Workflow Studio节点式可视化编辑器把多个图像/视频/音频模型串成流水线支持预置模板、社区共享、Playground 表单式试跑每条工作流最终也能通过 API 直接调用Agent Studio多轮对话式创意代理自己规划并执行生成任务AI Clipping从长视频里自动剪高光片段Marketing Studio一个输入生成多版营销素材AI Influencer管理风格一致的虚拟人设内容。电影感镜头Cinema Studio它把虚拟摄影机的专业参数翻译成优化过的提示词修饰符6 种机身从 16mm 胶片到 8K 数字、11 种镜头变形宽银幕、微距、焦外旋涡等、6 档焦距8mm 超广角到 85mm 特写、3 档光圈f/1.4 浅景深到 f/11 深焦。全部模型的数量与归属如下数字以 packages/studio/src/models.js 为准总计 420类别数量代表模型文生图70Flux Dev、Nano Banana 2、Seedream 5.0、Midjourney v7图生图70Nano Banana 2 Edit、Flux Kontext Pro、GPT-4o Edit文生视频85Kling v3、Sora 2、Veo 3、Seedance 2.0图生视频120Kling I2V、Veo3 I2V、Hunyuan I2V视频转视频35视频特效、AI Clipping、Vibe Motion唇形同步15Infinite Talk、LTX Lipsync、LatentSync主体替换3图像/视频换装与外观重铸音频15文生音乐、remix、音频编辑⚡ 本地推理两套互不相干的引擎这是桌面版独有的能力——Web 版永远走云端 API。设置面板的Local Models里可以分别配置两个引擎引擎一sd.cpp内置。来自 stable-diffusion.cpp 的 C 引擎与 App 同机运行Apple Silicon 走 Metal GPULinux/Windows 支持 CUDA/Vulkan/ROCm。只覆盖图像模型本地模型类型体积默认步数Z-Image TurboDiffusion Transformer2.5 GB8 步Z-Image BaseDiffusion Transformer3.5 GB50 步Dreamshaper 8SD 1.52.1 GB20 步Realistic Vision v5.1SD 1.52.1 GB25 步Anything v5SD 1.52.1 GB20 步SDXL Base 1.0SDXL6.9 GB30 步注意两点Z-Image 系列还要额外下载约 2.7 GB 的共享辅助文件Qwen3-4B 文本编码器 FLUX VAE且吃内存——8 GB 的基础款 M 系列 Mac 上已知会卡死系统建议只跑 SD 1.5所有文件默认放在 Electron 应用数据目录如 Linux 的~/.config/open-generative-ai/local-ai想挪到别的磁盘启动前设置环境变量即可export OPEN_GENERATIVE_AI_LOCAL_AI_DIR/data/local-ai引擎二Wan2GP自带服务器。App 不内置 Python 运行时和权重你需要在一台带 CUDA/ROCm GPU 的机器上自己跑 Wan2GP 服务器再把它的 URL如http://192.168.1.42:7860填进桌面版点 Test 再 Save。它补齐了本地推理的视频能力Wan2GP 侧模型类型说明Flux.1 Dev图像1024px28 步Qwen Image图像1024px30 步Wan 2.2T2V / I2V视频消费级 GPU 上较慢Hunyuan Video视频高质量文生视频LTX Video视频最快的视频选项之所以要拆成独立服务器是因为 Wan2GP 的底层内核Sage attention、flash-attn 等只有 CUDA 路径没有 Apple Silicon 支持。这个设计恰好让 Mac 用户能继续用桌面版 UI把重活卸载给局域网里的游戏主机或租来的云 GPU 实例。 上手路径最省力直接下载对应平台的桌面安装包macOS 提供 Apple Silicon 与 Intel 两个 DMGWindows 提供 x64 安装包装完即用不需要 Node.js。首次启动会提示输入 Muapi.ai 的 access key注意粘贴 key 的值不是 key 名称只用本地模型可以跳过。从源码跑面向贡献者先克隆仓库——必须带子模块Workflow 和 Agent 功能依赖它们——再装依赖并构建 workspace 包然后二选一启动git clone --recurse-submodules https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI cd Open-Generative-AI npm run setup npm run electron:dev # 桌面版Web 版改为 npm run dev → http://localhost:3000注意npm install单独执行是不够的npm run setup会额外构建packages/studio等子包。生产构建用npm run build npm run start打桌面安装包用npm run electron:buildmacOS、electron:build:win、electron:build:linux产物在release/目录。 内部机制它到底怎么跑生成走提交-轮询两步前端先POST /api/v1/{模型端点}提交任务拿到request_id再轮询GET /api/v1/predictions/{request_id}/result直到状态变成completed。整个提交与轮询逻辑封装在 packages/studio/src/muapi.js 的submitAndPoll()里唇形同步任务也是同一套路processLipSync()接受image_url/video_url加audio_url。密钥是 BYOK 模式且注入是有选择的API key 存在浏览器localStoragekey 名为muapi_key同时写一个一年有效期的同名 cookie 供后台请求识别身份axios 拦截器只往内部代理路径注入x-api-key头避免密钥泄露到外部 CDN 域名。见 components/StandaloneShell.js 的拦截器与 cookie 逻辑。服务端代理负责清洗请求头app/api/api/v1/[[...path]]/route.js 把/api/api/v1/*转发到 Muapi 网关cleanHeaders()会剥掉host/connection/cookiecookie 鉴权已被显式移除注释标注为 CWE-522 修复认证只认x-api-key头。模型目录是单一事实来源420 模型的定义全部集中在 packages/studio/src/models.js各工作室的可选模型、参数控件都从这里派生改这里自托管版和托管版同时生效。⚠️ 桌面版安装排坑按平台列出真实会遇到的四类问题macOS 首次打开被拦截已损坏/无法验证开发者原因应用未经 Apple 公证Gatekeeper 默认拦截。解法Terminal 执行xattr -cr /Applications/Open Generative AI.app然后右键应用选 Open 确认一次即可不想用终端可以走 系统设置 → 隐私与安全性 → Open Anyway。Windows SmartScreen 弹出未知发布者原因安装包未做代码签名。点 More info → Run anyway 即可应用会静默装进%LocalAppData%并生成开始菜单快捷方式。Ubuntu 24.04 上 AppImage 静默失败或秒崩原因新版内核策略apparmor_restrict_unprivileged_userns挡住了 Chromium 的用户命名空间沙箱。推荐直接改用.deb包自带 AppArmor profileAppImage 用户可临时执行sudo sysctl -w kernel.apparmor_restrict_unprivileged_userns0重启后失效永久生效需写入/etc/sysctl.d/99-userns.conf。老版本系统上 AppImage 打不开原因是缺少 FUSE 库sudo apt install libfuse2解决。源码启动报Couldnt find a pages directory原因是 Next.js 找不到app/目录或子模块没拉下来确认你在仓库根目录含app/、next.config.mjs的那层执行命令且克隆时带了--recurse-submodulespackages/Vibe-Workflow为空就重跑npm run setup。 Docker 自托管仓库自带 docker-compose.yml 一键起服务宿主机3001映射到容器内 Next.js 的3000端口以 production 模式运行并设置unless-stopped自动重启docker compose up -d后访问http://localhost:3001。配套 Dockerfile 是多阶段构建先装依赖、构建 workspace 子包和 Next.js 生产包运行阶段只保留.next与public镜像里不含开发依赖。注意容器版不提供本地推理云端模型仍需 API key。️ 想扩展时改哪里加新模型在 packages/studio/src/models.js 里按现有条目格式补一条定义端点、参数、能力标记对应工作室的模型列表和参数控件会自动跟上加新工作室页签复制 packages/studio/src/components/ 下任意 Studio 组件改造成新页面再到 components/StandaloneShell.js 的页签注册处挂上去加新的代理入口app/api/ 下已有/api/agents、/api/workflow、/api/app等转发路由照着 app/api/api/v1/[[...path]]/route.js 的写法新增即可加本地模型桌面版的模型目录在 electron/lib/modelCatalog.jssd.cpp与 electron/lib/wan2gpProvider.jsWan2GP里维护补条目后 Settings → Local Models 即可下载。谁适合、谁不适合如果你想要一个不卡提示词、数据留在本地、能改源码的 AI 图像视频工作台或者想在 Electron 里集成本地推理这个仓库可以直接抄作业如果你只想要开箱即用的订阅服务、或者需要 Apple Silicon 上跑 Wan2GP 视频模型该路径不存在就别折腾了。【免费下载链接】Open-Generative-AIUnrestricted Open-source alternative to AI video platforms — Free AI image video generation studio with 600 models (Flux, Midjourney, Kling, Sora, Veo). No content filters. Self-hosted, MIT licensed.项目地址: https://gitcode.com/GitHub_Trending/ch/Open-Generative-AI创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考