
Pixelle-Video输入一个主题3 分钟产出 AI 短视频【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-VideoPixelle-Video 是一款 AI 短视频生成引擎输入一个主题它会自动完成文案创作、AI 配图、TTS 语音合成和最终视频合成。它面向没有剪辑经验的自媒体创作者、教育工作者和企业营销人员最有吸引力的一点是——用 Ollama 本地 LLM 加本地 ComfyUI 的组合可以零成本运行一个 5 分镜的短视频大约 2~5 分钟就能出片。从主题到成片两个真实使用场景场景一运营一个知识科普账号每周要更新几条竖屏视频。你把「为什么要养成阅读习惯」这类主题填进内容输入框选默认模板点生成。系统先让 LLM 把主题拆成 5 个分镜并写好每句解说词再为每个分镜生成一张匹配的插图最后配上语音和背景音乐。全程你不需要打开任何剪辑软件产出的是一个 1080x1920 的 MP4 文件。场景二手头已经有一段写好的文案不想让 AI 改词。切换到「固定文案内容」模式把文案直接粘进去并选择按段落或句子分割视频照样能自动生成配图和语音。如果你还上传了一段 10~30 秒的参考音频用 Index-TTS 工作流跑成片里的解说声会接近你自己的声音适合做个人 IP 类账号。从安装到出片只需四步整个上手过程不需要配置复杂的依赖环境关键是装好两个前置工具uvPython 包管理器和ffmpeg视频合成用。装好后按下面步骤操作克隆并启动以下命令会自动安装项目依赖并打开浏览器访问 http://localhost:8501 即可看到 Web 界面。git clone https://gitcode.com/GitHub_Trending/pi/Pixelle-Video cd Pixelle-Video uv run streamlit run web/app.py系统配置首次使用展开「⚙️ 系统配置」面板选一个 LLM 预设如通义千问、DeepSeek并填入 API Key图像生成三选一——本地 ComfyUI 地址、RunningHub 云端 API Key或直连 DashScope / OpenAI 等媒体模型供应商。输入主题左侧栏选择「AI 生成内容」模式输入主题分镜数量默认 5 个可按需调整。选模板并生成中间栏确认 TTS 工作流默认 Edge-TTS 即可和视频模板点右侧「生成视频」。进度条会实时显示当前步骤比如「分镜 3/5 - 生成插图」完成后视频自动播放文件保存在output/文件夹。官方文档docs/zh/getting-started/quick-start.md四个值得试的功能文案、模板、语音、直连模型AI 文案生成。是什么把主题交给 LLM自动产出 5~8 个分镜的解说词模型支持通义千问、GPT-4o、DeepSeek 和 Ollama 等所有 OpenAI 兼容接口。何时用账号选题明确但不想写稿时。效果换一个 LLM 模型文案风格会明显不同这是调整成片调性最直接的旋钮。视频模板与三种尺寸。模板按命名区分类型static_*纯文字不需要 AI 配图生成最快、image_*AI 图片背景、video_*AI 动态视频背景基于 WAN 2.1 等模型。尺寸覆盖竖屏 1080x1920抖音、快手、横屏 1920x1080B 站、YouTube和方形 1080x1080微信朋友圈。下方这张是横屏「电影」模板的效果图黑底水墨风格适合文化、历史类内容。方形模板则更克制这张是「极简边框」模板白底、细线框、居中插图适合做社交媒体静态分享。TTS 与声音克隆。内置 Edge-TTS 开箱即用免费且稳定换 Index-TTS 工作流后支持声音克隆——上传一段清晰的参考音频建议 10~30 秒避免背景噪音点「预览语音」先试听再生成。注意 Edge-TTS 不支持克隆。直连媒体模型 API。不想部署 ComfyUI 也没关系2026 年 6 月新增的直连 API 配置支持 DashScope、OpenAI GPT Image、字节 Seedream / Seedance、可灵 Kling 等供应商在系统配置里填好密钥就能用图像和视频生成都不再依赖本地显卡。再进一步自定义模板、工作流与 API 集成想要品牌专属的视觉风格模板就是一个 HTMLCSS 文件支持{{ title }}、{{ text }}、{{ image }}三个变量。从templates/目录复制一个现有模板改改样式存回对应尺寸目录即可被界面识别开发细节见 docs/zh/user-guide/templates.md。工作流层面图像、视频、TTS、VLM 各能力都是可替换的原子模块在 ComfyUI 里设计好流程、导出 JSON、丢进workflows/目录Web 界面就能选中使用。想完全跳过 Web 界面时也可以程序化调用通过PixelleVideoCore类传入主题文本、模式AI 生成或固定文案和分镜数异步拿到成片路径方便接入自己的内容生产流水线用法见 docs/zh/user-guide/api.md。上手时常见的问题Q生成一个视频要多久3~5 个分镜的视频大约 2~5 分钟取决于 LLM 响应速度、图像生成速度和工作流类型界面会实时显示当前步骤。Q必须部署 ComfyUI 吗不一定。纯文字静态模板不需要任何图像服务零门槛出片需要 AI 配图时也可以选 RunningHub 云端服务或直连 API 媒体模型完全绕开本地显卡。Q使用成本多少完全免费方案Ollama 本地 LLM 本地 ComfyUI 0 元。推荐方案通义千问 本地 ComfyUI文档给出的参考成本约 0.01~0.05 元/个视频。Q生成的视频存在哪里能管理吗视频按时间戳保存在output/文件夹Web 界面的 History 页面可以查看历史记录并支持二次编辑。Q效果不满意怎么调按顺序试换 LLM 模型改文案风格 → 改图像提示词前缀需英文如 Minimalist black-and-white illustration→ 换 TTS 工作流或上传参考音频 → 换模板和尺寸。它最适合需要稳定、批量产出短视频的自媒体运营者以及完全不会剪辑但想让想法快速变成成片的新手。建议你从静态文字模板开始体验零门槛流程熟悉界面后再切到 AI 配图模板——第一次生成成功后3 分钟出片就不再是口号而是你会反复用的日常操作。核心源码目录pixelle_video/services/【免费下载链接】Pixelle-Video AI 全自动短视频引擎 | AI Fully Automated Short Video Engine项目地址: https://gitcode.com/GitHub_Trending/pi/Pixelle-Video创作声明:本文部分内容由AI辅助生成(AIGC),仅供参考