尧图网站设计 尧图网站设计YAOTU DESIGN
ARTICLE DETAIL

资讯详情

深耕网站设计与一线实操的经验洞察。

Minimax Music开源,配套神器已开源,继AI视频自由后,AI音乐也自由了!

Minimax Music开源,配套神器已开源,继AI视频自由后,AI音乐也自由了! Minimax Music开源配套神器T8已开源继AI视频自由后AI音乐也自由了新版comfyui整合包V18更新写一个教程MiniMax Music 3 开源 ComfyUI V18 整合包教程就在昨天继开源视频模型 H3 之后MiniMax 又把音乐模型MiniMax-Music3给开源了。配合 T8 大佬刚更新的ComfyUI V18 整合包AI 音乐本地自由现在真的实现了。一、MiniMax-Music3 是什么一句话一个能在你本地电脑上生成最长5分钟完整歌曲的AI模型带人声还支持中文/日文等多种语言。它和 Suno、Udio 这类在线工具最大的不同是——模型权重完全免费开放你可以下载到本地没有任何次数限制想生成多少首就生成多少首。效果到底怎么样目前开源TTS/SVS领域MiniMax-Music3绝对是顶级的SOTA级别。虽然和顶级的闭源商业产品比如 Suno比还有一点差距但在开源模型里它已经是天花板了。硬件门槛官方推荐24GB显存如RTX 4090实测生成3分钟歌曲约需219秒。整合包也支持通过配置在更低显存下运行。二、下载与安装V18整合包T8 大佬已经把所有依赖和环境都打包好了不需要自己配 Python 环境。MiniMax Music 3 模型 夸克网盘分享T8 CF 整合包 V18 夸克网盘分享T8 配套节点仓库https://github.com/T8mars/comfyui-minimax-h3-prompt-enhancer-T8官方模型 Hugging Facehttps://huggingface.co/MiniMaxAI/MiniMax-Music3官方提示词技能 (Skills) https://github.com/MiniMax-AI/MiniMax-Music3/tree/main/skills安装步骤下载整合包和模型文件解压整合包路径不要有中文把模型文件放到ComfyUI/models/minimax_music/目录下双击run_nvidia_gpu.bat启动 ComfyUI三、核心玩法如何写提示词MiniMax-Music3 不是随便写一句“来首悲伤的歌”就能出好效果的。它需要结构化的描述就像给音乐人写一份制作需求单。官方推荐的三段式结构1. 全局信息流派/子流派、BPM速度、调性情绪走向从哪到哪收听场景、制作风格2. 人声细节性别、音色特质、演唱风格和声、背景人声、效果3. 编曲与段落主奏/辅奏乐器每个段落主歌、副歌、桥段的乐器变化律动、低音、打击乐、空间感示例直接可复制修改Warm Mandarin pop / traditional Chinese ballad, 74 BPM, A-flat major. Tender nostalgia opens into a celebratory chorus, with a mature male baritone-tenor, delicate guzheng, soft strings, gentle acoustic textures, expressive vibrato, and a natural live-room sound.歌词格式歌词需要用段落标签来标记结构这样模型才知道哪里是主歌、哪里是副歌[Verse 1] 歌词第一段内容... [Pre-Chorus] 过渡段内容... [Chorus] 副歌内容... [Bridge] 桥段内容... [Outro] 尾奏内容...如果不想自己写可以用 MiniMax 官方提供的Skill提示词生成器输入主题就能自动生成结构化的描述和歌词。Skill 在官方 GitHub 的skills目录下。四、ComfyUI 工作流使用工作流节点说明V18 整合包中核心节点是MiniMax Music 3 Generator输入说明Caption上面的三段式结构化描述Lyrics带段落标签的歌词Duration生成时长最长300秒模型选择minimax_music3_dit_fp16.safetensors推荐显存够用就选这个minimax_music3_dit_int8_convrot.safetensors显存较低时使用生成后通过SaveAudioAdvanced节点导出 WAV 文件。常用参数建议采样步数官方建议 2-4 步即可因为是 Flow Matching 架构目标时长建议从 60 秒开始测试确认效果后再拉长五、常见问题Q1报错 block cache 相关T8 的整合包已经修复了这个问题更新到 V18 即可。如果自己装的节点更新ComfyUI-MiniMax-H3-BlockCache-T8到最新。Q2生成的歌声音不稳定/走调检查提示词是否写了足够的结构信息。只写一句话的描述效果通常不好尽量按三段式把 BPM、调性、乐器、段落变化都写清楚。Q3为什么只有 32kHz目前开源版本输出是 32kHz 16-bit 立体声 WAV比 CD 音质44.1kHz稍低但做 Demo、视频 BGM、播客配乐完全够用。Q4能生成纯音乐吗可以。歌词留空或者把is_instrumental设为 true就会生成无人声的纯音乐版本。六、相关资源汇总资源链接官方 GitHubGitHub - MiniMax-AI/MiniMax-Music3 · GitHubHugging Face 模型页https://huggingface.co/MiniMaxAI/MiniMax-Music3官方 Demo在线试听MiniMax Music 3官方 Skill提示词生成MiniMax-Music3/skills at main · MiniMax-AI/MiniMax-Music3 · GitHubComfyUI 官方工作流MiniMax Music 3テキストから音楽 - ComfyUI Workflow祝玩得开心记得给 大佬和官方点个 Star
返回列表