无言以对 发表于 2026-8-21 15:58:20

MiniMax-Music3 V2版:输入一句话,让 AI 从零创作一整首歌,不会写歌也能当音乐人


MiniMax-Music3 是一个“输入歌词 + 告诉它想要什么风格,就能直接帮你做出一整首歌”的 AI 音乐生成模型。 它不只是生成一小段背景音乐,而是重点针对“完整歌曲”的生成,最长可以做到约 5 分钟,并且尽量保持歌曲前后风格、旋律、节奏和人声的一致性。




你只需要提供两样东西:

歌词(可以带上结构标记,比如 、、 等)
音乐描述(比如风格、情绪、人声特点、乐器编排等)

它就能自动生成一首结构完整、人声表现力强、编曲会随时间推进变化的完整歌曲,输出高质量的 32kHz 立体声音频。


今天分享的 MiniMax-Music3 V2版,在上个版本的基础上新增“词曲创作”模块,你只需要输入简短的创作主题和曲风,即可一键生成“音乐描述”和“歌词”,并可以自定义微调,最后一键生成自己想要的音乐。




主要特点

能生成完整长歌:支持最长5分钟的完整歌曲,能保持主题、节奏、人声风格和编曲逻辑前后一致,不会中途“跑偏”。
控制力很细:既能控制整体风格(流行、电子、民谣等),也能精细指定人声性别/音色、情绪起伏、乐器搭配和段落发展。
技术架构先进:用了“大模型管整体结构 + 小模型管细节”的混合设计,再配合连续隐状态合成技术,让人声更自然、乐器质感更丰富、长时音频更稳定。
输出质量高:直接生成 32kHz、16-bit 立体声 WAV 文件。




应用领域

独立音乐人、创作者快速出 demo 或完整歌曲
短视频、广告、游戏、影视的配乐制作
内容平台、AI 音乐工具、个性化音乐生成服务
教育和实验性音乐创作
需要快速生成带人声的完整歌曲的各种场景




使用教程:(建议N卡,显存8G起,支持50系显卡)

整合包包含所需所有节点,下载主程序和模型(ComfyUI文件夹),解压主程序一键包,将ComfyUI文件夹移动到主程序目录下即可。

WebUI模式:
双击启动进入WebUI,输入需要创作的音乐主题曲风等,一键生成音乐描述和歌词,一键导入到“歌曲生成”,设置相关参数(时长等),运行生成即可。


ComfyUI模式:
双击启动ComfyUI,进入WebUI后,点击左侧的 工作流程,选择对应的工作流。
输入需要创作的音乐主题曲风等,一键生成音乐描述和歌词,设置相关参数(时长等),运行即可。

新增 “词曲创作” 功能,只需要输入简短的音乐描述,比如“一首流行音乐,失恋后的内心独白,60秒”,支持多个自定义标签,比如流派(hip-pop,jazz等),声音配置(男声,女生等),语言,时长等,让创作更丰富更自由。
音乐描述和歌词生成后,一键导入到“歌曲生成”,支持自定义修改描述和歌词,修改完成后即可生成。


注,8G显存建议生成时长不超过60秒,超过60秒显存建议12G起。


软件目录结构:

📂 ComfyUI/
├── 📂 models/
│   ├── 📂 diffusion_models/
│   │      └── minimax_music3_dit_int8_convrot.safetensors
│   ├── 📂 text_encoders/
│   │      └── minimax_music3_text_encoder_pruned_int8_convrot.safetensors
│   │      └── qwen3-vl-4b-heretic_int8.safetensors
│   ├── 📂 vae/
│   │      └── minimax_music3_dav.safetensors
📂 deepface/
......



下载地址:
迅雷云盘:主程序 https://pan.xunlei.com/s/VP0M6VK_XSN1w6ugU--2OXIFA1?pwd=z2km   模型 https://pan.xunlei.com/s/VP0M6dyD2pY2EBNRUQo_YJ02A1?pwd=ty4y


夸克网盘:
**** 本内容需购买 ****


百度网盘:
**** 本内容需购买 ****
页: [1]
查看完整版本: MiniMax-Music3 V2版:输入一句话,让 AI 从零创作一整首歌,不会写歌也能当音乐人