首页站长新闻MiniMax发布Music3音乐生成模型:输入歌词和描述 AI可生成最长5分钟完整歌曲

MiniMax发布Music3音乐生成模型:输入歌词和描述 AI可生成最长5分钟完整歌曲

2026-08-14 1,088

2026年8月14日,MiniMax 正式推出音乐生成模型 MiniMax-Music3。该模型支持用户输入歌词以及音乐风格描述,即可生成最长 5分钟 的完整歌曲,并输出 32kHz、16-bit立体声 WAV 音频文件。

MiniMax-Music3 的核心能力来自一套分层自回归架构,由两个语言模型协同完成音乐生成。

其中,Global LLM(全局语言模型) 参数规模达到 80亿(8B),主要负责歌曲整体结构和长期语义建模。该模型从 Qwen3-8B 初始化而来,通过训练适配音乐语义词元,负责预测第一个 RVQ(Residual Vector Quantization)码本信息,用于控制歌曲主题、结构变化以及整体音乐走向。

另一个 Local LLM(局部语言模型) 参数规模为 6亿(0.6B),主要负责细节层面的声学信息生成,通过预测其余声学码本,补充旋律、音色、节奏等细节表现。

简单来说,Global LLM 负责搭建歌曲的“骨架”,确定音乐结构和发展方向;Local LLM 则负责填充声音细节,让最终生成的歌曲更加完整自然。

据了解,MiniMax-Music3 在长音频生成方面进行了优化,可以较好保持歌曲主题一致性、节奏稳定性以及演唱风格连贯性。生成内容能够覆盖完整歌曲结构,包括前奏、主歌、预副歌、副歌、桥段、器乐间奏以及尾奏等部分。

目前,MiniMax 已在 GitHub 和 Hugging Face 平台公开模型信息,并提供生成歌曲样例供用户体验。

随着 AI 音乐生成技术不断发展,MiniMax-Music3 进一步降低了音乐创作门槛。用户无需具备专业编曲能力,只需提供歌词和创作方向,即可快速生成结构完整的歌曲作品。

  • 广告合作

  • QQ群号:4114653

温馨提示:
1、本网站发布的内容(图片、视频和文字)以原创、转载和分享网络内容为主,如果涉及侵权请尽快告知,我们将会在第一时间删除。邮箱:2942802716#qq.com(#改为@)。 2、本站原创内容未经允许不得转裁,转载请注明出处“站长百科”和原文地址。

相关文章