ithome
科技
采集 2026-08-14T07:18:03+00:00
MiniMax发布Music3音乐模型:AI可生成最长5分钟歌曲
原始标题:MiniMax-Music3 音乐模型发布:AI 生成最长 5 分钟歌曲
来源
ithome
发布时间
2026-08-14T07:15:22
采集批次
2026-08-14-07
字数
407
URL 指纹
78b29b5074a7c6c6
📌 AI 总结(215 字)
AI公司MiniMax于8月14日推出音乐生成模型Music3,用户只需提供歌词和音乐描述,即可一键生成最长5分钟的完整歌曲,输出格式为32kHz、16-bit立体声WAV文件。该模型采用分层自回归架构,由80亿参数的全局语言模型负责长程语义与结构建模,6000万参数的局部语言模型恢复细粒度声学信息。官方表示,模型能在长音频中保持音乐主题、节奏、歌声身份和编曲推进的一致性,完整覆盖前奏、主歌、副歌、桥段、间奏和尾奏等歌曲结构。
📄 正文(407 字)
IT之家8月14日消息,AI公司MiniMax今天(8月14日)推出音乐生成模型MiniMax-Music3,可根据歌词和音乐描述生成最长5分钟的完整歌曲。 架构方面,MiniMax-Music3模型采用分层自回归架构: Global LLM(全局语言模型)参数规模为8B,逐帧预测第1个RVQ码本,负责建模歌曲的长程语义与结构变化;Global LLM基于Qwen3-8B初始化,训练时先适配音乐语义词元的嵌入层和输出层,随后与Local LLM联合建模全部RVQ码本。 Local LLM(局部语言模型)参数规模为0.6B,预测每一帧中其余声学码本,恢复细粒度声学信息。 在输出方面,该模型生成的单首歌曲时长最长为5分钟,输出格式为32kHz、16-bit立体声WAV文件。 官方称,模型能够在长音频中保持音乐主题、节奏、歌声身份和编曲推进,覆盖前奏、主歌、预副歌、副歌、桥段、器乐间奏和尾奏等结构。