MiniMax Music 3.0 是 MiniMax 于 2026 年 8 月 13 日发布的开放权重音乐生成模型,官方定位是「一次生成一首完整歌曲」:给定创作概念与可选歌词,模型自行作曲、编曲、演唱与混音,单次最长约 5 分钟,输出 32 kHz、16 bit 立体声 WAV。结构上是 8B 全局 LLM 负责长程音乐结构、0.6B 局部 LLM 负责逐帧声学细节的 Hybrid-LM,配合多层 RVQ(残差矢量量化)、隐状态融合、Flow Matching 与 Flow-VAE 完成高保真音频重建。
权重已在 Hugging Face 的官方组织下开放(MiniMaxAI/MiniMax-Music3,含 diffusers 与 sglang-omni 支持),GitHub 提供 MiniMax-AI/MiniMax-Music3 代码与官方在线 Demo,也可通过 MiniMax 平台 API 调用。官方强调这一代解决三类难题:更准确理解创作意图、在整首歌里保持情绪与编曲走向、以及让音色听起来像真人演唱而非合成。适合独立音乐人的演唱小样、短视频与广告配乐、游戏与播客背景音乐等场景,本地部署的上限取决于显存与推理栈支持。
- 开放权重 + 代码开源,可本地部署或走官方 API,官方另提供在线 Demo
- Hybrid-LM(8B 全局 + 0.6B 局部)单次生成最长 5 分钟完整歌曲,32 kHz 立体声输出
- 对比上一代重点是创作意图理解、长程编曲结构与演唱自然度的提升
数据统计
数据评估
关于MiniMax Music 3(开源音乐生成)特别声明
本站AI之旅导航提供的MiniMax Music 3(开源音乐生成)都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由AI之旅导航实际控制,在2026年9月28日 上午5:05收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,AI之旅导航不承担任何责任。
相关导航
暂无评论...
