中国AI企业MiniMax于2026年8月14日公开了新一代音乐生成模型「MiniMax-Music3」。该模型能够根据文本指令生成带人声的完整歌曲,并支持日语人声。官方表示,这是一款“生产可用”的开放式权重音乐模型,目前已经免费公开,用户可以在本地环境直接运行。 MiniMax-Music3最长可生成5分钟的乐曲,输出格式为32kHz、16bit的立体声音乐文件。与许多只能生成纯音乐或简单哼唱的AI音乐工具不同,MiniMax-Music3可以直接生成包含歌词、演唱和编曲的完整歌曲,而不是简单地把文字变成一段器乐片段。 官方还同时公开了配套的“AI技能”(skills):用户只需要输入一句简短想法,系统就能自动扩展为完整歌词,并整理成对AI模型更友好的结构化提示词。这相当于把“写词”和“生成音乐”两个环节打通,降低了使用门槛。 官方也提供了免费在线演示应用「MiniMax Music 3 Studio」。实际测试中,输入“日语人声摇滚,吉他、贝斯、鼓,包含‘炎热夏天’‘注意防暑’‘多喝水’等歌词”,点击“Write lyrics & review”后,模型会先生成日语歌词和结构化提示,再点击“Generate”即可得到音乐文件和视频文件。从官方公开的示例来看,日语人声的咬字、语感和情绪表现都相当自然。 不过,免费在线演示并非完全无限制。该演示运行在Hugging Face的ZeroGPU免费推理服务上,测试中仅生成一首1分钟的歌曲,免费额度就已经用尽。如果希望不限量使用,可以转向本地部署。MiniMax-Music3目前已支持ComfyUI,本地生成没有数量限制,也不需要排队等待配额。 模型权重已在GitHub和Hugging Face公开,官方同时发布了大量示例歌曲,以及用于“短句→歌词+结构化提示”的skills目录。随着这类开放权重模型的出现,AI音乐生成的门槛正在快速降低,创作者或许不再需要依赖昂贵的付费AI音乐服务,就能在本地完成从写词到成品歌曲的完整流程。
热门跟贴