AI AI工具情报站
国内AI动态 ai-models

新一代开源权重、生产级全能音乐模型

📰 MiniMax:Blog(网页) 📅 2026-08-12

核心亮点

MiniMax 推出 Music 3.0,新一代音乐生成模型,并且带着开源权重登场。说白了,它不再只是"生成一段旋律",而是给你一个从创意概念到成品歌曲的端到端工厂:作曲、编曲、演奏、制作一次性完成,最长还能撑到五分钟整首歌。

具体能力或事件经过

Music 3.0 的使用方式很直接:你给一个创意概念,再可选地附上歌词,模型就能一口气把整首歌做出来。过去的音乐 AI 常常卡在"片段",要么只能哼几句,要么各阶段要分段处理。MiniMax 这次强调的是"全能"——从灵感到一个可发布的完整曲目,尽量不让人中途接手拼接。最长五分钟的时长,也足以覆盖一首标准流行歌的结构。

技术细节

"开源权重"是这次的关键词之一。对开发者和创作者来说,这意味着可以在本地或自有算力上微调、部署,数据和使用方式更可控。把作曲、编曲、演奏、制作压缩进同一个模型流程,要求它在旋律、配器、人声(若含歌词)和混音多个维度上同时达标,工程难度不低。五分钟时长则考验模型维持长结构一致性的能力,避免出现"前热后冷"的断裂感。

与竞品对比

对比 Suno、Udio 等主流音乐生成产品,Music 3.0 打出"开源 + 生产级 + 全能"的组合牌。简单来说,闭源产品胜在开箱即用的云端体验,而 MiniMax 想用开放权重换取开发者的二次创新和私有化部署,瞄准的是更看重可控与可集成的专业场景。

行业影响或适用场景

对独立音乐人、游戏与影视配乐、广告短片配乐等需求,Music 3.0 提供了一个可自托管、可定制的创作底座。开源降低了商业使用的门槛与成本。它预示着音乐生成正从"玩具 demo"走向"生产工具",当模型能稳定产出五分钟完整曲目,AI 配乐大概率会更快渗进内容产业的流水线。