Mureka V9.5 发布:更克制、更真实,AI 音乐开始“有人味”

2026/07/21 18:51阅读量 4

昆仑万维天工 AI 于 2026 年 7 月 19 日在世界人工智能大会上发布 Mureka V9.5 音乐生成底座,同时推出 O3 反思式音乐推理方案和创作 Agent。V9.5 摒弃了堆砌编配的惯用做法,侧重为音乐留出呼吸空间,提升人声自然度和指令精准度(盲测指令精准度从 6.92 提至 7.62,人声良品率达 61.0%)。O3 通过 test-time scaling 使模型在生成过程中持续审视和修正,将听感良品率从 35% 提至 43%。创作 Agent 将传统“定稿”模式转变为版本化工作流,支持探索、控制与执行三层空间。

事件概述

2026 年 7 月 19 日,昆仑万维天工 AI 在 WAIC 上发布新一代音乐生成底座 Mureka V9.5,并推出了基于该底座的 O3 反思式音乐推理方案和创作 Agent 体验。V9.5 的核心目标是减少 AI 音乐的“堆砌感”,让作品更自然、更贴合创作意图。

核心技术特点

  • MusiCoT 音乐思维链:模型在生成音频前先规划全曲结构和局部细节,而非逐帧盲猜。V9.5 在此基础上进一步优化:编配不再时刻拉满,声部学会呼吸,情绪推进留有空白,所有声学选择都服务于创作意图。
  • O3 反思式推理:运行在 V9.5 之上,通过 test-time scaling 让 MusiCoT 推理过程延长。模型在生成中持续自问:当前旋律是否服务全局目标?编配是否淹没人声?情绪是否透支?发现偏差后自行修正。覆盖全曲目标维持、生成中审视、偏差校正和成本控制四个能力。
  • 创作 Agent:将音乐创作从“生成→定稿”的单次行为转变为版本迭代。产品层面分为三个空间:探索空间(快速出多个版本)、控制空间(局部保留/替换,精确到段)、执行空间(低门槛指挥式操作)。

关键数据与竞赛对比

  • 同一轮 100 首样本盲测中,V9.5 在旋律、人声、音质、编配上均有提升,指令精准度从 6.92 提至 7.62。
  • 编配更克制,音乐框架更真实;人声表现良品率达 61.0%;控制良品率 97.0%,曲风完全体现比例 95.7%。
  • O3 在前期底座的实验中,将听感良品率从 35% 提至 43%,综合可用率从 35% 提至 39%。
  • 历史同口径评测显示,Mureka 系列在整体听感、成品音质、综合可用率上长期领先 Suno V5.5,V9.5 补齐了复杂提示词精准度上的短板。

发展历程

Mureka 是昆仑万维自研的通用 AI 音乐大模型。2024 年初 SkyMusic 1.0 内测完成从 0 到 1;2025 年 V6+O1 全球首次落地 MusiCoT;2025 年底 V7.6+O2 优化人声质感与提示词理解;2026 年初 V8 在权威评测中拿下人声、器乐双榜第一,综合实力超越 Suno、Udio、Google Lyria;同年 3 月 V9 进一步收紧编配逻辑;至 7 月 V9.5+O3 组合放弃堆砌声部,转向真实创作逻辑。

行业意义

V9.5+O3+创作 Agent 的组合标志着 AI 音乐竞争从“声音多”转向“像人一样思考、创作、打磨”。对普通创作者:可获取人声自然、编曲有层次的成品;对专业音乐人:克制基底适合灵感草稿,O3 省去反复调校;对企业客户:短视频、游戏等批量配乐的门槛和成本降低。Mureka 正从单一模型向 AI 原生平台演化,内容形态支持版本化、二创和持续进化,商业模式涵盖订阅、Studio 工具、B 端分发及 API。

其他相关发布

同期昆仑万维还发布了 Matrix-3.5 世界模型和 Riemann-1.0 底层底座,属于“4+3”AGI 战略(四大 SOTA 模型支撑 AI 短剧、AI 音乐、AI 游戏三大平台经济体)。在圆桌论坛上,业内人士提及使用 Mureka V9.5 生成对标杨宗纬《空白格》风格的抒情歌和模仿颜人中风格的中年危机主题歌曲,以及音乐人使用 AI 编曲后盲选更偏好 AI 版本的案例。

准备好启动您的定制项目了吗?

现在咨询,即可获得免费的业务梳理与技术架构建议方案。