2026年7月,昆仑万维旗下Mureka在WAIC 2026论坛上发布了V9.5和O3的全新组合。Mureka V9.5首次喊出最没有AI味的AI音乐模型这一口号,不再依赖声部堆砌和复杂编配制造厉害的第一印象,而是在真实的音乐框架中以更为克制的方式处理编配、人声、情绪与提示词意图。与V9.5同时亮相的O3音乐推理增强方案,通过推理时持续推演、回看偏差和修正后续决策,进一步强化了旋律发展、编曲结构与指令理解。从SkyMusic 1.0内测到Mureka V9.5加O3,昆仑万维的音乐模型走过了一条从作品成立到创作可控再到多模态创作的完整演进路径。
很长一段时间里,AI音乐行业竞争的核心是以声音多取胜。一些AI音乐模型擅长通过密集声部和厚重音色制造完成感,但容易出现人声被遮盖、编曲拥挤、情绪缺少起伏等问题。听众很难说清哪里不对,但听感上总觉得像是AI作品而不是人类创作。Mureka V9.5没有继续追求更满,而是把重点放在了人声、编配和情绪之间的平衡上。在Mureka V9.5的Demo演示中,中文流行歌曲夜色缓缓展示了模型对分寸的控制能力。伴奏托住人声但为其留出空间,弦乐在合适的时机进入,情绪从低声诉说逐渐走向释放但不过分煽情。另一首Melted Chrome则呈现了模型对复杂曲风的理解。提示词要求迷幻的西海岸G-Funk街头说唱,并限定了多种具体的音色元素,模型不仅识别了G-Funk的核心元素,还理解了如何组合这些元素才能形成低底盘夜间巡游般的迷幻氛围。对AI音乐来说,理解不要什么有时和理解要什么同样重要。
与V9.5同时亮相的O3音乐推理增强方案,是整个组合的另一关键拼图。O3建立在V9.5底座之上,通过test-time scaling扩展MusiCoT的推理过程。它不是简单地生成得更多或想得更久,而是让模型在生成过程中持续审视当前表达:局部旋律是否仍服务全曲目标,编配是否遮蔽人声,情绪是否提前透支,结构是否正在偏离最初意图。额外推理空间被用于回看偏差与自我修正,使音乐思维链能够逐步收敛,而不是一次决定后一路向前。V9.5负责把歌做得更自然,O3负责在交付前多看、多想、多修一遍,两个组合在一起实现的是一件事情:从一次性生成跨越到完整思考打磨,把复盘、修正、收敛的流程嵌进模型生成的每一步。在主观评测中,Mureka O3在情感表达得分上达到了7.88,在编曲结构上达到7.20,全面领先同类竞品。Mureka系列在整体听感、成品音质、综合可用率上长期领先海外竞品Suno V5.5,V9.5进一步补齐了复杂提示词精准度的短板,曲风还原和提示词匹配都做到了同轮评测第一。
Mureka V9.5加O3带来的不仅是音乐质量的提升,更是一种创作理念的根本转变。传统音乐创作和多数AI音乐工具的创作逻辑本质上是一个低频、高成本、看运气的事:生成一首歌然后定稿。Mureka对创作的理解发生了根本变化,创作不再是写出一首歌,而是在版本空间里做选择、做判断、做迭代。产品层面这一理念落地成三个空间。探索空间可以让同一创意快速出多个版本,打开创作的可能性边界。控制空间允许创作者在旋律、人声、结构等维度上做局部保留和精确到段的替换。执行空间中的Studio将操作DAW变成了指挥创作,创作者可以把更多时间花在审美决策上而不是反复试错。Mureka还推出了Character功能,仅需一段声音或一张照片即可生成专属歌手角色,贯穿歌曲与MV创作。这一功能有效降低了音乐创作门槛,让没有专业声乐训练的普通用户也能拥有属于自己的歌手声音。昆仑万维CEO方汉在WAIC论坛上指出AI音乐正升级为一种自我表达的语言,大幅降低了创作门槛,释放了大众的深层创作力。
Mureka此次升级还打通了音乐与视频MV的同一条创作链路。用户可以从一张图片、一段视频或moodboard开始,让系统理解画面的节奏、人物和情绪,再生成与之匹配的音乐。也可以从一首歌开始,让Agent理解歌词叙事和节拍编曲,继续生成角色与MV的视觉方案。这种音视频一体化的创作模式在短视频、游戏和影视内容生产场景中具有极高的实用价值。从商业模式来看,Mureka正在从单一模型向平台化发展。商业模型采用三条线并行策略:面向普通用户的订阅服务、面向专业创作者的Studio工具、以及面向企业的B端分发和API接入。方汉在WAIC上系统阐述了世界模型将走出屏幕进入物理世界、游戏行业被世界模型率先改变、以及AI音乐视频等工具促进AIGC深层发展三大产业预判。在Mureka V9.5加O3的组合推动下,AI音乐正在经历从能不能写歌到能不能做出好音乐的产业升级。就目前的发展速度和行业反馈来看,Mureka正在确立自己在全球AI音乐领域的领先地位。