返回顶部
返回首页 会员充值 我的足迹 返回上一页
具身智能
情绪经济
商业航天
十五五
银发经济

AI音乐创作

一个不懂乐理的普通用户可以通过自然语言对话生成一首词曲编唱俱全的歌曲。AI音乐生成能力持续演进,从早期“AI翻唱”或单一风格套用,逐步向文本、图像、音频、视频等多模态输入拓展。报告以趣丸科技“天谱乐”、MiniMax“Music2.6”和昆仑万维“Mureka”为样本,呈现了AI音乐从技术到商业化的多元探索。

技术演进:从“一键出结果”到“可反复打磨”

算法演进的两条路线融合

AI音乐生成经历了两条早期路线的融合。符号路线(以MIDI为代表)结构可控但音色机械化;音频路线(直接建模频谱/波形)音色真实但缺乏长程音乐结构。当前主流模型走向端到端生成,用模型自学的音频表征取代人工定义的符号表征,兼顾结构可控、音乐性与音质。

竞争焦点转移

目前主流模型的生成质量已达到可用水准。竞争焦点从“第一次生成是否惊艳”,转向“能否把一首歌持续改到满意”。创作入口也在从文本向图片、视频等多模态扩展。

尚存的技术壁垒

AI音乐向影视级、唱片级编曲工作流渗透时,仍面临“多轨独立可控性”壁垒。现阶段的端到端模型主要输出混合单轨音频,缺乏原生分轨生成与编辑能力。

典型实践一:“天谱乐”——“模型+应用+硬件”协同探索

趣丸科技从早期演唱类应用出发,逐步搭建起覆盖底层模型、C端创作应用与智能硬件终端的产品体系。

自研多模态音乐模型

“天谱乐”于2024年7月实现支持文生音乐、音频生音乐,还首创图片、视频生成音乐的能力。模型可支持生成最长5分钟的成品歌曲,在中文人声唱词生成能力上有“真假难辨”的效果。

对话式创作智能体与生成式AI吉他

2025年9月,趣丸推出对话式音乐创作Agent“Tunee”与生成式AI吉他“天谱乐TemPolor”。Tunee基于多代理架构构建,支持音乐生成、MV制作等功能,付费订阅用户可获得商业使用授权。天谱乐AI吉他将模型能力嵌入实体乐器终端,用户上传歌曲或哼唱片段后,模型可在数秒内生成对应的指弹旋律。

全链路布局

2019年趣丸推出唱鸭App,普及“无弦弹唱”玩法,入选文化和旅游部“文化和旅游数字化创新实践十佳案例”;2024年发布“天谱乐”;2025年9月公测Tunee,集成视频生成能力。

典型实践二:“MiniMax Music”——底层算法赋能多模态应用

MiniMax以通用多模态大模型研发为主要方向,更侧重以底层算法能力为支撑,向多类内容生成场景提供能力输出。

Music2.6的三项关键突破

2026年4月,MiniMax正式发布Music2.6。首包延迟压缩至20秒以内;实现BPM与调性精准锁定、段落结构精细控制、情绪表达进一步优化;优化了音色自然度与中低频声学表现。

多模态内容生成协同

MiniMax旗下“海螺AI”多模态智能创作平台整合Music2.6音乐生成能力,与文本、图像、视频生成等能力形成协同。Music2.6推出Cover跨风格翻唱功能,支持用户上传参考音频后进行旋律特征提取与跨风格迁移。

典型实践三:“Mureka”——“模型+平台”协同探索价值化

昆仑万维将Mureka音乐大模型作为AIGC内容矩阵的核心组成部分之一。

MusiCoT体系强化精准可控性

Mureka以持续演进的MusiCoT体系为核心,协同音乐结构、歌词语义与声音呈现。推动AI音乐从“能够生成一首歌”向“按创作意图完成一首歌”迈进。

平台化路径探索闭环

Mureka平台构建涵盖创作工具、内容分发与用户运营的AI音乐生态。据公开信息,Mureka2025年年化流水约1200万美元,一定程度上验证了AI音乐付费订阅模式的商业可行性。
点击阅读报告原文: 人民数据:2026数智赋能·文娱新生中国大文娱产业人工智能应用发展研究报告(64页)
相关报告