全球AI一直在飞速迭代。2025年12月11日,OpenAI发布了GPT的最新版本——GPT-5.2。就在三个月前的8月8日,他们刚推出GPT-5;紧接着11月13日又发布了GPT-5.1;现在才隔一个月,又更新了。这被看作是OpenAI对Google在2025年11月18日发布Gemini 3的一种回应。

全球头部AI公司靠着技术优势,正快速渗透写作、绘画、音乐这些创意领域。而音乐尤其引人关注——它既牵动大众的情感和娱乐消费,又涉及复杂的版权问题。

Google旗下的DeepMind在2024年5月就和YouTube联手推出了AI音乐创作工具Music AI Sandbox。用户可以用它生成和优化音乐,完成后还能一键上传到YouTube。到了2025年4月,Google又推出了新一代音乐模型Lyria 2,并把它整合进Music AI Sandbox里。Lyria 2能生成多种风格的音乐,只要输入文字提示,就能产出包含旋律、编曲甚至人声的完整歌曲。

据The Information在2025年10月的报道,OpenAI也在开发自己的AI音乐生成工具,还跟美国顶尖艺术院校茱莉亚学院的学生合作,让他们帮忙标注乐谱,用来构建高质量的训练数据。

技术进步让AI音乐开始频频登上国内外的音乐榜单。


拿Spotify来说,它的“Viral 50”(全球飙升榜前50)在2025年11月多次出现AI生成的歌曲。其中一首叫《Walk My Walk》的歌,播放量超过了640万。还有美国诗人泰莉莎(Telisha Nikki Jones)用Suno平台打造的虚拟歌手Xania Monet,在Spotify上已经有超过120万听众,她的热门单曲《How Was I Supposed to Know?》甚至登上了Billboard榜单。

国内也不甘落后。从2025年2月用DeepSeek创作的《七天爱人》,到10月、11月在B站爆火的《美猴亡》《Money Back My Home》,再到抖音上的AI热曲《远山少年》《不能不想你》,播放量都轻松破百万,最高的甚至超过1000万。

这些作品的走红,也让AI音乐生成平台成了焦点。

在海外,Suno和Udio是AI音乐领域的明星。两家公司都专注做一件事:你输入一段文字描述,AI就能直接生成带人声、歌词和完整编曲的歌曲。

Suno成立于2022年,到2025年已经推出V5版本。2025年11月,它刚拿到Menlo Ventures领投的2.5亿美元(约合17.6亿人民币)融资,估值飙到24.5亿美元(约172.8亿人民币)。

Udio由几位前Google研究员创办,2024年4月上线后迅速走红,很快融了超1000万美元(约7000万人民币)。

国内也有不少玩家入局:字节跳动推了“海绵音乐”,网易云音乐做了“天音AI”,阿里上线了“Inspire Music”,昆仑万维则推出了“天工SkyMusic”。

AI大幅降低了音乐创作的技术门槛,让更多人能参与进来,给行业注入了新活力。但争议也紧随其后——有人天然反感AI作品,版权问题在法律和伦理上都还没理清楚。AI音乐跑得很快,但前路仍有迷雾。


01 新意起于技术

现在,国内已经有不少高质量的AI音乐作品进入大众视野。

比如B站爆火的《美猴亡》。博主“漫游会议室”在2025年10月发了个视频,叫《大圣深夜崩溃,悲情演唱〈美猴亡〉》,目前播放量已超1344万,还进了B站“每周必看”榜单。视频里,经典《西游记》里的孙悟空戴着耳机,在录音棚唱这首歌,词、曲、演唱全都署名“孙悟空”。

很多观众喜欢这首歌浓烈的摇滚风格和独特的歌词。弹幕和评论里常刷“他们杀死了美猴王,用虚名,用香火,用金光”“他们供着我的金身像,却烧了我睡过的草窝”这样的金句。这首歌火了之后,连专业歌手都来翻唱——比如曾一鸣的翻唱视频,播放量已超114万。

博主“漫游会议室”在主页说明,除了B站,只授权把歌上传到网易云音乐。《美猴亡》多次冲进网易云摇滚榜前三。因为质量太高,甚至有人怀疑它根本不是AI做的。但博主明确把这些歌都归在自己建的“《西游记》AI歌曲”合辑里。

高产也是AI的一个明显特征。据海克财经观察,从2025年10月20日到11月2日,“漫游会议室”每天发一首新歌,全是以《西游记》角色口吻写的,比如黑熊精、高翠兰、哮天犬、玉兔精等等。到现在,这个合辑已有26首歌,B站总播放量超6315万。因为词、曲、唱全是AI搞定,网友戏称它们是“3A大作”。

另一首热门AI歌是B站博主“猫爷说道AIGC”在2025年11月发布的《Money Back My Home》,播放量超481万。他明确说,只有歌词是他自己写的,其他全是AI生成的。

这些优质AI音乐的出现,离不开技术进步。

回看2022年11月,ChatGPT横空出世,当时就有开发者盯上了AI音乐。ChatGPT代表了自然语言处理(NLP)的新高度,展示了AI强大的通用能力和协作潜力,这种能力被认为可以迁移到各个领域。

其实,ChatGPT和Suno都基于Transformer架构,只是一个处理文字,一个处理音乐。音乐本质上是有规律的声波,可以被转成电信号,再对应到模型里的最小单位——token。节奏、和声、旋律、歌词、甚至唱腔音色,都能变成token序列。这个过程叫“tokenization”(标记化)。

但把整首歌转成token,数据量太大了。按CD标准44.1kHz采样率算,一首3分钟的歌要采样近800万次。如果每次采样都对应一个token,模型根本扛不住。后来Meta、Google这些大厂搞出了高效的神经音频编解码工具,能把原始音频压缩几十甚至上百倍再做token化,这才让AI音乐真正实用起来。

2025年1月,Suno的CEO迈克·舒尔曼(Mikey Shulman)在播客20VC里提到,他们的突破不在模型结构,而在音频标记方法——花了大量时间解决token化难题,还借鉴了开源社区的经验。


02 创作能力飞跃

AI音乐的能力,真是一天一个样。

2023年时,多模态技术还没突破,就算压缩了音频数据,也很难把节拍、速度、和声、情感、乐器、歌词这些元素统一编码。所以那时候AI主要只能模仿人声。

“AI孙燕姿”就是典型例子。2023年4月,有网友上传AI模仿孙燕姿唱《红豆》《发如雪》的视频,有的播放量超300万。这事闹大后,孙燕姿本人发文说,AI让人变得“可预测”“可定制”,她只能选择“做自己”。

还有那首《Heart on My Sleeve》,用Drake和The Weeknd的声音风格做的,4月一发就在TikTok和Spotify爆红,但很快被环球音乐以侵权为由下架。

后来多模态技术突飞猛进,一键生成完整歌曲变得简单多了。2024年3月,有人把连花清瘟的说明书丢进Suno,AI居然真生成了一首结构完整的歌。虽然旋律简单、中文咬字有点僵,但已经能看出潜力。

技术提升后,AI能处理的数据更多、更准,融合的元素也更丰富。

2024年3月的Suno V3和4月的Udio,虽然能一键出歌,但“AI味儿”还挺重——旋律、咬字、情感都差点意思。到了2025年,Suno V5和新版Udio的作品整体性已经很强,听起来跟人做的几乎没差别,不少甚至达到行业平均水平以上。

专业音乐人的评价很能说明问题。

B站音乐博主“呆若木一在此”做过一期视频《AI能打败音乐人吗?》,请来吕彦良、秦凡淇试听AI改编他们自己的歌,还让刘恋等音乐人盲选编曲版本。结果有评委直接把票投给了AI编曲。吕彦良(金曲奖最佳新人提名者)感慨说,AI已经超过99%的人,甚至比大多数从业者都强。

国内老牌游戏音乐公司小旭音乐的CEO卢小旭也持类似观点。他多次公开表示AI音乐将重构行业。小旭音乐从2006年就开始给《QQ斗地主》《天龙八部》等上千款游戏配乐,2024年专门成立了“小旭AI Studio”。

更重要的是,AI音乐的技术还在加速进化。

早期AI生成像开盲盒,用户没法局部调整。2025年6月,Udio率先推出可视化编辑工具Sessions,能智能识别歌曲结构,让你移动、扩展或替换某一段,还能自动融合进整体。Suno也在2025年9月推出V5后,上线了数字音频工作站Suno Studio,支持多轨精细编辑,还能按指令重做任意片段。

这意味着AI音乐越来越专业、可控,“AI味儿”也越来越淡,甚至听不出来。法国流媒体平台Deezer和益普索2025年11月的联合调查显示,在英、法、加等8国9000多名受访者中,97%的人分不清AI歌和人做的歌。

据海克财经了解,现在AI甚至能模拟现场感,直接生成Live版歌曲。

所谓Live版,就是带观众欢呼、掌声、即兴发挥和空间混响的现场录音。只要在Suno或Udio输入“Acoustic”或“Live Concert Recording”这类提示词,就能生成有现场质感的音乐。


03 透明度待提升

技术变革也在重塑AI音乐的商业模式。

早期有些创作者靠“刷量”赚钱。比如2024年9月被起诉的美国人迈克尔·史密斯(Michael Smith),他用AI批量生成几十万首歌,上传到Amazon Music、Spotify等平台,再用多个账号伪造播放量套取版税。据《纽约时报》报道,涉案金额超1000万美元(约7000万人民币)。

但现在越来越多创作者转向做精品。像B站的《美猴亡》《Money Back My Home》,还有抖音热歌《不能不想你》——后者由博主“浮生未歇”创作,他说卖这首歌版权赚了80万。

值得注意的是,Spotify允许AI音乐拿分成,但国内各平台政策不一:腾讯系的酷狗、QQ音乐不让AI作者签约,也没收益;网易云可以签约,但没分成;字节的汽水音乐则允许AI音乐变现。

即便听起来没差别,还是有不少听众介意歌是AI做的。而目前识别技术还不完善,很多创作者会刻意规避标注。比如B站博主“SevenTeamMusic”做过实验,只要手动微调一下,AI歌就能被平台判为人工作品。

如果AI只参与部分创作——比如用户哼一段旋律,AI补全编曲,再由人重录精修——平台就更难识别了。国内乐队“灵活就业”的主创王博龙就在播客里说,他们热门歌《创作者中心》《菠菜去打工》都用了Suno。他在网易云上传了30多首歌,都没标AI。

汽水音乐倒是明确支持AI音乐,还有激励计划给播放收益。AI歌往往符合“神曲”逻辑——洗脑、易传播,特别适合短视频。加上和抖音打通,汽水成了AI创作者的首选。B站、小红书上已经有很多教程,教你怎么用AI做歌上传到汽水赚钱。

创作者看重汽水,也因为它用户涨得快。Quest Mobile数据显示,2025年9月,汽水音乐MAU达1.2亿,同比增长90.7%,在国内音乐APP里排第四,仅次于酷狗(2.1亿)、QQ音乐(1.9亿)和网易云(1.5亿)。

但版权问题依然棘手。

2024年6月,环球、华纳、索尼三大唱片公司集体起诉Suno和Udio,指控它们用未授权音乐训练模型。到2025年10月和11月,Udio先后和环球、华纳和解,计划推完全授权的订阅制AI平台,让用户合规使用授权声音创作,并建立分成机制。Suno也在2025年11月和华纳和解,准备合作推授权模型。只有索尼的官司还在打。

版权争议不止在训练阶段,更在最终作品归属。当用户用AI把自己的哼唱或歌词扩展成完整歌曲,这作品就成了人类创意、算法执行和海量数据的混合体——到底版权归谁?是被学习的原作者?平台?还是用户自己?

针对标注问题,Google的做法是在Lyria 2等工具生成的音频里嵌入SynthID水印。这是一种人耳听不出的数字水印,不影响音质,但能让AI内容被识别出来。

AI音乐已经不只是个工具升级,它可能系统性地重构整个音乐产业——从上游创作授权,到中游分发推广,再到下游消费互动。要解决的问题还有很多:训练数据版权、人机协作伦理、听众的情感接受度……但无论如何,AI音乐已是行业无法回避、且近在眼前的未来。