Suno发布v6音乐模型:首次采用唱片行业授权数据训练
Suno v6包含三个子模型,免费版v6-mini主打快速生成;新模型显著提升对音乐类型的理解,但仍无法生成“自然瑕疵”的不完美音乐。
AI解读:Suno这次最大的变化,是v6的训练数据首次获得了唱片公司的正式授权。此前AI音乐公司普遍被指控用未经授权的版权歌曲训练模型,Suno自己还正被各大唱片公司起诉。这次与华纳音乐、BMG和Believe合作,算是它第一次拿出一套合法来源的数据来训练模型,相当于给整个产业递了一份投名状。
对普通用户最直接的影响是:免费版换成了新的v6-mini,生成更快更省资源,但音质更简单、容易听出AI味;升级版v6在理解音乐风格上进步很大,以前写一句“Hyperpop”或“Krautrock”它可能完全跑偏,现在基本能抓住这些风格的表面特征。
不过V6还是治不好AI音乐的一个老毛病:你永远没法让它故意跑调、走音或制造点“人味”的瑕疵。测试者反复要求输出走音的钢琴或单调的人声,它都直接无视,只会给你和谐又工整的成品——AI再怎么学,也还是那个“完美癖”的优等生。
Suno正式发布其v6 AI音乐模型,这是该公司首个在唱片行业支持下训练而成的模型。Suno的Jack Brody告诉The Verge,v6“从头开始训练,使用了全新数据集,不包含此前模型所用的任何数据”。该数据包括来自合作伙伴华纳音乐集团(Warner Music Group)、BMG和Believe的授权内容,以及“用户数据”。目前尚不清楚v6训练数据是否已完全摆脱此前备受质疑的侵权内容。
三个子模型:免费版主打轻量快速
v6实际包含三个不同的模型:v6、v6-wild和v6-mini。v6-mini向所有用户免费开放,专注提供快速、轻量化的音乐生成体验,其输出结果更简单,且往往带有更多暴露其AI生成身份的伪影。v6-wild则被设计为更不可预测的模式,Brody称其初衷是追求“意外之喜和自然的瑕疵”。不过在The Verge有限的测试中,编辑发现很难注意到v6-wild与标准版v6之间的区别。
显著提升音乐类型理解,仍无法生成“自然瑕疵”
The Verge的测试显示,三个模型对音乐类型的理解都有显著提升。编辑循环使用旧模型上的大量提示词,例如要求生成“hyperpop”或“krautrock”风格的歌曲,旧模型曾大幅跑偏,而v6则精准抓住了所给类型的所有表面特征。
然而,v6依然无法真正输出“自然的瑕疵”。与v5相似,编辑尝试让v6生成走调、跑调或轻微不和谐的音乐,均告失败。无论怎么调整提示词,v6都只会产出保持和声与节奏上绝对“完美”的作品。测试中,要求“用单调人声”“不要鼓点”会被直接无视;反复要求“不按调性或节奏、随意乱弹且与整首歌完全不合拍的钢琴”,得到的也并非所描述的演奏。
与此同时,v6保留了AI音乐所特有的不自然伪影,人声部分尤其容易出现比v5更明显的生硬数字痕迹。
支持局部编辑、多模态输入
v6在底层更新上改变了用户交互方式:现在用户可通过对话用自然语言编辑歌曲的局部,例如修改吉他旋律或某一歌词,无需重新生成整首曲目。v6还能将Suno音乐库中的多个素材混搭并生成新作品。
提示词也不再局限于文字描述。Suno v6可以根据图像、视频或其他音频文件来创作音乐。
Suno v6于今日(发布日期即日起)开始向用户滚动推出,公司表示将逐步淘汰之前的模型。