据 The Verge 报道,Suno 于9月9日发布其首个获得唱片业支持的 AI 音乐模型 v6。该模型使用新的训练数据,当天开始向用户推出,Suno 称最终将停用此前模型。
Suno 的 Jack Brody 对 The Verge 表示,v6 是“从头训练,使用了一套新的数据,不包含我们此前模型训练所用的相同数据”。这些数据包括来自合作伙伴华纳音乐集团、BMG 和 Believe 的授权内容,以及“用户数据”。The Verge 指出,尚不清楚 v6 的训练数据是否完全不含来源可疑的内容。
v6 实际包含三个模型:v6、v6-wild 和 v6-mini。其中 mini 向所有用户免费提供,侧重快速、资源占用低的创作,但输出结果更简单,也往往带有更多暴露其 AI 生成痕迹的瑕疵。v6-wild 被设计为更具不可预测性。Brody 说,wild 版是为“意外之喜和自然的不完美”而设。The Verge 记者在有限测试中很难察觉 wild 与标准版 v6 的明显差别。
三个模型在理解音乐类型方面均有显著提升。The Verge 记者重新使用此前对旧模型无效的提示词,要求生成“hyperpop”或“krautrock”歌曲,旧模型严重偏离目标,而 v6 能准确抓住这些类型的外在特征。
但 v6 仍无法实现“自然的不完美”。与 v5 一样,记者尝试生成走音、跑调或轻微不和谐的结果均告失败。无论怎样要求,v6 都只能产出和声与节奏完美的内容。要求“单调人声”和“不要鼓”,模型直接忽略;反复要求“完全跑调、随意弹奏、无视调性和节奏的钢琴”,也没有得到相应结果。同时,v6 仍保留 AI 音乐的不自然瑕疵,人声尤其比 v5 产生更多边缘粗糙的人工生成瑕疵。
v6 还包含底层更新,可能改变用户与模型互动方式。用户现在可以在聊天中用自然语言编辑歌曲片段,修改吉他声部或单句歌词无需重新生成整首歌曲。v6 还能把用户 Suno 库中的多个元素混合成新作品。提示词也不再限于文字描述,v6 可根据图像、视频或其他音频生成曲目。