Suno v6模型|首獲唱片業授權數據 仍難捕捉真人音樂缺陷
美國AI音樂初創Suno推出v6模型,首次使用華納音樂集團、BMG及Believe等唱片公司授權數據訓練。新模型分v6、v6-wild及v6-mini三版,v6-mini供免費用戶,v6-wild強調自然缺陷但測試效果有限。v6在風格辨識上明顯進步,卻仍無法模擬走音或節奏不穩等人類特質。Jack Brody指模型「從零開始訓練」,但未確認是否完全排除未授權內容。新功能包括文字編輯片段及支援圖像影片輸入。
【揀報】美國AI音樂初創Suno推出第六代模型v6,這是該公司首個獲得唱片業界支持的版本。Suno的Jack Brody向《The Verge》表示,v6「從零開始訓練 (trained from the ground up),使用全新數據集,不包含舊模型的訓練數據」。數據來自華納音樂集團、BMG及Believe等合作夥伴授權內容,以及「用戶數據 (user data)」。他未明確說明是否完全排除未經授權素材。 v6分為三個版本:v6-mini供免費用戶,強調快速且低資源消耗;v6-wild設計用於「意外驚喜與自然缺陷 (happy accidents and natural imperfections)」,但測試中與標準版差異不大;標準版v6在辨識音樂風格上大幅提升,能準確捕捉hyperpop或krautrock等流派的表面特徵。 不過v6仍無法重現真人音樂的自然缺陷。無論如何要求「走音 (out-of-tune)」、「無節奏 (no rhythm)」或「單調人聲 (monotone vocals)」,模型都無法生成符合要求的結果。v6反而保留AI特有的不自然雜訊,人聲部分更易出現尖銳偽影。 新功能包括用戶可透過聊天以文字指令編輯歌曲局部,例如更改吉他線或單句歌詞,無需重新生成整首;亦可混合多首作品,並接受圖像、影片或音訊作為輸入。Suno表示將逐步淘汰舊模型,v6已開始推出。
新聞來源:《The Verge》