一時興起想來玩玩看用AI換歌曲的演唱者聲音,想當然不會有現成的,要自己訓練模型才行。 需要準備的煉丹材料大約是總計30分鐘到一小時的歌聲材料,最好乾淨而且覆蓋的音域夠廣. 如果材料裡面有伴奏的話,出來的聲音完全沒法用.如果覆蓋的音域不夠廣,在某些音高模型推理出來的結果就會啞掉. 由於so-vits-svc的中文資源看起來比較多,就先嘗試用這套來做訓練了。 準備資料的過程大約是準備好一些原始音檔,長…
一時興起想來玩玩看用AI換歌曲的演唱者聲音,想當然不會有現成的,要自己訓練模型才行。 需要準備的煉丹材料大約是總計30分鐘到一小時的歌聲材料,最好乾淨而且覆蓋的音域夠廣. 如果材料裡面有伴奏的話,出來的聲音完全沒法用.如果覆蓋的音域不夠廣,在某些音高模型推理出來的結果就會啞掉. 由於so-vits-svc的中文資源看起來比較多,就先嘗試用這套來做訓練了。 準備資料的過程大約是準備好一些原始音檔,長…
讨论
登录后参与讨论
还没有评论,来说第一句吧。