search

【原創】有手就能行,RVC新手模型訓練教學(雲端教學)

visibility 4.0kchat_bubble_outline 0favorite 15
更新於: 24/09/01釋出於: 24/04/10
【原創】有手就能行,RVC新手模型訓練教學(雲端教學)

推理對比

推理後

未提供

模型介紹

前沿

近期包小柏用AI“復刻”了女兒,其中在聲音這塊使用了當下最流行的Ai軟件RVC來復刻還原聲音,此外還有視頻網站音樂區up主掀了“AI孫燕姿”的風潮,都是使用了這一塊的Ai軟件來制作還原音色。

動手試一試

這裡我們使用

AUTODL

對比其他的雲端,Autodl顯卡種類多,相對於價格會比較便宜很多,或者如果不想訓練的話可以直接用其他已經制作好的高質量模型,這裡推薦妙音工坊,千款免費的大模型,也算是制作的比較全的一款模型網站妙音-RVC聲音克隆工坊

在選擇算力顯卡的時候默認推薦選擇3080Ti,價格和算力都是比較實惠的。

WX20240410-100057

選擇社區鏡像RVC-第一個

這裡需要註意的是V4推薦40以上的顯卡,V3適合30以上的顯卡,其他V1和V2版本不推薦使用。

WX20240410-100614

創建完成後我們進入控制台点擊-Jupyterlab

WX20240410-100854

控制台内輸出代碼

cd /root/Retrieval-based-Voice-Conversion-WebUI && python infer-web.py --port 6006

WX20240410-101122

我們訪問終端給出的鏈接進行訪問

WX20240410-101239

詳細功能說明

模型推理

WX20240410-101815

訓練好的模型第一步就是得刷新,才能正常的顯示在推理音色當中,男轉女+12,女轉男-12即可,其他的設置可以跟著上圖設置,其他默認不動,完成設置点擊轉換即可。

伴奏人聲分離

WX20240410-102146

這裡可以根據上方提示進行,需要註意的是音頻是否帶混響,再決定不同的模型。

WX20240410-102826

WX20240410-102858

這裡需要註意的是,乾音一定要沒有背景音,雜音,或者其他什么聲音,按照以上設置即可,這裡說一下輪數不一定是越高越好,我們測試一下來乾音質量好的情況下50輪也是能可以的,輸入的訓練音頻最少最少最少不能低於一分鐘,會失敗。 訓練完成後會保存在weights 文件夾内。

模型融合

WX20240410-103331

通俗的來說就是將A和B模型進行融合,輸出C模型,這裡需要註意的一点就是A和B融合的比例,如果你想保留更多A模型的音色你可以拉到超過0.5的比例。

其他說明

其實訓練RVC模型步驟就並沒有多復雜,復雜的是如何對乾音的處理,我們大部分下載過來的乾音就算去除背景音還是不太完美,導致後期推理的時候會出現各種奇奇怪怪的問題,訓練好的大模型最重要的是乾音部分的處理。

妙音模型

妙音模型

inventory_20person_add0

版本詳情

是否原創原創
基礎演算法Rmvpe
支援能力支持
語言國語
取樣率44K

推薦引數

Threshold0.25
Pitch0
Index Rate0.75
Volume Factor1.25
Sample Length192
Harvest Processes2
Fade Length100
Extra Inference Time500
info僅供參考,請根據實際情況調整!

相關模型

暫無相關模型

模型關鍵詞

#rvc#雲端#教學#模型#訓練

使用者評論

暫無評論