search

RVC的使用教學(WEB_UI推理版)

visibility 2.5kchat_bubble_outline 0favorite 9
更新於: 25/09/21釋出於: 25/09/21
RVC的使用教學(WEB_UI推理版)

推理對比

推理後

未提供

模型介紹

這是寫給從未接觸RVC的小伙伴們,近期有許多入門的小伙伴剛剛接觸RVC,不太懂如何能跑通,本教學將會以最簡單通俗的講法來教您。

配置

項目 最低能跑 建議入門
顯卡 GTX 1060 6 G 及以上 NVIDIA 卡 RTX 3060 12 G
CPU 4 核 8 線程 10 代 i5 / R5-5600 以上
内存 8 GB 16 GB
係統 Win10/11 64 位 同左

下載

網絡環境好的小伙伴可以直接在Github上下載整合包,我們的所有模型都是基於(2.2.231006)該版本訓練而成。

https://github.com/RVC-Project/Retrieval-based-Voice-Conversion-WebUI/releases/tag/2.2.231006

當然作者也準備了慢速包的下載地址。

下載完成後直接解壓。

其中,你只需要註意項目根目錄下的兩個文件:

go-realtime-gui.bat(實時變聲客戶端)

go-web.bat(RVC_Web)

這兩個的區別在於前者只需要配合聲卡(虛擬聲卡)跳線,即可實時進行音色的轉換。後者可以進行音頻推理以及模型的訓練。

模型訓練以及實時變聲客戶端這裡就不進行闡述,上方模型關聯有教學,如果您感興趣,可以看看《從入門到精通》的這個教學。

這裡主要教大家怎么使用RVC_web進行音頻推理(一般用於ai翻唱,二創)等。

推理

go-web.bat,雙擊打開文件,控制台會輸出以下信息:

\RVC1006Nvidia>runtime\python.exe infer-web.py --pycmd runtime\python.exe --port 6968默認端口是6969,我這裡由於和其他端口有衝突,改成了6968,如果遇到警告端口衝突,你只需要在go-web.bat編輯一個新的端口重新運行即可。
2025-09-21 13:55:10 | INFO | configs.config | Found GPU NVIDIA GeForce RTX 4090這裡是你的GPU信息,如果無,可能你沒有選擇對應的整合包版本,識別不出來。
is_half:True, device:cuda:0同上
2025-09-21 13:55:14 | INFO | __main__ | Use Language: zh_CN默認的語言。

Running on local URL: http://0.0.0.0:6968

之後就會彈出網頁(可能有一部分小伙伴的電腦彈不出來,那么就請你在瀏覽器中輸入)http://127.0.0.1:6969即可。基本上在這裡你的環境就沒有什么問題。有問題可能結合問題搜尋一下解決方法。

—–補充——-

有小伙伴控制台一直沒有跳出這個網頁這一步,卡住了。解決方法,控制台回車即可。

圖片[1]-妙音-RVC音色模型工坊

這裡比較重要,要想獲得推理的模型,首先將我們的模型放入。

RVC1006Nvidia\assets\weights

切記,以後下載的所有rvc模型,後綴帶有pth一律要放在這個文件夾内。

之後,我們刷新音色列表和索引路徑即可,下拉到我們放入的模型。

關於index後綴,你可以隨便放在什么地方,然後將路徑填寫到[特征檢索庫文件路徑,為空則使用下拉的選擇結果]即可。

變調:假設我們的模型告訴你是女聲的音源,那么你是男聲,你就在這裡直接填入數字12,當然你也可以填寫一個你認為差不多的音調數值。反之,我們的模型告訴你是男生的音源,那么數字就要填寫-12。也是根據實際情況來填寫數值。往往很多時候,小伙伴下載的模型和預覽的模型听起來不一樣,這裡需要解釋,每個人的音源都不同,所以大概只能達到70-80%相似程度,比如一個模型,a用和b用兩個音色都會有一些差別。這裡你只能根據變調來調整一個你覺得合適的位置。

輸入待處理音頻文件路徑(默認是正確格式示例):填寫一個乾淨的音源,模型就會輸出這個音源所說的話或者歌曲。

重点

保持輸入音源的乾淨,一定要一個乾淨的音源,你需要了解一下人聲分離,單獨吧人聲提取輸出,目前【剪映-收費】以及【uvr5-開源免費】都可以實現人聲分離,如果不太懂uvr5,網絡有很多教學,小伙伴可以搜一搜。

呼吸保護,有些時候的輸出呼吸有撕裂的電流音,你可以將 保護清輔音和呼吸聲 拉低,拉到你覺得沒有呼吸撕裂感覺為止。

有些獨特的音色需要特別註意變調的靈活運用,打個比方正太音,明明是個小男孩說話的聲音,那我變調設置在0,怎么沒有達到預期?正太音几乎都是女生“偽”出來的音色,變調也需要根據實際情況往上走,大概在8到12的一個位置區間,總之需要靈活運用,變調。

還有一個就是模型語言,如果模型語言標記是日語,那么模型就只能推理日語方面的歌曲,當然也可以推薦其他語音,只不過達不到效果,會出現“大佐音”。

其他在web_ui中的推理就沒什么重点可說,大部分都很簡單,只要跑通一兩次,你也可以創建一個自己的”二創作品”。

妙音模型

妙音模型

inventory_20person_add0

版本詳情

是否原創非原創

推薦引數

Threshold0.25
Pitch0
Index Rate0.75
Volume Factor1.25
Sample Length192
Harvest Processes2
Fade Length100
Extra Inference Time500
info僅供參考,請根據實際情況調整!

相關模型

暫無相關模型

模型關鍵詞

#rvc#rvc_ui#下載#推理#教學

使用者評論

暫無評論