在本周,我們新增一項新功能,MiaoYin Studio翻唱台上線。
它能在線制作包括目前已有模型的所有在線翻唱功能,並且實時在線轉換模型的音色,在此之前,您應當了解功能以及產品價格。
![圖片[1]-妙音-RVC音色模型工坊](https://apis.klrvc.com/wp-content/uploads/2026/08/da54f3143820260816113302-1024x498.png)
第一步:選擇可用音色
“可用音色庫”只會展示當前賬號有權使用的模型,包括:
- 所有用戶均可使用的免費模型
- 你單獨購買過的模型
- 普通煉丹師會員可使用的模型
- 永久煉丹師會員可使用的模型
- 通過其他授權方式獲得使用權限的模型
例如,即使你不是會員,只要單獨購買過某個音色,該音色仍然會出現在你的音色庫中。
普通煉丹師和永久煉丹師登錄後,係統也會根據各自的會員權益,自動展示對應的可用模型。你不需要手動驗證權限,也不會看到當前賬號無權使用的模型。
選擇一個音色後,即可繼續上傳音頻並設置推理參數。
“免費”“已購買”或“會員可用”代表你擁有該模型的平台使用權限,不代表同時取得歌曲版權、聲音授權或商業使用許可。
第二步:上傳音頻
点擊時間軸中的上傳區域,選擇需要轉換的音頻文件。
為了獲得更好的翻唱效果,建議上傳:
- 人聲清晰、雜音較少的音頻
- 音量穩定、沒有嚴重削波的音頻
- 混響較少的乾聲
- WAV、FLAC 或高碼率 MP3 文件
- 時長不超過6分鐘、大小不超過50 MB的音頻
上傳完成後,原始音頻將顯示在第一條時間軸中。你可以試听、拖動播放進度,也可以重新上傳其他音頻。
相同音頻在有效期内再次使用時,係統會盡量復用已經上傳的文件,避免重復上傳和等待。
第三步:設置推理參數
MiaoYin Studio 保留了 RVC 常用的推理參數。如果你是第一次使用,可以直接保留默認值。
最需要了解的是以下兩個參數。
變調(半音)
變調用於調整輸入人聲與目標音色之間的音高差異。
- 向左調整:降低音高
- 向右調整:提高音高
0:保持原始音高
如果原始聲音偏低,而目標音色偏高,可以適當提高變調;如果原始聲音偏高,而目標音色偏低,可以適當降低變調。
常見參考值:
- 男聲轉換為偏高的女聲:可從
+6 至 +12 開始嘗試
- 女聲轉換為偏低的男聲:可從
-6 至 -12 開始嘗試
- 音域相近的聲音:建議先使用
0
這些數值不是固定規則。不同歌曲和音色模型的最佳設置可能不同,建議先用默認值生成,再根據試听結果微調。
音量包絡
音量包絡用於控制轉換結果在多大程度上跟隨原始音頻或模型輸出的音量變化。
它並不是簡單的“音量大小”控制:
- 數值較低:更多保留原始音頻的強弱變化
- 數值較高:更多采用轉換後音頻的音量包絡
- 默認值:適合大多數音頻
如果生成結果的音量起伏不自然,可以小幅調整此參數。不要一次調整太多,否則可能出現聲音忽大忽小或細節丟失的問題。
索引強度
索引強度決定推理時使用模型特征索引的程度。
較高的數值通常會讓結果更接近目標音色,但設置過高也可能增加雜音、咬字異常或不自然的音色特征。
第一次使用時,建議保留默認值。
子音保護
子音保護用於減少輔音、呼吸聲和清音在轉換過程中受到的破壞。
如果生成結果出現咬字模糊、輔音丟失或齒音異常,可以適當調整。第一次使用時建議保留默認值。
人聲分離
如果上傳的是一首已經混合了人聲和伴奏的完整歌曲,可以開啟“人聲分離”。
開啟後,係統會先將音頻分離為人聲和伴奏,只轉換分離出來的人聲,最後再將轉換後的人聲與伴奏重新混合。
時間軸將顯示以下五條軌道:
- 原始音頻
- 伴奏
- 分離人聲
- 轉換後人聲
- 轉換結果
五條軌道均可單獨試听和下載,方便你在其他音頻軟件中進行後期處理。
伴奏音量
控制最終混音中伴奏的音量。
如果伴奏蓋過人聲,可以適當降低;如果伴奏太小,則可以適當提高。
人聲音量
控制轉換後人聲在最終混音中的音量。
如果人聲不夠突出,可以適當提高;如果出現爆音或人聲過強,則建議降低。
人聲混響
開啟後,係統會為轉換後的人聲增加一定的空間感,使人聲與伴奏的融合更加自然。
如果原始音頻本身已經帶有明顯混響,建議謹慎開啟,以免最終結果的混響過重。
人聲分離註意事項
目前的人聲分離主要用於提取人聲和伴奏,無法保證完全去除原音頻中的混響、和聲、背景人聲或其他復雜聲音。
如果原始歌曲帶有明顯混響,分離後的人聲可能仍然包含部分空間殘留。為了獲得更好的效果,建議提前使用專業音頻分離或去混響軟件處理,取得質量較好的乾聲後再上傳。此時可以關閉 MiaoYin Studio 的人聲分離功能,直接轉換處理後的人聲。
人聲分離需要額外的計算資源,因此生成價格會高於普通轉換。開啟前,右側面板會自動顯示預計費用。
需要註意的是,任何人聲分離技術都無法保證完全無損。最終效果會受到歌曲類型、混響程度、人聲與伴奏重疊情況以及原始音頻質量的影響。
第四步:查看價格並開始生成
選擇音色、上傳音頻並設置參數後,右側面板會顯示本次任務的預計費用。
費用會優先從贈送時長中扣除;贈送時長不足時,再根據當前計費規則使用帳戶餘額。提交前請確認贈送額度或帳戶餘額充足。
確認無誤後,点擊“開始生成翻唱”。
如果所選模型是第一次在 GPU 服務器上使用,係統會自動完成以下流程:
- 準備並部署音色模型
- 部署完成後自動提交翻唱任務
- 等待任務排隊
- 執行人聲分離(如已開啟)
- 執行音色轉換
- 混合人聲與伴奏
- 生成最終結果
模型準備期間不需要重復点擊按鈕。部署完成後,係統會自動繼續執行你剛才提交的生成操作。
已經部署過的模型會保存在服務器緩存中。下次使用同一模型時,通常不需要再次等待部署。
第五步:試听與下載
生成完成後,你可以直接在時間軸中試听不同軌道。
開啟人聲分離時,原始音頻、伴奏、分離人聲、轉換後人聲和轉換結果均提供獨立下載按鈕。
如果沒有開啟人聲分離,則可以下載原始音頻和最終轉換結果。
係統同時會創建一條推理歷史記錄。你可以在右側“推理歷史”中:
- 試听歷史生成結果
- 下載歷史生成結果
- 查看使用的音色和生成時間
- 刪除不再需要的歷史記錄
文件保留與隱私
我們重視每一位用戶的隱私。
用戶上傳的音頻、中間處理文件及最終生成結果默認保留7天。在保留期内,你可以隨時試听或下載。
超過保留期限後,係統將自動清理相關文件。文件刪除後無法恢復,因此請及時下載需要長期保存的結果。
你也可以手動刪除推理歷史。刪除後,相關歷史記錄以及服務器上的對應音頻文件會同步清除,且無法恢復。
平台不會在頁面上公開你的音頻溯源信息,也不會向其他用戶展示你的上傳内容。
生成失敗與退款
MiaoYin Studio 目前處於公測階段。在模型部署、任務排隊、音頻上傳或推理過程中,可能受到網絡狀態、GPU負載以及音頻格式等因素影響。
如果任務未能成功完成:
- 未實際扣費的任務不會產生費用
- 已預扣的餘額將自動退回
- 已預扣的贈送時長將自動釋放
- 失敗任務不會按照成功任務計費
遇到臨時網絡錯誤時,請先等待片刻或刷新頁面查看任務狀態,不建議連續重復提交相同任務。
獲得更好效果的小技巧
- 盡量使用清晰、乾淨、混響較少的人聲。
- 原始音域與目標音色差距較大時,適當調整變調。
- 第一次使用某個模型時,先保留默認參數。
- 不要一次調整多個參數,否則很難判斷哪個參數影響了結果。
- 使用完整歌曲時可以開啟人聲分離;已有乾聲時建議關閉。
- 生成完成後分別試听“分離人聲”“轉換後人聲”和“轉換結果”,可以更快判斷問題來自分離、轉換還是最終混音。
- 重要作品請在7天内下載並自行備份。
AI 翻唱價格表
| 用戶類型 |
普通轉換 |
開啟人聲分離 |
| 普通用戶 |
¥0.12/分鐘 |
¥0.25/分鐘 |
| 普通煉丹師 |
¥0.08/分鐘 |
¥0.16/分鐘 |
| 永久煉丹師 |
¥0.05/分鐘 |
¥0.10/分鐘 |
開啟人聲分離後,將按照“人聲分離”單價計費,不會在普通轉換價格上重復疊加費用。
贈送時長
| 用戶類型 |
贈送額度 |
有效期 |
| 新註冊用戶 |
3分鐘 |
一次性贈送 |
| 普通煉丹師 |
每月50分鐘 |
當月有效,次月重新發放 |
| 永久煉丹師 |
首次贈送100分鐘 |
長期有效 |
| 永久煉丹師 |
此後每月10分鐘 |
當月有效,次月重新發放 |
贈送時長會優先使用。贈送時長用完後,才會從帳戶餘額中扣費。
常見時長價格參考
以下價格不包含贈送額度抵扣。
普通轉換
| 音頻時長 |
普通用戶 |
普通煉丹師 |
永久煉丹師 |
| 1分鐘 |
¥0.12 |
¥0.10* |
¥0.10* |
| 3分鐘 |
¥0.36 |
¥0.24 |
¥0.15 |
| 5分鐘 |
¥0.60 |
¥0.40 |
¥0.25 |
| 6分鐘 |
¥0.72 |
¥0.48 |
¥0.30 |
開啟人聲分離
| 音頻時長 |
普通用戶 |
普通煉丹師 |
永久煉丹師 |
| 1分鐘 |
¥0.25 |
¥0.16 |
¥0.10 |
| 3分鐘 |
¥0.75 |
¥0.48 |
¥0.30 |
| 5分鐘 |
¥1.25 |
¥0.80 |
¥0.50 |
| 6分鐘 |
¥1.50 |
¥0.96 |
¥0.60 |
* 單次產生餘額扣費時,最低扣費金額為 ¥0.10。
計費規則
- 按音頻實際時長計費,每10秒為一個計費單位。
- 不足10秒的部分按10秒計算。
- 贈送時長優先於帳戶餘額使用。
- 贈送時長足夠覆蓋本次任務時,帳戶餘額不會被扣除。
- 贈送時長只夠覆蓋部分音頻時,剩餘時長按照當前賬號對應的單價計費。
- 單次產生餘額扣費時,最低扣費金額為 ¥0.10。
- 開啟人聲分離後,按照人聲分離單價計算整段音頻。
- 提交按鈕上方會顯示本次任務的預計費用,確認後再提交即可。
例如,一段3分22秒的音頻會按照3分30秒計算。如果賬號還有2分鐘贈送時長,係統會先使用這2分鐘,剩餘1分30秒再按照當前用戶等級的單價扣費。
失敗退款
提交任務後,係統會暫時鎖定本次所需的贈送時長和帳戶餘額。
如果任務成功完成,係統將確認扣費;如果上傳、模型部署、人聲分離或推理過程失敗,係統會自動:
- 退回預扣的帳戶餘額
- 恢復本次使用的贈送時長
- 將交易記錄標記為已退款
失敗任務不會按照成功任務收取費用。
使用範圍
AI 翻唱功能僅提供音頻處理、聲音轉換與人聲分離等技術服務。使用本功能前,請確認你對上傳的音頻、歌曲、伴奏、人聲及所選音色模型擁有合法使用權。
可以使用的範圍
- 處理本人原創或已經獲得合法授權的歌曲、伴奏及錄音。
- 用於個人學習、技術測試、非公開試听和非商業創作。
- 在獲得完整授權後,用於視頻配樂、游戲、廣告、直播、音樂發行等商業場景。
- 按照音色模型頁面標註的授權範圍使用對應模型。
音色模型授權說明
“免費”“已購買”“普通煉丹師可用”或“永久煉丹師可用”,僅代表當前賬號擁有調用該模型進行推理的權限,不代表自動獲得以下權利:
- 歌曲詞曲版權
- 伴奏及錄音制品版權
- 原演唱者、配音者的聲音及人格權益
- 模型角色、名稱、形象及相關知識產權
- 商業發行、廣告代言或公開傳播授權
購買模型、開通會員或支付生成費用,購買的是模型使用資格和計算服務,不等同於獲得模型文件所有權、作品版權或商業授權。
禁止使用的範圍
不得利用本功能:
- 未經授權模仿、轉換或公開傳播可識別自然人的聲音。
- 制作虛假演唱、虛假代言、詐騙、冒充身份或可能誤導公眾的内容。
- 上傳或處理盜版歌曲、未經授權的伴奏、乾聲、錄音或其他侵權内容。
- 制作違法、色情、暴力、侮辱、誹謗、騷擾或侵犯他人隱私的内容。
- 提取、轉售、共享、破解或以其他方式獲取平台的模型文件及模型下載地址。
- 繞過會員、計費、訪問控制、簽名驗證或其他安全限制。
- 將生成結果描述為原歌手、配音演員或相關權利人的真實演唱、官方作品或授權作品。