在本周,我们新增一项新功能,MiaoYin Studio翻唱台上线。
它能在线制作包括目前已有模型的所有在线翻唱功能,并且实时在线转换模型的音色,在此之前,您应当了解功能以及产品价格。
![图片[1]-妙音-RVC音色模型工坊](https://apis.klrvc.com/wp-content/uploads/2026/08/da54f3143820260816113302-1024x498.png)
第一步:选择可用音色
“可用音色库”只会展示当前账号有权使用的模型,包括:
- 所有用户均可使用的免费模型
- 你单独购买过的模型
- 普通炼丹师会员可使用的模型
- 永久炼丹师会员可使用的模型
- 通过其他授权方式获得使用权限的模型
例如,即使你不是会员,只要单独购买过某个音色,该音色仍然会出现在你的音色库中。
普通炼丹师和永久炼丹师登录后,系统也会根据各自的会员权益,自动展示对应的可用模型。你不需要手动验证权限,也不会看到当前账号无权使用的模型。
选择一个音色后,即可继续上传音频并设置推理参数。
“免费”“已购买”或“会员可用”代表你拥有该模型的平台使用权限,不代表同时取得歌曲版权、声音授权或商业使用许可。
第二步:上传音频
点击时间轴中的上传区域,选择需要转换的音频文件。
为了获得更好的翻唱效果,建议上传:
- 人声清晰、杂音较少的音频
- 音量稳定、没有严重削波的音频
- 混响较少的干声
- WAV、FLAC 或高码率 MP3 文件
- 时长不超过6分钟、大小不超过50 MB的音频
上传完成后,原始音频将显示在第一条时间轴中。你可以试听、拖动播放进度,也可以重新上传其他音频。
相同音频在有效期内再次使用时,系统会尽量复用已经上传的文件,避免重复上传和等待。
第三步:设置推理参数
MiaoYin Studio 保留了 RVC 常用的推理参数。如果你是第一次使用,可以直接保留默认值。
最需要了解的是以下两个参数。
变调(半音)
变调用于调整输入人声与目标音色之间的音高差异。
- 向左调整:降低音高
- 向右调整:提高音高
0:保持原始音高
如果原始声音偏低,而目标音色偏高,可以适当提高变调;如果原始声音偏高,而目标音色偏低,可以适当降低变调。
常见参考值:
- 男声转换为偏高的女声:可从
+6 至 +12 开始尝试
- 女声转换为偏低的男声:可从
-6 至 -12 开始尝试
- 音域相近的声音:建议先使用
0
这些数值不是固定规则。不同歌曲和音色模型的最佳设置可能不同,建议先用默认值生成,再根据试听结果微调。
音量包络
音量包络用于控制转换结果在多大程度上跟随原始音频或模型输出的音量变化。
它并不是简单的“音量大小”控制:
- 数值较低:更多保留原始音频的强弱变化
- 数值较高:更多采用转换后音频的音量包络
- 默认值:适合大多数音频
如果生成结果的音量起伏不自然,可以小幅调整此参数。不要一次调整太多,否则可能出现声音忽大忽小或细节丢失的问题。
索引强度
索引强度决定推理时使用模型特征索引的程度。
较高的数值通常会让结果更接近目标音色,但设置过高也可能增加杂音、咬字异常或不自然的音色特征。
第一次使用时,建议保留默认值。
子音保护
子音保护用于减少辅音、呼吸声和清音在转换过程中受到的破坏。
如果生成结果出现咬字模糊、辅音丢失或齿音异常,可以适当调整。第一次使用时建议保留默认值。
人声分离
如果上传的是一首已经混合了人声和伴奏的完整歌曲,可以开启“人声分离”。
开启后,系统会先将音频分离为人声和伴奏,只转换分离出来的人声,最后再将转换后的人声与伴奏重新混合。
时间轴将显示以下五条轨道:
- 原始音频
- 伴奏
- 分离人声
- 转换后人声
- 转换结果
五条轨道均可单独试听和下载,方便你在其他音频软件中进行后期处理。
伴奏音量
控制最终混音中伴奏的音量。
如果伴奏盖过人声,可以适当降低;如果伴奏太小,则可以适当提高。
人声音量
控制转换后人声在最终混音中的音量。
如果人声不够突出,可以适当提高;如果出现爆音或人声过强,则建议降低。
人声混响
开启后,系统会为转换后的人声增加一定的空间感,使人声与伴奏的融合更加自然。
如果原始音频本身已经带有明显混响,建议谨慎开启,以免最终结果的混响过重。
人声分离注意事项
目前的人声分离主要用于提取人声和伴奏,无法保证完全去除原音频中的混响、和声、背景人声或其他复杂声音。
如果原始歌曲带有明显混响,分离后的人声可能仍然包含部分空间残留。为了获得更好的效果,建议提前使用专业音频分离或去混响软件处理,取得质量较好的干声后再上传。此时可以关闭 MiaoYin Studio 的人声分离功能,直接转换处理后的人声。
人声分离需要额外的计算资源,因此生成价格会高于普通转换。开启前,右侧面板会自动显示预计费用。
需要注意的是,任何人声分离技术都无法保证完全无损。最终效果会受到歌曲类型、混响程度、人声与伴奏重叠情况以及原始音频质量的影响。
第四步:查看价格并开始生成
选择音色、上传音频并设置参数后,右侧面板会显示本次任务的预计费用。
费用会优先从赠送时长中扣除;赠送时长不足时,再根据当前计费规则使用账户余额。提交前请确认赠送额度或账户余额充足。
确认无误后,点击“开始生成翻唱”。
如果所选模型是第一次在 GPU 服务器上使用,系统会自动完成以下流程:
- 准备并部署音色模型
- 部署完成后自动提交翻唱任务
- 等待任务排队
- 执行人声分离(如已开启)
- 执行音色转换
- 混合人声与伴奏
- 生成最终结果
模型准备期间不需要重复点击按钮。部署完成后,系统会自动继续执行你刚才提交的生成操作。
已经部署过的模型会保存在服务器缓存中。下次使用同一模型时,通常不需要再次等待部署。
第五步:试听与下载
生成完成后,你可以直接在时间轴中试听不同轨道。
开启人声分离时,原始音频、伴奏、分离人声、转换后人声和转换结果均提供独立下载按钮。
如果没有开启人声分离,则可以下载原始音频和最终转换结果。
系统同时会创建一条推理历史记录。你可以在右侧“推理历史”中:
- 试听历史生成结果
- 下载历史生成结果
- 查看使用的音色和生成时间
- 删除不再需要的历史记录
文件保留与隐私
我们重视每一位用户的隐私。
用户上传的音频、中间处理文件及最终生成结果默认保留7天。在保留期内,你可以随时试听或下载。
超过保留期限后,系统将自动清理相关文件。文件删除后无法恢复,因此请及时下载需要长期保存的结果。
你也可以手动删除推理历史。删除后,相关历史记录以及服务器上的对应音频文件会同步清除,且无法恢复。
平台不会在页面上公开你的音频溯源信息,也不会向其他用户展示你的上传内容。
生成失败与退款
MiaoYin Studio 目前处于公测阶段。在模型部署、任务排队、音频上传或推理过程中,可能受到网络状态、GPU负载以及音频格式等因素影响。
如果任务未能成功完成:
- 未实际扣费的任务不会产生费用
- 已预扣的余额将自动退回
- 已预扣的赠送时长将自动释放
- 失败任务不会按照成功任务计费
遇到临时网络错误时,请先等待片刻或刷新页面查看任务状态,不建议连续重复提交相同任务。
获得更好效果的小技巧
- 尽量使用清晰、干净、混响较少的人声。
- 原始音域与目标音色差距较大时,适当调整变调。
- 第一次使用某个模型时,先保留默认参数。
- 不要一次调整多个参数,否则很难判断哪个参数影响了结果。
- 使用完整歌曲时可以开启人声分离;已有干声时建议关闭。
- 生成完成后分别试听“分离人声”“转换后人声”和“转换结果”,可以更快判断问题来自分离、转换还是最终混音。
- 重要作品请在7天内下载并自行备份。
AI 翻唱价格表
| 用户类型 |
普通转换 |
开启人声分离 |
| 普通用户 |
¥0.12/分钟 |
¥0.25/分钟 |
| 普通炼丹师 |
¥0.08/分钟 |
¥0.16/分钟 |
| 永久炼丹师 |
¥0.05/分钟 |
¥0.10/分钟 |
开启人声分离后,将按照“人声分离”单价计费,不会在普通转换价格上重复叠加费用。
赠送时长
| 用户类型 |
赠送额度 |
有效期 |
| 新注册用户 |
3分钟 |
一次性赠送 |
| 普通炼丹师 |
每月50分钟 |
当月有效,次月重新发放 |
| 永久炼丹师 |
首次赠送100分钟 |
长期有效 |
| 永久炼丹师 |
此后每月10分钟 |
当月有效,次月重新发放 |
赠送时长会优先使用。赠送时长用完后,才会从账户余额中扣费。
常见时长价格参考
以下价格不包含赠送额度抵扣。
普通转换
| 音频时长 |
普通用户 |
普通炼丹师 |
永久炼丹师 |
| 1分钟 |
¥0.12 |
¥0.10* |
¥0.10* |
| 3分钟 |
¥0.36 |
¥0.24 |
¥0.15 |
| 5分钟 |
¥0.60 |
¥0.40 |
¥0.25 |
| 6分钟 |
¥0.72 |
¥0.48 |
¥0.30 |
开启人声分离
| 音频时长 |
普通用户 |
普通炼丹师 |
永久炼丹师 |
| 1分钟 |
¥0.25 |
¥0.16 |
¥0.10 |
| 3分钟 |
¥0.75 |
¥0.48 |
¥0.30 |
| 5分钟 |
¥1.25 |
¥0.80 |
¥0.50 |
| 6分钟 |
¥1.50 |
¥0.96 |
¥0.60 |
* 单次产生余额扣费时,最低扣费金额为 ¥0.10。
计费规则
- 按音频实际时长计费,每10秒为一个计费单位。
- 不足10秒的部分按10秒计算。
- 赠送时长优先于账户余额使用。
- 赠送时长足够覆盖本次任务时,账户余额不会被扣除。
- 赠送时长只够覆盖部分音频时,剩余时长按照当前账号对应的单价计费。
- 单次产生余额扣费时,最低扣费金额为 ¥0.10。
- 开启人声分离后,按照人声分离单价计算整段音频。
- 提交按钮上方会显示本次任务的预计费用,确认后再提交即可。
例如,一段3分22秒的音频会按照3分30秒计算。如果账号还有2分钟赠送时长,系统会先使用这2分钟,剩余1分30秒再按照当前用户等级的单价扣费。
失败退款
提交任务后,系统会暂时锁定本次所需的赠送时长和账户余额。
如果任务成功完成,系统将确认扣费;如果上传、模型部署、人声分离或推理过程失败,系统会自动:
- 退回预扣的账户余额
- 恢复本次使用的赠送时长
- 将交易记录标记为已退款
失败任务不会按照成功任务收取费用。
使用范围
AI 翻唱功能仅提供音频处理、声音转换与人声分离等技术服务。使用本功能前,请确认你对上传的音频、歌曲、伴奏、人声及所选音色模型拥有合法使用权。
可以使用的范围
- 处理本人原创或已经获得合法授权的歌曲、伴奏及录音。
- 用于个人学习、技术测试、非公开试听和非商业创作。
- 在获得完整授权后,用于视频配乐、游戏、广告、直播、音乐发行等商业场景。
- 按照音色模型页面标注的授权范围使用对应模型。
音色模型授权说明
“免费”“已购买”“普通炼丹师可用”或“永久炼丹师可用”,仅代表当前账号拥有调用该模型进行推理的权限,不代表自动获得以下权利:
- 歌曲词曲版权
- 伴奏及录音制品版权
- 原演唱者、配音者的声音及人格权益
- 模型角色、名称、形象及相关知识产权
- 商业发行、广告代言或公开传播授权
购买模型、开通会员或支付生成费用,购买的是模型使用资格和计算服务,不等同于获得模型文件所有权、作品版权或商业授权。
禁止使用的范围
不得利用本功能:
- 未经授权模仿、转换或公开传播可识别自然人的声音。
- 制作虚假演唱、虚假代言、诈骗、冒充身份或可能误导公众的内容。
- 上传或处理盗版歌曲、未经授权的伴奏、干声、录音或其他侵权内容。
- 制作违法、色情、暴力、侮辱、诽谤、骚扰或侵犯他人隐私的内容。
- 提取、转售、共享、破解或以其他方式获取平台的模型文件及模型下载地址。
- 绕过会员、计费、访问控制、签名验证或其他安全限制。
- 将生成结果描述为原歌手、配音演员或相关权利人的真实演唱、官方作品或授权作品。