今
週は新機能を追加しました:MiaoYin Studioのカバーテーブルです。
既存のすべてのモデルに対してオンラインカバー機能を作成し、モデルのトーンをリアルタイムで変換できます。その前に、機能や商品価格を理解しておくべきです。
![Image [1]-Miaoyin-RVC Sound Model Workshop](https://apis.klrvc.com/wp-content/uploads/2026/08/da54f3143820260816113302-1024x498.png)
ステップ1:利用可能な音色を選ぶ
「利用可能な音声ライブラリ」には、現在のアカウントで使用許可されているモデルのみが表示されます。以下は以下の通りです:
- すべてのユーザーが利用できる無料モデル
- 別途購入したモデル
- 通常の錬金術師メンバーが利用できるモデル
- 常駐錬金術師メンバーが利用できるモデル
- 他の認可方法を通じて使用権を取得するモデル
例えば、メンバーでなくても、特定の音を個別に購入していれば、その音色は引き続きボイスライブラリに表示されます。
ログイン後、通常および常勤の錬金術師はそれぞれのメンバー特典に基づいて利用可能なモデルを自動的に表示します。 権限を手動で確認する必要はなく、現在のアカウントで使用許可されていないモデルも表示されません。
ト
ーンを選択した後、音声のアップロードを続けて推論パラメータを設定できます。
「無料」「購入済み」または「会員利用可能」とは、モデルにプラットフォームアクセス権があることを意味しますが、同時に楽曲の著作権、音響承認、商業ライセンスを取得しているわけではありません。
ステップ2:音声アップロード
タイムラインのアップロードエリアをクリックし、変換したい音声ファイルを選択します。
より良いカバー効果を狙うには、以下のアップロードを推奨します:
- クリアなボーカルと最小限のノイズを持つ音声
- 音量は安定していて、重度のクリッピングはありません
- 残響が少ないドライな音
- WAV、FLAC、または高ビットレートのMP3ファイル
- 音声の長さは6分を超えず、最大容量は50MB以下
アップロード後、最初のタイムラインに元の音声が表示されます。 再生進行をドラッグしたり、他の音声ファイルを再アップロードしたりできます。
有効期間内に同じ音声が再び使用されると、システムは重複アップロードや待ち時間を避けるためにアップロードしたファイルの再利用を試みます。
ステップ3:推論パラメータを設定する
MiaoYin StudioはRVCで一般的に用いられる推論パラメータを保持しています。 初めて使う場合は、デフォルト値をそのまま使っても構いません。
最も理解すべき2つのパラメータは以下の通りです。
トーンサンディ(ハーフトーン)。
ピッチサンディは入力ボーカルとターゲット音色のピッチ差を調整するために使われます。
- 左調整:音程を下げる
- 右に調整する:ピッチを上げる
- <コード dir="ltr">0:元の音高を維持する
元の音が低くて目標音が高ければ、ピッチ変化を適切に大きくすることができます。 元の音が高く、ターゲットトーンが低い場合は、適切にピッチの変化を下げることができます。
一般的な参照値:
- 男性の声を高音の女性の声に変換する:
+6から+12へと始められます
- 女性の声を低い男性の声に変換する:
-6から-12へ
- 音域が似ている場合:まず
0を使うことをお勧めします
これらの値は固定されたルールではありません。 最適な設定は曲や音色モデルによって異なる場合があります。まずデフォルト値を生成し、その後、聴く結果に基づいて微調整を行うことが推奨されます。
体積エンベロープ
音量エンベロープは、変換結果が元の音声やモデル出力の音量変化にどれだけ従うかを制御します。
単
なる「音量コントロール」ではありません。
- 低評価:元の音声の強度の変動をより多く保持します
- より高い値:変換されたオーディオの音量エンベロープを多く使用
します
- デフォルト:ほとんどの音声に適している
生成された結果の音量変動が不自然な場合は、この設定を少し調整できます。 一度にあまり多くの調整をしないと、音量の変動や細部の損失が起きる可能性があります。
指数強度
指数の強さは、推論時にモデルの特徴指数がどの程度使用されるかを決定します。
値を上げると結果が目標の音色に近づくことが多いですが、高すぎるとノイズやアーティキュレーション、不自然な音色特性が増すこともあります。
初めて使うときは、デフォルトの設定を維持することが推奨されます。
子
音保護
子
音保護は、変換時の子音、呼吸音、無声音の損傷を減らすために用いられます。
生成された結果で発音のぼやけ、子音の喪失、または異常な歯擦音が見られた場合は、それに応じて調整を行うことができます。 初回使用時はデフォルトの値を保つことが推奨されます。
声
が分かれている
すでにボーカルと伴奏が混ざった完全な曲をアップロードすれば、「ボーカルセレクション」を有効にすることができます。
有効化されると、システムはまず音声をボーカルと伴奏に分け、分離したボーカルのみを変換し、最後に変換したボーカルと伴奏をリミックスします。
タイムラインには以下の5曲が表示されます。
- オリジナル音声
- 伴奏
- 人の声によって隔てられて
- 改宗後のボーカル
- 転換結果
5トラックすべてを個別にプレビュー・ダウンロードできるため、他のオーディオソフトでのポストプロセッシングにも便利です。
伴奏音量
最終ミックスで伴奏の音量をコントロールしてください。
伴奏がボーカルをかき消す場合は、適切に音量を下げることができます。 伴奏が小さすぎる場合は、適切に増やすことができます。
声量
最終ミックス時に変換後のボーカルの音量をコントロールします。
ボーカルが十分に目立たない場合は、適切に増幅させることができます。 ポップやボーカルが強すぎる場合は、音量を下げることが推奨されます。
声がこだまする
一度有効化されると、変換されたボーカルに空間感を加え、ボーカルと伴奏の融合がより自然になります。
元の音声にすでに明らかな残響がある場合は、最終的な結果で過度な残響を避けるために慎重に有効に設定することが推奨されます。
声帯分離に関する注記
現在、ボーカルセパレーションは主にボーカルや伴奏の抽出に使われており、リバーブ、ハーモニー、バックボーカル、その他の複雑な音を完全に元の音声から除去することは保証できません。
元の曲に明らかな残響がある場合、分離されたボーカルに空間的な残滓が残っている可能性があります。 より良い結果を得るためには、事前にプロの音声分離または残響除去ソフトウェアを使用し、高品質でドライな音を得た後にのみアップロードすることが推奨されます。 この段階で、MiaoYin Studioのボーカル分離機能を無効にして、処理したボーカルを直接変換できます。
声の分離は追加の計算資源を必要とするため、生成コストは通常の変換よりも高くなります。 アクティベート前に、見積もり費用が右側のパネルに自動的に表示されます。
ボー
カル分離技術では完全な無損失性を保証することはできません。 最終的な結果は曲の種類、残響レベル、ボーカルと伴奏の重なり、そしてオリジナル音声の品質によって影響されます。
ステップ4:価格を確認し、作成を始めます
音色を選択し、音声をアップロードし、パラメータを設定すると、この作業の推定コストが右側のパネルに表示されます。
まずボーナス期間から手数料が差し引かれます。 プレゼント期間が不十分な場合は、現在の請求ルールに従って口座残高を使用してください。 提出前に、ギフトの限度額または口座残高が十分かどうかを確認してください。
すべてが正しいことを確認したら、「カバーの生成を開始します」をクリックしてください。
選択したモデルがGPUサーバー上で初めて使用された場合、システムは自動的に以下のステップを実行します。
- ティンバーモデルを準備し展開する
- 展開後、カバータスクは自動的に提出されます
- クエストがキューに入るのを待っています
- ボーカルセレクション(有効なら)を実行してください。
- トーン変換を行う
- ボーカルと伴奏のミキシング
- 最終結果を生成します
モデル準備中に繰り返しボタンを押す必要はありません。 展開完了後、システムは自動的に提出した発電操作を継続します。
展開されたモデルはサーバーキャッシュに保存されます。 同じモデルを次に使うときは、通常は次の展開を待つ必要はありません。
ステップ5:聴いてダウンロードする
一度生成されると、タイムライン上の異なるトラックを直接聴くことができます。
ボーカル分離を有効にすると、元の音声、伴奏、分離されたボーカル、変換されたボーカル、変換結果にそれぞれ別のダウンロードボタンが表示されます。
ボーカル分離が有効でない場合は、元の音声と最終変換結果をダウンロードできます。
この
システムは推論の歴史も作成します。 右側の「推論履歴」欄で見つけることができます:
- 歴史的な生成結果を聞いてみましょう
- 過去に生成された結果をダウンロードしてください
- 使用されている音色や生成時間を確認してください
- 不要な歴史的記録を削除してください
ファイルの保存とプライバシー
私たちはすべてのユーザーのプライバシーを大切にしています。
ユーザーがアップロードした音声、中間処理ファイル、最終生成された結果は、デフォルトで7日間保持されます。 保存期間中はいつでも聴くかダウンロードできます。
保存期間が終了すると、システムは自動的に関連ファイルをクリーンアップします。 一度ファイルが削除されると復元できないため、長期保存が必要な結果は速やかにダウンロードしてください。
手動で推論履歴を削除することもできます。 削除後は、サーバー上の関連する履歴と対応する音声ファイルが同時に消去され、復元は不可能です。
プラットフォームはページ上で音声のトレーサビリティ情報を開示せず、アップロードしたコンテンツも他のユーザーに表示しません。
発電故障と返金
MiaoYin Studioは現在パブリックベータ版です。 モデル展開、タスクキューイング、音声アップロード、推論中に、ネットワークの状態、GPU負荷、音声フォーマットなどの要素が影響を受けることがあります。
タスクが正常に完了しなかった場合:
- 実際には控除されない作業には手数料
がかかりません
- 差し引いた残高は自動的に返金されます
- 差し引いたボーナス時間は自動的に解放されます
- 失敗したタスクは成功としてカウントされません
一時的なネットワークエラーが発生した場合は、少し待つかページを更新してタスクの状況を確認してください。同じタスクを繰り返し提出することは推奨されません。
より良い結果を得るためのヒント
- クリアでクリーンなボーカルを使い、リバーバーを最小限に抑えるようにしましょう。
- 元の音域が目標音色と大きく異なる場合は、キーチェンジを適切に調整してください。
- 初めてモデルを使うときは、まずデフォルトのパラメータを保持してください。
- 複数のパラメータを同時に調整しないでください。そうしないと、どのパラメータが結果に影響を与えるか判別しにくくなります。
- フル曲を使用する場合はボーカル分離を有効にすることができます。 すでに乾いた音がある場合は、電源を切ることを推奨します。
- 生成後は「分離されたボーカル」「変換されたボーカル」「変換結果」を別々に聴くことで、分離、変換、最終ミキシングによる問題をより早く特定できます。
- 重要な作品は7日以内にダウンロードし、ご自身でバックアップしてください。
AIカバープライスリスト
| ユーザータイプ |
正規変換 |
声帯分離を発動する |
| 常連ユーザー |
¥0.12/分 |
¥0.25/分 |
| 普通の錬金術師 |
¥0.08/分 |
¥0.16/分 |
| 常設錬金術師 |
¥0.05/分 |
¥0.10/分 |
声帯分離が有効になると、「声帯分離」の単価で請求され、通常の換算価格に追加料金はかかりません。
時間を無駄にする
| ユーザータイプ |
ボーナスクレジット限度額 |
有効期間 |
| 新規登録ユーザー |
3分 |
一度きりの贈り物 |
| 普通の錬金術師 |
月50分 |
当月有効で翌月に再発行 |
| 常設錬金術師 |
最初の100分は含まれています |
長期的な効果 |
| 常設錬金術師 |
その後は月に10分ずつ |
当月有効で翌月に再発行 |
ボーナスタイムが優先されます。 ボーナスはボーナス期間が終了した後にのみ口座残高から差し引かれます。
共通デュレーション価格の参照
以下の料金にはボーナスクレジット控除は含まれていません。
正規変換
| 音声の長さ |
常連ユーザー |
普通の錬金術師 |
常設錬金術師 |
| 1分 |
¥0.12 |
¥0.10* |
¥0.10* |
| 3分 |
¥0.36 |
¥0.24 |
¥0.15 |
| 5分 |
¥0.60 |
¥0.40 |
¥0.25 |
| 6分 |
¥0.72 |
¥0.48 |
¥0.30 |
声帯分離を発動する
| 音声の長さ |
常連ユーザー |
普通の錬金術師 |
常設錬金術師 |
| 1分 |
¥0.25 |
¥0.16 |
¥0.10 |
| 3分 |
¥0.75 |
¥0.48 |
¥0.30 |
| 5分 |
¥1.25 |
¥0.80 |
¥0.50 |
| 6分 |
¥1.50 |
¥0.96 |
¥0.60 |
* 単独の残高控除の場合、最低控除額は¥0.10です。
請求ルール
- 請求は実際の音声時間に基づいており、10秒ごとに1単位の請求単位が行われます。
- 10秒未満の分数は10秒とカウントされます。
- 贈与期間は口座残高よりも優先されます。
- 報酬期間がこの作業を賄うのに十分であれば、口座残高は差し引かれません。
ボーナス- 時間が音声の一部しかカバーしない場合、残りの時間はあなたの現在の口座に対応する単価に応じて請求されます。
- 単一残高控除の場合、最低控除額は¥0.10です。
- ボーカル分離を有効にした後、音声セグメント全体がボーカル分離の単価に基づいて計算されます。
- タスクの推定費用は送信ボタンの上に表示されます。確認後、送信が可能です。
例えば、3分22秒の音声セグメントは3分30秒とカウントされます。 アカウントにまだ2分間のボーナス時間がある場合、システムはまずその2分間を使用し、残りの1分30秒は現在のユーザーレベルの単価に応じて請求されます。
失敗した場合は返金してください
タスクを送信すると、システムは必要なギフト期間とアカウント残高を一時的にロックします。
タスクが正常に完了すると、システムは充電を確認します。 アップロード、モデル展開、音声分離、推論が失敗した場合、システムは自動的に以下を行います。
- 差し止めた口座残高を返金してください
今- 回使ったボーナス持続時間が回復します
- 取引記録を返金済みとしてマークしてください
失敗したタスクは成功としてカウントされません。
使用範囲
AIカバー機能は音声処理、音声変換、ボーカルセレクションなどの技術サービスのみを提供します。 この機能を使用する前に、アップロードされた音声、楽曲、伴奏、ボーカル、選ばれたトーンモデルを使用する法的権利があるか確認してください。
適用範囲
- オリジナルまたは法的に許可された曲、伴奏、録音は自分で扱っています。
- 個人学習、技術テスト、プライベートオーディション、非商業的な創作に使用されます。
- 完全な承認を得た後は、ビデオスコア、ゲーム、広告、ライブストリーミング、音楽配信などの商業的シナリオに使用されます。
- ティンバーモデルページに示された認可範囲に従って対応するモデルを使用してください。
トーンモデル認可命令
「無料」「購入済み」「通常錬金術師に利用可能」または「常設錬金術師に利用可能」とは、当座口座がモデルを理由に呼び出す権利を有するものであり、以下の権利を自動的に付与するものではありません。
- 歌詞および作曲の著作権
- 伴奏および録音製品の著作権
- オリジナル歌手および吹き替えアーティストの声とパーソナリティの権利
- モデルキャラクター、名前、画像、関連する知的財産
- 商業的流通、広告の推薦、または公共のコミュニケーション承認
モデルの購入、会員登録、生成料の支払いはモデル使用資格や計算サービスの購入であり、モデルファイルの所有権、著作権、商業的承認を得ることには意味しません。
禁止範囲
この機能は使わないでください:
- 自然人に識別可能な声の無許可の模倣、変容、または公衆の拡散。
- 虚偽のパフォーマンス、虚偽の推薦、詐欺、なりすまし、または一般を誤解させる可能性のあるコンテンツの作成。
- 海賊版の曲のアップロードまたは取り扱い、無許可の伴奏、乾いた声、録音、その他の侵害コンテンツ。
- 違法、ポルノ、暴力、侮辱、名誉毀損、嫌がらせ、または他人のプライバシー侵害を制作すること。
プラットフォームの- モデルファイルやダウンロードアドレスの抽出、再販、共有、クラック、またはその他の方法で取得すること。
- メンバーシップ、請求、アクセス制御、署名認証、その他のセキュリティ制限を回避すること。
- 生成された結果を、実際のパフォーマンス、公式作品、または元の歌手、声優、または関連権利者による公式作品として記述します。