アイ・チウチウ 24000歩文宇RVCモデル
visibility 2.1kchat_bubble_outline 0favorite 6
更新日: 26/07/10公開日: 25/03/01
推論比較
推論後
0:000:00
mxgf.otherInference
0:000:00
モデル紹介
これは刺激的なモデルトレーニングセッションで、この時点で私たちは最新のファインチューニング済み事前学習モデルを使っていました。
モデルデータセットは約15分の長さで、生のセリフとトーンパフォーマンスを含み、合計24,000ステップ
があります
(部分訓練損失関数曲線)。
推論テストでは、発音はデフォルトの低モードモデルよりも優れており、曲の最適化も比較的良好です。
ただし、このモデルについて注意すべき点は、呼吸に理想的ではないことです。これは、元のデータでの呼吸処理時の音量不足や分離時の呼吸喪失が原因と考えられます。 2回目のトレーニングでは、対応する呼吸音を追加して少し和らげようとしましたが、元の呼吸音を抑える必要がある場合やできるだけ低く抑える必要がある場合は、その音を使いたいと思っていました。
例えばトーンテストの観点では、「話しながら静かに笑う」は問題ありませんが、大声で笑いすぎると電流が出ることがあり、これはこのモデルの電流の欠点です。
もちろん、人それぞれのデバイスや入力によって影響は異なるかもしれません。
zhangzhang
inventory_20person_add0
バージョン詳細
オリジナルはい
ベースアルゴリズムRmvpe
対応能力支援
言語マンダリン
サンプルレート44K
推奨パラメータ
Threshold0.25
Pitch0
Index Rate0.75
Volume Factor1.25
Sample Length192
Harvest Processes2
Fade Length100
Extra Inference Time500
info参考用です。実際の入力に応じて調整してください!
関連モデル
関連モデルなし
キーワード
#Ai#rvc#若い少女#モデル#文宇#秋秋
コメント
コメントはまだありません

