Skip to main content
LTXV Reference Audio は、参照オーディオクリップから生成オーディオへ話者の声のアイデンティティを転送します。参照オーディオをコンディショニングにエンコードし、オプションでアイデンティティガイダンスを用いてモデルにパッチを適用します。これは、話者のアイデンティティ効果を増幅するために、各ステップで参照なしの追加フォワードパスを実行します。

入力

注: アイデンティティガイダンスは、identity_guidance_scale が 0 より大きく、かつ現在のサンプリングステップが start_percentend_percent で定義された範囲内にある場合にのみ適用されます。参照オーディオとオーディオ VAE のサンプルレートが異なる場合、参照オーディオはオーディオ VAE のサンプルレートにリサンプリングされます。 注: start_percentend_percent は詳細パラメータであり、インターフェースで詳細オプションが有効な場合にのみ表示されます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): ae15c5838656324667d099614b325b863341f05afda43054658999574522dd49