Skip to main content
LTXV Reference Audio は、参照音声クリップから話者の声のアイデンティティを生成音声に転送します。参照音声をコンディショニングにエンコードし、必要に応じてモデルをアイデンティティガイダンスでパッチ処理します。これにより、各ステップで参照なしの追加フォワードパスが実行され、話者性の効果が増幅されます。

入力

注:アイデンティティガイダンスは、identity_guidance_scale が0より大きく、現在のサンプリングステップが start_percentend_percent で定義された範囲内にある場合にのみ適用されます。参照音声は、オーディオVAEのサンプルレートと異なる場合、そのサンプルレートにリサンプリングされます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): ae15c5838656324667d099614b325b863341f05afda43054658999574522dd49