Skip to main content
このノードは、LTXV-AVモデルに対してクロスモーダル(オーディオ・ビデオ)ガイダンスを適用します。サンプリング中、各ステップでオーディオからビデオへのクロスアテンション接続とビデオからオーディオへのクロスアテンション接続を無効にした状態で前方パスを1回余分に実行し、その結果を結合された予測に向けて押し出すことで、リップシンクなどの音声と映像の同期を強化します。modality_scale の参照デフォルト値は 3.0 です。1.0 に設定すると余分なパスが無効になり、dual-CFGガイダーおよびSTGと組み合わせて使用できます。

入力

ガイダンスは、シグマ値が start_percentend_percent で定義される範囲内にあるサンプリングステップにのみ適用されます。この範囲外では、ノードはノイズ除去された結果を変更せずに返します。modality_scale が 1.0 の場合も、余分な前方パスは完全に無効になります。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 038be607c42e626a8a8f5fe336ee466d0847d43835edb71e20ff38f668069cfb