Skip to main content
VOIDInpaintConditioning ノードは、CogVideoX モデルでインペインティングに必要なコンディショニングデータを準備します。ソース動画と前処理済みの quadmask を受け取り、それらを VAE でエンコードし、モデルがマスク領域を埋めるために使用する 32 チャンネルのコンディショニング信号(マスクからの 16 チャンネル + マスクされた動画からの 16 チャンネル)に結合します。

入力

注意: CogVideoX-Fun-V1.5 は patch_size_t=2 を使用するため、エンコードされた latent の時間次元は偶数でなければなりません。length が奇数 latent_t を生成する場合、ノードは自動的に最も近い有効な値へ切り捨て、警告をログに記録します。奇数 latent_t を使用すると、循環パディングによって最後のフレームが破損し、デコードされた動画の終盤で目に見えるジッターや被写体の消失が発生することがあります。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 885e462c0f17a3e9610146a05ba3b9c879db0112d3961c95a83f63ba2cd511f1