width、height、length、バッチサイズから空の latent 動画を作成し、参照画像が指定された場合は VAE でエンコードして、時間次元の視覚的ガイダンスとして conditioning に追加します。
入力
注意:
images が指定された場合、それらは指定された width と height に一致するように自動的にアップスケールされ、最初の length 枚の画像のみが処理に使用されます。各画像は vae でエンコードされて時間次元に沿って連結され、各画像の RGB チャンネルのみが使用されます。images が指定されない場合、3 つの conditioning 出力はすべて入力 conditioning から変更されずに返されます。
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
a1853382f6e564f66262b69dd7b06cc58e26b93386a460a98e6fcc2ff6acf12b