Skip to main content
WanHuMoImageToVideo ノードは、Wan HuMo 動画生成パイプライン用のコンディショニングデータと空の潜在動画を準備します。参照画像と音声埋め込みをポジティブおよびネガティブコンディショニング入力に付加でき、要求された widthheightlengthbatch_size に応じたサイズのゼロ埋めされた潜在表現を生成します。

入力

注記: 参照画像が提供された場合、バッチ内の最初の画像は、バイリニア補間を使用して要求された widthheight にアップスケールされ、VAE でエンコードされます。その参照潜在表現はポジティブコンディショニングに付加され、同じ形状のゼロ埋めされた潜在表現はネガティブコンディショニングに付加されます。audio_encoder_output が提供された場合、音声埋め込みは補間されてポジティブコンディショニングに付加され、ゼロ埋めされた音声埋め込みはネガティブコンディショニングに付加されます。いずれかのオプション入力が省略された場合、ゼロ埋めされたプレースホルダーテンソルが使用されます。形状 [batch_size, 16, 1, height // 8, width // 8] のゼロ参照潜在表現、および/または形状 [batch_size, latent_t + 1, 8, 5, 1280] のゼロ音声埋め込みです。ここで latent_t = ((length - 1) // 4) + 1 です。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): db674a4a00729a8715988030083e2858f958cd21de73bbbe4ed6d76f5f539419