> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanHuMoImageToVideo - ComfyUI Built-in Node Documentation

> WanHuMoImageToVideo ノードは、Wan HuMo 動画生成パイプライン用のコンディショニングデータと空の潜在動画を準備します。

WanHuMoImageToVideo ノードは、Wan HuMo 動画生成パイプライン用のコンディショニングデータと空の潜在動画を準備します。参照画像と音声埋め込みをポジティブおよびネガティブコンディショニング入力に付加でき、要求された `width`、`height`、`length`、`batch_size` に応じたサイズのゼロ埋めされた潜在表現を生成します。

## 入力

| パラメータ           | 説明                                                     | データ型               | 必須  | 範囲                         |
| --------------- | ------------------------------------------------------ | ------------------ | --- | -------------------------- |
| `ポジティブ`         | 動画生成を望ましい内容へ導くポジティブコンディショニング入力。                        | CONDITIONING       | はい  | -                          |
| `ネガティブ`         | 動画生成を望ましくない内容から遠ざけるネガティブコンディショニング入力。                   | CONDITIONING       | はい  | -                          |
| `VAE`           | 参照画像を潜在空間へエンコードするために使用される VAE モデル。                     | VAE                | はい  | -                          |
| `幅`             | 出力動画フレームの幅（ピクセル単位）。デフォルト: 832。                         | INT                | はい  | 16～MAX\_RESOLUTION、ステップ 16 |
| `高さ`            | 出力動画フレームの高さ（ピクセル単位）。デフォルト: 480。                        | INT                | はい  | 16～MAX\_RESOLUTION、ステップ 16 |
| `長さ`            | 生成される動画シーケンス内のフレーム数。デフォルト: 97。                         | INT                | はい  | 1～MAX\_RESOLUTION、ステップ 4   |
| `バッチサイズ`        | 同時に生成する動画シーケンス数。デフォルト: 1。                              | INT                | はい  | 1～4096                     |
| `オーディオエンコーダー出力` | 音声内容に基づいて動画生成に影響を与えることができる、オプションの音声エンコードデータ。           | AUDIOENCODEROUTPUT | いいえ | -                          |
| `参照画像`          | 動画生成のスタイルと内容を導くために使用されるオプションの参照画像。バッチ内の最初の画像のみが使用されます。 | IMAGE              | いいえ | -                          |

**注記:** 参照画像が提供された場合、バッチ内の最初の画像は、バイリニア補間を使用して要求された `width` と `height` にアップスケールされ、VAE でエンコードされます。その参照潜在表現はポジティブコンディショニングに付加され、同じ形状のゼロ埋めされた潜在表現はネガティブコンディショニングに付加されます。`audio_encoder_output` が提供された場合、音声埋め込みは補間されてポジティブコンディショニングに付加され、ゼロ埋めされた音声埋め込みはネガティブコンディショニングに付加されます。いずれかのオプション入力が省略された場合、ゼロ埋めされたプレースホルダーテンソルが使用されます。形状 `[batch_size, 16, 1, height // 8, width // 8]` のゼロ参照潜在表現、および/または形状 `[batch_size, latent_t + 1, 8, 5, 1280]` のゼロ音声埋め込みです。ここで `latent_t = ((length - 1) // 4) + 1` です。

## 出力

| 出力名        | 説明                                                                                                                                                                           | データ型         |
| ---------- | ---------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ------------ |
| `positive` | 参照画像および/または音声埋め込みが組み込まれた、変更済みのポジティブコンディショニング。                                                                                                                                | CONDITIONING |
| `negative` | 参照画像および/または音声埋め込みが組み込まれた、変更済みのネガティブコンディショニング。                                                                                                                                | CONDITIONING |
| `latent`   | 動画シーケンス用のゼロで初期化された潜在表現。サイズは `width`、`height`、`length`、`batch_size` に従います。形状: `[batch_size, 16, latent_t, height // 8, width // 8]`。ここで `latent_t = ((length - 1) // 4) + 1`。 | LATENT       |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanHuMoImageToVideo/ja.md)

***

**Source fingerprint (SHA-256):** `db674a4a00729a8715988030083e2858f958cd21de73bbbe4ed6d76f5f539419`
