> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# Wan22ImageToVideoLatent - ComfyUI Built-in Node Documentation

> Wan22ImageToVideoLatent は、画像から動画の潜在表現を生成します。

Wan22ImageToVideoLatent は、画像から動画の潜在表現を生成します。指定された幅、高さ、フレーム長、バッチサイズで空の動画潜在空間を生成し、必要に応じて開始画像シーケンスを先頭フレームにエンコードできます。開始画像が提供されると、ノードはそれを潜在空間にエンコードし、生成時にノイズ除去すべき領域を示す対応するノイズマスクを作成します。

## 入力

| パラメータ    | 説明                                                      | データ型  | 必須  | 範囲                    |
| -------- | ------------------------------------------------------- | ----- | --- | --------------------- |
| `vae`    | 開始画像を潜在空間にエンコードするために使用される VAE モデル                       | VAE   | はい  | -                     |
| `幅`      | 出力動画の幅（ピクセル単位、デフォルト: 1280、ステップ: 32）                     | INT   | はい  | 32 to MAX\_RESOLUTION |
| `高さ`     | 出力動画の高さ（ピクセル単位、デフォルト: 704、ステップ: 32）                     | INT   | はい  | 32 to MAX\_RESOLUTION |
| `長さ`     | 動画シーケンス内のフレーム数（デフォルト: 49、ステップ: 4）                       | INT   | はい  | 1 to MAX\_RESOLUTION  |
| `バッチサイズ` | 生成する動画潜在表現の数（デフォルト: 1）                                  | INT   | はい  | 1 〜 4096              |
| `開始画像`   | 動画潜在表現の先頭フレームにエンコードする任意の開始画像シーケンス（最初の `length` フレームを使用） | IMAGE | いいえ | -                     |

**注記:** `start_image` が提供される場合、画像シーケンスはターゲットの `width` と `height` にアップスケールされ、VAE でエンコードされて、潜在表現の先頭フレームに配置されます。これらのフレームのノイズマスクは 0（保持）に設定され、残りのフレームのマスク値は 1（ノイズ除去対象）になります。潜在表現は常に 48 チャンネル、空間次元は `height / 16` × `width / 16`、時間次元は `((length - 1) // 4) + 1` です。`width` と `height` は 16 で割り切れる必要があり（ステップ 32 によって強制されます）、`length` は時間次元を 4 刻みで増加させます。

`start_image` が提供されない場合、完全に空の潜在表現がノイズマスクなしで返され、その空の潜在表現には `batch_size` 入力は適用されません。

## 出力

| 出力名          | 説明                                                 | データ型   |
| ------------ | -------------------------------------------------- | ------ |
| `samples`    | 生成された動画潜在表現。バッチ内の各項目に対して繰り返されます                    | LATENT |
| `noise_mask` | ノイズ除去すべき領域（値 1）と、エンコードされた開始画像を保持する領域（値 0）を示すノイズマスク | LATENT |

両方のフィールドは、単一の LATENT 出力内にまとめて返されます。

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/Wan22ImageToVideoLatent/ja.md)

***

**Source fingerprint (SHA-256):** `3d05980641eeef2e86df7a845aa8b2bd703882db98fe71adef2746ab34a9d717`
