> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSoundImageToVideo - ComfyUI Built-in Node Documentation

> WanSoundImageToVideo ノードは、Wan サウンド・トゥ・ビデオ生成用のコンディショニングと空の潜在ビデオテンソルを準備します。

WanSoundImageToVideo ノードは、Wan サウンド・トゥ・ビデオ生成用のコンディショニングと空の潜在ビデオテンソルを準備します。オプションで、音声エンコーディング、参照画像、制御ビデオ、モーション参照を取り込み、生成されるビデオをガイドすることができます。

## 入力

| パラメータ          | 説明                                                                                                                         | データ型                   | 必須  | 範囲                    |
| -------------- | -------------------------------------------------------------------------------------------------------------------------- | ---------------------- | --- | --------------------- |
| `ポジティブ`        | 生成されるビデオにどのようなコンテンツを含めるかをガイドするポジティブコンディショニングプロンプト                                                                          | CONDITIONING           | はい  | -                     |
| `ネガティブ`        | 生成されるビデオで避けるべきコンテンツを指定するネガティブコンディショニングプロンプト                                                                                | CONDITIONING           | はい  | -                     |
| `VAE`          | 参照画像、モーション参照、制御ビデオフレームを潜在表現にエンコードするために使用される VAE モデル                                                                        | VAE                    | はい  | -                     |
| `幅`            | 出力ビデオの幅（ピクセル単位、デフォルト: 832、ステップ: 16）                                                                                        | INT                    | はい  | 16 to MAX\_RESOLUTION |
| `高さ`           | 出力ビデオの高さ（ピクセル単位、デフォルト: 480、ステップ: 16）                                                                                       | INT                    | はい  | 16 to MAX\_RESOLUTION |
| `長さ`           | 生成されるビデオのフレーム数（デフォルト: 77、ステップ: 4）                                                                                          | INT                    | はい  | 1 to MAX\_RESOLUTION  |
| `バッチサイズ`       | 同時に生成するビデオの数（デフォルト: 1）                                                                                                     | INT                    | はい  | 1 〜 4096              |
| `オーディオエンコーダ出力` | 音の特性に基づいてビデオ生成に影響を与えることができるオプションの音声エンコーディング。指定された場合、音声特徴量が補間され、ビデオ生成のコンディショニングに使用されます。                                     | AUDIO\_ENCODER\_OUTPUT | いいえ | -                     |
| `参照画像`         | ビデオコンテンツの視覚的なガイダンスを提供するオプションの参照画像。画像は指定された幅と高さに合わせてアップスケールされ、その後潜在表現にエンコードされます。入力の最初の画像のみが参照として使用されます。                     | IMAGE                  | いいえ | -                     |
| `制御ビデオ`        | 生成されるビデオの動きと構造をガイドするオプションの制御ビデオ。ビデオはアップスケールおよびエンコードされ、出力のコンディショニングに使用されます。最初の `length` フレームのみが使用されます。                      | IMAGE                  | いいえ | -                     |
| `参照モーション`      | ビデオ内の動きのパターンに対するガイダンスを提供するオプションのモーション参照。入力のフレーム数が 73 を超える場合、最後の 73 フレームのみが使用されます。73 フレーム未満の場合は、ニュートラルフレームでシーケンスがパディングされます。 | IMAGE                  | いいえ | -                     |

注: すべてのオプション入力は、個別に、または組み合わせて使用できます。ノードは、接続されているオプション入力に基づいて、提供された `positive` および `negative` コンディショニングを変更します。

## 出力

| 出力名        | 説明                                                                                                                                       | データ型         |
| ---------- | ---------------------------------------------------------------------------------------------------------------------------------------- | ------------ |
| `positive` | ビデオ生成用に変更された処理済みのポジティブコンディショニング。対応するオプション入力が提供された場合、音声埋め込み、参照潜在、モーション参照、制御ビデオコンディショニングが含まれます                                             | CONDITIONING |
| `negative` | ビデオ生成用に変更された処理済みのネガティブコンディショニング。対応するオプション入力が提供された場合、音声埋め込み（ゼロに設定）、参照潜在、モーション参照、制御ビデオコンディショニングが含まれます                                      | CONDITIONING |
| `latent`   | 生成の開始点として使用される空の潜在ビデオテンソル。潜在テンソルの形状は `[batch_size, 16, latent_t, height/8, width/8]` で、`latent_t` は `((length - 1) // 4) + 1` として計算されます。 | LATENT       |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSoundImageToVideo/ja.md)

***

**Source fingerprint (SHA-256):** `b1148cd00d8999dd6842e3c2fb13655fda8f20d5befed975a6d1652688b2807c`
