> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSoundImageToVideo - ComfyUI Built-in Node Documentation

> WanSoundImageToVideo 노드는 Wan 사운드-투-비디오 생성을 위해 컨디셔닝과 빈 잠재 비디오 텐서를 준비합니다. 선택적으로 오디오 인코딩, 참조 이미지, 제어 비디오 및 모션 참조를 통합하여 생성된 비디오를 안내할 수 있습니다.

WanSoundImageToVideo 노드는 Wan 사운드-투-비디오 생성을 위해 컨디셔닝과 빈 잠재 비디오 텐서를 준비합니다. 선택적으로 오디오 인코딩, 참조 이미지, 제어 비디오 및 모션 참조를 통합하여 생성된 비디오를 안내할 수 있습니다.

## 입력

| 매개변수         | 설명                                                                                                                   | 데이터 타입                 | 필수  | 범위                    |
| ------------ | -------------------------------------------------------------------------------------------------------------------- | ---------------------- | --- | --------------------- |
| `긍정 프롬프트`    | 생성된 비디오에 나타나야 할 콘텐츠를 안내하는 긍정 컨디셔닝 프롬프트                                                                               | CONDITIONING           | 예   | -                     |
| `부정 프롬프트`    | 생성된 비디오에서 피해야 할 콘텐츠를 지정하는 부정 컨디셔닝 프롬프트                                                                               | CONDITIONING           | 예   | -                     |
| `VAE`        | 참조 이미지, 모션 참조 및 제어 비디오 프레임을 잠재 표현으로 인코딩하는 데 사용되는 VAE 모델                                                              | VAE                    | 예   | -                     |
| `너비`         | 출력 비디오의 너비(픽셀 단위) (기본값: 832, 단계: 16)                                                                                 | INT                    | 예   | 16 to MAX\_RESOLUTION |
| `높이`         | 출력 비디오의 높이(픽셀 단위) (기본값: 480, 단계: 16)                                                                                 | INT                    | 예   | 16 to MAX\_RESOLUTION |
| `길이`         | 생성된 비디오의 프레임 수 (기본값: 77, 단계: 4)                                                                                      | INT                    | 예   | 1 to MAX\_RESOLUTION  |
| `배치 크기`      | 동시에 생성할 비디오 수 (기본값: 1)                                                                                               | INT                    | 예   | 1  \~  4096           |
| `오디오 인코더 출력` | 선택적 오디오 인코딩으로, 사운드 특성에 따라 비디오 생성에 영향을 줄 수 있습니다. 제공된 경우 오디오 특징이 보간되어 비디오 생성 조건으로 사용됩니다.                               | AUDIO\_ENCODER\_OUTPUT | 아니요 | -                     |
| `참조 이미지`     | 비디오 콘텐츠에 대한 시각적 안내를 제공하는 선택적 참조 이미지입니다. 이미지는 지정된 너비와 높이에 맞게 업스케일된 후 잠재 표현으로 인코딩됩니다. 입력의 첫 번째 이미지만 참조로 사용됩니다.         | IMAGE                  | 아니요 | -                     |
| `제어 비디오`     | 생성된 비디오의 모션과 구조를 안내하는 선택적 제어 비디오입니다. 비디오는 업스케일되고 인코딩된 후 출력을 컨디셔닝하는 데 사용됩니다. 처음 `length` 프레임만 사용됩니다.                  | IMAGE                  | 아니요 | -                     |
| `참조 모션`      | 비디오의 움직임 패턴에 대한 안내를 제공하는 선택적 모션 참조입니다. 입력에 73개 이상의 프레임이 있는 경우 마지막 73개만 사용됩니다. 73개 미만의 프레임이 제공되면 시퀀스는 중립 프레임으로 패딩됩니다. | IMAGE                  | 아니요 | -                     |

참고: 모든 선택적 입력은 독립적으로 또는 함께 사용할 수 있습니다. 노드는 연결된 선택적 입력에 따라 제공된 `positive` 및 `negative` 컨디셔닝을 수정합니다.

## 출력

| 출력 이름      | 설명                                                                                                                                                | 데이터 타입       |
| ---------- | ------------------------------------------------------------------------------------------------------------------------------------------------- | ------------ |
| `positive` | 비디오 생성을 위해 수정된 처리된 긍정 컨디셔닝으로, 해당 선택적 입력이 제공된 경우 오디오 임베딩, 참조 잠재, 모션 참조 및 제어 비디오 컨디셔닝을 포함합니다.                                                       | CONDITIONING |
| `negative` | 비디오 생성을 위해 수정된 처리된 부정 컨디셔닝으로, 해당 선택적 입력이 제공된 경우 오디오 임베딩(0으로 설정됨), 참조 잠재, 모션 참조 및 제어 비디오 컨디셔닝을 포함합니다.                                              | CONDITIONING |
| `latent`   | 생성을 위한 시작점으로 사용되는 빈 잠재 비디오 텐서입니다. 잠재 텐서의 형태는 `[batch_size, 16, latent_t, height/8, width/8]`이며, 여기서 `latent_t`는 `((length - 1) // 4) + 1`로 계산됩니다. | LATENT       |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSoundImageToVideo/ko.md)

***

**Source fingerprint (SHA-256):** `b1148cd00d8999dd6842e3c2fb13655fda8f20d5befed975a6d1652688b2807c`
