> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# MiniMaxH3ReferenceToVideo - ComfyUI Built-in Node Documentation

> MiniMax H3 Reference to Video는 MiniMax H3 reference-to-video 생성에 필요한 텍스트 컨디셔닝과 빈 오디오-비디오 latent를 생성합니다. 프롬프트와 선택적 참조 이미지, 비디오, 오디오 클립을 제공하면, 노드가 이러한 참조를 모델이 생성 중 사용할 수 있는 컨디셔닝으로 인코

MiniMax H3 Reference to Video는 MiniMax H3 reference-to-video 생성에 필요한 텍스트 컨디셔닝과 빈 오디오-비디오 latent를 생성합니다. 프롬프트와 선택적 참조 이미지, 비디오, 오디오 클립을 제공하면, 노드가 이러한 참조를 모델이 생성 중 사용할 수 있는 컨디셔닝으로 인코딩합니다. 프롬프트는 `<Picture i>`, `<Video k>`, `<Audio j>` 태그로 참조를 가리킵니다.

## 입력

| 매개변수               | 설명                                                                                                                                                                                      | 데이터 타입 | 필수  | 범위                     |
| ------------------ | --------------------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | ------ | --- | ---------------------- |
| `clip`             | 프롬프트를 토큰화하고 참조 미디어를 컨디셔닝 토큰으로 인코딩하는 데 사용되는 CLIP 모델입니다.                                                                                                                                  | CLIP   | 예   |                        |
| `vae`              | 비디오 VAE입니다. 이것이 없으면 참조 이미지/비디오는 텍스트 인코더만 조건화합니다.                                                                                                                                        | VAE    | 아니요 |                        |
| `audio_vae`        | 오디오 VAE입니다. 이것이 없으면 참조 오디오는 텍스트 인코더만 조건화합니다.                                                                                                                                            | VAE    | 아니요 |                        |
| `prompt`           | 비디오용 텍스트 프롬프트입니다. 참조 미디어는 `<Picture i>`, `<Video k>`, `<Audio j>` 태그로 지정할 수 있습니다(유형별 1부터 시작). 여러 줄 및 동적 프롬프트를 지원합니다.                                                                    | STRING | 예   |                        |
| `width`            | 생성되는 비디오의 너비(픽셀)입니다(기본값: 1344).                                                                                                                                                         | INT    | 예   | 32  \~  16384 (단계: 32) |
| `height`           | 생성되는 비디오의 높이(픽셀)입니다(기본값: 768).                                                                                                                                                          | INT    | 예   | 32  \~  16384 (단계: 32) |
| `length`           | 24 fps에서의 프레임 수입니다(124 = 약 5초, 학습 범위는 약 124-362)(기본값: 124).                                                                                                                             | INT    | 예   | 5  \~  3600 (단계: 17)   |
| `ref_image_size`   | 참조 이미지 크기 조정입니다. `match`는 각 참조를 생성의 픽셀 영역에 맞게 조정합니다(축소만 하며 종횡비 유지). `max`는 최상의 아이덴티티 충실도를 위해 참조 파이프라인의 2048px 짧은 변을 사용합니다. 참조 토큰은 모든 샘플링 단계를 거치므로 `max`는 몇 배 더 느릴 수 있습니다(기본값: `match`). | COMBO  | 예   | `"match"`<br />`"max"` |
| `ref_images`       | 확장 가능한 슬롯: 최대 9개의 참조 이미지를 연결합니다(`ref_image_1` ... `ref_image_9`). 참조 이미지(더 큰 경우 2048 짧은 변으로 축소되며, 절대 업스케일되지 않음).                                                                        | IMAGE  | 아니요 | 0  \~  9               |
| `ref_videos`       | 확장 가능한 슬롯: 최대 3개의 참조 비디오를 연결합니다(`ref_video_1` ... `ref_video_3`). 24 fps의 참조 비디오 프레임(2-15초).                                                                                            | IMAGE  | 아니요 | 0  \~  3               |
| `ref_video_audios` | 확장 가능한 슬롯: 최대 3개의 사운드트랙을 연결합니다(`ref_video_audio_1` ... `ref_video_audio_3`). 같은 번호의 참조 비디오의 사운드트랙입니다.                                                                                   | AUDIO  | 아니요 | 0  \~  3               |
| `ref_audios`       | 확장 가능한 슬롯: 최대 3개의 독립형 참조 오디오 클립을 연결합니다(`ref_audio_1` ... `ref_audio_3`). 독립형 참조 오디오입니다.                                                                                                 | AUDIO  | 아니요 | 0  \~  3               |

참고:

* 프롬프트는 유형별 1부터 시작하는 태그로 참조 미디어를 가리킵니다. 이미지는 `<Picture i>`, 비디오는 `<Video k>`, 오디오는 `<Audio j>`입니다. 참조는 이미지, 그다음 비디오(각 사운드트랙의 `<Audio j>` 레이블이 해당 `<Video k>` 바로 앞에 위치), 그다음 독립형 오디오의 고정된 순서로 모델에 제공됩니다.
* `ref_video_audio_N`에 연결된 사운드트랙은 `ref_video_N`에 연결된 참조 비디오와 함께 사용됩니다.
* 참조 비디오는 최소 5프레임(24 fps에서 약 0.2초)을 포함해야 하며, 그렇지 않으면 노드에서 오류를 발생시킵니다. 요청된 `length`를 초과하는 프레임은 잘라내며, 남은 프레임 수는 모델에서 지원하는 값으로 조정됩니다.
* 요청된 `length`는 latent가 생성되기 전에 지원되는 프레임 수로 정렬됩니다.
* `vae`가 없으면 참조 이미지와 비디오는 텍스트 인코더만 조건화합니다(참조 latent가 생성되지 않음). `audio_vae`가 없으면 참조 오디오는 텍스트 인코더만 조건화합니다.

## 출력

| 출력 이름      | 설명                                                                                                   | 데이터 타입       |
| ---------- | ---------------------------------------------------------------------------------------------------- | ------------ |
| `positive` | 인코딩된 프롬프트를 포함하는 컨디셔닝입니다. 참조 미디어와 관련 VAE가 제공되면 MiniMax H3 모델에서 사용하는 인코딩된 참조 이미지, 비디오, 오디오 콘텐츠도 포함합니다. | CONDITIONING |
| `latent`   | 요청된 `width`, `height`, `length`(프레임 수)의 빈 오디오-비디오 latent이며, 정렬된 비디오 latent와 오디오 latent를 포함합니다.       | LATENT       |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/MiniMaxH3ReferenceToVideo/ko.md)

***

**Source fingerprint (SHA-256):** `47df0d6d13cb02aa4f69b50a7f8d0f6c1639c1fb5e0f69bf8fc57dd4cb752db8`
