> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-partner-nodes-consolidate.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSoundImageToVideo - ComfyUI Built-in Node Documentation

> WanSoundImageToVideo 노드는 선택적 오디오 조건화와 함께 이미지에서 비디오 콘텐츠를 생성합니다.

WanSoundImageToVideo 노드는 선택적 오디오 조건화와 함께 이미지에서 비디오 콘텐츠를 생성합니다. VAE 모델과 함께 포지티브 및 네거티브 조건화 프롬프트를 입력받아 비디오 잠재 표현을 생성하며, 참조 이미지, 오디오 인코딩, 컨트롤 비디오 및 모션 참조를 통합하여 비디오 생성 과정을 안내할 수 있습니다.

## 입력

| 매개변수         | 설명                                                                                                                   | 데이터 타입                 | 필수  | 범위                    |
| ------------ | -------------------------------------------------------------------------------------------------------------------- | ---------------------- | --- | --------------------- |
| `긍정 프롬프트`    | 생성된 비디오에 나타나야 할 콘텐츠를 안내하는 포지티브 조건화 프롬프트입니다.                                                                          | CONDITIONING           | 예   | -                     |
| `부정 프롬프트`    | 생성된 비디오에서 피해야 할 콘텐츠를 지정하는 네거티브 조건화 프롬프트입니다.                                                                          | CONDITIONING           | 예   | -                     |
| `VAE`        | 비디오 잠재 표현을 인코딩하고 디코딩하는 데 사용되는 VAE 모델입니다.                                                                             | VAE                    | 예   | -                     |
| `너비`         | 출력 비디오의 픽셀 단위 너비입니다 (기본값: 832, 16으로 나누어 떨어져야 합니다).                                                                   | INT                    | 예   | 16 to MAX\_RESOLUTION |
| `높이`         | 출력 비디오의 픽셀 단위 높이입니다 (기본값: 480, 16으로 나누어 떨어져야 합니다).                                                                   | INT                    | 예   | 16 to MAX\_RESOLUTION |
| `길이`         | 생성된 비디오의 프레임 수입니다 (기본값: 77, 4로 나누어 떨어져야 합니다).                                                                        | INT                    | 예   | 1 to MAX\_RESOLUTION  |
| `배치 크기`      | 동시에 생성할 비디오 수입니다 (기본값: 1).                                                                                           | INT                    | 예   | 1 \~ 4096             |
| `오디오 인코더 출력` | 사운드 특성에 따라 비디오 생성에 영향을 줄 수 있는 선택적 오디오 인코딩입니다. 제공되면 오디오 특징이 보간되어 비디오 생성 조건화에 사용됩니다.                                   | AUDIO\_ENCODER\_OUTPUT | 아니요 | -                     |
| `참조 이미지`     | 비디오 콘텐츠에 대한 시각적 안내를 제공하는 선택적 참조 이미지입니다. 이미지는 지정된 너비와 높이에 맞게 업스케일된 후 잠재 표현으로 인코딩됩니다. 입력의 첫 번째 이미지만 참조로 사용됩니다.         | IMAGE                  | 아니요 | -                     |
| `제어 비디오`     | 생성된 비디오의 모션과 구조를 안내하는 선택적 컨트롤 비디오입니다. 비디오는 업스케일 및 인코딩된 후 출력 조건화에 사용됩니다. 처음 `length` 프레임만 사용됩니다.                      | IMAGE                  | 아니요 | -                     |
| `참조 모션`      | 비디오의 움직임 패턴에 대한 안내를 제공하는 선택적 모션 참조입니다. 입력에 73개 이상의 프레임이 있는 경우 마지막 73개만 사용됩니다. 73개 미만의 프레임이 제공되면 시퀀스는 중립 프레임으로 채워집니다. | IMAGE                  | 아니요 | -                     |

## 출력

| 출력 이름     | 설명                                                                                                                                                | 데이터 타입       |
| --------- | ------------------------------------------------------------------------------------------------------------------------------------------------- | ------------ |
| `긍정 프롬프트` | 비디오 생성을 위해 수정된 처리된 포지티브 조건화로, 오디오 임베딩, 참조 잠재 표현, 모션 참조 및 컨트롤 비디오 조건화를 포함합니다.                                                                      | CONDITIONING |
| `부정 프롬프트` | 비디오 생성을 위해 수정된 처리된 네거티브 조건화로, 오디오 임베딩(0으로 설정), 참조 잠재 표현, 모션 참조 및 컨트롤 비디오 조건화를 포함합니다.                                                              | CONDITIONING |
| `잠재 공간`   | 최종 비디오 프레임으로 디코딩될 수 있는 잠재 공간의 생성된 비디오 표현입니다. 잠재 텐서는 \[batch\_size, 16, latent\_t, height/8, width/8] 형상을 가지며, 여기서 latent\_t는 length 매개변수에서 파생됩니다. | LATENT       |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSoundImageToVideo/ko.md)

***

**Source fingerprint (SHA-256):** `b1148cd00d8999dd6842e3c2fb13655fda8f20d5befed975a6d1652688b2807c`
