> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-docs-partner-nodes-consolidate.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSCAILToVideo - ComfyUI Built-in Node Documentation

> WanSCAILToVideo 노드는 SCAIL 및 SCAIL-2 비디오 모델을 사용한 비디오 생성을 위해 컨디셔닝과 빈 잠재 공간을 준비합니다. 참조 이미지, 포즈 비디오, CLIP 비전 출력, 색상 ID 마스크, 이전 프레임 청크와 같은 선택적 입력을 처리하여 포지티브 및 네거티브 컨디셔닝에 임베딩합니다. 이 노드는 수

WanSCAILToVideo 노드는 SCAIL 및 SCAIL-2 비디오 모델을 사용한 비디오 생성을 위해 컨디셔닝과 빈 잠재 공간을 준비합니다. 참조 이미지, 포즈 비디오, CLIP 비전 출력, 색상 ID 마스크, 이전 프레임 청크와 같은 선택적 입력을 처리하여 포지티브 및 네거티브 컨디셔닝에 임베딩합니다. 이 노드는 수정된 컨디셔닝과 지정된 비디오 크기의 빈 잠재 텐서를 출력하여 샘플링 준비를 마칩니다.

## 입력

| Parameter              | Description                                                                                                                                               | Data Type            | Required | Range                 |
| ---------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------- | -------------------- | -------- | --------------------- |
| `positive`             | 포지티브 컨디셔닝 입력입니다.                                                                                                                                          | CONDITIONING         | 예        | -                     |
| `negative`             | 네거티브 컨디셔닝 입력입니다.                                                                                                                                          | CONDITIONING         | 예        | -                     |
| `vae`                  | 이미지와 비디오 프레임을 인코딩하는 데 사용되는 VAE 모델입니다.                                                                                                                     | VAE                  | 예        | -                     |
| `너비`                   | 출력 비디오의 너비(픽셀)입니다 (기본값: 512). 값은 32 단위로 증가합니다.                                                                                                            | INT                  | 예        | 32 to MAX\_RESOLUTION |
| `높이`                   | 출력 비디오의 높이(픽셀)입니다 (기본값: 896). 값은 32 단위로 증가합니다.                                                                                                            | INT                  | 예        | 32 to MAX\_RESOLUTION |
| `길이`                   | 비디오의 프레임 수입니다 (기본값: 81). 값은 4 단위로 증가합니다.                                                                                                                  | INT                  | 예        | 1 to MAX\_RESOLUTION  |
| `배치 크기`                | 한 번에 생성할 비디오 수입니다 (기본값: 1).                                                                                                                               | INT                  | 예        | 1 \~ 4096             |
| `포즈 비디오`               | 포즈 컨디셔닝에 사용되는 비디오입니다. 주 비디오 해상도의 절반으로 축소됩니다.                                                                                                              | IMAGE                | No       | -                     |
| `pose_video_mask`      | SCAIL-2 전용입니다. `pose_video`와 동일한 해상도의 ID별 색상 SAM3 마스크 비디오입니다.                                                                                             | IMAGE                | No       | -                     |
| `replacement_mode`     | SCAIL-2 전용입니다. False = 애니메이션 모드 (`pose_video_mask`의 배경은 검은색이어야 합니다). True = 교체 모드 (`pose_video_mask`의 배경은 흰색이어야 합니다). (기본값: False)                        | BOOLEAN              | No       | -                     |
| `포즈 강도`                | 포즈 잠재의 강도입니다. (기본값: 1.0)                                                                                                                                  | FLOAT                | 예        | 0.0 \~ 10.0           |
| `포즈 시작`                | 포즈 컨디셔닝의 시작 단계입니다. (기본값: 0.0)                                                                                                                             | FLOAT                | 예        | 0.0 \~ 1.0            |
| `포즈 종료`                | 포즈 컨디셔닝의 종료 단계입니다. (기본값: 1.0)                                                                                                                             | FLOAT                | 예        | 0.0 \~ 1.0            |
| `참조 이미지`               | 참조 이미지입니다. 첫 번째 이미지는 기본 참조입니다 (모든 ID를 이 이미지에 합성합니다). SCAIL-2: 추가 배치 이미지는 추가 뷰(후면 뷰, 클로즈업, 가려진 배경)로 사용되며, 각각 해당 ID 색상의 일치하는 `reference_image_mask`가 필요합니다. | IMAGE                | No       | -                     |
| `reference_image_mask` | SCAIL-2 전용입니다. `reference_image`와 배치가 일치하는 색상 참조 마스크입니다 (첫 번째 = 기본 참조 마스크, 나머지 = 추가 `reference_image`에 대한 ID 마스크).                                        | IMAGE                | No       | -                     |
| `clip_vision_output`   | 컨디셔닝을 위한 CLIP 비전 특징입니다. 모델은 종횡비에 맞춰 늘려서 리사이즈하는 방식으로 학습되었습니다.                                                                                              | CLIP\_VISION\_OUTPUT | No       | -                     |
| `video_frame_offset`   | 이 청크가 시작되는 누적 출력 프레임입니다. 이전 청크의 `video_frame_offset` 출력에서 연결하세요. (기본값: 0)                                                                                 | INT                  | 예        | 0 to MAX\_RESOLUTION  |
| `previous_frame_count` | 앵커링할 `previous_frames`의 끝 프레임 수입니다. SCAIL-2는 5로 학습되었습니다 (81프레임 청크, 76프레임 스텝). (기본값: 5)                                                                    | INT                  | 예        | 1 to MAX\_RESOLUTION  |
| `previous_frames`      | SCAIL-2 전용입니다. 이전 청크의 완전히 디코딩된 출력입니다. 마지막 `previous_frame_count` 프레임만 확장 앵커로 사용됩니다.                                                                       | IMAGE                | No       | -                     |

**참고:** `pose_video`와 `pose_video_mask` 입력은 둘 중 더 짧은 길이에 맞춰 함께 잘리며, 처음 `length` 프레임에 대해서만 처리됩니다. 두 입력 중 하나라도 `video_frame_offset`보다 짧거나 같으면 해당 입력은 완전히 무시됩니다. `pose_video`는 인코딩 전에 주 비디오 해상도의 절반으로 축소되며, 인코딩된 포즈 잠재는 `pose_strength`만큼 곱해져서 `pose_start`와 `pose_end` 타임스텝 단계 사이에서만 컨디셔닝에 적용됩니다. `pose_video_mask`가 제공되면 색상 마스크 비디오는 절반 해상도로 축소되고 28채널 드라이빙 마스크로 변환되어 포지티브 및 네거티브 컨디셔닝에 모두 추가됩니다.

**참고:** `reference_image`가 제공되면 배치의 각 이미지는 개별적으로 잠재로 인코딩되어 포지티브 및 네거티브 컨디셔닝에 모두 임베딩됩니다. 첫 번째 이미지는 기본 참조이며, 추가 이미지는 추가 뷰로 사용되며 각각 일치하는 `reference_image_mask`가 필요합니다. `reference_image_mask`는 `reference_image`도 함께 제공될 때만 사용됩니다. 둘 다 제공되면 참조 프레임을 ID에 바인딩하는 28채널 참조 마스크가 마스크들로부터 생성되어 컨디셔닝에 추가됩니다. 교체 모드(`replacement_mode=True`)에서는 참조 이미지가 `reference_image_mask`를 알파 매트로 사용하여 검은 배경에 합성됩니다. `clip_vision_output`이 제공되면 포지티브 및 네거티브 컨디셔닝에 모두 적용됩니다.

**참고:** `previous_frames`가 제공되면 마지막 `previous_frame_count` 프레임만 확장 앵커로 사용되며, `video_frame_offset`도 그에 따라 조정됩니다(앵커링된 프레임 수만큼 감소하며, 최소 0으로 제한됩니다). 앵커링된 프레임은 인코딩되어 출력 잠재의 시작 부분에 기록되며, 생성 중 해당 프레임이 변경되지 않도록 노이즈 마스크가 포함됩니다.

## 출력

| Output Name          | Description                                                                                                                                                | Data Type    |
| -------------------- | ---------------------------------------------------------------------------------------------------------------------------------------------------------- | ------------ |
| `positive`           | 수정된 포지티브 컨디셔닝입니다. 임베딩된 참조 이미지 잠재, CLIP 비전 출력, 포즈 비디오 잠재, 드라이빙 마스크, 참조 마스크 또는 이전 프레임 잠재를 포함할 수 있습니다.                                                        | CONDITIONING |
| `negative`           | 수정된 네거티브 컨디셔닝입니다. 임베딩된 참조 이미지 잠재, CLIP 비전 출력, 포즈 비디오 잠재, 드라이빙 마스크, 참조 마스크 또는 이전 프레임 잠재를 포함할 수 있습니다.                                                        | CONDITIONING |
| `latent`             | 모양이 `[batch_size, 16, ((length - 1) // 4) + 1, height // 8, width // 8]`인 빈 잠재 텐서입니다. `previous_frames`가 제공되면 잠재는 인코딩된 이전 프레임으로 부분적으로 채워지고 노이즈 마스크가 포함됩니다. | LATENT       |
| `video_frame_offset` | 조정된 오프셋 + 길이입니다. 순차 비디오 생성을 위해 다음 청크에 연결하세요.                                                                                                               | INT          |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSCAILToVideo/ko.md)

***

**Source fingerprint (SHA-256):** `4a1a2201dfa94bd2f1330db02ec18a5e0a6aae9e9ac5ae97d456b7af1aa84b7b`
