> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSCAILToVideo - ComfyUI Built-in Node Documentation

> WanSCAILToVideo 노드는 SCAIL 및 SCAIL-2 비디오 모델을 사용한 비디오 생성을 위해 컨디셔닝과 빈 잠재 공간을 준비합니다. 참조 이미지, 포즈 비디오, CLIP vision 출력, 색상이 지정된 아이덴티티 마스크, 이전 프레임 청크와 같은 선택적 입력을 처리하여 긍정 및 부정 컨디셔닝에 임베딩합니다.

WanSCAILToVideo 노드는 SCAIL 및 SCAIL-2 비디오 모델을 사용한 비디오 생성을 위해 컨디셔닝과 빈 잠재 공간을 준비합니다. 참조 이미지, 포즈 비디오, CLIP vision 출력, 색상이 지정된 아이덴티티 마스크, 이전 프레임 청크와 같은 선택적 입력을 처리하여 긍정 및 부정 컨디셔닝에 임베딩합니다. 노드는 수정된 컨디셔닝과 지정된 비디오 크기의 빈 잠재 텐서를 출력하며, 이는 샘플링할 준비가 되어 있습니다.

## 입력

| 매개변수                   | 설명                                                                                                                                                        | 데이터 타입               | 필수  | 범위                    |
| ---------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------- | -------------------- | --- | --------------------- |
| `positive`             | 긍정 컨디셔닝 입력입니다.                                                                                                                                            | CONDITIONING         | 예   | -                     |
| `negative`             | 부정 컨디셔닝 입력입니다.                                                                                                                                            | CONDITIONING         | 예   | -                     |
| `vae`                  | 이미지와 비디오 프레임을 인코딩하는 데 사용되는 VAE 모델입니다.                                                                                                                     | VAE                  | 예   | -                     |
| `너비`                   | 출력 비디오의 너비(픽셀)입니다(기본값: 512). 값은 32 단위로 증가합니다.                                                                                                             | INT                  | 예   | 32 to MAX\_RESOLUTION |
| `높이`                   | 출력 비디오의 높이(픽셀)입니다(기본값: 896). 값은 32 단위로 증가합니다.                                                                                                             | INT                  | 예   | 32 to MAX\_RESOLUTION |
| `길이`                   | 비디오의 프레임 수입니다(기본값: 81). 값은 4 단위로 증가합니다.                                                                                                                   | INT                  | 예   | 1 to MAX\_RESOLUTION  |
| `배치 크기`                | 한 배치에서 생성할 비디오 수입니다(기본값: 1).                                                                                                                              | INT                  | 예   | 1  \~  4096           |
| `포즈 비디오`               | 포즈 컨디셔닝에 사용되는 비디오입니다. 메인 비디오 해상도의 절반으로 다운스케일됩니다.                                                                                                          | IMAGE                | 아니요 | -                     |
| `pose_video_mask`      | SCAIL-2 전용입니다. `pose_video`와 동일한 해상도의 각 아이덴티티별 색상 SAM3 마스크 비디오입니다.                                                                                        | IMAGE                | 아니요 | -                     |
| `replacement_mode`     | SCAIL-2 전용입니다. False = 애니메이션 모드(`pose_video_mask`는 검은색 배경이어야 합니다). True = 교체 모드(`pose_video_mask`는 흰색 배경이어야 합니다). (기본값: False)                            | BOOLEAN              | 아니요 | -                     |
| `포즈 강도`                | 포즈 잠재의 강도입니다. (기본값: 1.0)                                                                                                                                  | FLOAT                | 예   | 0.0  \~  10.0         |
| `포즈 시작`                | 포즈 컨디셔닝의 시작 단계입니다. (기본값: 0.0)                                                                                                                             | FLOAT                | 예   | 0.0  \~  1.0          |
| `포즈 종료`                | 포즈 컨디셔닝의 종료 단계입니다. (기본값: 1.0)                                                                                                                             | FLOAT                | 예   | 0.0  \~  1.0          |
| `참조 이미지`               | 참조 이미지입니다. 첫 번째 이미지가 기본 참조입니다(모든 아이덴티티를 그 위에 합성). SCAIL-2: 추가 배치 이미지는 추가 뷰(후면 뷰, 클로즈업, 가려진 배경)로 사용되며, 각각 해당 아이덴티티 색상의 일치하는 `reference_image_mask`가 필요합니다. | IMAGE                | 아니요 | -                     |
| `reference_image_mask` | SCAIL-2 전용입니다. `reference_image`와 배치가 일치하는 색상 참조 마스크입니다(첫 번째 = 기본 참조 마스크, 나머지 = 추가 `reference_image`용 아이덴티티 마스크).                                         | IMAGE                | 아니요 | -                     |
| `clip_vision_output`   | 컨디셔닝을 위한 CLIP vision 특징입니다. 모델은 종횡비에 맞춘 스트레치 리사이즈로 학습되었습니다.                                                                                               | CLIP\_VISION\_OUTPUT | 아니요 | -                     |
| `video_frame_offset`   | 이 청크가 시작되는 누적 출력 프레임입니다. 이전 청크의 `video_frame_offset` 출력에서 연결하세요. (기본값: 0)                                                                                 | INT                  | 예   | 0 to MAX\_RESOLUTION  |
| `previous_frame_count` | 앵커로 사용할 `previous_frames`의 마지막 프레임 수입니다. SCAIL-2는 5로 학습되었습니다(81프레임 청크, 76프레임 스텝). (기본값: 5). 값은 4 단위로 증가합니다.                                               | INT                  | 예   | 1 to MAX\_RESOLUTION  |
| `previous_frames`      | SCAIL-2 전용입니다. 이전 청크의 전체 디코딩된 출력입니다. 마지막 `previous_frame_count`개만 확장 앵커로 사용됩니다.                                                                           | IMAGE                | 아니요 | -                     |

**참고:** `pose_video` 및 `pose_video_mask` 입력은 둘 중 더 짧은 쪽에 맞춰 함께 잘리며, 처음 `length` 프레임에 대해서만 처리됩니다. 두 입력 중 하나라도 `video_frame_offset`보다 짧거나 같으면 완전히 무시됩니다. `pose_video`는 인코딩 전에 메인 비디오 해상도의 절반으로 다운스케일되며, 인코딩된 포즈 잠재는 `pose_strength`를 곱한 뒤 `pose_start`와 `pose_end` 타임스텝 단계 사이에서만 컨디셔닝에 적용됩니다. `pose_video_mask`가 제공되면 색상 마스크 비디오는 절반 해상도로 다운스케일되고 28채널 드라이빙 마스크로 변환되어 긍정 및 부정 컨디셔닝 모두에 추가됩니다.

**참고:** `reference_image`가 제공되면 배치의 각 이미지가 개별적으로 잠재로 인코딩되어 긍정 및 부정 컨디셔닝 모두에 임베딩됩니다. 첫 번째 이미지는 기본 참조입니다. 추가 이미지는 추가 뷰로 사용되며, 각각 일치하는 `reference_image_mask`가 필요합니다. `reference_image_mask`는 `reference_image`도 제공된 경우에만 사용됩니다. 둘 다 제공되면 참조 프레임을 아이덴티티에 바인딩하는 28채널 참조 마스크도 마스크로부터 생성되어 컨디셔닝에 추가됩니다. 교체 모드(`replacement_mode=True`)에서는 참조 이미지 마스크를 알파 매트로 사용하여 참조 이미지를 검은색 배경 위에 합성합니다. `clip_vision_output`이 제공되면 긍정 및 부정 컨디셔닝 모두에 적용됩니다.

**참고:** `previous_frames`가 제공되면 마지막 `previous_frame_count`개 프레임만 확장 앵커로 사용되며, `video_frame_offset`은 그에 맞게 조정됩니다(앵커된 프레임 수만큼 감소하며, 0에서 클램프됨). 앵커된 프레임은 인코딩되어 출력 잠재의 시작 부분에 기록되며, 생성 중 해당 프레임이 변경되지 않도록 노이즈 마스크가 포함됩니다.

## 출력

| 출력 이름                | 설명                                                                                                                                                        | 데이터 타입       |
| -------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------- | ------------ |
| `positive`           | 수정된 긍정 컨디셔닝으로, 임베딩된 참조 이미지 잠재, CLIP vision 출력, 포즈 비디오 잠재, 드라이빙 마스크, 참조 마스크 또는 이전 프레임 잠재를 포함할 수 있습니다.                                                      | CONDITIONING |
| `negative`           | 수정된 부정 컨디셔닝으로, 임베딩된 참조 이미지 잠재, CLIP vision 출력, 포즈 비디오 잠재, 드라이빙 마스크, 참조 마스크 또는 이전 프레임 잠재를 포함할 수 있습니다.                                                      | CONDITIONING |
| `latent`             | `[batch_size, 16, ((length - 1) // 4) + 1, height // 8, width // 8]` 형태의 빈 잠재 텐서입니다. `previous_frames`가 제공되면 잠재가 인코딩된 이전 프레임으로 부분적으로 채워지고 노이즈 마스크가 포함됩니다. | LATENT       |
| `video_frame_offset` | 조정된 오프셋 + 길이입니다. 순차 비디오 생성을 위해 다음 청크에 연결하세요.                                                                                                              | INT          |

> 이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! [GitHub에서 편집](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSCAILToVideo/ko.md)

***

**Source fingerprint (SHA-256):** `4a1a2201dfa94bd2f1330db02ec18a5e0a6aae9e9ac5ae97d456b7af1aa84b7b`
