> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# WanSCAILToVideo - ComfyUI Built-in Node Documentation

> WanSCAILToVideo ノードは、SCAIL および SCAIL-2 動画モデルによる動画生成のために、コンディショニングと空の潜在空間を準備します。

WanSCAILToVideo ノードは、SCAIL および SCAIL-2 動画モデルによる動画生成のために、コンディショニングと空の潜在空間を準備します。参照画像、ポーズ動画、CLIP vision 出力、色付き identity マスク、前回のフレームチャンクなどのオプション入力を処理し、それらを positive と negative のコンディショニングに埋め込みます。このノードは、変更されたコンディショニングと、指定された動画寸法の空の潜在テンソルを出力し、サンプリング可能な状態にします。

## 入力

| パラメータ                  | 説明                                                                                                                                                        | データ型                 | 必須  | 範囲                 |
| ---------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------- | -------------------- | --- | ------------------ |
| `positive`             | positive コンディショニング入力。                                                                                                                                     | CONDITIONING         | はい  | -                  |
| `negative`             | negative コンディショニング入力。                                                                                                                                     | CONDITIONING         | はい  | -                  |
| `vae`                  | 画像と動画フレームのエンコードに使用される VAE モデル。                                                                                                                            | VAE                  | はい  | -                  |
| `幅`                    | 出力動画の幅（ピクセル単位、デフォルト：512）。値は32刻みです。                                                                                                                        | INT                  | はい  | 32～MAX\_RESOLUTION |
| `高さ`                   | 出力動画の高さ（ピクセル単位、デフォルト：896）。値は32刻みです。                                                                                                                       | INT                  | はい  | 32～MAX\_RESOLUTION |
| `長さ`                   | 動画内のフレーム数（デフォルト：81）。値は4刻みです。                                                                                                                              | INT                  | はい  | 1～MAX\_RESOLUTION  |
| `バッチサイズ`               | バッチで生成する動画の数（デフォルト：1）。                                                                                                                                    | INT                  | はい  | 1～4096             |
| `ポーズビデオ`               | ポーズコンディショニングに使用される動画。メイン動画の半分の解像度にダウンスケールされます。                                                                                                            | IMAGE                | いいえ | -                  |
| `pose_video_mask`      | SCAIL-2 のみ。`pose_video` と同じ解像度の、identity ごとに色分けされた SAM3 マスク動画。                                                                                            | IMAGE                | いいえ | -                  |
| `replacement_mode`     | SCAIL-2 のみ。False = アニメーションモード（`pose_video_mask` は黒背景である必要があります）。True = 置換モード（`pose_video_mask` は白背景である必要があります）。（デフォルト：False）                              | BOOLEAN              | いいえ | -                  |
| `ポーズ強度`                | ポーズ潜在の強度。（デフォルト：1.0）                                                                                                                                      | FLOAT                | はい  | 0.0～10.0           |
| `ポーズ開始ステップ`            | ポーズコンディショニングの開始ステップ。（デフォルト：0.0）                                                                                                                           | FLOAT                | はい  | 0.0～1.0            |
| `ポーズ終了ステップ`            | ポーズコンディショニングの終了ステップ。（デフォルト：1.0）                                                                                                                           | FLOAT                | はい  | 0.0～1.0            |
| `参照画像`                 | 参照画像。最初の画像がプライマリ参照です（すべての identity をそれに合成します）。SCAIL-2：追加のバッチ画像は追加ビュー（背面図、クローズアップ、遮蔽された背景）として使用され、それぞれがその identity の色に対応する `reference_image_mask` を必要とします。 | IMAGE                | いいえ | -                  |
| `reference_image_mask` | SCAIL-2 のみ。色付き参照マスク。バッチは `reference_image` に対応します（最初 = プライマリ参照マスク、残り = 追加の `reference_image` 用の identity マスク）。                                            | IMAGE                | いいえ | -                  |
| `clip_vision_output`   | コンディショニング用の CLIP vision 特徴量。モデルはアスペクト比へのストレッチリサイズで学習されています。                                                                                               | CLIP\_VISION\_OUTPUT | いいえ | -                  |
| `video_frame_offset`   | このチャンクが開始する累積出力フレーム。前のチャンクの `video_frame_offset` 出力から接続します。（デフォルト：0）                                                                                      | INT                  | はい  | 0～MAX\_RESOLUTION  |
| `previous_frame_count` | アンカーする `previous_frames` の末尾フレーム数。SCAIL-2 は5で学習されています（81フレームのチャンク、76フレームのステップ）。（デフォルト：5）。値は4刻みです。                                                         | INT                  | はい  | 1～MAX\_RESOLUTION  |
| `previous_frames`      | SCAIL-2 のみ。前のチャンクの完全なデコード済み出力。最後の `previous_frame_count` フレームのみが拡張アンカーとして使用されます。                                                                          | IMAGE                | いいえ | -                  |

**注：** `pose_video` と `pose_video_mask` 入力は、両者の短い方に合わせて切り詰められ、最初の `length` フレームのみが処理されます。どちらかの入力が `video_frame_offset` 以下である場合、その入力は完全に無視されます。`pose_video` はエンコード前にメイン動画の半分の解像度にダウンスケールされ、エンコードされたポーズ潜在は `pose_strength` で乗算され、`pose_start` と `pose_end` のタイムステップ間でのみコンディショニングに適用されます。`pose_video_mask` が指定されている場合、色付きマスク動画は半分の解像度にダウンスケールされ、28チャンネルのドライビングマスクに変換され、positive と negative の両方のコンディショニングに追加されます。

**注：** `reference_image` が指定されている場合、バッチ内の各画像は個別に潜在へエンコードされ、positive と negative の両方のコンディショニングに埋め込まれます。最初の画像がプライマリ参照です。追加画像は追加ビューとして使用され、それぞれ対応する `reference_image_mask` を必要とします。`reference_image_mask` は `reference_image` も指定されている場合にのみ使用されます。両方が指定された場合、参照フレームを identity に結び付ける28チャンネルの参照マスクもマスクから構築され、コンディショニングに追加されます。置換モード（`replacement_mode=True`）では、参照画像マスクをアルファマットとして使用して、参照画像が黒背景上に合成されます。`clip_vision_output` が指定されている場合、それは positive と negative の両方のコンディショニングに適用されます。

**注：** `previous_frames` が指定されている場合、最後の `previous_frame_count` フレームのみが拡張アンカーとして使用され、`video_frame_offset` はそれに応じて調整されます（アンカーされたフレーム数だけ減算され、0でクランプされます）。アンカーされたフレームはエンコードされて出力潜在の先頭に書き込まれ、それらのフレームが生成中に変更されないようにノイズマスクが含まれます。

## 出力

| 出力名                  | 説明                                                                                                                                                     | データ型         |
| -------------------- | ------------------------------------------------------------------------------------------------------------------------------------------------------ | ------------ |
| `positive`           | 変更された positive コンディショニング。参照画像潜在、CLIP vision 出力、ポーズ動画潜在、ドライビングマスク、参照マスク、または前フレーム潜在が埋め込まれている可能性があります。                                                    | CONDITIONING |
| `negative`           | 変更された negative コンディショニング。参照画像潜在、CLIP vision 出力、ポーズ動画潜在、ドライビングマスク、参照マスク、または前フレーム潜在が埋め込まれている可能性があります。                                                    | CONDITIONING |
| `latent`             | 形状 `[batch_size, 16, ((length - 1) // 4) + 1, height // 8, width // 8]` の空の潜在テンソル。`previous_frames` が指定されている場合、潜在はエンコードされた前フレームで部分的に埋められ、ノイズマスクが含まれます。 | LATENT       |
| `video_frame_offset` | 調整済みオフセット + 長さ。連続した動画生成のために次のチャンクに接続します。                                                                                                               | INT          |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/WanSCAILToVideo/ja.md)

***

**Source fingerprint (SHA-256):** `4a1a2201dfa94bd2f1330db02ec18a5e0a6aae9e9ac5ae97d456b7af1aa84b7b`
