Skip to main content
WanSCAILToVideo ノードは、SCAIL および SCAIL-2 動画モデルによる動画生成のために、コンディショニングと空の潜在空間を準備します。参照画像、ポーズ動画、CLIP vision 出力、色付き identity マスク、前回のフレームチャンクなどのオプション入力を処理し、それらを positive と negative のコンディショニングに埋め込みます。このノードは、変更されたコンディショニングと、指定された動画寸法の空の潜在テンソルを出力し、サンプリング可能な状態にします。

入力

注: pose_videopose_video_mask 入力は、両者の短い方に合わせて切り詰められ、最初の length フレームのみが処理されます。どちらかの入力が video_frame_offset 以下である場合、その入力は完全に無視されます。pose_video はエンコード前にメイン動画の半分の解像度にダウンスケールされ、エンコードされたポーズ潜在は pose_strength で乗算され、pose_startpose_end のタイムステップ間でのみコンディショニングに適用されます。pose_video_mask が指定されている場合、色付きマスク動画は半分の解像度にダウンスケールされ、28チャンネルのドライビングマスクに変換され、positive と negative の両方のコンディショニングに追加されます。 注: reference_image が指定されている場合、バッチ内の各画像は個別に潜在へエンコードされ、positive と negative の両方のコンディショニングに埋め込まれます。最初の画像がプライマリ参照です。追加画像は追加ビューとして使用され、それぞれ対応する reference_image_mask を必要とします。reference_image_maskreference_image も指定されている場合にのみ使用されます。両方が指定された場合、参照フレームを identity に結び付ける28チャンネルの参照マスクもマスクから構築され、コンディショニングに追加されます。置換モード(replacement_mode=True)では、参照画像マスクをアルファマットとして使用して、参照画像が黒背景上に合成されます。clip_vision_output が指定されている場合、それは positive と negative の両方のコンディショニングに適用されます。 注: previous_frames が指定されている場合、最後の previous_frame_count フレームのみが拡張アンカーとして使用され、video_frame_offset はそれに応じて調整されます(アンカーされたフレーム数だけ減算され、0でクランプされます)。アンカーされたフレームはエンコードされて出力潜在の先頭に書き込まれ、それらのフレームが生成中に変更されないようにノイズマスクが含まれます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 4a1a2201dfa94bd2f1330db02ec18a5e0a6aae9e9ac5ae97d456b7af1aa84b7b