Skip to main content
TextEncodeQwenImageEditPlus ノードは、テキストプロンプトと最大3つのオプション画像を処理し、画像生成または編集タスク用のコンディショニングデータを生成します。このノードは特殊なテンプレートを使用して、まずモデルに入力画像の主要な特徴を記述させ、次にユーザーのテキスト指示によってそれらをどのように変更すべきかを説明させることで、エンコードされた結果が画像と要求された変更の両方を理解できるようにします。VAE が提供された場合、ノードは入力画像から参照潜在変数も作成します。

入力

注記: VAE が提供された場合、ノードは提供されたすべての入力画像から参照潜在変数を生成します。一度に最大3つの画像を処理できます。画像は視覚言語処理のためにターゲット領域 384x384 ピクセル(アスペクト比を保持)に、VAE エンコードのために8で割り切れる次元(ターゲット領域 1024x1024 ピクセル)にスケーリングされます。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 5eea53a84045924b44d445244e6149b341188d22573aaaced87bac8a139dac96