入力
注記: VAE が提供された場合、ノードは提供されたすべての入力画像から参照潜在変数を生成します。一度に最大3つの画像を処理できます。画像は視覚言語処理のためにターゲット領域 384x384 ピクセル(アスペクト比を保持)に、VAE エンコードのために8で割り切れる次元(ターゲット領域 1024x1024 ピクセル)にスケーリングされます。
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
5eea53a84045924b44d445244e6149b341188d22573aaaced87bac8a139dac96