width、height、length 和 batch_size 设定尺寸的空视频 latent,并且可以选择性地对起始图像进行编码,通过更新 positive 和 negative 条件数据来引导生成视频的初始帧。
输入
注意: 当提供
start_image 时,它会自动使用双线性插值调整大小,以匹配指定的 width 和 height。图像批次中仅前 length 帧用于编码;任何额外的帧都会被忽略。如果图像批次的帧数少于 length,则仅使用这些帧。仅图像的 RGB 通道会被编码。然后,编码后的 latent 会被注入到 positive 和 negative 条件数据中,以引导视频的初始外观,并且干净的编码帧会替换模型输出 latent 的噪声起始部分。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
7212f0ea912578d3b72dddf1333a20054a881e3f22c2b8abd9645fc21e75a08b