base_shift 和 max_shift 进行线性插值来计算偏移值,然后使用专门的采样配置为输入模型打补丁。如果提供了 latent,则由其维度决定 token 数量;否则使用 4096 个 token。
输入
偏移值通过在 1024 个 token 处的
base_shift 与 4096 个 token 处的 max_shift 之间进行插值来计算。当提供 latent 时,token 数量为 latent 样本中前两个维度之后所有维度(即空间/时间维度)的乘积。如果未提供 latent,则 token 数量默认为 4096。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
aba596c5478e9d6ee821eec1eca15506935bcc765a368087ccc442fc2ed6671b