输入
注意: 当提供
start_image 时,图像序列会放大到目标 width 和 height,使用 VAE 编码,并放入潜空间的开头帧中。这些帧的噪声掩码设置为 0(保留),而其余帧的掩码值为 1(待去噪)。该潜空间始终有 48 个通道,空间维度为 height / 16 × width / 16,时间维度为 ((length - 1) // 4) + 1。width 和 height 必须能被 16 整除(通过步长 32 强制保证),并且 length 以 4 为步长增加时间维度。
当未提供 start_image 时,将返回完全空白的潜空间且没有噪声掩码,并且 batch_size 输入不会应用于该空白潜空间。
输出
这两个字段一起在单个 LATENT 输出中返回。
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
3d05980641eeef2e86df7a845aa8b2bd703882db98fe71adef2746ab34a9d717