Skip to main content
Wan22ImageToVideoLatent 从图像创建视频潜表示。它生成具有指定宽度、高度、帧长度和批次大小的空白视频潜空间,并且可选地将起始图像序列编码到视频潜空间的开头帧中。当提供起始图像时,该节点将其编码到潜空间中,并创建相应的噪声掩码,用于标记生成过程中应被去噪的区域。

输入

注意: 当提供 start_image 时,图像序列会放大到目标 widthheight,使用 VAE 编码,并放入潜空间的开头帧中。这些帧的噪声掩码设置为 0(保留),而其余帧的掩码值为 1(待去噪)。该潜空间始终有 48 个通道,空间维度为 height / 16 × width / 16,时间维度为 ((length - 1) // 4) + 1widthheight 必须能被 16 整除(通过步长 32 强制保证),并且 length 以 4 为步长增加时间维度。 当未提供 start_image 时,将返回完全空白的潜空间且没有噪声掩码,并且 batch_size 输入不会应用于该空白潜空间。

输出

这两个字段一起在单个 LATENT 输出中返回。
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): 3d05980641eeef2e86df7a845aa8b2bd703882db98fe71adef2746ab34a9d717