Skip to main content
此节点准备使用 MiniMax H3 模型生成视频所需的 conditioning 和空 latent。它接收文本提示词,以及可选的视频首帧和/或尾帧图像,并将其转换为模型输入。关键帧图像会被调整尺寸、编码,并分别附加到视频开头和结尾的 conditioning 上。

输入

当提供 first_frame 和/或 last_frame 时,关键帧图像会使用 VAE 编码,并分别附加到第 0 帧和最后一帧的 conditioning 上。当两者都未提供时,此节点仅根据提示词工作。请求的 length 会向上对齐到最接近的有效帧数(17k + 5),因此实际帧数可能会略高于请求值。 音频-视频 latent 会创建为一个空对,与请求的 widthheight 以及对齐后的帧数匹配。音频部分根据相同帧数按每秒 40 个音频帧确定尺寸。

输出

本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑

Source fingerprint (SHA-256): d1bdf3f8c66ef20ff11c35203d2c266a88dcf8cc00c65dbb0aea2b1dd16befd6