输入
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
此节点分析音频片段,并将其转换为一组可指导视频生成模型的特征。
| 参数 | 描述 | 数据类型 | 是否必需 | 范围 |
|---|---|---|---|---|
音频 | 要分析和编码的音频输入。如果音频有多个声道,则在特征提取前将各声道平均为单声道。 | AUDIO | 是 | - |
视频帧 | 目标视频中的帧数。用于计算同步所需的帧率(默认:149)。 | INT | 是 | Min: 1, Max: 16384 (MAX_RESOLUTION), Step: 4 |
音频注入比例 | 音频特征注入视频模型时的缩放比例(默认:1.0)。 | FLOAT | 是 | Min: 0.0, Max: 10.0, Step: 0.01 |
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
audio_encoder_output | 一个字典,包含处理后的音频特征、计算出的帧率(fps)以及音频注入缩放比例。此输出用于为视频生成模型提供条件。 | AUDIO_ENCODER_OUTPUT |
fps_string | 一个文本字符串,描述基于音频长度和视频帧数计算出的帧率(fps)。该字符串旨在用于视频模型的提示词中。其格式为中文,以匹配参考流程。 | STRING |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
ce27a3bdea2d9e3cf8875c24236a2a0a1429e9bc13a58581e372fb669d2c0018