输入
注意:
mask_end 值必须大于 mask_start 值。输入音频的时长必须介于 6 到 190 秒之间。
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
3c180043c538311b1808cddd84b0c0ab22a6fa1d943b7f9ddc9edab0fb3413adDocumentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
使用文本指令转换现有音频样本的一部分。
| 参数 | 描述 | 数据类型 | 必需 | 范围 |
|---|---|---|---|---|
model | 用于音频修补的 AI 模型。 | STRING | 是 | "stable-audio-2.5" |
prompt | 指导音频应如何转换的文本描述(默认:空)。最大长度为 10,000 个字符。 | STRING | 是 | |
audio | 要转换的输入音频文件。音频长度必须介于 6 到 190 秒之间。 | AUDIO | 是 | |
duration | 控制生成音频的时长(以秒为单位,默认:190)。 | INT | 否 | 1 到 190 |
seed | 用于生成的随机种子(默认:0)。 | INT | 否 | 0 到 4294967294 |
steps | 控制采样步数(默认:8)。 | INT | 否 | 4 到 8 |
mask_start | 要转换的音频片段的起始位置(以秒为单位,默认:30)。 | INT | 否 | 0 到 190 |
mask_end | 要转换的音频片段的结束位置(以秒为单位,默认:190)。 | INT | 否 | 0 到 190 |
mask_end 值必须大于 mask_start 值。输入音频的时长必须介于 6 到 190 秒之间。
| 输出名称 | 描述 | 数据类型 |
|---|---|---|
audio | 根据提示修改指定部分后的转换音频输出。 | AUDIO |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
3c180043c538311b1808cddd84b0c0ab22a6fa1d943b7f9ddc9edab0fb3413ad