> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-comfy-docs-comfyapi-search.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# TextGenerateLTX2Prompt - ComfyUI Built-in Node Documentation

> TextGenerateLTX2Prompt 节点将简短的用户提示词扩展为详细的、适合使用 LTX-2 系列视频模型生成视频的音视频描述。

TextGenerateLTX2Prompt 节点将简短的用户提示词扩展为详细的、适合使用 LTX-2 系列视频模型生成视频的音视频描述。它会自动添加特定于任务的系统指令，将格式化后的提示词发送给语言模型，并返回增强后的文本。当提供可选的参考图像时，该节点会切换到图像到视频模式，并从该图像的内容出发扩展提示词。

## 输入

| 参数                     | 描述                                                                                                   | 数据类型    | 必填 | 范围                                                            |
| ---------------------- | ---------------------------------------------------------------------------------------------------- | ------- | -- | ------------------------------------------------------------- |
| `clip`                 | 用于文本编码的 CLIP 模型。该节点会检查模型的 tokenizer 名称以选择匹配的指令：基于 Gemma 4 的模型使用 LTX-2.4 格式，而其他模型使用 LTX-2（Gemma 3）格式。 | CLIP    | 是  |                                                               |
| `提示词`                  | 原始文本输入，用于描述要扩展为详细视频生成提示词的场景或概念。                                                                      | STRING  | 是  |                                                               |
| `最大长度`                 | 允许语言模型生成的 token 最大数量。                                                                                | INT     | 是  |                                                               |
| `采样模式`                 | 文本生成过程中用于选择下一个 token 的采样策略。                                                                          | COMBO   | 是  | `"greedy"`<br />`"top_k"`<br />`"top_p"`<br />`"temperature"` |
| `图像`                   | 可选的输入图像，用作视频的第一帧。提供后，节点会切换到图像到视频模式，并使用基于图像内容扩展用户提示词的系统提示词。                                           | IMAGE   | 否  |                                                               |
| `思考模式`                 | 启用后，模型会先进行推理再作答。返回的输出中会移除任何推理块（默认值：False）。                                                           | BOOLEAN | 否  |                                                               |
| `use_default_template` | 启用后，节点使用默认的聊天模板进行格式化（默认值：True）。                                                                      | BOOLEAN | 否  |                                                               |
| `视频`                   | 可选的视频输入，可用作生成的额外上下文。                                                                                 | VIDEO   | 否  |                                                               |
| `音频`                   | 可选的音频输入，可用作生成的额外上下文。                                                                                 | AUDIO   | 否  |                                                               |

**注意：** 节点的行为会根据其输入而变化：

* 如果提供了 `image`，生成的提示词会按图像到视频任务进行格式化，使用描述如何基于图像内容扩展提示词的系统提示词。如果未提供图像，则按文本到视频任务进行格式化，使用将提示词扩展为详细视频生成描述的系统提示词。
* 如果 CLIP tokenizer 的名称包含 "gemma4"，节点使用 LTX-2.4 系统提示词和 Gemma 4 聊天格式。否则，使用 LTX-2（Gemma 3）系统提示词和聊天格式。
* 当对 Gemma 4 模型启用 `thinking` 时，模型会在其推理通道上打开；禁用时，模型直接在最终答案通道上打开。对于非 Gemma 4 模型，`thinking` 会传递到底层生成步骤。
* 如果语言模型在移除推理块后没有产生可用文本，节点会返回原始 `prompt`。

## 输出

| 输出名称     | 描述                                           | 数据类型   |
| -------- | -------------------------------------------- | ------ |
| `output` | 语言模型生成的增强视频生成提示词，已移除任何推理块。如果结果为空，则返回原始用户提示词。 | STRING |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerateLTX2Prompt/zh.md)

***

**Source fingerprint (SHA-256):** `8f524ea60a247217dde8a1edaf7a689e253ae05acc9eb52ad47b91e879dba1df`
