> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-mintlify-theme-mint.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# TextGenerateLTX2Prompt - ComfyUI Built-in Node Documentation

> TextGenerateLTX2Prompt 节点可将简短的用户提示词扩展为详细的音视频描述，适用于使用 LTX-2 系列视频模型生成视频。

TextGenerateLTX2Prompt 节点可将简短的用户提示词扩展为详细的音视频描述，适用于使用 LTX-2 系列视频模型生成视频。它会自动添加针对具体任务的系统指令，将格式化后的提示词发送给语言模型，并返回增强后的文本。当提供可选的参考图像时，节点会切换到图生视频模式，并以该图像的内容为起点来扩展提示词。

## 输入

### 通用输入

| 参数                     | 描述                                                                                                                        | 数据类型           | 必填 | 范围                                                                |
| ---------------------- | ------------------------------------------------------------------------------------------------------------------------- | -------------- | -- | ----------------------------------------------------------------- |
| `clip`                 | 用于文本编码的 CLIP 模型。节点会检查模型的 tokenizer 名称以选择匹配的指令：基于 Gemma 4 的模型使用 LTX-2.4 格式，其他模型使用 LTX-2 (Gemma 3) 格式。                      | CLIP           | 是  | -                                                                 |
| `提示词`                  | 描述场景或概念的原始文本输入，将扩展为详细的视频生成提示词。                                                                                            | STRING         | 是  | -                                                                 |
| `图像`                   | 可选输入图像，用作视频的第一帧。提供后，节点会切换到图生视频模式，并使用根据图像内容扩展用户提示词的系统提示。                                                                   | IMAGE          | 否  | -                                                                 |
| `视频`                   | 可选的视频输入，用作额外上下文。作为图像批次传递给语言模型；假定为 24 FPS，并在内部下采样至 1 FPS。                                                                  | IMAGE          | 否  | -                                                                 |
| `音频`                   | 可选的音频输入，可用作生成的额外上下文。                                                                                                      | AUDIO          | 否  | -                                                                 |
| `最大长度`                 | 语言模型允许生成的最大 token 数（默认：512）。                                                                                              | INT            | 是  | 1 到 32768                                                         |
| `采样模式`                 | 控制文本生成期间是否使用随机采样。设置为 `"on"` 时，下方的采样参数可用；设置为 `"off"` 时，节点在不进行随机采样的情况下生成文本。                                                 | DYNAMIC\_COMBO | 是  | `"on"`<br />`"off"`                                               |
| `思考模式`                 | 启用后，模型会被指示在回答前先进行推理。返回的输出中会移除任何推理块（默认：False）。                                                                             | BOOLEAN        | 否  | True/False                                                        |
| `use_default_template` | 启用后，节点使用默认聊天模板进行格式化（默认：True）。高级设置。                                                                                        | BOOLEAN        | 否  | True/False                                                        |
| `mtp`                  | 使用检查点的多 token 预测头进行投机解码。没有 MTP 权重时无效。`"auto"` 会自适应草稿深度，`"2"` 到 `"5"` 则固定草稿深度。采样输出仍保持正确分布，但对于相同种子与非 MTP 输出不同（默认：`"auto"`）。 | COMBO          | 否  | `"auto"`<br />`"off"`<br />`"2"`<br />`"3"`<br />`"4"`<br />`"5"` |

### 采样参数（当 `sampling_mode` 为 "on" 时）

| 参数                   | 描述                                                       | 数据类型  | 必填 | 范围                       |
| -------------------- | -------------------------------------------------------- | ----- | -- | ------------------------ |
| `temperature`        | 控制输出的随机性。较低的值使输出更可预测，较高的值使其更具创造性（默认：0.7）。                | FLOAT | 是  | 0.01 到 2.0               |
| `top_k`              | 将采样池限制为最有可能的下一个 token 中排名前 K 的 token。值为 0 时禁用此过滤（默认：64）。 | INT   | 是  | 0 到 1000                 |
| `top_p`              | 使用核采样：保留累计概率达到该值的最小一组最可能 token。（默认：0.95）                 | FLOAT | 是  | 0.0 到 1.0                |
| `min_p`              | 设置 token 被考虑的最小概率阈值（默认：0.05）。                            | FLOAT | 是  | 0.0 到 1.0                |
| `repetition_penalty` | 对已生成的 token 施加惩罚，以减少重复。值为 1.0 时不施加惩罚（默认：1.05）。           | FLOAT | 是  | 0.0 到 5.0                |
| `seed`               | 用于初始化随机数生成器以获得可复现结果的数字（默认：0）。                            | INT   | 是  | 0 到 18446744073709551615 |
| `presence_penalty`   | 根据新 token 是否已在文本中出现过对其施加惩罚，鼓励模型讨论新话题（默认：0.0）。            | FLOAT | 否  | 0.0 到 5.0                |

**注意：** 仅当 `sampling_mode` 设置为 "on" 时，上述采样参数才会在节点界面中生效并可见。设置为 "off" 时，没有任何采样参数可用，节点在不进行随机采样的情况下生成文本。

**注意：** 节点的行为会根据其输入而变化：

* 如果提供了 `image`，生成的提示词会针对图生视频任务进行格式化，使用描述如何根据图像内容扩展提示词的系统提示。如果未提供图像，则针对文生视频任务进行格式化，使用将提示词扩展为详细视频生成描述的系统提示。
* 如果 CLIP tokenizer 的名称包含 "gemma4"，节点使用 LTX-2.4 系统提示和 Gemma 4 聊天格式。否则，使用 LTX-2 (Gemma 3) 系统提示和聊天格式。
* 当 `thinking` 在 Gemma 4 模型上启用时，模型会在其推理通道上开启；禁用时，模型会直接在最终答案通道上开启。对于非 Gemma 4 模型，`thinking` 会传递到基础生成步骤。
* 如果语言模型在移除推理块后没有产生可用文本，节点会返回原始 `prompt`。

## 输出

| 输出名称             | 描述                                            | 数据类型   |
| ---------------- | --------------------------------------------- | ------ |
| `generated_text` | 由语言模型生成的增强视频生成提示词，已移除任何推理块。如果结果为空，则返回原始用户提示词。 | STRING |

> 本文档由 AI 生成。如果您发现任何错误或有改进建议，欢迎贡献！ [在 GitHub 上编辑](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerateLTX2Prompt/zh.md)

***

**Source fingerprint (SHA-256):** `1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943`
