> ## Documentation Index
> Fetch the complete documentation index at: https://dripart-chore-mintlify-theme-mint.mintlify.site/llms.txt
> Use this file to discover all available pages before exploring further.

# TextGenerateLTX2Prompt - ComfyUI Built-in Node Documentation

> TextGenerateLTX2Prompt ノードは、短いユーザープロンプトを、LTX-2 シリーズの動画モデルで動画を生成するのに適した、音声付き映像の詳細な説明へと拡張します。

TextGenerateLTX2Prompt ノードは、短いユーザープロンプトを、LTX-2 シリーズの動画モデルで動画を生成するのに適した、音声付き映像の詳細な説明へと拡張します。タスク固有のシステム指示を自動的に追加し、フォーマット済みのプロンプトを言語モデルに送信して、拡張されたテキストを返します。オプションの参照画像が指定されると、ノードは image-to-video モードに切り替わり、その画像の内容を起点にプロンプトを拡張します。

## 入力

### 共通入力

| パラメータ                  | 説明                                                                                                                                                                          | データ型           | 必須  | 範囲                                                                |
| ---------------------- | --------------------------------------------------------------------------------------------------------------------------------------------------------------------------- | -------------- | --- | ----------------------------------------------------------------- |
| `clip`                 | テキストエンコードに使用される CLIP モデル。ノードはモデルのトークナイザー名を確認して、対応する指示を選択します。Gemma 4 ベースのモデルは LTX-2.4 形式を使用し、それ以外のモデルは LTX-2（Gemma 3）形式を使用します。                                               | CLIP           | はい  | -                                                                 |
| `プロンプト`                | 詳細な動画生成プロンプトへ拡張されるシーンまたは概念を記述した生のテキスト入力。                                                                                                                                    | STRING         | はい  | -                                                                 |
| `画像`                   | 動画の最初のフレームとして使用されるオプションの入力画像。指定すると、ノードは image-to-video モードに切り替わり、画像の内容に基づいてユーザープロンプトを拡張するシステムプロンプトを使用します。                                                                   | IMAGE          | いいえ | -                                                                 |
| `ビデオ`                  | 追加のコンテキストとして使用されるオプションの動画入力。言語モデルには画像バッチとして渡されます。24 FPS であると想定され、内部的に 1 FPS にサブサンプリングされます。                                                                                  | IMAGE          | いいえ | -                                                                 |
| `オーディオ`                | 生成の追加コンテキストとして使用できるオプションの音声入力。                                                                                                                                              | AUDIO          | いいえ | -                                                                 |
| `最大長`                  | 言語モデルが生成できる最大トークン数（デフォルト: 512）。                                                                                                                                             | INT            | はい  | 1～32768                                                           |
| `サンプリングモード`            | テキスト生成中にランダムサンプリングを使用するかどうかを制御します。`"on"` に設定すると、以下のサンプリングパラメータが利用可能になります。`"off"` の場合、ノードはランダムサンプリングなしでテキストを生成します。                                                           | DYNAMIC\_COMBO | はい  | `"on"`<br />`"off"`                                               |
| `思考モード`                | 有効にすると、モデルは回答する前に推論するよう指示されます。推論ブロックは返される出力から削除されます（デフォルト: False）。                                                                                                          | BOOLEAN        | いいえ | True/False                                                        |
| `use_default_template` | 有効にすると、ノードはフォーマットにデフォルトのチャットテンプレートを使用します（デフォルト: True）。詳細設定。                                                                                                                 | BOOLEAN        | いいえ | True/False                                                        |
| `mtp`                  | チェックポイントのマルチトークン予測ヘッドを使用した投機的デコーディング。MTP 重みがない場合は効果がありません。`"auto"` はドラフト深さを適応させ、`"2"` から `"5"` はそれを固定します。サンプリングされた出力は正しい分布を保ちますが、同じシードでも MTP なしの出力とは異なります（デフォルト: `"auto"`）。 | COMBO          | いいえ | `"auto"`<br />`"off"`<br />`"2"`<br />`"3"`<br />`"4"`<br />`"5"` |

### サンプリングパラメータ（`sampling_mode` が "on" の場合）

| パラメータ                | 説明                                                                          | データ型  | 必須  | 範囲                     |
| -------------------- | --------------------------------------------------------------------------- | ----- | --- | ---------------------- |
| `temperature`        | 出力のランダム性を制御します。値を低くすると出力がより予測可能になり、高くするとより創造的になります（デフォルト: 0.7）。             | FLOAT | はい  | 0.01～2.0               |
| `top_k`              | サンプリング対象を、次に来る可能性が最も高い上位 K 個のトークンに制限します。値 0 はこのフィルターを無効にします（デフォルト: 64）。     | INT   | はい  | 0～1000                 |
| `top_p`              | nucleus sampling を使用し、累積確率がこの値に達する、最も可能性の高いトークンの最小集合を保持します。（デフォルト: 0.95）    | FLOAT | はい  | 0.0～1.0                |
| `min_p`              | 考慮対象とするトークンの最小確率しきい値を設定します（デフォルト: 0.05）。                                    | FLOAT | はい  | 0.0～1.0                |
| `repetition_penalty` | すでに生成されたトークンにペナルティを課し、繰り返しを減らします。値 1.0 ではペナルティは適用されません（デフォルト: 1.05）。        | FLOAT | はい  | 0.0～5.0                |
| `seed`               | 再現可能な結果を得るために乱数生成器を初期化する数値（デフォルト: 0）。                                       | INT   | はい  | 0～18446744073709551615 |
| `presence_penalty`   | これまでにテキスト内に出現したかどうかに基づいて新しいトークンにペナルティを課し、モデルが新しい話題について話すよう促します（デフォルト: 0.0）。 | FLOAT | いいえ | 0.0～5.0                |

**注:** 上記のサンプリングパラメータは、`sampling_mode` が "on" に設定されている場合にのみ、ノードインターフェースで有効になり表示されます。"off" に設定されている場合、サンプリングパラメータは利用できず、ノードはランダムサンプリングなしでテキストを生成します。

**注:** ノードの動作は入力に基づいて変化します：

* `image` が指定された場合、生成されたプロンプトは image-to-video タスク用にフォーマットされ、画像の内容に基づいてプロンプトを拡張する方法を記述したシステムプロンプトを使用します。画像が指定されていない場合、フォーマットは text-to-video タスク用となり、プロンプトを詳細な動画生成説明に拡張するシステムプロンプトを使用します。
* CLIP トークナイザー名に "gemma4" が含まれる場合、ノードは LTX-2.4 システムプロンプトと Gemma 4 チャット形式を使用します。それ以外の場合は、LTX-2（Gemma 3）システムプロンプトとチャット形式を使用します。
* Gemma 4 モデルで `thinking` が有効な場合、モデルは推論チャネルで開かれます。無効な場合、モデルは最終回答チャネルで直接開かれます。Gemma 4 以外のモデルでは、`thinking` は基盤となる生成ステップにそのまま渡されます。
* 推論ブロックを削除した後に言語モデルが使用可能なテキストを生成しなかった場合、ノードは代わりに元の `prompt` を返します。

## 出力

| 出力名              | 説明                                                                         | データ型   |
| ---------------- | -------------------------------------------------------------------------- | ------ |
| `generated_text` | 言語モデルによって生成された拡張済みの動画生成プロンプト。推論ブロックはすべて削除されています。結果が空の場合、元のユーザープロンプトが返されます。 | STRING |

> このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください！ [GitHub で編集](https://github.com/Comfy-Org/embedded-docs/blob/main/comfyui_embedded_docs/docs/TextGenerateLTX2Prompt/ja.md)

***

**Source fingerprint (SHA-256):** `1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943`
