Skip to main content
TextGenerateLTX2Prompt ノードは、短いユーザープロンプトを、LTX-2 シリーズの動画モデルで動画を生成するのに適した、音声付き映像の詳細な説明へと拡張します。タスク固有のシステム指示を自動的に追加し、フォーマット済みのプロンプトを言語モデルに送信して、拡張されたテキストを返します。オプションの参照画像が指定されると、ノードは image-to-video モードに切り替わり、その画像の内容を起点にプロンプトを拡張します。

入力

共通入力

サンプリングパラメータ(sampling_mode が “on” の場合)

注: 上記のサンプリングパラメータは、sampling_mode が “on” に設定されている場合にのみ、ノードインターフェースで有効になり表示されます。“off” に設定されている場合、サンプリングパラメータは利用できず、ノードはランダムサンプリングなしでテキストを生成します。 注: ノードの動作は入力に基づいて変化します:
  • image が指定された場合、生成されたプロンプトは image-to-video タスク用にフォーマットされ、画像の内容に基づいてプロンプトを拡張する方法を記述したシステムプロンプトを使用します。画像が指定されていない場合、フォーマットは text-to-video タスク用となり、プロンプトを詳細な動画生成説明に拡張するシステムプロンプトを使用します。
  • CLIP トークナイザー名に “gemma4” が含まれる場合、ノードは LTX-2.4 システムプロンプトと Gemma 4 チャット形式を使用します。それ以外の場合は、LTX-2(Gemma 3)システムプロンプトとチャット形式を使用します。
  • Gemma 4 モデルで thinking が有効な場合、モデルは推論チャネルで開かれます。無効な場合、モデルは最終回答チャネルで直接開かれます。Gemma 4 以外のモデルでは、thinking は基盤となる生成ステップにそのまま渡されます。
  • 推論ブロックを削除した後に言語モデルが使用可能なテキストを生成しなかった場合、ノードは代わりに元の prompt を返します。

出力

このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集

Source fingerprint (SHA-256): 1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943