image_interleave 設定に従ってこれら2つのソースを融合したトークンを生成します。
入力
出力
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
Source fingerprint (SHA-256):
016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
TextEncodeHunyuanVideoImageToVideo ノードは、テキストプロンプトと参照画像からの視覚情報を組み合わせることで、画像から動画への生成用のコンディショニングデータを作成します。
image_interleave 設定に従ってこれら2つのソースを融合したトークンを生成します。
| パラメータ | 説明 | データ型 | 必須 | 範囲 |
|---|---|---|---|---|
clip | トークン化とエンコーディングに使用される CLIP モデル。 | CLIP | はい | - |
clip_vision_output | 参照画像の画像コンテキストを提供する、CLIP ビジョンモデルからの視覚的埋め込み。 | CLIP_VISION_OUTPUT | はい | - |
プロンプト | 動画生成をガイドするテキスト説明。複数行入力とダイナミックプロンプトに対応しています。プロンプトは、参照画像に基づいて動画を説明するようモデルに求めるテンプレートを使用してフォーマットされ、主な内容、オブジェクトの詳細、アクション、背景、カメラアングルなどの側面を網羅します。 | STRING | はい | - |
画像インターリーブ | テキストプロンプトに対する画像の影響度。数値が大きいほど、テキストプロンプトからの影響が大きくなります。(デフォルト: 2) | INT | はい | 1-512 |
| 出力名 | 説明 | データ型 |
|---|---|---|
CONDITIONING | テキストと画像情報を組み合わせた、動画生成用のコンディショニングデータ。 | CONDITIONING |
このドキュメントは AI によって生成されました。エラーを見つけた場合や改善のご提案がある場合は、ぜひ貢献してください! GitHub で編集
016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73