image_interleave 设置生成融合这两种来源的 token。
输入
输出
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
Source fingerprint (SHA-256):
016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
TextEncodeHunyuanVideoImageToVideo 节点通过将文本提示与参考图像的视觉信息相结合,为图像转视频生成创建条件数据。
image_interleave 设置生成融合这两种来源的 token。
| 参数 | 描述 | 数据类型 | 必填 | 范围 |
|---|---|---|---|---|
clip | 用于分词和编码的 CLIP 模型。 | CLIP | 是 | - |
clip视觉输出 | 来自 CLIP 视觉模型的视觉嵌入,为参考图像提供图像上下文。 | CLIP_VISION_OUTPUT | 是 | - |
提示 | 用于指导视频生成的文本描述。支持多行输入和动态提示。提示使用模板进行格式化,该模板要求模型基于参考图像描述视频,涵盖主要内容、物体细节、动作、背景和摄像机角度等方面。 | STRING | 是 | - |
图像交错 | 图像相对于文本提示的影响程度。数值越高,表示文本提示的影响越大。(默认值:2) | INT | 是 | 1-512 |
| 输出名 | 描述 | 数据类型 |
|---|---|---|
CONDITIONING | 结合文本和图像信息用于视频生成的条件数据。 | CONDITIONING |
本文档由 AI 生成。如果您发现任何错误或有改进建议,欢迎贡献! 在 GitHub 上编辑
016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73