image_interleave 설정에 따라 이 두 소스를 혼합하는 토큰을 생성합니다.
입력
출력
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
Source fingerprint (SHA-256):
016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73Documentation Index
Fetch the complete documentation index at: /llms.txt
Use this file to discover all available pages before exploring further.
TextEncodeHunyuanVideoImageToVideo 노드는 텍스트 프롬프트와 참조 이미지의 시각적 정보를 결합하여 이미지-투-비디오 생성용 컨디셔닝 데이터를 생성합니다.
image_interleave 설정에 따라 이 두 소스를 혼합하는 토큰을 생성합니다.
| 매개변수 | 설명 | 데이터 타입 | 필수 여부 | 범위 |
|---|---|---|---|---|
클립 | 토큰화 및 인코딩에 사용되는 CLIP 모델입니다. | CLIP | 예 | - |
clip_vision 출력 | 참조 이미지에 대한 이미지 컨텍스트를 제공하는 CLIP 비전 모델의 시각적 임베딩입니다. | CLIP_VISION_OUTPUT | 예 | - |
프롬프트 | 비디오 생성을 안내하는 텍스트 설명입니다. 여러 줄 입력 및 동적 프롬프트를 지원합니다. 프롬프트는 참조 이미지를 기반으로 비디오를 설명하도록 모델에 요청하는 템플릿을 사용하여 형식화되며, 주요 콘텐츠, 객체 세부 정보, 동작, 배경 및 카메라 각도와 같은 측면을 다룹니다. | STRING | 예 | - |
이미지 인터리브 | 이미지가 텍스트 프롬프트 대비 얼마나 영향을 미치는지를 나타냅니다. 숫자가 높을수록 텍스트 프롬프트의 영향이 커집니다. (기본값: 2) | INT | 예 | 1-512 |
| 출력 이름 | 설명 | 데이터 타입 |
|---|---|---|
CONDITIONING | 비디오 생성을 위해 텍스트와 이미지 정보를 결합한 컨디셔닝 데이터입니다. | CONDITIONING |
이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집
016b87ead6f7a6ca61eff220e57f59252018cc78e80ec8cff5b83223b8f90f73