Skip to main content
TextGenerateLTX2Prompt 노드는 짧은 사용자 프롬프트를 LTX-2 시리즈 비디오 모델로 비디오를 생성하는 데 적합한 상세한 시청각 설명으로 확장합니다. 작업별 시스템 지침을 자동으로 추가하고, 형식이 지정된 프롬프트를 언어 모델로 전송한 뒤 향상된 텍스트를 반환합니다. 선택적 참조 이미지가 제공되면 노드는 이미지-투-비디오 모드로 전환하고 해당 이미지의 내용에서 시작하여 프롬프트를 확장합니다.

입력

공통 입력

샘플링 매개변수 (sampling_mode가 “on”일 때)

참고: 위 샘플링 매개변수는 sampling_mode가 “on”으로 설정된 경우에만 노드 인터페이스에서 활성화되고 표시됩니다. “off”로 설정하면 사용 가능한 샘플링 매개변수가 없으며 노드는 무작위 샘플링 없이 텍스트를 생성합니다. 참고: 노드의 동작은 입력에 따라 달라집니다:
  • image가 제공되면 생성된 프롬프트는 이미지 내용을 기반으로 프롬프트를 확장하는 방법을 설명하는 시스템 프롬프트를 사용하여 이미지-투-비디오 작업에 맞게 형식이 지정됩니다. 이미지가 제공되지 않으면 텍스트-투-비디오 작업에 맞게 형식이 지정되며, 시스템 프롬프트를 사용하여 프롬프트를 상세한 비디오 생성 설명으로 확장합니다.
  • CLIP 토크나이저의 이름에 “gemma4”가 포함되어 있으면 노드는 LTX-2.4 시스템 프롬프트와 Gemma 4 채팅 형식을 사용합니다. 그렇지 않으면 LTX-2(Gemma 3) 시스템 프롬프트와 채팅 형식을 사용합니다.
  • Gemma 4 모델에서 thinking이 활성화되면 모델은 추론 채널에서 열리고, 비활성화되면 최종 답변 채널에서 직접 열립니다. Gemma 4가 아닌 모델의 경우 thinking은 기본 생성 단계로 전달됩니다.
  • 언어 모델이 추론 블록을 제거한 후 사용 가능한 텍스트를 생성하지 않으면 노드는 대신 원래 prompt를 반환합니다.

출력

이 문서는 AI에 의해 생성되었습니다. 오류를 발견하거나 개선 제안이 있으시면 기여해 주세요! GitHub에서 편집

Source fingerprint (SHA-256): 1da4a388b7c358e5649b4746b9b8d288977ec6fbed3eedc4c8709187c9f7b943