한줄 요약
LTX-2 모델을 사용하여 오디오와 비디오를 동기화하여 생성하고, LoRA를 통해 파인튜닝할 수 있는 공식 Python 패키지입니다.
핵심 기능
추론: 텍스트 프롬프트 등으로 고품질 오디오-비디오 콘텐츠를 생성합니다.
LoRA 학습: 모델을 특정 도메인이나 스타일에 맞게 파인튜닝할 수 있습니다.
모델 체크포인트: HuggingFace에서 제공하는 다양한 크기와 버전의 모델을 지원합니다.
스페이셜/템포럴 업스케일러: 비디오 해상도와 프레임률을 향상시키는 파이프라인을 포함합니다.
언제 쓰나
텍스트 프롬프트로 맞춤형 오디오-비디오 콘텐츠를 생성해야 할 때
특정 스타일이나 도메인에 특화된 비디오 생성 모델을 만들고자 할 때
LTX-2 모델의 최신 기능을 직접 사용하고 실험해야 할 때