LTXV_13B_LoRA_Dance_from_gui
naomiKenKorem
Texto a video
Versión de LTXV_13B_097_DEV ajustada mediante LoRA con datos personalizados para generar vídeo a partir de texto o imágenes dentro del ecosistema LTXV de Lightricks.
Como usar
Instalación y ejemplo mostrado para Diffusers:
pip install -U diffusers transformers accelerate
import torch
from diffusers import DiffusionPipeline
# switch to "mps" for apple devices
pipe = DiffusionPipeline.from_pretrained(
"naomiKenKorem/LTXV_13B_LoRA_Dance_from_gui",
torch_dtype=torch.bfloat16,
device_map="cuda"
)
prompt = "Astronaut in a jungle, cold color palette, muted colors, detailed, 8k"
image = pipe(prompt).images[0]
Para usar la LoRA entrenada en ComfyUI, copia el archivo de pesos .safetensors en la carpeta models/loras de la instalación. Después, añade el nodo «LTXV LoRA Selector» para seleccionar el archivo y conéctalo a «LTXV LoRA Loader» para aplicarlo a la generación. Los flujos de referencia de texto a vídeo e imagen a vídeo están disponibles en el repositorio oficial de LTXV para ComfyUI.
Funcionalidades
- Ajuste fino LoRA sobre el modelo base LTXV_13B_097_DEV.
- Entrenado durante 600 pasos con una tasa de aprendizaje de 0,0002 y un tamaño de lote de 1.
- Compatible con flujos de texto a vídeo e imagen a vídeo de LTXV.
- Integración con ComfyUI mediante los nodos «LTXV LoRA Selector» y «LTXV LoRA Loader».
- Utiliza indicaciones en inglés; el ejemplo de validación publicado es «cakefy a mountain».
- Hereda la licencia del modelo base LTXV_13B_097_DEV.
Casos de uso
- Generación de vídeos a partir de instrucciones textuales con el pipeline LTXV.
- Aplicación del estilo o comportamiento aprendido por la LoRA a flujos de vídeo en ComfyUI.
- Generación de vídeo a partir de una imagen mediante flujos I2V compatibles con LTXV.
- Experimentación con indicaciones como «cakefy a mountain» usando los pesos ajustados.