my_first_lora_v1-lora

hyperchainsad
Texto a video

Adaptador LoRA de hyperchainsad para el modelo base Wan2.2-T2V-A14B, orientado a la generación de vídeo a partir de texto. Fue entrenado con AI Toolkit de Ostris y distribuye sus pesos en formato Safetensors. No tiene palabras de activación definidas.

Como usar

Instala las dependencias y carga el adaptador sobre el modelo base Wan2.2-T2V-A14B:

pip install -U diffusers transformers accelerate
import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Cambia a "mps" para dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("hyperchainsad/my_first_lora_v1-lora")

prompt = "A man with short gray hair plays a red electric guitar."
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La tarjeta también proporciona este ejemplo para cargar directamente el archivo de pesos LoRA:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    'ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16',
    torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
    'hyperchainsad/my_first_lora_v1-lora',
    weight_name='my_first_lora_v1_high_noise.safetensors'
)
image = pipeline('a beautiful landscape').images[0]
image.save("my_image.png")

El segundo ejemplo aparece en la tarjeta del modelo, aunque usa una canalización de texto a imagen mientras el modelo está clasificado como Text-to-Video.

Funcionalidades

Adaptador LoRA para generación de texto a vídeo
Compatible con el modelo base ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16
Pesos disponibles en formato Safetensors
Integración con la biblioteca Diffusers
Compatible con interfaces como ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
Licencia CreativeML Open RAIL-M
No requiere palabras de activación específicas

Casos de uso

Generación de clips de vídeo a partir de descripciones textuales
Personalización de Wan2.2-T2V-A14B mediante pesos LoRA
Experimentación local con flujos de generación en Diffusers
Integración del adaptador en flujos visuales basados en ComfyUI