LL1999/my_first_lora_v1-lora

LL1999
Texto a video

Adaptador LoRA entrenado con AI Toolkit sobre Wan2.2-T2V-A14B para generar contenido activado por la palabra clave «Setsuna». Sus pesos se distribuyen en formato Safetensors y está orientado principalmente a flujos de difusión de texto a vídeo, aunque la ficha también incluye un ejemplo de generación de imagen.

Como usar

Instala las dependencias y carga el LoRA sobre el modelo base Wan2.2. Para generar un vídeo:

pip install -U diffusers transformers accelerate

import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Cambia a "mps" para dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    torch_dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("LL1999/my_first_lora_v1-lora")

prompt = "Setsuna"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La ficha también proporciona este ejemplo para generar una imagen usando el archivo de pesos de bajo ruido:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    torch_dtype=torch.bfloat16
).to("cuda")

pipeline.load_lora_weights(
    "LL1999/my_first_lora_v1-lora",
    weight_name="my_first_lora_v1_low_noise.safetensors"
)

image = pipeline("Setsuna").images[0]
image.save("my_image.png")

Funcionalidades

Adaptador LoRA para el modelo base ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16
Generación condicionada mediante la palabra de activación «Setsuna»
Compatible con la biblioteca Diffusers
Pesos disponibles en formato Safetensors
Puede descargarse para herramientas como ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
Licencia CreativeML Open RAIL-M
No está desplegado actualmente en ningún proveedor de inferencia

Casos de uso

Generar vídeos asociados al concepto o personaje activado por «Setsuna»
Crear imágenes de «Setsuna» mediante el peso LoRA de bajo ruido
Integrar el estilo o sujeto aprendido en flujos locales de Diffusers
Usar los pesos Safetensors en interfaces compatibles con LoRA