KVwan21-lora

jude1903
Texto a video

Adaptador LoRA para el modelo base Wan2.1-T2V-14B-Diffusers, entrenado con AI Toolkit para generar contenido visual de una mujer asociada al concepto «KV». Utiliza la frase de activación «KV woman» y distribuye sus pesos en formato Safetensors.

Como usar

Instala las dependencias:

pip install -U diffusers transformers accelerate

Carga el modelo base y aplica el adaptador LoRA para generar un vídeo:

import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Cambia a "mps" para dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "Wan-AI/Wan2.1-T2V-14B-Diffusers",
    torch_dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("jude1903/KVwan21-lora")

prompt = "KV woman"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La ficha también proporciona este ejemplo para cargar directamente el archivo Safetensors y generar una imagen:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    'Wan-AI/Wan2.1-T2V-14B-Diffusers',
    torch_dtype=torch.bfloat16
).to('cuda')

pipeline.load_lora_weights(
    'jude1903/KVwan21-lora',
    weight_name='KVwan21_000002250.safetensors'
)

image = pipeline('KV woman').images[0]
image.save("my_image.png")

Funcionalidades

Adaptador LoRA para generación de texto a vídeo
Compatible con el modelo base Wan-AI/Wan2.1-T2V-14B-Diffusers
Frase de activación: «KV woman»
Pesos disponibles en formato Safetensors
Compatible con Diffusers, ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
Licencia CreativeML Open RAIL-M

Casos de uso

Generación de vídeos condicionados por el prompt «KV woman»
Creación de variaciones visuales del personaje o concepto KV
Integración del estilo aprendido en flujos locales basados en Diffusers o ComfyUI
Experimentación con pesos, combinación y fusión de adaptadores LoRA