THwan21-lora

jude1903
Texto a video

Adaptador LoRA para Wan2.1-T2V-14B orientado a generar contenido visual de una mujer tailandesa. Fue entrenado con AI Toolkit de Ostris y se activa mediante la frase «TH woman». Sus pesos se distribuyen en formato Safetensors bajo la licencia CreativeML Open RAIL-M.

Como usar

Instalación:

pip install -U diffusers transformers accelerate

Generación de vídeo con Diffusers:

import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Cambia a "mps" en dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "Wan-AI/Wan2.1-T2V-14B-Diffusers",
    dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("jude1903/THwan21-lora")

prompt = "TH woman"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La página también proporciona este ejemplo alternativo para cargar el archivo específico del adaptador:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    'Wan-AI/Wan2.1-T2V-14B-Diffusers',
    torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
    'jude1903/THwan21-lora',
    weight_name='THwan21_000002750.safetensors'
)
image = pipeline('TH woman').images[0]
image.save("my_image.png")

Funcionalidades

Adaptador LoRA basado en Wan-AI/Wan2.1-T2V-14B-Diffusers
Generación de texto a vídeo
Palabra de activación: «TH woman»
Pesos disponibles en formato Safetensors
Compatible con Diffusers y herramientas como ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
No está desplegado actualmente mediante proveedores de inferencia

Casos de uso

Generar vídeos condicionados por texto con el concepto «TH woman»
Incorporar este concepto visual a flujos de trabajo basados en Wan2.1
Usar el adaptador LoRA en interfaces locales compatibles
Experimentar con la ponderación, combinación o fusión de adaptadores LoRA