jude1903/Jun3wan22-lora

jude1903
Texto a video

Adaptador LoRA para generación de vídeo a partir de texto, entrenado con AI Toolkit sobre el modelo base Wan2.2-T2V-A14B en formato Diffusers BF16. Sus pesos están disponibles en formato Safetensors y no requiere palabras de activación específicas.

Como usar

Instala las dependencias y carga el adaptador LoRA sobre el modelo base para generar un vídeo:

pip install -U diffusers transformers accelerate

import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Usa "mps" en dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    torch_dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("jude1903/Jun3wan22-lora")

prompt = "A man with short gray hair plays a red electric guitar."
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La página también proporciona este ejemplo para cargar directamente el archivo de pesos de bajo ruido:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    torch_dtype=torch.bfloat16
).to("cuda")

pipeline.load_lora_weights(
    "jude1903/Jun3wan22-lora",
    weight_name="Jun3wan22_low_noise.safetensors"
)

image = pipeline("a beautiful landscape").images[0]
image.save("my_image.png")

Funcionalidades

Generación de vídeo condicionada mediante descripciones de texto
Adaptador LoRA basado en ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16
Compatible con la biblioteca Diffusers
Pesos disponibles en formato Safetensors
Utilizable con ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
No tiene palabras de activación definidas
Licencia CreativeML Open RAIL-M
No está desplegado actualmente en proveedores de inferencia

Casos de uso

Generar clips de vídeo a partir de instrucciones textuales
Aplicar el estilo o ajuste aprendido por el LoRA al modelo Wan2.2-T2V-A14B
Integrar generación audiovisual personalizada en flujos de trabajo de Diffusers
Usar los pesos LoRA en interfaces locales compatibles, como ComfyUI