spamnco/wan21_ccerf_02-lora

spamnco
Texto a video

Adaptador LoRA para el modelo base Wan2.1-T2V-14B-Diffusers, entrenado con AI Toolkit de Ostris y orientado a generar contenido visual mediante la palabra de activación «ccerf». Sus pesos se distribuyen en formato Safetensors.

Como usar

Instala las dependencias y carga el adaptador sobre el modelo base:

pip install -U diffusers transformers accelerate
import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Usa "mps" en dispositivos Apple compatibles
pipe = DiffusionPipeline.from_pretrained(
    "Wan-AI/Wan2.1-T2V-14B-Diffusers",
    dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("spamnco/wan21_ccerf_02-lora")

prompt = "ccerf"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La tarjeta también incluye este ejemplo alternativo para cargar directamente el archivo Safetensors:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    'Wan-AI/Wan2.1-T2V-14B-Diffusers',
    torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
    'spamnco/wan21_ccerf_02-lora',
    weight_name='wan21_ccerf_02_000004250.safetensors'
)
image = pipeline('ccerf').images[0]
image.save("my_image.png")

Debe incluirse «ccerf» en el prompt para activar el concepto aprendido por el LoRA.

Funcionalidades

Adaptador LoRA para generación de texto a vídeo
Basado en Wan-AI/Wan2.1-T2V-14B-Diffusers
Palabra de activación: ccerf
Pesos disponibles en formato Safetensors
Compatible con Diffusers, ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
Licencia CreativeML Open RAIL-M
No está desplegado actualmente en proveedores de inferencia

Casos de uso

Generar vídeos condicionados por texto con el concepto visual asociado a «ccerf»
Añadir el estilo o sujeto aprendido por el adaptador a Wan2.1-T2V-14B
Integrar el LoRA en flujos locales de Diffusers o interfaces compatibles con Safetensors