wan21_kapi_01-lora
spamnco
Texto a video
Adaptador LoRA creado por spamnco para el modelo base Wan-AI/Wan2.1-T2V-14B-Diffusers. Fue entrenado con AI Toolkit de Ostris y utiliza «kapi» como palabra de activación para generar contenido visual asociado al concepto aprendido. Sus pesos están disponibles en formato Safetensors bajo la licencia CreativeML Open RAIL-M.
Como usar
Instalación:
pip install -U diffusers transformers accelerate
Generación de vídeo con Diffusers:
import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video
# Cambia a "mps" para dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
"Wan-AI/Wan2.1-T2V-14B-Diffusers",
torch_dtype=torch.bfloat16,
device_map="cuda"
)
pipe.load_lora_weights("spamnco/wan21_kapi_01-lora")
prompt = "kapi"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")
La página también proporciona este ejemplo para cargar un archivo de pesos específico y generar una imagen:
from diffusers import AutoPipelineForText2Image
import torch
pipeline = AutoPipelineForText2Image.from_pretrained(
'Wan-AI/Wan2.1-T2V-14B-Diffusers',
torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
'spamnco/wan21_kapi_01-lora',
weight_name='wan21_kapi_01_000003250.safetensors'
)
image = pipeline('kapi').images[0]
image.save("my_image.png")
Funcionalidades
- Adaptador LoRA para Wan2.1-T2V-14B-Diffusers
- Generación de texto a vídeo
- Palabra de activación: «kapi»
- Compatible con la biblioteca Diffusers
- Pesos disponibles en formato Safetensors
- Puede descargarse para herramientas como ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
- No está desplegado actualmente mediante proveedores de inferencia
Casos de uso
- Generar vídeos a partir de prompts que incluyan la palabra «kapi»
- Aplicar el concepto visual aprendido por el LoRA al modelo Wan2.1 T2V de 14B
- Integrar el adaptador en flujos locales basados en Diffusers
- Usar sus pesos Safetensors en interfaces compatibles como ComfyUI o Invoke AI