wan21_diddly_01-lora
spamnco
Texto a video
Adaptador LoRA para el modelo base Wan2.1-T2V-14B-Diffusers, entrenado con AI Toolkit para generar contenido visual asociado al concepto «diddly». Se activa incluyendo la palabra clave «diddly» en el prompt.
Como usar
Instala las dependencias y carga el adaptador LoRA sobre el modelo base para generar un vídeo:
pip install -U diffusers transformers accelerate
import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video
# switch to "mps" for apple devices
pipe = DiffusionPipeline.from_pretrained(
"Wan-AI/Wan2.1-T2V-14B-Diffusers",
torch_dtype=torch.bfloat16,
device_map="cuda"
)
pipe.load_lora_weights("spamnco/wan21_diddly_01-lora")
prompt = "diddly"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")
La ficha también proporciona este ejemplo alternativo para cargar el archivo Safetensors concreto y producir una imagen:
from diffusers import AutoPipelineForText2Image
import torch
pipeline = AutoPipelineForText2Image.from_pretrained(
'Wan-AI/Wan2.1-T2V-14B-Diffusers',
torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
'spamnco/wan21_diddly_01-lora',
weight_name='wan21_diddly_01_000002750.safetensors'
)
image = pipeline('diddly').images[0]
image.save("my_image.png")
Funcionalidades
- Adaptador LoRA basado en Wan-AI/Wan2.1-T2V-14B-Diffusers.
- Orientado principalmente a la generación de texto a vídeo.
- Palabra de activación: «diddly».
- Pesos disponibles en formato Safetensors.
- Compatible con Diffusers y potencialmente con ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI.
- Licencia CreativeML Open RAIL-M.
Casos de uso
- Generar vídeos condicionados por texto con el estilo o concepto aprendido mediante «diddly».
- Aplicar el adaptador LoRA a flujos locales basados en Wan2.1 y Diffusers.
- Integrar los pesos Safetensors en interfaces compatibles como ComfyUI o Invoke AI.
- Experimentar con la intensidad, combinación o fusión del LoRA sobre el modelo base.