Wan2.1-T2V-1.3B-crush-smol-v0

finetrainers
Texto a video

Checkpoint experimental LoRA de generación de vídeo a partir de texto, ajustado sobre Wan2.1-T2V-1.3B-Diffusers con el conjunto finetrainers/crush-smol. Está especializado en escenas de objetos aplastados por una prensa hidráulica mediante el activador «PIKA_CRUSH». Su capacidad de generalización fuera de este efecto es limitada.

Como usar

Instala las dependencias:

pip install -U diffusers transformers accelerate

Carga el modelo base, aplica el adaptador LoRA y exporta el vídeo:

import torch
from diffusers import WanPipeline
from diffusers.utils import export_to_video

pipe = WanPipeline.from_pretrained(
    "Wan-AI/Wan2.1-T2V-1.3B-Diffusers",
    torch_dtype=torch.bfloat16
).to("cuda")

pipe.load_lora_weights(
    "finetrainers/Wan2.1-T2V-1.3B-crush-smol-v0",
    adapter_name="wan-lora"
)
pipe.set_adapters(["wan-lora"], [0.75])

prompt = "PIKA_CRUSH A large metal cylinder is seen pressing down on a pile of colorful jelly beans, flattening them as if they were under a hydraulic press."
video = pipe(prompt).frames[0]
export_to_video(video, "output.mp4", fps=24)

No está desplegado actualmente mediante ningún proveedor de inferencia de Hugging Face.

Funcionalidades

Generación de vídeo a partir de descripciones de texto
Efecto visual especializado de compresión o aplastamiento con prensa hidráulica
Adaptador LoRA para Wan-AI/Wan2.1-T2V-1.3B-Diffusers
Activación del efecto mediante el término «PIKA_CRUSH»
Compatible con Diffusers y ejecución en GPU CUDA
Checkpoint experimental con generalización deficiente conocida

Casos de uso

Crear vídeos estilizados de objetos aplastados por una prensa hidráulica
Generar variaciones del efecto «squish» inspirado en Pika
Experimentar con adaptadores LoRA para generación de vídeo con Wan2.1
Producir clips cortos de compresión de alimentos, cubos u otros objetos