Remade-AI/Cats

Remade-AI
Texto a video

Adaptador LoRA para Wan2.1 14B T2V, entrenado para generar vídeos de gatos a partir de descripciones textuales. Se entrenó durante 10 épocas con 27 clips de gatos —unos dos minutos de vídeo en total— y sus pesos se distribuyen en formato Safetensors bajo licencia Apache 2.0.

Como usar

Instala las dependencias y carga el LoRA sobre el modelo base Wan2.1 14B T2V:

pip install -U diffusers transformers accelerate

import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Cambia a "mps" para dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "Wan-AI/Wan2.1-T2V-14B",
    dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("Remade-AI/Cats")

prompt = "cat video A short-haired tabby cat sits on a wooden fence, watching a butterfly flutter in front of it."
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

Para obtener resultados más alineados con el entrenamiento, usa la frase de activación ca45t cat video al inicio del prompt. En ComfyUI, utiliza el flujo Wan T2V modificado con un nodo Wan LoRA conectado al modelo base.

Funcionalidades

Generación de vídeo de gatos a partir de texto
Adaptador LoRA basado en Wan-AI/Wan2.1-T2V-14B
Frase de activación recomendada: «ca45t cat video»
Compatible con Diffusers y un flujo modificado de Wan Video Wrapper para ComfyUI
Intensidad LoRA recomendada: 1.0
Escala de guía integrada recomendada: 6.0
Flow Shift recomendado: 5.0
Pesos disponibles en formato Safetensors

Casos de uso

Crear vídeos cortos de gatos a partir de descripciones textuales
Animar escenas concretas con gatos de distintas razas, colores y comportamientos
Generar contenido visual felino para redes sociales o proyectos creativos
Integrar generación especializada de vídeos de gatos en flujos de Diffusers o ComfyUI