Ruzarh/c0ldv_T2V_Sigmoid_Flow_Rank64-lora

Ruzarh
Texto a video

Adaptador LoRA de rango 64 para generación de vídeo a partir de texto, entrenado con AI Toolkit sobre Wan2.2-T2V-A14B. Utiliza «c0ldv» como palabra de activación y distribuye sus pesos en formato Safetensors.

Como usar

Instala las dependencias y carga el adaptador LoRA sobre el modelo base:

pip install -U diffusers transformers accelerate
import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Cambia a "mps" para dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights(
    "Ruzarh/c0ldv_T2V_Sigmoid_Flow_Rank64-lora"
)

prompt = "c0ldv"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La tarjeta también incluye este ejemplo alternativo para cargar un archivo de pesos específico:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    'ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16',
    torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
    'Ruzarh/c0ldv_T2V_Sigmoid_Flow_Rank64-lora',
    weight_name='c0ldv_T2V_Sigmoid_Flow_Rank64_low_noise.safetensors'
)
image = pipeline('c0ldv').images[0]
image.save("my_image.png")

Funcionalidades

Generación de vídeo a partir de texto mediante un adaptador LoRA
Basado en ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16
Palabra de activación: c0ldv
Pesos disponibles en formato Safetensors
Compatible con Diffusers, ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
Licencia CreativeML Open RAIL-M
No está desplegado actualmente por ningún proveedor de inferencia

Casos de uso

Generar clips de vídeo condicionados por prompts que incluyan la palabra «c0ldv»
Incorporar el estilo o concepto aprendido por el LoRA a flujos de trabajo basados en Wan2.2
Ejecutar generación local con Diffusers o interfaces compatibles con pesos LoRA Safetensors