Hex333/ostro_v3-lora

Hex333
Texto a video

Adaptador LoRA para el modelo base Wan2.2-T2V-A14B, entrenado con AI Toolkit de Ostris. Se activa mediante la palabra clave «ostro» y está orientado principalmente a la generación de vídeo a partir de texto.

Como usar

Instalación y generación de vídeo con Diffusers:

pip install -U diffusers transformers accelerate
import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# Cambia a "mps" para dispositivos Apple
pipe = DiffusionPipeline.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    torch_dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("Hex333/ostro_v3-lora")

prompt = "ostro"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La página también proporciona este ejemplo para cargar el archivo específico de bajo ruido y generar una imagen:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    'ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16',
    torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
    'Hex333/ostro_v3-lora',
    weight_name='ostro_v3_low_noise.safetensors'
)
image = pipeline('ostro').images[0]
image.save("my_image.png")

Funcionalidades

Adaptador LoRA para generación de texto a vídeo
Compatible con la biblioteca Diffusers
Palabra de activación: «ostro»
Pesos disponibles en formato Safetensors
Compatible con ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI
Licencia CreativeML Open RAIL-M
No está desplegado actualmente en ningún proveedor de inferencia

Casos de uso

Generar vídeos a partir de prompts que incluyan la palabra de activación «ostro»
Integrar el estilo o concepto aprendido por el LoRA en flujos de Wan2.2
Ejecutar generación local mediante Diffusers o interfaces compatibles con LoRA
Experimentar con el peso, la fusión y la combinación del adaptador con otros LoRA