notreallyangelic/my_second_lora_v1-lora

notreallyangelic
Texto a video

Adaptador LoRA entrenado con AI Toolkit sobre Wan2.2-T2V-A14B. Utiliza la palabra de activación «m0n420» y está orientado principalmente a la generación de vídeo a partir de texto, aunque su tarjeta también incluye un ejemplo de generación de imágenes.

Como usar

Instala las dependencias necesarias:

pip install -U diffusers transformers accelerate

Ejemplo para generar un vídeo con Diffusers:

import torch
from diffusers import DiffusionPipeline
from diffusers.utils import export_to_video

# switch to "mps" for apple devices
pipe = DiffusionPipeline.from_pretrained(
    "ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16",
    dtype=torch.bfloat16,
    device_map="cuda"
)
pipe.load_lora_weights("notreallyangelic/my_second_lora_v1-lora")
prompt = "m0n420"
output = pipe(prompt=prompt).frames[0]
export_to_video(output, "output.mp4")

La tarjeta también proporciona este ejemplo para generar una imagen usando el archivo de pesos de bajo ruido:

from diffusers import AutoPipelineForText2Image
import torch

pipeline = AutoPipelineForText2Image.from_pretrained(
    'ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16',
    torch_dtype=torch.bfloat16
).to('cuda')
pipeline.load_lora_weights(
    'notreallyangelic/my_second_lora_v1-lora',
    weight_name='my_second_lora_v1_low_noise.safetensors'
)
image = pipeline('m0n420').images[0]
image.save("my_image.png")

Funcionalidades

Adaptador LoRA para el modelo base ai-toolkit/Wan2.2-T2V-A14B-Diffusers-bf16.
Compatible con la biblioteca Diffusers.
Palabra de activación recomendada: m0n420.
Pesos disponibles en formato Safetensors.
Puede descargarse para utilizarlo con ComfyUI, AUTOMATIC1111, SD.Next e Invoke AI.
Licencia CreativeML Open RAIL-M.
No está desplegado actualmente por ningún proveedor de inferencia.

Casos de uso

Generación de vídeo a partir de texto mediante Wan2.2-T2V.
Generación de contenido visual activado con el token «m0n420».
Incorporación del estilo o concepto aprendido por el LoRA en flujos locales de Diffusers o ComfyUI.
Experimentación con los pesos LoRA de bajo ruido para generar imágenes.