jueves, 16 de mayo de 2024

DT

¿Qué encontrarás en esta entrada?
  • Mi nueva canción.
Ale! Estreno nueva "canción". Realmente es algo medio improvisado basado en mis sesiones de en casa, con algún motivo fijo al que vuelvo de vez en cuando. Ni siquiera estoy seguro de que no haya grabado algo muy parecido antes xD, y el nombre (DT) no es más que una vaga referencia a algo a lo que me recuerda... en cualquier caso, creo que puede ser entretenida de escuchar, así que ya la tenéis disponible en Bandcamp.
 
 
Hasta la próxima :D!

martes, 19 de marzo de 2024

ComfyUI

¿Qué encontrarás en esta entrada?
  • Presentación de ComfyUI.
  • Vídeos juntando imágenes generadas por IA.
Como podéis haber visto en mi última entrada, ha vuelto a picarme el gusanillo de la generación de imágenes por IA, lo cual me ha llevado a descubrir ComfyUI. Aunque parece ser que tiene interfaz web, siguiendo las instrucciones de Yushan777 (a quien estoy muy agradecido por ello), me lo he instalado en local y estoy a tope con él.
 
Lo que me ha impresionado de esta interfaz de usuario para Stable Diffusion es que está planteada como un diagrama de nodos, lo que permite, de forma muy visual, configurártelo como quieras y desatar toda la potencia y personalización que desees.

Yo llevo unos días jugando con esto y abajo os dejo el esquema que estoy utilizando y una muestra de cómo funciona (siendo consciente de que, por mi inexperiencia, probablemente tenga muchas carencias).


La ventaja de construirte modularmente una interfaz a tu medida, es que le puedes añadir lo que desees. Yo, por ejemplo, le he añadido a través de un LoRa un módulo LCM, que me permite disfrutar de una previsualización casi a tiempo real según voy escribiendo, lo cuál es muy útil como paso inicial para afinar prompts.

Otra ventaja, es que puedes sacar los parámetros como variables y hacer un barrido, lo que permite, de forma fácil crear vídeos como los siguientes (en los que he variado el cfg).


Todo esto lo podéis ver en Mephisto's Dream, que está últimamente más activo que nunca. ¡Os veo por allí!

martes, 12 de marzo de 2024

Pika Fallout

¿Qué encontrarás en esta entrada?
  • Animar imágenes fijas con IA (Pika)
  • Imágenes generadas con SD con temáticas del Fallout

Vale!, lo sé... probablemente he llegado muy tarde, pero acabo de descubrir Pika y estoy jugando un poco para ver su potencial en combinación con Stable Diffusion.

Pero, como decía Jack el Destripador, vamos por partes. Stable Diffusion es una inteligencia artificial generativa de imágenes desarrollada por Stability AI y de la que ya hemos hablado en este blog. Pika es una aplicación que permite, entre otras cosas, dotar de cierto movimiento a una imagen fija. Por lo visto, en sus inicios era muy básica, pero ha mejorado mucho, aunque los resultados siguen siendo muy limitados, nada que ver con la IA de moda: Sora.

En esta entrada pretendo hacer una prueba básica. Primero, genero las imágenes. He intentado crear una chica dentro del universo del Fallout, aprovechando el hype de la salida de la serie el próximo 11 de abril. He usado Stable Diffusion 1.5 con el modelo RPG 5.





Podéis ver más imágenes como estas en mi otro blog, Mephisto's Dream.

Después las he dotado de movimiento con Pika. No he tocado mucho las opciones porque soy un poco manazas y, aunque la aplicación ofrece ciertos créditos gratis, estos bajan muy rápidamente. Le he enchufado la música y esto es lo que ha quedado:


Estoy de acuerdo: es muy mejorable, pero da una idea de las capacidades de la aplicación y seguramente se pueda mejorar el resultado jugando adecuadamente con los parámetros. En cualquier caso, al ritmo que avanza, quizás podamos jugar con algo a la altura de Sora en no mucho tiempo, lo que dejaría esto obsoleto.

Para quitaros el mal sabor de boca, os dejo on vídeo mucho mejor hecho que el mío que he encontrado mientras lo hacía.