En el próspero mundo de los generadores de imágenes de IA, la paciencia es aparentemente una virtud esquiva. Los entusiastas entusiastas de Stable Diffusion, posiblemente el generador de imágenes de código abierto más popular en línea, están pasando por alto la espera del lanzamiento oficial de su última versión, Stable Diffusion XL v0.9, que se filtró en línea el jueves. La versión, destinada a pruebas en la nube y aún no destinado para el lanzamiento público por el creador Stability AI, encontró su camino en el ámbito público y comenzó a extenderse rápidamente. Joe Penna, miembro del creador Stability AI, ofreció un sentimiento mixto: «¿Estoy orgulloso de ustedes o… lo contrario de orgulloso?». reflexionó sobre un hilo de subreddit centrado en la fuga. Mientras tanto, su colega de Stability AI, Alex Goodwin, le confió a Reddit que el equipo había estado interesado en implementar un modelo que pudiera ejecutarse en A1111, una GUI favorita de los fanáticos entre los usuarios de Stable Diffusion, antes de la lanzamiento. Ese plan, al parecer, ahora tendrá que acelerarse. “Esperábamos, ya sabes, tener tiempo para implementar las cosas antes del lanzamiento”, escribió Goodwin, “pero [I] Supongo que habrá que apresurarse ahora”. Stable Diffusion XL representa un ápice en la evolución de los generadores de imágenes de código abierto. Está diseñado para competir con sus predecesores y contrapartes, incluido el famoso MidJourney. Con su capacidad para generar imágenes que hacen eco de la calidad de MidJourney, el nuevo lanzamiento de Stable Diffusion se ha hecho un hueco rápidamente. Conserva su ethos de código abierto, ofreciendo beneficios como compatibilidad con complementos, garantía de privacidad y cientos de modelos diferentes. Tales características pueden atraer a cualquiera que busque gráficos de alta calidad sin gastar cerca de $ 100 al año por MidJourney. También requiere indicaciones menos complejas para proporcionar resultados de calidad. Sin embargo, hay una advertencia sobre el Stable Diffusion XL v0.9 adquirido clandestinamente. El torrent consume unos gigantescos 91,3 GB de espacio, aunque tener el modelo base y el refinador debería ser suficiente para las operaciones. Además, no funciona bien con las interfaces predominantes, y la mejor opción para probarlo actualmente es a través de Comfy UI, una interfaz ligera pero menos intuitiva basada en nodos. Stability AI, por su parte, se está poniendo al día. En una búsqueda por recuperar el control, la compañía cerró una versión de Stable Diffusion XL v0.9 en la comunidad de IA Huggingface. Desafortunadamente para Stability AI, el modelo ya se ha descentralizado a través de un torrent y, por lo tanto, será difícil detener la propagación. Este nuevo modelo tiene un par de inconvenientes. Muchos complementos integrales para el éxito de Stable Diffusion 1.5, como LoRA, Lycoris, Lohas, Controlnet y otros, parecen ser incompatibles con este modelo. Además, una vez que el modelo base genera una imagen, se necesita un proceso de refinamiento para obtener la imagen final óptima. Sin embargo, estos fallos no han disminuido el entusiasmo. La calidad visual del modelo, entrenada a una resolución de 1024×1024 en comparación con la versión 1.5 de 512×512, y la calidad estética de las imágenes generadas por el modelo XL ya están generando respuestas eufóricas de los usuarios. En una comunidad tan vibrante, es solo cuestión de tiempo antes de que todos los ojos se vuelven hacia esta nueva época en el arte generativo, y parece que el caos en torno a la filtración ha provocado, sin darse cuenta, un frenesí creativo entre los usuarios.
Publi
















