Publi

MidJourney acaba de anunciar su nuevo modelo de generador de imágenes con IA, el modelo base V6, en la concurrida carrera por dominar el ámbito de la creatividad digital. El equipo de desarrollo, que se lanzó hoy para las pruebas alfa, dice que V6 presenta una precisión de aviso mejorada, una coherencia mejorada y, por primera vez en la evolución de MidJourney, capacidades de generación de texto. Anunciado en una publicación oficial de Discord, V6 se posiciona como una revisión importante «. Seguimiento de indicaciones mucho más preciso, así como indicaciones más largas, coherencia mejorada y conocimiento del modelo», revela el anuncio, destacando su avance con respecto al modelo V5.1 anterior lanzado en mayo de 2023. El modelo V5, destacado por su facilidad de uso indicaciones breves y mejoras estéticas allanaron el camino para el V6 más sofisticado y detallado.Uno de los componentes más notables de V6 es su capacidad de dibujar texto. Si bien no es el punto focal del modelo (el equipo dice que sigue siendo una característica «menor»), esta capacidad coloca a MidJourney en competencia directa con otros modelos líderes como Dall-E 3 e Ideogram. Sin embargo, el enfoque de MidJourney para la generación de texto es único. Al describirlo como «capacidad menor de dibujo de texto», dice Midjourney. «Debes escribir el texto entre 'comillas' y, aplicar estilo sin formato o valores más bajos, estilizar puede ayudar». Decrypt fue capaz de probar el modelo y compararlo con Dall-E 3, conocido por su precisión en la generación de texto. MidJourney parece priorizar el estilo y la estética, a veces a costa de la precisión del texto. La mayoría de las veces generó texto inexacto o ningún texto. Pero cuando lo hizo, las imágenes estaban a la par o incluso mejores que las generadas por Dall-E 3, el modelo de inteligencia artificial de texto a imagen que impulsa ChatGPT y Microsoft Bing.Comparando las generaciones de texto de MidJourney, Dall-E 3, SDXL con Harrlogos e Ideogram AI, una recomendación demasiado simplificada podría ser usar MidJourney si la estética es una prioridad, Dall-E 3 para facilidad de uso y estética de arte digital de dibujos animados, SDXL para aquellos con conocimientos avanzados de A1111 e Ideogram AI para resultados en los que el texto es más importante que la estética. MidJourney y Dalle-3 con ChatGPT actualmente cuestan dinero, mientras que SDXL e Ideogram AI son gratuitos. La versión de Bing de Dall-E 3 es de uso gratuito, pero solo genera imágenes cuadradas y las personas solo pueden modificar las indicaciones en lugar del enfoque de conversación natural adoptado por OpenAI. MidJourney V6 también es un poco más lento y más caro que v5, sin embargo, el equipo enfatiza su enfoque en acelerar el modelo con el tiempo. El modelo V6 también cuenta con escaladores mejorados en modos «sutil» y «creativo», mejorando la resolución de la imagen al doble. Estas características, junto con una amplia gama de argumentos admitidos como –ar (para cambiar la resolución), –chaos (para cambiar las variaciones entre generaciones) y –estilizar (para cambiar cuán creativo es el modelo), ofrecen a los usuarios un amplio espectro de posibilidades creativas. Sin embargo, otras funciones como pintura interior, pintura exterior y descripción de la imagen aún no están disponibles. Según MidJourney, deberían aparecer en una actualización el próximo mes. El anuncio pide a los usuarios que empleen estos «poderes increíbles con alegría, asombro, responsabilidad y respeto», lo que siempre ha sido parte del espíritu de MidJourney. Pero no se emocionen demasiado porque serán más estrictos con la censura. “No seas idiota ni crees imágenes para causar drama”, dice el anuncio. Lo más probable es que eso bloquee los intentos de crear waifus digitales o deepfakes políticos. Editado por Ryan Ozawa.

Manténgase al tanto de las noticias sobre criptomonedas y reciba actualizaciones diarias en su bandeja de entrada.