En este artículo de la serie de la sección del profesor productivo en el podcast IA y Educación, vamos a introducir los tres modelos de IA para generar imágenes más importantes: Midjourney, DALL-E y Stable Diffusion, los cuales ya habíamos introducido en un artículo anterior.
⚠️ ACTUALIZACIÓN: Además de estos 3 grandes modelos, han surgido otros, como Adobe Firefly, y es muy posible que otros modelos surjan en el futuro, ya que es un campo con mucho desarrollo. También es posible que algunos datos no estén actualizados.

Resumen: Texto a imagen (text-to-image) con Inteligencia Artificial
- Motores de IA para imágenes: Los motores de IA son los modelos entrenados específicamente para generar imágenes, diferenciándose de herramientas generales que utilizan estas tecnologías.
- Tres grandes motores a septiembre de 2023: Actualmente, los tres principales motores de IA para crear imágenes son Midjourney, Dall-E, y Stable Diffusion. Estos dominan el mercado debido a los altos costos y tiempo necesario para entrenar nuevos modelos.
- Midjourney: Calidad superior en generación de imágenes:
- Reconocido por su calidad: Midjourney es considerado el mejor motor en términos de calidad de las imágenes generadas.
- Ejemplo destacado: Una imagen creada con Midjourney, titulada «Teatro de Ópera Espacial» por James Allen, ganó un concurso de arte digital, destacando el potencial de esta IA.
- Inconvenientes: No ofrece un plan gratuito (mínimo $10/mes) y se utiliza a través de un canal de Discord, lo cual puede ser complicado para algunos usuarios.
- Acceso exclusivo: Midjourney solo se puede utilizar a través de su propia plataforma.
- Dall-E: Acceso y usabilidad:
- Desarrollado por OpenAI: Dall-E es la IA de generación de imágenes creada por la misma empresa detrás de ChatGPT.
- Alternativa recomendada: Aunque no es completamente gratuita, Microsoft ha integrado Dall-E en Bing Chat, permitiendo la generación gratuita de imágenes cuadradas de alta resolución (1024×1024 píxeles).
- Ideal para principiantes: Bing Chat es la opción recomendada para quienes quieren comenzar a practicar con prompts en español sin costo.
- Stable Diffusion: Flexibilidad y código abierto:
- Desarrollado por Stability AI: Stable Diffusion es de código abierto, lo que ha permitido la creación de múltiples herramientas derivadas y software asociado.
- Amplia adopción: Es el motor más utilizado en webs, aplicaciones y herramientas debido a su flexibilidad y gratuidad (aunque algunas plataformas pueden cobrar por su uso).
- Herramientas recomendadas: Para calidad superior y opciones de edición, se sugieren leonardo.ai y lexica.art, que ofrecen más control y personalización, aunque requieren un poco de aprendizaje.
- Especialización y variedad en herramientas derivadas: Existen cientos de herramientas basadas en Stable Diffusion, especializadas en diferentes tipos de imágenes, como avatares, caricaturas, patrones para telas, y estilo manga japonés.
La sección del profesor productivo: Modelos de IA para generar imágenes
👉 Puedes escuchar también este audio en YouTube.
👉 Si te interesa el episodio completo, este es el enlace a ivoox, pero se puede escuchar en muchas otras plataformas.
⚠️ Los enlaces de esta página y de toda la web pueden contener código de afiliados de Amazon o de otras empresas. Esto significa que recibimos una comisión por cada compra de producto o servicio sin que cambie el precio de venta para el comprador.



