Crear imágenes con Midjourney: guía completa 2026

Aprende a crear imágenes con Midjourney paso a paso

Si llevas un tiempo viendo imágenes hiperrealistas o ilustraciones imposibles en redes sociales y te preguntas cómo se hacen, es muy probable que la respuesta sea Midjourney. Es, junto a un puñado de herramientas más, la que marca el nivel de calidad que el resto intenta igualar.

En esta guía vas a aprender qué es exactamente, cómo registrarte, cómo escribir tu primer prompt y qué parámetros usar para controlar el resultado con precisión. También verás errores que cometen casi todos los principiantes, algunos trucos que solo se aprenden con la práctica, y una comparativa honesta con sus principales alternativas. El objetivo es que, al terminar de leer, generes tu primera imagen sabiendo qué estás haciendo y por qué.

Qué es

Midjourney es un laboratorio de investigación independiente que desarrolla un modelo de inteligencia artificial capaz de generar imágenes a partir de descripciones de texto. Funciona mediante un modelo de difusión: parte de ruido visual aleatorio y lo va refinando paso a paso hasta convertirlo en una imagen coherente con lo que has pedido.

A diferencia de otras herramientas que nacieron dentro de grandes compañías tecnológicas, Midjourney se mantiene como una empresa pequeña y autofinanciada, centrada casi exclusivamente en mejorar la calidad artística de sus resultados. Eso se nota: sigue siendo, para buena parte de la comunidad de diseñadores e ilustradores, la referencia en cuanto a composición, iluminación y coherencia visual.

Hoy puedes usarla de dos formas: a través de su servidor de Discord (su método original y todavía muy utilizado) o desde su aplicación web en midjourney.com, que permite generar, organizar y editar imágenes sin salir del navegador.

Para qué sirve

Midjourney se usa en contextos muy distintos, más allá de la simple curiosidad de “a ver qué genera la IA”:

  • Diseño de portadas y material editorial: cubiertas de libros, carátulas de álbumes, ilustraciones para artículos.
  • Concept art: videojuegos, cine y proyectos de animación la usan para explorar personajes, escenarios y ambientaciones antes de pasar a producción.
  • Marketing y publicidad: creación de imágenes para campañas cuando no hay presupuesto o tiempo para una sesión fotográfica.
  • Branding: moodboards, referencias visuales y exploración de estilos antes de definir la identidad de una marca.
  • Ilustración y arte personal: muchos artistas la usan como punto de partida creativo, no como resultado final, y luego retocan la imagen en otros programas.

Principales características

  • Generación de imágenes a partir de texto (text-to-image) mediante el comando /imagine.
  • Image prompts: puedes subir una o varias imágenes de referencia junto al texto para guiar el estilo o la composición.
  • Style reference (--sref) y character reference (--cref): mantienen un estilo visual o un personaje consistente entre distintas generaciones.
  • Control de aspect ratio (--ar) para adaptar la imagen a formato cuadrado, vertical, horizontal o panorámico.
  • Parámetros de stylize (--stylize) y chaos (--chaos) para ajustar cuánto se aleja el resultado de una interpretación literal del prompt.
  • Seed (--seed): permite reproducir o partir de la misma base aleatoria en distintas generaciones.
  • Modo Niji (--niji): un modelo entrenado específicamente para estilos de anime e ilustración.
  • Editor integrado: herramienta de retoque por regiones (inpainting) para modificar solo una parte de la imagen sin regenerarla entera.
  • Vary (Subtle/Strong), Pan y Zoom Out: funciones para variar ligeramente un resultado, extender el lienzo o alejar la composición sin perder lo ya generado.
  • Modo Remix: permite cambiar el prompt entre variaciones de una misma imagen.
  • Generación de vídeo a partir de imagen (image-to-video), disponible en todos los planes, que consume las mismas horas de GPU rápida que la generación de imágenes.
  • Modo Sigiloso (Stealth Mode): oculta tus generaciones de la galería pública, disponible solo en los planes Pro y Mega.

Ventajas

  • Calidad estética y coherencia visual que sigue por delante de buena parte de la competencia, especialmente en iluminación y composición.
  • Control granular gracias a sus parámetros: no es solo “escribe y reza”, puedes ajustar el resultado con precisión.
  • Comunidad enorme y muy activa, lo que se traduce en muchísimos ejemplos de prompts y estilos ya probados.
  • Todos los planes incluyen derechos de uso comercial sobre las imágenes generadas.
  • Actualizaciones de modelo frecuentes: la calidad ha mejorado de forma notable versión tras versión.

Desventajas

  • No existe plan gratuito ni periodo de prueba en la web oficial; hay que pagar desde el primer día.
  • El sistema de facturación por horas de GPU, en lugar de por número de imágenes, resulta confuso al principio y puede hacer que gastes más de lo previsto si no controlas tu consumo.
  • En los dos planes más económicos (Basic y Standard) tus imágenes son públicas por defecto: cualquiera puede verlas y descargarlas desde la galería de Midjourney.
  • La curva de aprendizaje de los parámetros y comandos es más pronunciada que la de herramientas con interfaz totalmente visual.
  • Si tu empresa factura más de un millón de dólares al año, necesitas obligatoriamente un plan Pro o Mega para poder usar las imágenes con fines comerciales.

Cómo empezar

  1. Entra en midjourney.com y crea una cuenta (puedes registrarte con tu correo o con una cuenta de Google/Discord).
  2. Elige un plan de suscripción. No hay prueba gratuita, así que tendrás que seleccionar directamente uno de pago: Basic, Standard, Pro o Mega.
  3. Introduce tus datos de pago y confirma la suscripción.
  4. Una vez dentro, puedes generar imágenes directamente desde la web, sin necesidad de usar Discord, aunque el servidor de Discord de Midjourney sigue disponible si prefieres esa interfaz.
  5. Verifica siempre el precio y las condiciones actuales en la página oficial antes de suscribirte, ya que Midjourney ajusta sus planes con cierta frecuencia.
Crear imágenes con Midjourney

Tutorial completo paso a paso

Paso 1: Define qué quieres generar antes de escribir el prompt

No abras la herramienta sin tener claro el sujeto, el estilo y el ambiente que buscas. Consejo: piensa en tres capas — qué hay en la imagen, cómo está iluminada y qué estilo artístico quieres. Error frecuente: escribir prompts demasiado vagos (“una ciudad bonita”) y esperar un resultado muy específico. Buena práctica: anota tres o cuatro adjetivos concretos antes de escribir el prompt final.

Paso 2: Escribe el prompt en inglés siempre que puedas

Midjourney entiende español, pero su entrenamiento principal está en inglés, así que la precisión suele ser mayor en ese idioma. Consejo: si no dominas el inglés, escribe el prompt en español y tradúcelo con cualquier traductor antes de introducirlo. Error frecuente: mezclar los dos idiomas en el mismo prompt, lo que puede confundir al modelo. Buena práctica: mantén el prompt en un solo idioma de principio a fin.

Paso 3: Estructura el prompt de lo general a lo específico

Empieza por el sujeto principal, sigue con el entorno, después el estilo artístico y termina con los parámetros técnicos. Consejo: un orden típico es “sujeto + acción + entorno + iluminación + estilo + parámetros”. Error frecuente: meter todos los detalles sin orden, lo que hace que unos elementos “compitan” con otros por protagonismo. Buena práctica: usa comas para separar bloques de información claramente diferenciados.

Paso 4: Añade parámetros técnicos al final del prompt

Incorpora --ar para el formato, --stylize para el nivel de interpretación artística y --v para elegir la versión del modelo. Consejo: para retratos, --ar 2:3 suele funcionar mejor que el formato cuadrado por defecto. Error frecuente: olvidar el parámetro de versión y dejar que Midjourney use la que tenga por defecto en ese momento. Buena práctica: fija siempre la versión del modelo que quieres usar, así tus resultados son predecibles y comparables entre sí.

Paso 5: Genera el primer lote de imágenes

Cada generación te da cuatro variaciones a partir del mismo prompt. Consejo: no descartes las cuatro por igual; suele haber una claramente mejor que sirve como punto de partida. Error frecuente: regenerar todo el lote en vez de trabajar sobre la variación que más te gusta. Buena práctica: usa el botón de variación (V) sobre la imagen elegida, no un prompt completamente nuevo.

Paso 6: Ajusta con Vary, Pan o Zoom Out

Si el resultado va por buen camino pero necesita retoques, usa Vary Subtle para cambios pequeños o Vary Strong para cambios más notables. Consejo: Pan y Zoom Out son ideales cuando la composición está bien pero necesitas más espacio alrededor del sujeto. Error frecuente: usar Vary Strong esperando un cambio mínimo, cuando en realidad puede transformar buena parte de la imagen. Buena práctica: prueba primero Subtle; si no es suficiente, entonces pasa a Strong.

Paso 7: Retoca detalles concretos con el Editor

Si solo quieres cambiar una parte de la imagen (por ejemplo, el fondo o un objeto concreto), usa el Editor integrado para seleccionar esa región y regenerarla sin tocar el resto. Consejo: selecciona un área algo más amplia que el objeto que quieres cambiar, para que el resultado se integre mejor. Error frecuente: seleccionar un área demasiado ajustada, lo que genera bordes poco naturales. Buena práctica: revisa el resultado a tamaño completo, no solo en miniatura, antes de darlo por bueno.

Paso 8: Aumenta la resolución final

Cuando ya tengas la imagen definitiva, usa la opción de aumentar resolución antes de descargarla para uso profesional. Consejo: hazlo siempre como último paso, después de cerrar todos los ajustes de composición. Error frecuente: aumentar la resolución demasiado pronto y tener que repetir el proceso tras hacer más cambios. Buena práctica: guarda también la versión sin aumentar, por si necesitas volver a editarla más adelante.

Ejemplos reales

  • Un estudio de videojuegos indie usa Midjourney para generar decenas de variaciones de un mismo personaje antes de decidir el diseño definitivo que luego dibuja un ilustrador desde cero.
  • Una agencia de branding lo emplea en la fase de moodboard, para mostrarle al cliente distintas direcciones estéticas antes de invertir en fotografía o ilustración original.
  • Un autor autopublicado genera la base visual de la portada de su libro y después la retoca en Photoshop para añadir tipografía y ajustes finales.
  • Un creador de contenido genera fondos e ilustraciones de apoyo para sus vídeos, evitando pagar licencias de bancos de imágenes para cada pieza.

Trucos

  • Usa --sref con el enlace de una imagen que te guste para mantener una misma dirección estética en todo un proyecto, sin tener que describir el estilo palabra por palabra cada vez.
  • Cuando un prompt no funcione como esperabas, elimina parámetros uno por uno en vez de cambiar el texto entero: así identificas qué parte estaba afectando al resultado.
  • Si necesitas coherencia entre varias imágenes de un mismo personaje, combina --cref con una semilla (--seed) fija.
  • Baja el valor de --stylize cuando necesites resultados más literales y fieles al prompt, y súbelo cuando busques resultados más artísticos y libres.
  • Aprovecha el modo Relax (disponible desde el plan Standard) para las pruebas y bocetos, y reserva tus horas de GPU rápida para las versiones finales que tengan prisa.

Prompts útiles

Retrato editorial:

retrato de estudio de una mujer de mediana edad, luz lateral suave, fondo neutro desenfocado, fotografía profesional, expresión serena --ar 2:3 --stylize 250 --v 6.1

Ilustración de producto para marca:

botella de perfume minimalista sobre superficie de mármol, iluminación de estudio, sombra suave, estética de lujo, fotografía comercial --ar 1:1 --stylize 150

Concept art de entorno:

ciudad futurista al atardecer vista desde un puente elevado, arquitectura vertical, niebla ligera, paleta de colores cálidos, concept art cinematográfico --ar 16:9 --chaos 15

Ilustración estilo anime:

personaje joven con abrigo largo caminando bajo la lluvia, calle iluminada por neones, estilo de animación japonesa --niji 6 --ar 3:4

Automatizaciones

Midjourney no ofrece de forma nativa una API pública sencilla para automatizar generaciones masivas fuera de su interfaz de Discord o web, así que las combinaciones habituales con otras herramientas de IA suelen funcionar en flujo manual o semi-automatizado:

  • Con ChatGPT o Gemini: usa el chatbot para generar y perfeccionar el texto del prompt antes de pegarlo en Midjourney, especialmente útil si no dominas el inglés o quieres explorar variaciones de una misma idea rápidamente.
  • Con herramientas de edición como Photoshop: Midjourney genera la base visual, y el retoque final (tipografía, ajustes de color de marca, composición con otros elementos) se completa en un editor tradicional.
  • Con generadores de vídeo: algunas imágenes generadas en Midjourney se usan como fotograma de partida en herramientas externas de animación, más allá de la función de imagen a vídeo que ya incluye la propia plataforma.
  • Con gestores de proyectos como Notion: para organizar y documentar los prompts que mejor funcionan, de forma que un equipo pueda reutilizarlos sin empezar de cero cada vez.

Comparativa

HerramientaPunto fuertePunto débil frente a Midjourney
MidjourneyCalidad artística y coherencia visual superioresSin plan gratuito, curva de aprendizaje más alta
DALL·E (dentro de ChatGPT)Muy fácil de usar, entiende instrucciones en lenguaje naturalMenos control fino y resultados algo menos artísticos
Leonardo AIPlan gratuito real y buena relación calidad-precioCoherencia visual algo por debajo en escenas complejas
Stable DiffusionGratuito, de código abierto, control total si sabes configurarloRequiere más conocimiento técnico para obtener buenos resultados
Adobe FireflyIntegración directa con Photoshop y uso comercial “seguro” por diseñoResultados más conservadores, menos sorprendentes estéticamente

Preguntas frecuentes

¿Midjourney es gratis? No. Desde 2023 no ofrece plan gratuito ni prueba gratuita en su web oficial; el plan más económico parte de 10 dólares al mes.

¿Necesito usar Discord para usar Midjourney? No es obligatorio. Puedes generar, organizar y editar imágenes directamente desde la aplicación web en midjourney.com, aunque el servidor de Discord sigue funcionando como alternativa.

¿Puedo usar las imágenes que genero con fines comerciales? Sí, todos los planes incluyen derechos de uso comercial, salvo que tu empresa facture más de un millón de dólares anuales, en cuyo caso necesitas un plan Pro o Mega.

¿Mis imágenes son privadas? Solo si tienes un plan Pro o Mega, que incluyen el Modo Sigiloso. En los planes Basic y Standard, tus generaciones son visibles en la galería pública de Midjourney.

¿Qué diferencia hay entre el modo Rápido y el modo Relax? El modo Rápido genera casi al instante y consume tus horas de GPU asignadas; el modo Relax no consume esas horas pero la generación tarda más, en una cola compartida con otros usuarios.

Conclusión

Midjourney merece la pena cuando la calidad visual final es una prioridad real: portadas, concept art, branding o cualquier proyecto donde el resultado se vea de cerca y tenga que sostener comparación con trabajo profesional. Si solo necesitas imágenes ocasionales sin mucha exigencia estética, herramientas con plan gratuito como Leonardo AI o el propio DALL·E dentro de ChatGPT pueden ser suficientes y más económicas.

Lo que marca la diferencia con Midjourney no es solo el modelo en sí, sino el tiempo que inviertas en aprender su sistema de parámetros: quien domina --sref, --cref y el control de stylize obtiene resultados muy por encima de quien se limita a escribir una frase y esperar suerte.

Publicaciones Similares

Deja una respuesta

Tu dirección de correo electrónico no será publicada. Los campos obligatorios están marcados con *