Cómo usar Midjourney v8 para crear imágenes: prompts que funcionan

Midjourney v8 cambió la forma de generar imágenes con IA, con una coherencia más nítida, mejor iluminación y una interpretación más inteligente de los prompts. Este artículo desglosa la estructura exacta del prompt, los parámetros y los flujos de trabajo que dan resultados de calidad profesional, además de adónde acudir cuando v8 se queda corto.

Cómo usar Midjourney v8 para crear imágenes: prompts que funcionan
Cristian Da Conceicao
Fundador de Picasso IA

Midjourney v8 llegó con poco revuelo, pero con un impacto enorme. El salto de v6.1 a v8 no fue incremental. Fue arquitectónico. Los prompts que antes producían resultados confusos y espacialmente incoherentes ahora devuelven imágenes con la lógica de iluminación y la precisión compositiva que cabría esperar de un fotógrafo experimentado. Pero v8 también trajo nuevos desafíos: un filtrado de contenido más estricto, comportamientos predeterminados distintos y una sintaxis de prompts que sorprende incluso a usuarios con experiencia. Este artículo explica con detalle cómo usar Midjourney v8 para crear imágenes, desde la anatomía del prompt hasta el control de parámetros, para que dejes de adivinar y empieces a producir resultados que coincidan con tu visión.

Manos de diseñador sobre el teclado, rodeadas de muestras de color, un tablero de inspiración impreso y una copa de espresso

Qué diferencia a Midjourney v8

El modelo insignia anterior, v6.1, ya ofrecía una fidelidad de detalle impresionante. v8 toma esa base y reconstruye la forma en que el modelo procesa las relaciones espaciales. Los objetos ya no flotan de forma extraña sobre los fondos. Las fuentes de luz proyectan sombras físicamente plausibles en todo el encuadre. La anatomía humana, en concreto manos, pies y rostros, presenta muchos menos artefactos que cualquier versión anterior.

La mejora de coherencia

Midjourney v8 usa lo que el equipo llama internamente "ponderación de coherencia estructural". Dicho de forma sencilla: el modelo ahora equilibra la lógica compositiva en toda la imagen, no solo dentro de regiones aisladas. Una lámpara colocada a la izquierda de una escena proyecta ahora sombras coherentes sobre todos los objetos del encuadre, incluidos los elementos lejanos del fondo.

Esto importa muchísimo para el uso comercial, la fotografía editorial y el contenido para redes sociales. Un único prompt bien escrito puede producir ahora de forma fiable:

  • Fuentes de luz coherentes que se comportan correctamente en todos los elementos de la escena
  • Perspectiva precisa entre los objetos del primer plano y del fondo
  • Oclusión natural cuando los objetos se superponen o se bloquean entre sí de forma lógica
  • Figuras humanas proporcionadas que resisten una inspección detallada en alta resolución

Nuevos ajustes de estilo predeterminados

v8 llega con valores predeterminados notablemente distintos a los de sus predecesores. El parámetro --stylize ahora tiene 100 por defecto, y el modelo tiende a los estilos cinematográficos y editoriales desde el primer momento. Esto hace que los resultados por defecto sean visualmente más marcados de lo que muchos usuarios esperan si vienen de v5 o v6.

💡 Si los resultados de v8 parecen demasiado artísticos para la fotografía de producto o de estilo de vida, prueba --stylize 50 o --stylize 25 para acercarlos al realismo documental.

Conviene conocer el indicador --style raw: elimina gran parte de la interpretación estética del modelo y devuelve resultados más cercanos a lo que el prompt describe literalmente. Para referencias técnicas o precisión fotográfica, --style raw suele ser el punto de partida correcto.

Escribir prompts que de verdad producen grandes imágenes

Escribir prompts en v8 se comporta de forma distinta a las versiones anteriores de Midjourney. El modelo asigna peso a los descriptores según el orden en que aparecen, poniendo al principio la información más importante para la composición. Las aperturas vagas producen imágenes vagas. Las aperturas específicas producen imágenes específicas.

Mujer joven sentada con las piernas cruzadas en un sofá de lino blanco revisando imágenes de retratos generadas con IA en una tableta de alta resolución

La anatomía de un prompt sólido para v8

Piensa en cada prompt de Midjourney v8 como un conjunto de cuatro capas distintas. Completar cada una con precisión marca la diferencia entre un resultado genérico y una imagen lista para publicar:

CapaQué incluirEjemplo
SujetoQuién o qué aparece en la escena"retrato de una mujer de unos 30 años"
EntornoDónde transcurre la escena"en una cafetería parisina iluminada por el sol"
IluminaciónDirección, calidad y color de la luz"contraluz cálido de la tarde, sombras suaves"
EstiloParámetros de cámara, película o fotografía"película de 35 mm, Kodak Portra 400, profundidad de campo reducida"

Un prompt que combine las cuatro capas supera siempre a las frases descriptivas simples. Compara:

  • Débil: woman at café, photorealistic
  • Sólido: portrait of a woman in her 30s sitting at a sunlit Parisian café, warm golden afternoon backlight from the right, soft lens flare, 35mm f/2.0, Kodak Portra 400 film grain, shallow depth of field --ar 16:9 --q 2

La versión sólida da a v8 suficiente información para tomar decisiones coherentes en cada nivel de la composición: cómo interactúa la luz con el sujeto, cómo debería ser el fondo y qué cualidades fotográficas priorizar.

Prompts negativos en v8

v8 usa el parámetro --no para la lógica de exclusión, que en esta versión es más fiable que los enfoques anteriores de prompts negativos:

--no text, watermark, logo, cartoon, CGI, illustration, neon lighting, blurry

Para trabajos fotorrealistas, incluye estos negativos como base estándar:

  • --no CGI elimina el aspecto de render de plástico habitual en los resultados sintéticos
  • --no cartoon evita la deriva estilística hacia estéticas ilustradas
  • --no text elimina los artefactos de texto generado
  • --no neon lighting mantiene la iluminación natural para resultados de estilo fotográfico
  • --no blurry mejora la nitidez general, sobre todo en los detalles del fondo

Estrategias de prompt según el sujeto

Distintas categorías de sujetos se benefician de estructuras de prompt diferentes:

Retratos y personas: empieza por la edad, la expresión y la ropa antes que el entorno. "Un hombre de 40 años con piel curtida, expresión relajada, con una chaqueta de lona desgastada, de pie frente a una gasolinera rural al atardecer" supera por mucho a "hombre en una gasolinera".

Arquitectura e interiores: especifica explícitamente la hora del día y las fuentes de luz artificial. "Un salón moderno de mediados de siglo a las 6 de la tarde, lámparas de mesa cálidas que crean charcos de luz ámbar sobre suelos de roble, luz azul grisácea y nublada entrando por ventanales de suelo a techo" ofrece al modelo una lógica compositiva clara.

Fotografía de producto: indica directamente la superficie del fondo. "Un frasco de perfume de cristal sobre una superficie de mármol blanco, luz difusa desde arriba, un ligero reflejo en el mármol, limpio y minimalista, sin accesorios ni elementos de fondo que distraigan" produce resultados constantes de estilo de estudio.

Parámetros y ajustes en v8

Los parámetros van al final de cada prompt de Midjourney, separados por espacios. No son decorativos. Cada uno da al modelo una instrucción concreta que anula su comportamiento predeterminado.

Equipo creativo en un estudio de agencia abierto, con muros de ladrillo visto, revisando obras de arte con IA clavadas en un tablero de corcho junto a ventanas altas

Relación de aspecto, calidad y caos

Tres parámetros definen la base de cada imagen que generas:

ParámetroFunciónValores habituales
--arDefine la relación de aspecto de salida16:9, 1:1, 9:16, 4:3
--qControla la calidad de render y el tiempo de procesamiento1 (predeterminado), 2 (más detalle)
--chaosControla la variación entre los 4 resultados de la cuadrícula0 (constante) a 100 (muy variado)

Para trabajos editoriales y comerciales, --ar 16:9 --q 2 --chaos 10 es una configuración inicial fiable. El valor de caos leve mantiene las cuatro opciones de la cuadrícula lo bastante distintas como para ofrecer elecciones significativas sin que ninguna resulte inservible.

Semillas y control de variación

El parámetro --seed fija una base compositiva para que puedas iterar a partir de ella. Cuando encuentres una imagen con la composición y la iluminación adecuadas, copia su valor de semilla desde la interfaz web de Midjourney y reutilízalo en los prompts siguientes:

A woman reading at a café window, warm morning light --ar 16:9 --q 2 --seed 4821903

Cambiar la descripción del sujeto manteniendo la semilla produce imágenes que comparten la misma lógica de iluminación y la misma disposición espacial. Esta es la base de los flujos de trabajo profesionales con v8: encuentra una base compositiva sólida, fija la semilla y varía los detalles hasta que la imagen coincida con el encargo.

💡 Combina --seed con --chaos 0 para lograr la máxima reproducibilidad en una serie de contenido. Es especialmente útil cuando necesitas crear un conjunto de imágenes que deben verse visualmente cohesionadas.

Iluminación y realismo de estilo fotográfico

El sistema de iluminación de v8 es su mejora más significativa. Las versiones anteriores de Midjourney trataban la luz como una cualidad estética. v8 la trata como una propiedad física con dirección, caída, temperatura de color y comportamiento especular.

Monitor grande de 27 pulgadas que muestra una comparación lado a lado de dos retratos generados con IA, con distintos ambientes de luz, en una configuración minimalista

Comandos de iluminación cinematográfica

Los siguientes descriptores de iluminación producen siempre resultados de alta calidad en v8. Cada uno da al modelo información concreta sobre cómo se comporta físicamente la luz en la escena:

  • "luz de la mañana volumétrica desde la izquierda" crea rayos con caída realista y neblina atmosférica
  • "luz de día difusa y nublada" aplana las sombras para tomas limpias de estilo producto y belleza
  • "una única bombilla práctica, claroscuro de alto contraste" produce una iluminación dramática para retratos
  • "contraluz de hora dorada con destello de lente" aporta la estética exterior cálida y cinematográfica
  • "iluminación frontal con softbox" imita configuraciones controladas de retrato en estudio
  • "tiras de luz de neón en el techo, dominante azul frío" produce looks comerciales de interior sobrios

Cuanto más específico seas con la dirección y la calidad de la luz, menos improvisa el modelo. La iluminación improvisada en la generación de imágenes con IA casi siempre es un retroceso.

Prompts de lente de cámara y profundidad de campo

v8 responde con una precisión notable a las especificaciones fotográficas de lente. No son palabras decorativas. Indican al modelo qué física óptica debe simular:

  • 85mm f/1.4 produce bokeh de retrato con una separación natural entre sujeto y fondo
  • 24mm f/8 da escenas de gran angular con todo nítido, de delante a atrás
  • 100mm macro f/2.8 crea detalle de primerísimo plano extremo con fondos comprimidos y suavizados
  • 35mm f/2.0 imita el campo visual natural humano para imágenes de estilo documental
  • 50mm f/5.6 produce una perspectiva neutra sin distorsión, un valor general fiable por defecto

Al combinar las especificaciones de lente con los descriptores de iluminación, v8 empieza a producir resultados que de verdad rivalizan con la fotografía de archivo de alta calidad.

Refinar resultados: variar, escalar y remezclar

Generar un primer resultado es el comienzo, no el final. El control real llega con las herramientas posteriores a la generación de v8.

Artista digital freelance trabajando de noche en un acogedor estudio en casa, con el resplandor de dos monitores reflejado en su cara y sus gafas, auriculares alrededor del cuello

El flujo de trabajo de variar y remezclar

Después de generar tu cuadrícula inicial de 4 imágenes, tres herramientas impulsan la mayoría de los flujos de trabajo profesionales:

  1. Variar (sutil): genera variaciones leves manteniendo la composición y la iluminación casi idénticas. Úsalo cuando quieras ajustar pequeños detalles sin perder una base sólida.
  2. Variar (fuerte): produce alternativas más dramáticas que mantienen el mismo sujeto principal, pero cambian la composición, el ángulo o el ambiente de forma más notable.
  3. Modo Remix: te permite modificar el texto del prompt entre variaciones. Actívalo con /prefer remix en Discord o desde la configuración de la interfaz web.

El modo Remix es la herramienta posterior a la generación más potente de v8. Con él activo, puedes generar una imagen, seleccionar tu favorita de la cuadrícula, hacer clic en Variar y modificar el prompt antes de que se ejecute la variación. Así puedes cambiar la iluminación, sustituir ubicaciones o modificar el ambiente de una imagen sin empezar un prompt desde cero.

El sistema de escalado en v8

v8 ofrece dos vías de escalado:

  • Escalar (sutil): resolución 2x con una nitidez leve. Cambios mínimos en el contenido. Lo mejor cuando la imagen base ya está casi terminada.
  • Escalar (creativo): resolución 2x con detalle adicional generado por IA. El modelo rellena las microtexturas: poros de la piel, tejido de la ropa, grano de la piedra en las superficies.

Escalar (creativo) es potente, pero conviene revisarlo con atención. Puede añadir detalles materiales que no estaban en el prompt original. Para impresión o formatos grandes, el escalado creativo casi siempre produce un mejor resultado que el sutil.

Dónde topa v8 con las restricciones de contenido

Ninguna evaluación honesta de Midjourney v8 omite esta sección. La plataforma aplica filtros de contenido que rechazan los prompts marcados como potencialmente problemáticos, y la lógica de filtrado de v8 es más agresiva que la de versiones anteriores.

Primer plano macro de un lápiz óptico apoyado sobre la superficie de una tableta de dibujo Wacom, con una imagen arquitectónica generada con IA visible en bokeh suave al fondo

Qué se bloquea

El sistema de filtros de v8 bloquea una gama significativa de categorías de contenido:

  • Material explícito, incluida la desnudez sugerida incluso en contextos claramente artísticos
  • Violencia realista, incluidas muchas escenas de acción con lesiones o sangre
  • Figuras públicas representadas en escenarios concretos o comprometedores
  • Logotipos de marcas y marcas protegidas que el modelo reconoce
  • Imaginería de moda y estilo de vida sugerente que cruza umbrales que el modelo asigna según la redacción del prompt

Incluso los prompts realmente inofensivos se marcan. "Un atleta cayéndose durante una competición" puede activar el filtro de violencia. "Un editorial de moda con tela transparente" puede disparar el filtro de desnudez, aunque sea claramente no explícito según cualquier criterio razonable.

Lo que funciona como alternativa

Reformular suele ayudar. Sustituir descriptores explícitos por referencias fotográficas o editoriales, "fotografiado para Vogue Italia, editorial de alta costura, fotografía de moda artística", tiende a producir contenido que un prompt más literal habría bloqueado.

Pero hay un límite a lo que puede lograr la reformulación. Si tu trabajo creativo implica con regularidad contenido que queda fuera de las categorías permitidas por Midjourney, una plataforma distinta es una solución más práctica que intentar la ingeniería de prompts alrededor de filtros restrictivos.

PicassoIA como alternativa flexible

PicassoIA reúne 91 modelos de texto a imagen y cubre un abanico creativo bastante más amplio que el que permite Midjourney v8. Para creadores que necesitan resultados sin negociar constantemente con filtros, es una alternativa lista para producción y no un parche.

Vista de gran angular de un estudio fotográfico profesional con fondo blanco continuo, equipos de luz estroboscópica y un equipo revisando juntos los resultados de un equipo portátil conectado

Modelos de texto a imagen que merecen la pena

Varios modelos de PicassoIA igualan o superan la calidad de resultado de v8 en categorías concretas:

Seedream 5 Pro produce imágenes nítidas de 2K con una gran adherencia al prompt y una coherencia facial excelente. Para trabajos de retrato y estilo de vida, compite directamente con la calidad de resultado de Midjourney v8 y acepta una gama más amplia de prompts creativos.

Reve 2.1 destaca en la edición en contexto. Generas una imagen y luego refinas regiones concretas sin reconstruir todo el prompt. Para creadores que trabajan a base de iteraciones, este flujo es considerablemente más rápido.

Stable Diffusion 3 sigue siendo un caballo de batalla fiable para la producción por lotes. Cuando necesitas un estilo constante en decenas de imágenes dentro de una misma sesión, su previsibilidad es una ventaja frente a modelos más marcados.

Flux Schnell LoRA es la opción de velocidad. Genera resultados lo bastante rápido como para iterar entre 10 y 15 variaciones de prompt en el tiempo que Midjourney v8 tarda en terminar un único trabajo. Para las fases de ideación en las que el volumen importa más que el acabado, es la herramienta adecuada.

Recraft 20B maneja cualquier estilo visual desde una única interfaz: fotorrealista, vectorial, estilo icono, ilustración. Para equipos que crean recursos en varias categorías visuales, reduce la necesidad de cambiar entre herramientas especializadas.

💡 Para prompts de estilo de vida, glamour o moda que Midjourney v8 suele bloquear, Seedream 5 Pro maneja de forma fiable contenido para adultos sugerente, artístico y no explícito. Accede al catálogo completo de modelos en picassoia.com/en/all-models.

Eliminar fondos con un clic

Una vez que tienes una imagen generada, quitar el fondo para fichas de producto, materiales de marketing o composición normalmente requiere una aplicación aparte. El modelo Remove Background de PicassoIA lo resuelve en un solo paso, con recortes limpios y una detección precisa de bordes en sujetos complejos: cabello, tela, objetos transparentes y detalles estructurales finos.

Sin Photoshop. Sin enmascarado manual. El resultado está listo para usarse de inmediato en cualquier flujo de trabajo posterior.

Escalar resultados a calidad de publicación

PicassoIA ofrece varias opciones de escalado adaptadas a distintos casos de uso:

  • Clarity Pro Upscaler: ideal para trabajos fotorrealistas en los que necesitas recuperar textura de forma natural y afinar el detalle
  • P Image Upscale: procesamiento rápido, muy adecuado para flujos de gran volumen en los que importa el tiempo de entrega
  • Real ESRGAN: destaca al recuperar detalle de imágenes de origen de menor resolución sin introducir artefactos visuales

Primer plano extremo de una interfaz oscura en un monitor de equipo mostrando los ajustes de generación de imágenes con IA, deslizadores y un campo de texto para el prompt

Un flujo de trabajo práctico para resultados constantes

Las disciplinas de prompt que funcionan en Midjourney v8 se trasladan directamente a PicassoIA y a cualquier otra plataforma de imágenes con IA. La precisión, el vocabulario de iluminación y el encuadre basado en la lente no son habilidades propias de una plataforma. Son alfabetización visual.

Un flujo de trabajo que produce resultados fiables sin importar qué herramienta uses:

  1. Empieza con un prompt por capas: sujeto, entorno, iluminación, especificaciones de cámara y referencias de estilo, en ese orden
  2. Añade exclusiones --no: CGI, dibujos animados, luz de neón, texto, borroso
  3. Genera con la máxima calidad: el costo en tiempo de --q 2 merece la pena para los resultados finales
  4. Varía tu resultado más sólido en lugar de volver a generar desde cero cada vez
  5. Escala antes de exportar: ya sea para redes sociales, editorial o impresión, los resultados escalados conservan mejor el detalle en tamaños finales

Pasar cada prompt por la misma lógica estructural produce mejores resultados medios que tratar cada generación como una improvisación nueva. La plataforma cambia. El enfoque se mantiene constante.

Empieza a crear en PicassoIA ahora mismo

Director creativo con americana azul marino presentando imágenes impresas generadas con IA en un tablero de presentación ante un pequeño equipo en una mesa de conferencias con vistas a la ciudad al fondo

Todo lo que aparece en este artículo funciona, y la única forma de aplicarlo es empezar a generar imágenes. Las estructuras de prompt, las combinaciones de parámetros y el vocabulario de iluminación de arriba se pueden usar de inmediato en Midjourney v8 y en PicassoIA.

Si el costo de la suscripción de Midjourney v8, su filtrado de contenido o el consumo de créditos frena tu producción creativa, PicassoIA te da acceso inmediato a 91 modelos de texto a imagen, eliminación de fondos, escalado y todas las categorías de herramientas mencionadas en este artículo, desde una única interfaz en el navegador.

Elige un modelo. Escribe un prompt por capas con la estructura de cuatro niveles de arriba. Genera, varía y escala. La distancia entre lo que las herramientas de imagen con IA pueden producir hoy y lo que exige el trabajo creativo profesional nunca ha sido tan corta. Las herramientas están listas. Empieza a usarlas.

Compartir este artículo

Elige tu idioma