Cómo usar Midjourney v8 para crear imágenes: prompts que funcionan
Midjourney v8 cambió la forma de generar imágenes con IA, con una coherencia más nítida, mejor iluminación y una interpretación más inteligente de los prompts. Este artículo desglosa la estructura exacta del prompt, los parámetros y los flujos de trabajo que dan resultados de calidad profesional, además de adónde acudir cuando v8 se queda corto.
Midjourney v8 llegó con poco revuelo, pero con un impacto enorme. El salto de v6.1 a v8 no fue incremental. Fue arquitectónico. Los prompts que antes producían resultados confusos y espacialmente incoherentes ahora devuelven imágenes con la lógica de iluminación y la precisión compositiva que cabría esperar de un fotógrafo experimentado. Pero v8 también trajo nuevos desafíos: un filtrado de contenido más estricto, comportamientos predeterminados distintos y una sintaxis de prompts que sorprende incluso a usuarios con experiencia. Este artículo explica con detalle cómo usar Midjourney v8 para crear imágenes, desde la anatomía del prompt hasta el control de parámetros, para que dejes de adivinar y empieces a producir resultados que coincidan con tu visión.
Qué diferencia a Midjourney v8
El modelo insignia anterior, v6.1, ya ofrecía una fidelidad de detalle impresionante. v8 toma esa base y reconstruye la forma en que el modelo procesa las relaciones espaciales. Los objetos ya no flotan de forma extraña sobre los fondos. Las fuentes de luz proyectan sombras físicamente plausibles en todo el encuadre. La anatomía humana, en concreto manos, pies y rostros, presenta muchos menos artefactos que cualquier versión anterior.
La mejora de coherencia
Midjourney v8 usa lo que el equipo llama internamente "ponderación de coherencia estructural". Dicho de forma sencilla: el modelo ahora equilibra la lógica compositiva en toda la imagen, no solo dentro de regiones aisladas. Una lámpara colocada a la izquierda de una escena proyecta ahora sombras coherentes sobre todos los objetos del encuadre, incluidos los elementos lejanos del fondo.
Esto importa muchísimo para el uso comercial, la fotografía editorial y el contenido para redes sociales. Un único prompt bien escrito puede producir ahora de forma fiable:
Fuentes de luz coherentes que se comportan correctamente en todos los elementos de la escena
Perspectiva precisa entre los objetos del primer plano y del fondo
Oclusión natural cuando los objetos se superponen o se bloquean entre sí de forma lógica
Figuras humanas proporcionadas que resisten una inspección detallada en alta resolución
Nuevos ajustes de estilo predeterminados
v8 llega con valores predeterminados notablemente distintos a los de sus predecesores. El parámetro --stylize ahora tiene 100 por defecto, y el modelo tiende a los estilos cinematográficos y editoriales desde el primer momento. Esto hace que los resultados por defecto sean visualmente más marcados de lo que muchos usuarios esperan si vienen de v5 o v6.
💡 Si los resultados de v8 parecen demasiado artísticos para la fotografía de producto o de estilo de vida, prueba --stylize 50 o --stylize 25 para acercarlos al realismo documental.
Conviene conocer el indicador --style raw: elimina gran parte de la interpretación estética del modelo y devuelve resultados más cercanos a lo que el prompt describe literalmente. Para referencias técnicas o precisión fotográfica, --style raw suele ser el punto de partida correcto.
Escribir prompts que de verdad producen grandes imágenes
Escribir prompts en v8 se comporta de forma distinta a las versiones anteriores de Midjourney. El modelo asigna peso a los descriptores según el orden en que aparecen, poniendo al principio la información más importante para la composición. Las aperturas vagas producen imágenes vagas. Las aperturas específicas producen imágenes específicas.
La anatomía de un prompt sólido para v8
Piensa en cada prompt de Midjourney v8 como un conjunto de cuatro capas distintas. Completar cada una con precisión marca la diferencia entre un resultado genérico y una imagen lista para publicar:
Capa
Qué incluir
Ejemplo
Sujeto
Quién o qué aparece en la escena
"retrato de una mujer de unos 30 años"
Entorno
Dónde transcurre la escena
"en una cafetería parisina iluminada por el sol"
Iluminación
Dirección, calidad y color de la luz
"contraluz cálido de la tarde, sombras suaves"
Estilo
Parámetros de cámara, película o fotografía
"película de 35 mm, Kodak Portra 400, profundidad de campo reducida"
Un prompt que combine las cuatro capas supera siempre a las frases descriptivas simples. Compara:
Débil: woman at café, photorealistic
Sólido: portrait of a woman in her 30s sitting at a sunlit Parisian café, warm golden afternoon backlight from the right, soft lens flare, 35mm f/2.0, Kodak Portra 400 film grain, shallow depth of field --ar 16:9 --q 2
La versión sólida da a v8 suficiente información para tomar decisiones coherentes en cada nivel de la composición: cómo interactúa la luz con el sujeto, cómo debería ser el fondo y qué cualidades fotográficas priorizar.
Prompts negativos en v8
v8 usa el parámetro --no para la lógica de exclusión, que en esta versión es más fiable que los enfoques anteriores de prompts negativos:
Para trabajos fotorrealistas, incluye estos negativos como base estándar:
--no CGI elimina el aspecto de render de plástico habitual en los resultados sintéticos
--no cartoon evita la deriva estilística hacia estéticas ilustradas
--no text elimina los artefactos de texto generado
--no neon lighting mantiene la iluminación natural para resultados de estilo fotográfico
--no blurry mejora la nitidez general, sobre todo en los detalles del fondo
Estrategias de prompt según el sujeto
Distintas categorías de sujetos se benefician de estructuras de prompt diferentes:
Retratos y personas: empieza por la edad, la expresión y la ropa antes que el entorno. "Un hombre de 40 años con piel curtida, expresión relajada, con una chaqueta de lona desgastada, de pie frente a una gasolinera rural al atardecer" supera por mucho a "hombre en una gasolinera".
Arquitectura e interiores: especifica explícitamente la hora del día y las fuentes de luz artificial. "Un salón moderno de mediados de siglo a las 6 de la tarde, lámparas de mesa cálidas que crean charcos de luz ámbar sobre suelos de roble, luz azul grisácea y nublada entrando por ventanales de suelo a techo" ofrece al modelo una lógica compositiva clara.
Fotografía de producto: indica directamente la superficie del fondo. "Un frasco de perfume de cristal sobre una superficie de mármol blanco, luz difusa desde arriba, un ligero reflejo en el mármol, limpio y minimalista, sin accesorios ni elementos de fondo que distraigan" produce resultados constantes de estilo de estudio.
Parámetros y ajustes en v8
Los parámetros van al final de cada prompt de Midjourney, separados por espacios. No son decorativos. Cada uno da al modelo una instrucción concreta que anula su comportamiento predeterminado.
Relación de aspecto, calidad y caos
Tres parámetros definen la base de cada imagen que generas:
Parámetro
Función
Valores habituales
--ar
Define la relación de aspecto de salida
16:9, 1:1, 9:16, 4:3
--q
Controla la calidad de render y el tiempo de procesamiento
1 (predeterminado), 2 (más detalle)
--chaos
Controla la variación entre los 4 resultados de la cuadrícula
0 (constante) a 100 (muy variado)
Para trabajos editoriales y comerciales, --ar 16:9 --q 2 --chaos 10 es una configuración inicial fiable. El valor de caos leve mantiene las cuatro opciones de la cuadrícula lo bastante distintas como para ofrecer elecciones significativas sin que ninguna resulte inservible.
Semillas y control de variación
El parámetro --seed fija una base compositiva para que puedas iterar a partir de ella. Cuando encuentres una imagen con la composición y la iluminación adecuadas, copia su valor de semilla desde la interfaz web de Midjourney y reutilízalo en los prompts siguientes:
A woman reading at a café window, warm morning light --ar 16:9 --q 2 --seed 4821903
Cambiar la descripción del sujeto manteniendo la semilla produce imágenes que comparten la misma lógica de iluminación y la misma disposición espacial. Esta es la base de los flujos de trabajo profesionales con v8: encuentra una base compositiva sólida, fija la semilla y varía los detalles hasta que la imagen coincida con el encargo.
💡 Combina --seed con --chaos 0 para lograr la máxima reproducibilidad en una serie de contenido. Es especialmente útil cuando necesitas crear un conjunto de imágenes que deben verse visualmente cohesionadas.
Iluminación y realismo de estilo fotográfico
El sistema de iluminación de v8 es su mejora más significativa. Las versiones anteriores de Midjourney trataban la luz como una cualidad estética. v8 la trata como una propiedad física con dirección, caída, temperatura de color y comportamiento especular.
Comandos de iluminación cinematográfica
Los siguientes descriptores de iluminación producen siempre resultados de alta calidad en v8. Cada uno da al modelo información concreta sobre cómo se comporta físicamente la luz en la escena:
"luz de la mañana volumétrica desde la izquierda" crea rayos con caída realista y neblina atmosférica
"luz de día difusa y nublada" aplana las sombras para tomas limpias de estilo producto y belleza
"una única bombilla práctica, claroscuro de alto contraste" produce una iluminación dramática para retratos
"contraluz de hora dorada con destello de lente" aporta la estética exterior cálida y cinematográfica
"iluminación frontal con softbox" imita configuraciones controladas de retrato en estudio
"tiras de luz de neón en el techo, dominante azul frío" produce looks comerciales de interior sobrios
Cuanto más específico seas con la dirección y la calidad de la luz, menos improvisa el modelo. La iluminación improvisada en la generación de imágenes con IA casi siempre es un retroceso.
Prompts de lente de cámara y profundidad de campo
v8 responde con una precisión notable a las especificaciones fotográficas de lente. No son palabras decorativas. Indican al modelo qué física óptica debe simular:
85mm f/1.4 produce bokeh de retrato con una separación natural entre sujeto y fondo
24mm f/8 da escenas de gran angular con todo nítido, de delante a atrás
100mm macro f/2.8 crea detalle de primerísimo plano extremo con fondos comprimidos y suavizados
35mm f/2.0 imita el campo visual natural humano para imágenes de estilo documental
50mm f/5.6 produce una perspectiva neutra sin distorsión, un valor general fiable por defecto
Al combinar las especificaciones de lente con los descriptores de iluminación, v8 empieza a producir resultados que de verdad rivalizan con la fotografía de archivo de alta calidad.
Refinar resultados: variar, escalar y remezclar
Generar un primer resultado es el comienzo, no el final. El control real llega con las herramientas posteriores a la generación de v8.
El flujo de trabajo de variar y remezclar
Después de generar tu cuadrícula inicial de 4 imágenes, tres herramientas impulsan la mayoría de los flujos de trabajo profesionales:
Variar (sutil): genera variaciones leves manteniendo la composición y la iluminación casi idénticas. Úsalo cuando quieras ajustar pequeños detalles sin perder una base sólida.
Variar (fuerte): produce alternativas más dramáticas que mantienen el mismo sujeto principal, pero cambian la composición, el ángulo o el ambiente de forma más notable.
Modo Remix: te permite modificar el texto del prompt entre variaciones. Actívalo con /prefer remix en Discord o desde la configuración de la interfaz web.
El modo Remix es la herramienta posterior a la generación más potente de v8. Con él activo, puedes generar una imagen, seleccionar tu favorita de la cuadrícula, hacer clic en Variar y modificar el prompt antes de que se ejecute la variación. Así puedes cambiar la iluminación, sustituir ubicaciones o modificar el ambiente de una imagen sin empezar un prompt desde cero.
El sistema de escalado en v8
v8 ofrece dos vías de escalado:
Escalar (sutil): resolución 2x con una nitidez leve. Cambios mínimos en el contenido. Lo mejor cuando la imagen base ya está casi terminada.
Escalar (creativo): resolución 2x con detalle adicional generado por IA. El modelo rellena las microtexturas: poros de la piel, tejido de la ropa, grano de la piedra en las superficies.
Escalar (creativo) es potente, pero conviene revisarlo con atención. Puede añadir detalles materiales que no estaban en el prompt original. Para impresión o formatos grandes, el escalado creativo casi siempre produce un mejor resultado que el sutil.
Dónde topa v8 con las restricciones de contenido
Ninguna evaluación honesta de Midjourney v8 omite esta sección. La plataforma aplica filtros de contenido que rechazan los prompts marcados como potencialmente problemáticos, y la lógica de filtrado de v8 es más agresiva que la de versiones anteriores.
Qué se bloquea
El sistema de filtros de v8 bloquea una gama significativa de categorías de contenido:
Material explícito, incluida la desnudez sugerida incluso en contextos claramente artísticos
Violencia realista, incluidas muchas escenas de acción con lesiones o sangre
Figuras públicas representadas en escenarios concretos o comprometedores
Logotipos de marcas y marcas protegidas que el modelo reconoce
Imaginería de moda y estilo de vida sugerente que cruza umbrales que el modelo asigna según la redacción del prompt
Incluso los prompts realmente inofensivos se marcan. "Un atleta cayéndose durante una competición" puede activar el filtro de violencia. "Un editorial de moda con tela transparente" puede disparar el filtro de desnudez, aunque sea claramente no explícito según cualquier criterio razonable.
Lo que funciona como alternativa
Reformular suele ayudar. Sustituir descriptores explícitos por referencias fotográficas o editoriales, "fotografiado para Vogue Italia, editorial de alta costura, fotografía de moda artística", tiende a producir contenido que un prompt más literal habría bloqueado.
Pero hay un límite a lo que puede lograr la reformulación. Si tu trabajo creativo implica con regularidad contenido que queda fuera de las categorías permitidas por Midjourney, una plataforma distinta es una solución más práctica que intentar la ingeniería de prompts alrededor de filtros restrictivos.
PicassoIA como alternativa flexible
PicassoIA reúne 91 modelos de texto a imagen y cubre un abanico creativo bastante más amplio que el que permite Midjourney v8. Para creadores que necesitan resultados sin negociar constantemente con filtros, es una alternativa lista para producción y no un parche.
Modelos de texto a imagen que merecen la pena
Varios modelos de PicassoIA igualan o superan la calidad de resultado de v8 en categorías concretas:
Seedream 5 Pro produce imágenes nítidas de 2K con una gran adherencia al prompt y una coherencia facial excelente. Para trabajos de retrato y estilo de vida, compite directamente con la calidad de resultado de Midjourney v8 y acepta una gama más amplia de prompts creativos.
Reve 2.1 destaca en la edición en contexto. Generas una imagen y luego refinas regiones concretas sin reconstruir todo el prompt. Para creadores que trabajan a base de iteraciones, este flujo es considerablemente más rápido.
Stable Diffusion 3 sigue siendo un caballo de batalla fiable para la producción por lotes. Cuando necesitas un estilo constante en decenas de imágenes dentro de una misma sesión, su previsibilidad es una ventaja frente a modelos más marcados.
Flux Schnell LoRA es la opción de velocidad. Genera resultados lo bastante rápido como para iterar entre 10 y 15 variaciones de prompt en el tiempo que Midjourney v8 tarda en terminar un único trabajo. Para las fases de ideación en las que el volumen importa más que el acabado, es la herramienta adecuada.
Recraft 20B maneja cualquier estilo visual desde una única interfaz: fotorrealista, vectorial, estilo icono, ilustración. Para equipos que crean recursos en varias categorías visuales, reduce la necesidad de cambiar entre herramientas especializadas.
💡 Para prompts de estilo de vida, glamour o moda que Midjourney v8 suele bloquear, Seedream 5 Pro maneja de forma fiable contenido para adultos sugerente, artístico y no explícito. Accede al catálogo completo de modelos en picassoia.com/en/all-models.
Eliminar fondos con un clic
Una vez que tienes una imagen generada, quitar el fondo para fichas de producto, materiales de marketing o composición normalmente requiere una aplicación aparte. El modelo Remove Background de PicassoIA lo resuelve en un solo paso, con recortes limpios y una detección precisa de bordes en sujetos complejos: cabello, tela, objetos transparentes y detalles estructurales finos.
Sin Photoshop. Sin enmascarado manual. El resultado está listo para usarse de inmediato en cualquier flujo de trabajo posterior.
Escalar resultados a calidad de publicación
PicassoIA ofrece varias opciones de escalado adaptadas a distintos casos de uso:
Clarity Pro Upscaler: ideal para trabajos fotorrealistas en los que necesitas recuperar textura de forma natural y afinar el detalle
P Image Upscale: procesamiento rápido, muy adecuado para flujos de gran volumen en los que importa el tiempo de entrega
Real ESRGAN: destaca al recuperar detalle de imágenes de origen de menor resolución sin introducir artefactos visuales
Un flujo de trabajo práctico para resultados constantes
Las disciplinas de prompt que funcionan en Midjourney v8 se trasladan directamente a PicassoIA y a cualquier otra plataforma de imágenes con IA. La precisión, el vocabulario de iluminación y el encuadre basado en la lente no son habilidades propias de una plataforma. Son alfabetización visual.
Un flujo de trabajo que produce resultados fiables sin importar qué herramienta uses:
Empieza con un prompt por capas: sujeto, entorno, iluminación, especificaciones de cámara y referencias de estilo, en ese orden
Genera con la máxima calidad: el costo en tiempo de --q 2 merece la pena para los resultados finales
Varía tu resultado más sólido en lugar de volver a generar desde cero cada vez
Escala antes de exportar: ya sea para redes sociales, editorial o impresión, los resultados escalados conservan mejor el detalle en tamaños finales
Pasar cada prompt por la misma lógica estructural produce mejores resultados medios que tratar cada generación como una improvisación nueva. La plataforma cambia. El enfoque se mantiene constante.
Empieza a crear en PicassoIA ahora mismo
Todo lo que aparece en este artículo funciona, y la única forma de aplicarlo es empezar a generar imágenes. Las estructuras de prompt, las combinaciones de parámetros y el vocabulario de iluminación de arriba se pueden usar de inmediato en Midjourney v8 y en PicassoIA.
Si el costo de la suscripción de Midjourney v8, su filtrado de contenido o el consumo de créditos frena tu producción creativa, PicassoIA te da acceso inmediato a 91 modelos de texto a imagen, eliminación de fondos, escalado y todas las categorías de herramientas mencionadas en este artículo, desde una única interfaz en el navegador.
Elige un modelo. Escribe un prompt por capas con la estructura de cuatro niveles de arriba. Genera, varía y escala. La distancia entre lo que las herramientas de imagen con IA pueden producir hoy y lo que exige el trabajo creativo profesional nunca ha sido tan corta. Las herramientas están listas. Empieza a usarlas.