Prompts de imágenes con IA que de verdad funcionan: lo que los profesionales no te cuentan
La mayoría de los prompts de imágenes con IA fallan porque son demasiado vagos, no incluyen especificaciones de iluminación o carecen de los modificadores adecuados. Este artículo explica paso a paso cómo escribir prompts que den resultados impresionantes y fotorrealistas siempre, y cubre la estructura, la iluminación, los detalles de cámara, los prompts negativos y consejos específicos para Flux, RealVisXL y Stable Diffusion.
La mayoría de la gente escribe algo como "una mujer hermosa en un bosque" y pulsa generar. ¿El resultado? Plano, sin vida, genérico. El prompt no está mal, simplemente está vacío. No le da al modelo nada real con lo que trabajar: ni fuente de luz, ni lente, ni textura, ni atmósfera. El modelo rellena los huecos como quiere, y "como quiere" rara vez es lo que tenías en mente.
Esto no es un fallo de la IA. Flux Schnell, Flux Dev, RealVisXL y Stable Diffusion son capaces de producir imágenes fotorrealistas asombrosas. La diferencia entre lo que genera la mayoría de la gente y lo que estos modelos pueden producir depende por completo del prompt. Así se cierra esa brecha, paso a paso.
Por qué fallan la mayoría de los prompts
"Hermosa" no aporta nada
La palabra "hermosa" aparece en alrededor del 60% de todos los prompts de imágenes con IA. Y casi no hace nada. Los modelos de imagen no tienen opiniones sobre la belleza. Responden a detalles concretos: una dirección de luz, una distancia focal, una temperatura de color, una textura de superficie. "Retrato hermoso de una mujer" no le dice al modelo casi nada. "Retrato de una mujer, iluminación Rembrandt desde la izquierda, 85 mm f/1.4, fondo con bokeh suave, piel con pecas, reflejo de luz en el ojo izquierdo" le dice exactamente qué producir.
Cada adjetivo vago de tu prompt es una oportunidad perdida de darle al modelo una instrucción concreta. Sustituye "hermosa" por una condición de luz. Sustituye "increíble" por una especificación de cámara. Sustituye "impresionante" por una hora del día.
La especificidad es la verdadera ingeniería de prompts
La ingeniería de prompts suena complicada. No lo es. Consiste en sustituir el lenguaje vago por instrucciones visuales concretas. El modelo lee tu texto e intenta relacionarlo con patrones de sus datos de entrenamiento. Cuanto más específico y fotográfico sea tu lenguaje, más directamente conectas con ejemplos de entrenamiento de alta calidad.
Piénsalo así: un fotógrafo profesional no dice "haz una foto bonita". Dice "f/1.8, contraluz de la mañana, subexpón medio punto, coloca al sujeto frente a la ventana". Ese nivel de especificidad es exactamente lo que separa un prompt de imagen con IA sólido de uno débil.
La anatomía de un prompt ganador
Sujeto + acción + entorno
Todo prompt sólido empieza con tres elementos bien definidos: qué aparece en la imagen (sujeto), qué está haciendo (acción o estado) y dónde existe (entorno). Es la base. Todo lo demás se añade encima.
Débil: "Una mujer al aire libre"
Sólido: "Una mujer de unos 30 años sentada en un muelle de madera frente a un lago neblinoso al amanecer, con las rodillas pegadas al pecho, mirando hacia el horizonte"
La versión sólida le da al modelo una disposición espacial concreta, un ambiente y un estado emocional. Ahora el modelo tiene restricciones reales dentro de las que trabajar.
La iluminación lo es todo
La iluminación es la variable más influyente de cualquier fotografía, y en los prompts de imágenes con IA funciona exactamente igual. Especifica tu fuente de luz, su dirección, su calidad (dura o suave) y su temperatura de color.
Tipo de luz
Frase para el prompt
Efecto
Hora dorada
"contraluz cálido de la tarde, sol de las 4 p. m. desde la izquierda"
Borde cálido, sombras largas, ambiente romántico
Rembrandt
"iluminación Rembrandt, luz de una única ventana desde arriba a la izquierda"
Triángulo de sombra dramático en el rostro
Nublado
"luz difusa de día nublado, sin sombras duras, iluminación plana"
Limpio, editorial, tonos de piel uniformes
Lámpara práctica
"lámpara de escritorio ámbar cálida, única fuente de luz práctica"
Íntimo, con mucho carácter, atmósfera de interior
Hora azul
"luz de hora azul, 20 minutos después del atardecer, ambiente azul frío"
Cinematográfico, melancólico, con profundidad
Ángulo de cámara y especificaciones de lente
Los modelos de imagen con IA responden con fuerza al vocabulario fotográfico. La distancia focal de la lente, la apertura y el ángulo de cámara no son adornos. Determinan directamente la geometría, la profundidad y la compresión de la imagen generada.
85 mm f/1.4: compresión clásica de retrato, bokeh cremoso, separación del sujeto muy favorecedora
35 mm f/2: contexto ambiental más amplio, ligera presencia del primer plano, aire documental
16 mm gran angular: paisajes dramáticos, perspectiva acusada, tomas arquitectónicas
100 mm macro f/2.8: detalle extremo en primer plano, texturas finas, fotos de producto y naturaleza
Ángulo bajo: hace que los sujetos parezcan poderosos, el cielo dramático llena el fondo
Aérea/cenital: escala, patrón, aislamiento, composiciones de paisajes amplios
Añadir "85 mm f/1.4" a un prompt de retrato cambiará de forma visible cómo el modelo representa la separación del fondo y la compresión del sujeto. No es opcional, es estructural.
Modificadores de prompt que lo cambian todo
Etiquetas de calidad que sí hacen algo
No todos los modificadores de calidad son iguales. Algunas frases tienen un impacto real porque conectan con patrones concretos de los datos de entrenamiento. Otras son básicamente ruido.
Frases que funcionan:
film grain o Kodak Portra 400 acercan a la estética de la fotografía analógica
photorealistic, 8K, RAW photography indica una salida de alta fidelidad
volumetric lighting genera rayos de luz atmosféricos y profundidad visible
hyper-detailed skin texture empuja el render de la piel hacia el realismo
shallow depth of field activa el bokeh y la separación del sujeto
natural lighting, no flash aleja los resultados duros o de aspecto artificial
Frases que apenas sirven de algo:
"obra maestra" (muy usada y saturada en datos de entrenamiento de baja calidad)
"la mejor calidad" (demasiado genérica, no aporta señal visual)
"perfecto" (no es un descriptor visual)
"foto premiada" (los modelos no pueden evaluar premios)
💡 En lugar de acumular palabras genéricas de calidad, describe cómo se manifiesta visualmente la calidad. "Pestañas hiperdetalladas, mechones de pelo individuales en foco nítido, poros visibles en la piel" es mucho más eficaz que "retrato de alta calidad".
Prompts negativos bien usados
Los prompts negativos indican al modelo qué debe dejar fuera. En modelos como Stable Diffusion y RealVisXL, son una de las herramientas más potentes que existen.
Prompt negativo estándar para imágenes fotorrealistas:
Exclusiones de estilo (illustration, cartoon, painting) empujan con firmeza al modelo hacia la fotografía
Exclusiones de artefactos (extra fingers, deformed hands) reducen los errores anatómicos habituales
Exclusiones de calidad (blurry, low resolution) indican que quieres la mejor versión posible del modelo
En Flux Schnell y Flux Dev, los campos de prompt negativo funcionan de otra manera, ya que Flux depende más del guidance scale que de los prompts negativos. Para los modelos Flux, concentra el esfuerzo en que la descripción del prompt positivo sea lo más específica posible.
Prompts para retratos fotorrealistas
Textura de la piel y el triángulo de iluminación
En los retratos fallan más los prompts de imágenes con IA. El modelo tiende a un rostro humano idealizado y de aspecto algo plástico si no le dices lo contrario. Para conseguir piel realista, hay que describirla de forma explícita.
Portrait of a woman in her late 30s, natural morning light from a window on the left,
Rembrandt lighting triangle visible on right cheek, hyper-realistic skin pores,
faint freckles on nose bridge, slight under-eye shadow, no heavy makeup,
authentic expression, 85mm f/1.4, shallow depth of field, creamy bokeh background,
film grain, Kodak Portra 400 color rendering
La frase "poros de la piel hiperrealistas" es especialmente eficaz. Activa patrones de los datos de entrenamiento asociados a la fotografía de primer plano, donde las imperfecciones de la piel son visibles y se valoran artísticamente.
Los ojos: el detalle que vende el realismo
Nada hace o deshace un retrato como los ojos. Prompts específicos para los ojos:
visible iris texture, bright catchlight in left eye fija los ojos a una posición concreta de la luz
slight moisture visible at the waterline añade un realismo orgánico y convincente
individual eyelash strands in sharp focus separa el fotorrealismo de los renders de CGI
Si tu retrato parece algo fuera de lugar, casi siempre el problema está en los ojos. Descríbelos de forma explícita en tu prompt cada vez.
Prompts para paisajes y entornos
La hora del día como variable del prompt
La variable más transformadora de un prompt de paisaje es la hora del día. Controla a la vez la temperatura de color, la longitud de las sombras, la neblina atmosférica y el tono emocional.
Amanecer (primera luz): ambiente azul frío, calidez solo en los puntos más altos, niebla en los valles
Hora dorada (1 hora antes del atardecer): luz naranja cálida, sombras largas, posible destello de lente
Hora azul (después del atardecer): ambiente azul profundo y frío, atmósfera cinematográfica, luces artificiales visibles
Nublado: luz plana y uniforme, colores ricos y saturados, sin sombras duras
Mountain valley at dawn, first light touching only the snow-capped peaks in warm amber,
valley floor in cool blue shadow, morning mist rolling through pine forests,
alpine lake perfectly mirroring the peaks above, 16mm ultra-wide lens,
extreme depth of field, Fujifilm Velvia color rendering, natural film grain
Tomas aéreas frente a tomas a nivel del suelo
La altura de la cámara lo cambia todo en un paisaje. Una perspectiva aérea comprime el primer plano y el fondo en una composición plana y gráfica. Una perspectiva baja, a nivel del suelo, exagera la escala y crea dramatismo.
Indicaciones para tomas aéreas (dron):
"perspectiva fotográfica aérea con dron"
"vista cenital, mirando directamente hacia abajo"
"punto de vista en altura sobre el paisaje"
Indicaciones para tomas bajas a nivel del suelo:
"toma en ángulo bajo, cámara cerca del suelo"
"mirando hacia arriba al sujeto, con el cielo como fondo"
"los elementos del primer plano dominan la parte inferior del encuadre"
Cómo usar Flux Schnell en PicassoIA
Flux Schnell es uno de los modelos de texto a imagen más rápidos disponibles, y produce una imagen terminada de 1 megapíxel en menos de 5 segundos. Es ideal para iterar rápidamente: puedes probar 20 variaciones de prompt en el tiempo que otros modelos tardan en generar una imagen.
Paso a paso: crear un prompt en Flux Schnell
Paso 1: Abre el modelo
Ve a Flux Schnell en PicassoIA. No necesitas configurar ninguna cuenta ni tarjeta de crédito para empezar a generar.
Paso 2: Fija primero la relación de aspecto
Antes de escribir el prompt, elige tu relación de aspecto. Usa 16:9 para tomas horizontales y cinematográficas, 9:16 para retratos y redes sociales, y 1:1 para publicaciones cuadradas en redes. La relación de aspecto define cómo se encuadrará la composición, así que decídela antes de escribir el prompt.
Paso 3: Construye el prompt por capas
Empieza por el sujeto y la acción. Después añade la iluminación. Luego, las especificaciones de cámara. Por último, la textura y la atmósfera.
Layer 1 (Subject): "A woman in her 30s sitting on a park bench in autumn"
Layer 2 (Lighting): "warm afternoon backlight, golden hour sun from behind left"
Layer 3 (Camera): "85mm f/1.4, shallow depth of field"
Layer 4 (Texture): "film grain, Kodak Portra 400, visible fabric texture on coat"
Layer 5 (Atmosphere): "fallen leaves on ground, soft bokeh background, warm tones"
Prompt final combinado: "Una mujer de unos 30 años sentada en un banco de parque en otoño, contraluz cálido de la tarde, sol de hora dorada desde detrás a la izquierda, 85 mm f/1.4, profundidad de campo reducida, grano de película, Kodak Portra 400, textura visible de la tela del abrigo, hojas caídas en el suelo, fondo con bokeh suave, tonos cálidos"
Paso 4: Usa el parámetro de semilla para iterar
Cuando obtengas un resultado que te guste, anota el número de semilla y fíjalo mientras ajustas solo el texto del prompt. Así aíslas una variable cada vez y la iteración se vuelve mucho más rápida.
Paso 5: Empieza con el modo rápido
Flux Schnell usa por defecto su modo fp8 optimizado para velocidad. Mantenlo activado para iterar rápido y hacer pruebas de borrador. Para una versión final que vayas a publicar, desactívalo para obtener la máxima fidelidad.
Parámetros que más importan en Flux Schnell
Parámetro
Ajuste recomendado
Por qué
Inference Steps
4 (por defecto)
Diseñado para 4 pasos. Más pasos no lo mejoran.
Megapixels
1
Usa siempre 1 MP para resultados publicables
Go Fast
Activado para borradores, desactivado para finales
Más rápido con fp8, más nítido con bf16
Seed
Fijo una vez que encuentres un buen resultado
Permite una iteración controlada
Output Format
PNG para transparencia, WebP para web
PNG conserva la calidad, WebP reduce el tamaño del archivo
Prompts según el tipo de modelo
Flux Schnell frente a Flux Dev
Tanto Flux Schnell como Flux Dev usan la misma arquitectura subyacente de 12 000 millones de parámetros, pero se comportan de forma distinta.
Flux Schnell está pensado para la velocidad y el volumen. Basado en un denoising de 4 pasos, es excelente para iterar rápidamente entre 10 y 20 variaciones de prompt. Los detalles muy finos en escenas complejas pueden ser algo menos refinados que en Flux Dev.
Flux Dev ejecuta entre 28 y 50 pasos de denoising y admite el modo img2img. Esto significa que puedes usar una foto existente como punto de partida y reconducirla con un prompt. Para las imágenes finales de producción, donde la máxima fidelidad importa, Flux Dev es la mejor opción.
💡 Flujo de trabajo: usa Flux Schnell para encontrar la composición, la iluminación y el tratamiento del sujeto adecuados entre muchas variaciones. Cuando tengas una dirección que te guste, cambia a Flux Dev para la versión final de alta fidelidad.
RealVisXL para el máximo realismo
RealVisXL añade compatibilidad con multi-ControlNet sobre una salida fotorrealista. Es clave para cualquiera que necesite controlar la disposición espacial de una imagen, no solo su calidad estética.
Con ControlNet activado, puedes subir una imagen de esqueleto de pose y el modelo colocará a tu sujeto exactamente en esa pose. Puedes subir un mapa de profundidad para controlar la disposición espacial. Puedes subir un boceto de líneas y hacer que se renderice de forma fotorrealista.
Los prompts para RealVisXL funcionan mejor cuando especificas con detalle la iluminación, las texturas y la atmósfera. ControlNet se encarga de la estructura; el prompt se encarga del estilo y la calidad.
Prompt negativo eficaz para RealVisXL:(worst quality, low quality, illustration, 3d render, 2d painting, cartoons, sketch), open mouth, extra limbs, blurry, watermark, text
Stable Diffusion: el caballo de batalla flexible
Stable Diffusion sigue siendo uno de los modelos más flexibles disponibles. Usa un sistema de prompts en el que importan tanto el orden como el peso de los términos.
Diferencias respecto a los prompts para modelos Flux:
Los términos al principio del prompt tienen un peso ligeramente mayor
Los paréntesis aumentan el énfasis: (Rembrandt lighting:1.3) hace que ese término sea un 30 % más intenso
El guidance scale (CFG) cambia de forma notable hasta qué punto el modelo sigue tu prompt al pie de la letra. Un CFG bajo (3 a 5) da al modelo libertad creativa. Un CFG alto (10 a 15) fuerza una adherencia estricta, pero puede introducir artefactos
Los prompts negativos son mucho más potentes aquí que en los modelos Flux
Estructura estándar de prompt de fotorrealismo para Stable Diffusion:
Todos los principios de prompts de este artículo se aplican de inmediato en PicassoIA. Ya sea con la velocidad de Flux Schnell, la fidelidad de Flux Dev, el control espacial de RealVisXL o la flexibilidad de Stable Diffusion, los principios de los prompts se mantienen constantes en todos ellos.
Elige un sujeto. Añade una condición de luz. Añade una especificación de cámara. Añade un detalle de textura. Genera. Itera a partir de ahí. El salto de calidad de un prompt de tres palabras a uno estructurado de 40 palabras no es sutil. Es la diferencia entre un borrador desechable y una imagen que de verdad usarías.
PicassoIA ofrece generaciones ilimitadas en todos los modelos, así que iterar no tiene penalización. Genera 30 variaciones. Ajusta la iluminación en cada una. Compara los resultados lado a lado. Así se crean las mejores imágenes de IA: no con un prompt perfecto, sino con un proceso de iteración rápido y estructurado en el que cada generación te enseña algo sobre el modelo.
Los modelos son capaces. Los prompts dependen de ti. Ahora tienes la estructura para escribir los que de verdad funcionan.