6 consejos de prompt para cuerpos de IA con aspecto más natural
Conseguir cuerpos realistas y naturales con generadores de imágenes de IA exige más que escribir "fotorrealista". Estos 6 consejos de prompt te indican exactamente qué palabras añadir para mejorar la textura de la piel, las proporciones corporales, la dirección de la luz, la física de la ropa y los ángulos de cámara, y lograr resultados auténticamente convincentes en los principales modelos de IA.
Todos los generadores de imágenes de IA tienen el mismo punto ciego. Escribes "beautiful woman, photorealistic" y obtienes un resultado que parece un maniquí envuelto en plástico de color piel. Las proporciones están ligeramente desviadas. La piel no tiene poros. La postura es rígida. La iluminación trata el cuerpo como una forma plana.
El resultado es técnicamente correcto, pero se reconoce al instante como IA.
Este no es un problema del modelo, sino de prompt. Los modelos tienen datos suficientes para generar una anatomía humana increíblemente realista, pero necesitan que les digas exactamente qué significa "realista". Estos 6 consejos de prompt son las instrucciones específicas que cierran la brecha entre el maniquí de IA y un resultado convincentemente humano.
Por qué los cuerpos de IA salen falsos por defecto
La configuración por defecto del modelo
La mayoría de los modelos de imagen se entrenan con todo internet, que incluye una cantidad desproporcionada de fotografía muy retocada, renders de CGI e ilustraciones idealizadas. Cuando escribes un prompt vago, el modelo recurre al promedio estadístico de todas esas entradas, que se inclina con fuerza hacia resultados suaves, simétricos, con iluminación uniforme y proporciones exageradas.
El modelo no se equivoca. Hace exactamente lo que fue entrenado para hacer. Tu trabajo es anular esos valores por defecto con un lenguaje específico.
Lo que "fotorrealista" no alcanza a decir
La palabra "fotorrealista" por sí sola es uno de los tokens más sobrecargados de la generación de imágenes con IA. Le dice al modelo que produzca algo que parezca una fotografía, pero no especifica de qué tipo. La IA la interpreta por defecto como "fotografía comercial de alta resolución", que es precisamente el género más asociado con resultados retocados con aerógrafo, idealizados e inquietantes.
Lo que buscas es fotografía documental en bruto, retrato espontáneo o fotografía editorial de moda con imperfecciones visibles. Son categorías distintas y requieren palabras distintas.
Consejo 1: describe la piel, no solo el tono de piel
Decir "piel clara" o "tez bronceada" le indica al modelo el color, pero nada sobre la textura. La piel humana no es un material: es una superficie compleja con poros, vello fino, variaciones sutiles de color, imperfecciones ocasionales y propiedades elásticas que crean arrugas y pliegues cada vez que el cuerpo se mueve o se comprime.
La solución es describir la piel como lo haría un dermatólogo, no como lo haría una marca de cosméticos.
Palabras que fuerzan la textura de la piel
Añade estos términos específicos a cualquier prompt de cuerpo:
"visible pore texture": obliga al modelo a renderizar la microestructura de la piel
"fine vellus hairs on forearms": añade realismo biológico a la piel expuesta de los brazos
"slight freckle pattern across shoulders": introduce variación natural de pigmentación
"natural skin imperfections" o "authentic skin blemishes": evita el efecto de aerógrafo
"capillary lines at the inner wrist": añade detalle vascular subcutáneo
"elastic skin folds at the elbow": cuando los brazos están doblados, la piel no se mantiene lisa
💡 Consejo profesional: Combina las palabras de textura de piel con referencias de película fotográfica. "Kodak Portra 400" le indica al modelo que renderice el color y el grano de una forma que capta naturalmente las imperfecciones de la piel en lugar de suavizarlas.
El truco del espectro de tonos de piel
En lugar de decir "piel oliva", describe la variación: "tez beige dorado cálido con el interior del brazo ligeramente más claro y un tono más profundo en el codo". La piel real no es uniforme. Describir su variación indica al modelo que quieres fidelidad biológica, no un relleno de color.
Consejo 2: especifica la dirección y la calidad de la luz
La iluminación es el elemento más infrautilizado en los prompts de cuerpo. Una luz plana, uniforme y ambiental hace que la piel parezca de plástico y elimina toda la profundidad anatómica. La luz direccional desde un ángulo concreto crea sombras en las depresiones naturales, revela el tono muscular y hace que el cuerpo parezca tridimensional.
Especifica la fuente y la dirección de la luz
No escribas "good lighting" ni "beautiful lighting". En su lugar:
Prompt vago
Prompt específico
good lighting
fuente de luz única desde la parte superior izquierda a 45 grados
natural light
luz de ventana por la mañana desde la derecha, sombras suaves
studio light
patrón de iluminación Rembrandt, fuente de luz principal a las 2 en punto
dramatic light
luz lateral direccional intensa, sombra profunda en el lado derecho
La posición de la fuente de luz determina directamente dónde caen las sombras sobre el cuerpo. Las sombras en ubicaciones anatómicas naturales, como la clavícula, la axila y la depresión de la cintura, son lo que hace que un cuerpo parezca real.
Frases de luz volumétrica
Estas frases indican profundidad atmosférica, no iluminación plana:
"volumetric morning light streaming from left"
"soft diffused overcast daylight, no harsh shadows"
"golden rim light from behind tracing the shoulder outline"
💡 Consejo profesional: "Late afternoon golden hour backlight" es especialmente eficaz para planos de cuerpo completo y exteriores. Crea una luz de contorno que separa el cuerpo del fondo y añade calidez a los tonos de piel sin sobreexponer.
Consejo 3: ancla las proporciones corporales con palabras de referencia
Los modelos de IA tienen un fuerte sesgo de entrenamiento hacia proporciones corporales exageradas en contextos generativos. Sin corrección, obtendrás resultados simultáneamente sobreidealizados en algunas zonas y anatómicamente incorrectos en otras.
La solución no es describir medidas, sino usar un lenguaje cualitativo que ancle las expectativas.
Lenguaje de proporción que funciona
"natural body proportions": anulación genérica pero eficaz del valor por defecto de idealización
"realistic waist-to-hip ratio": apunta específicamente a la relación que con más frecuencia se distorsiona
"visible but not exaggerated muscle tone": aborda el valor por defecto de "físico sobrehumano"
"slight natural belly roundness" o "soft abdominal definition": obliga a un torso no idealizado
"normal thigh width, no thigh gap exaggeration": aborda directamente una distorsión común
"authentic human silhouette": anulación amplia que recalibra todo el cuerpo
La postura como proporción
Las señales de postura también influyen en la proporción percibida. Una pose de pie rígida y perfectamente erguida resulta artificial porque las personas reales casi nunca se quedan así sin esforzarse. Usa lenguaje de postura para introducir asimetría natural:
"weight shifted onto the right leg, left knee slightly bent"
"relaxed sloped shoulder posture"
"slight forward hip tilt from standing"
"natural spinal S-curve visible from the side"
Estas frases obligan al modelo a interpretar la anatomía como un sistema en reposo bajo la gravedad, y no como un maniquí posado.
Consejo 4: usa lenguaje de cámara y objetivo
Las especificaciones de cámara y objetivo hacen mucho más que controlar el encuadre. Cambian a fondo la forma en que el modelo renderiza el cuerpo, porque las distintas distancias focales tienen relaciones geométricas diferentes con la figura humana.
Distancia focal y renderizado del cuerpo
Distancia focal
Efecto en el cuerpo
24-35mm
Ligera distorsión de perspectiva, alarga las extremidades cerca de los bordes
50mm
Perspectiva neutra, la más cercana a la visión humana natural
85mm
Ligera compresión de teleobjetivo, proporciones favorecedoras
100-135mm
Compresión fuerte, elimina las distracciones del fondo
Macro (50-100mm)
Fuerza un detalle extremo de la piel, ideal para primeros planos
Para planos de cuerpo completo, 85mm f/2.8 o 50mm f/2.0 son las especificaciones más fiables para proporciones naturales y sin distorsión. Para planos de detalle de la piel, macro de 100mm a f/2.8 o f/4 obliga al modelo a renderizar la piel con una resolución en la que no puede ocultar imperfecciones.
Apertura y profundidad de campo
Especificar la apertura cambia la forma en que el modelo renderiza la separación del fondo y la profundidad del plano de enfoque:
f/1.4 a f/2.0: profundidad de campo muy reducida, fondo completamente difuminado, sujeto totalmente nítido
f/2.8 a f/4: separación moderada, algo de textura del fondo visible
f/8 a f/11: enfoque profundo, todo el entorno en contexto con el sujeto
La profundidad de campo reducida es especialmente eficaz en planos de cuerpo porque obliga al modelo a dedicar todo su detalle de renderizado a la superficie del sujeto, lo que resulta en una mayor calidad de textura en la piel, el cabello y la tela.
💡 Consejo profesional: Combina la especificación del objetivo con la película fotográfica: "85mm f/1.8, Kodak Portra 400 film grain" es una de las combinaciones más fiables para resultados naturales de retrato y cuerpo en casi todos los modelos de texto a imagen.
Consejo 5: añade física de la ropa y comportamiento de la tela
La ropa es donde la generación de cuerpos con IA más visiblemente falla. La IA tiende a generar prendas que se comportan como una cáscara pintada en lugar de una tela que cae sobre un cuerpo tridimensional. La ropa real tiene peso, elasticidad e interacción con la forma del cuerpo que tiene debajo.
Palabras clave de física de la tela
Estos términos indican al modelo que simule el comportamiento real de los textiles:
"natural gravity folds in fabric": la tela cuelga y se acumula de forma realista
"tension lines where garment contacts the hip": la tela se estira y tira en los puntos de presión
"fabric bunching authentically at the waistband": compresión realista en la cinturilla elástica
"slight crease where elbow bends": deformación de la tela basada en la articulación
"translucent fabric showing body silhouette in backlight": interacción de la luz con textiles finos
"worn cotton texture with visible weave": detalle de superficie específico del material
La ropa como herramienta para revelar el cuerpo
La ropa que sigue con precisión el cuerpo es una de las señales más fuertes de una anatomía realista. Cuando describes el comportamiento de la tela, obligas al modelo a comprometerse con una forma corporal concreta debajo, lo que evita el problema de las extremidades flotantes e indefinidas tan frecuente en la generación de cuerpos con IA.
Usa frases como:
"the fabric reveals the natural curve of her hips without clinging"
"slight abdominal shape visible through the thin jersey material"
"denim conforming to natural thigh shape while walking"
Consejo 6: estructura tu prompt en capas
La mayoría de los prompts de cuerpo fallidos con IA son una sola frase larga que mezcla descripción del sujeto, entorno, iluminación y estilo al mismo tiempo. Esto crea una interferencia de tokens en la que el modelo pondera todos los elementos por igual, diluyendo las instrucciones específicas del cuerpo.
La solución es una arquitectura de prompt en capas: primero el sujeto, después el entorno, luego la iluminación, después la cámara, luego la textura y, por último, el estilo.
El marco SELCTS
Capa
Qué controla
Ejemplo
Subject (sujeto)
Quién es, qué lleva puesto, pose y anatomía
"A woman in her late 20s, natural body proportions, relaxed standing posture"
Environment (entorno)
Dónde está, elementos del fondo
"in a public park, soft bokeh greenery background"
Lighting (iluminación)
Dirección, calidad, fuente
"overcast afternoon light, diffused, no harsh shadows"
"photorealistic, 8K RAW, no airbrushing --ar 16:9 --style raw"
Construir tu prompt en este orden garantiza que las instrucciones corporales específicas del sujeto no se diluyan con tokens del entorno o de estilo. Cada capa refuerza la anterior.
Una plantilla de prompt reutilizable
[Subject: person description + pose + body language + clothing with fabric physics] +
[Environment: setting + background] +
[Lighting: source, direction, quality] +
[Camera: lens spec + aperture + framing] +
[Texture: skin detail + film stock + imperfections] +
[Style flags: photorealistic, 8K RAW, --ar 16:9 --style raw]
Esta plantilla, aplicada a cualquiera de los consejos anteriores, siempre genera resultados más naturales que un volcado desestructurado de adjetivos.
Usar modelos de lenguaje de IA para escribir mejores prompts
Escribir prompts largos y detallados desde cero es tedioso. Una de las formas más prácticas de ahorrar tiempo es usar un modelo de lenguaje de IA para ampliar y refinar tu prompt antes de enviarlo al generador de imágenes.
PicassoIA incluye varios modelos de lenguaje de alto rendimiento que puedes usar directamente en la plataforma:
Claude Sonnet 5 destaca en la descripción creativa y puede ampliar un prompt corporal breve hasta una versión completa con estructura SELCTS y lenguaje preciso de piel e iluminación.
GPT-5 es eficaz para generar variaciones de un prompt de trabajo, lo que te permite probar distintos enfoques de iluminación o proporción sin reescribirlo desde cero.
Gemini 3.5 Flash es rápido y muy adecuado para iterar con agilidad, lo que te permite probar entre 10 y 15 variantes de prompt en el tiempo que te llevaría redactar uno con cuidado.
DeepSeek R1 es especialmente bueno para razonar sobre problemas de precisión anatómica, y resulta útil cuando quieres averiguar por qué un elemento concreto del cuerpo se sigue generando mal.
Un flujo de trabajo sencillo: describe lo que quieres en lenguaje natural al LLM, pídele que lo convierta en un prompt de generación de imágenes de entre 60 y 75 palabras con la estructura SELCTS y, después, pega el resultado directamente en tu generador de imágenes.
Escalar y refinar el resultado
Incluso una imagen bien promptada se beneficia del escalado posterior a la generación. Una resolución mayor obliga al renderizado a comprometerse con detalles específicos de piel y tela que se promedian en salidas de menor resolución.
Los modelos de superresolución de PicassoIA añaden pasadas de detalle significativas a imágenes ya generadas:
Clarity Pro Upscaler es la opción más sólida para imágenes de cuerpo fotorrealistas, aplicando pasadas de refinamiento de textura detallada que mejoran el realismo de la piel y la tela sin introducir artefactos artificiales.
Crystal Upscaler está optimizado específicamente para retratos y es especialmente eficaz en la textura de la piel del rostro y el cuello en planos de cuerpo donde la cara entra en el encuadre.
Real ESRGAN es una opción sólida y gratuita para el escalado estándar 4x, que añade resolución sin alterar la composición original.
P Image Upscale es la opción más rápida disponible en PicassoIA, y completa el escalado en aproximadamente un segundo por imagen.
Un flujo de acabado estándar: genera la imagen con la resolución base y un prompt SELCTS detallado y, después, pásala por Clarity Pro Upscaler a 2x o 4x. La capa de detalle añadida durante el escalado suele aportar los poros y el tejido de la tela que la generación base no captó.
La comparación que muestra la diferencia
La diferencia entre una imagen de cuerpo generada por IA convincente y una inquietante suele reducirse a tres o cuatro frases específicas. A continuación se muestra una comparación lado a lado de estructuras de prompt para el mismo sujeto:
"volumetric morning light from the upper left at 45 degrees, soft shadow in collarbone indentation"
Proporciones
"fit woman"
"natural body proportions, realistic waist-to-hip ratio, slight muscle definition without exaggeration"
Cámara
"photorealistic"
"85mm f/2.0 lens, shallow depth of field, Kodak Portra 400 film grain"
Ropa
"wearing a dress"
"light linen dress with natural gravity folds, fabric tension at the hip, slight fabric movement"
Cada mejora apunta a un modo de fallo específico. Juntas, cierran la mayor parte de la brecha entre el maniquí de IA y una figura humana realmente convincente.
Prueba estos prompts en PicassoIA
Los 6 consejos anteriores no son teóricos. Funcionan en los principales modelos de generación de imágenes porque atacan los mecanismos subyacentes con los que las redes neuronales interpretan los prompts de cuerpo humano.
PicassoIA te da acceso a más de 91 modelos de texto a imagen, incluidos los generadores más capaces del momento, todo en un mismo lugar. Eso significa que puedes probar estas estructuras de prompt en varias arquitecturas de modelos sin cambiar de plataforma, pagar suscripciones separadas ni gestionar distintas configuraciones de API.
El enfoque más eficaz es tomar un consejo cada vez, aplicarlo a un prompt que ya tengas y comparar el resultado. Empieza por el Consejo 1 (textura de la piel), ya que produce la mejora más visible con la menor complejidad de prompt. Después incorpora el Consejo 2 (dirección de la luz), que es el cambio de mayor impacto para los planos de cuerpo completo.
Cuando tengas una estructura de prompt que funcione, guárdala y usa los modelos de lenguaje de PicassoIA para generar variaciones. El ciclo de iteración, prompt, imagen, escalado y variación, es donde los resultados pasan de buenos a extraordinarios.
Explora todos los modelos de generación de imágenes y de lenguaje disponibles en picassoia.com/en/all-models y empieza a probar estos consejos en tu próxima tanda de generación.