6 dicas de prompt para corpos de IA com aparência mais natural
Obter corpos realistas e naturais em geradores de imagens por IA exige mais do que escrever "fotorrealista". Estas 6 dicas de prompt mostram exatamente quais palavras acrescentar para ajustar textura da pele, proporções do corpo, direção da luz, física da roupa e ângulos de câmera, para resultados realmente convincentes em todos os principais modelos de IA.
Todo gerador de imagens por IA tem o mesmo ponto cego. Você digita "beautiful woman, photorealistic" e recebe um resultado que parece alguém que embrulhou um manequim em plástico com cor de pele. As proporções ficam levemente erradas. A pele não tem poros. A postura é rígida. A iluminação trata o corpo como uma forma chapada.
O resultado é tecnicamente correto, mas reconhecível como IA na hora.
Este não é um problema do modelo. É um problema do prompt. Os modelos têm dados suficientes para gerar anatomia humana incrivelmente realista, mas precisam que você diga exatamente o que "realista" significa. Estas 6 dicas de prompt são as instruções específicas que fecham a distância entre o manequim de IA e uma imagem convincentemente humana.
Por que os corpos de IA voltam ao artificial
As configurações padrão do modelo
A maioria dos modelos de imagem é treinada com a internet inteira, que inclui uma quantidade desproporcional de fotografias muito retocadas, renderizações de CGI e ilustrações idealizadas. Quando você dá um prompt vago, o modelo recorre à média estatística de todas essas entradas, que pende fortemente para resultados lisos, simétricos, com iluminação uniforme e proporções exageradas.
O modelo não está errado. Ele está fazendo exatamente o que foi treinado para fazer. Seu trabalho é substituir esses padrões com linguagem específica.
O que "fotorrealista" realmente deixa de fora
A palavra "fotorrealista" sozinha é um dos tokens mais sobrecarregados na geração de imagens por IA. Ela manda o modelo produzir algo com aparência de fotografia, mas não especifica qual tipo. Por padrão, a IA interpreta isso como "fotografia comercial de alta resolução", que é justamente o gênero mais associado a resultados com aerografia, idealizados e perturbadores.
O que você quer é fotografia documental crua, retrato espontâneo ou editorial de moda com imperfeições visíveis. São categorias diferentes e exigem palavras diferentes.
Dica 1: descreva a pele, não só o tom da pele
Dizer "pele clara" ou "tom bronzeado" informa ao modelo sobre a cor. Não informa nada sobre a textura. A pele humana não é um material, é uma superfície complexa com poros, pelos finos, variação sutil de cor, manchas ocasionais e propriedades elásticas que criam rugas e dobras sempre que o corpo se move ou se comprime.
A solução é descrever a pele como um dermatologista faria, e não como uma marca de cosméticos faria.
Palavras que forçam a textura da pele
Acrescente estes termos específicos a qualquer prompt de corpo:
"visible pore texture": força o modelo a renderizar a microestrutura da pele
"fine vellus hairs on forearms": acrescenta realismo biológico à pele exposta dos braços
"slight freckle pattern across shoulders": introduz variação natural de pigmentação
"natural skin imperfections" ou "authentic skin blemishes": evita a aerografia
"capillary lines at the inner wrist": acrescenta detalhe vascular subcutâneo
"elastic skin folds at the elbow": quando os braços se dobram, a pele não fica lisa
💡 Dica de especialista: combine termos de textura da pele com referências de filme fotográfico. "Kodak Portra 400" manda o modelo renderizar cor e granulação de um jeito que captura naturalmente as imperfeições da pele, em vez de suavizá-las.
O truque do espectro de tons de pele
Em vez de dizer "pele oliva", descreva a variação: "complexão dourada-bege quente, com parte interna do braço um pouco mais clara e tom mais escuro no cotovelo". A pele real não é uniforme. Descrever sua variação sinaliza ao modelo que você quer fidelidade biológica, e não um preenchimento de cor.
Dica 2: especifique a direção e a qualidade da luz
A luz é o elemento de prompt de corpo mais subutilizado. Uma luz plana, uniforme e ambiente faz a pele parecer plástica e elimina toda a profundidade anatômica. A luz direcional, vinda de um ângulo específico, cria sombras nas reentrâncias naturais, revela o tônus muscular e faz o corpo parecer tridimensional.
Especifique a fonte e a direção da luz
Não escreva "boa iluminação" nem "iluminação bonita". Em vez disso:
Prompt vago
Prompt específico
iluminação boa
fonte de luz única vinda do canto superior esquerdo a 45 graus
luz natural
luz de janela da manhã vinda da direita, sombras suaves
luz de estúdio
padrão de iluminação Rembrandt, fonte de luz principal às 2 horas
luz dramática
luz lateral direcional forte, sombra profunda do lado direito
A posição da fonte de luz determina diretamente onde as sombras caem sobre o corpo. Sombras em locais anatômicos naturais, como a clavícula, a axila e a reentrância da cintura, são o que faz um corpo parecer real.
Frases de luz volumétrica
Estas frases sinalizam profundidade atmosférica, e não apenas iluminação chapada:
"volumetric morning light streaming from left"
"soft diffused overcast daylight, no harsh shadows"
"golden rim light from behind tracing the shoulder outline"
💡 Dica de especialista: "Late afternoon golden hour backlight" é especialmente eficaz em fotos de corpo inteiro e em áreas externas. Ela cria uma luz de contorno que separa o corpo do fundo e adiciona calor aos tons de pele sem superexpor a imagem.
Dica 3: ancore as proporções do corpo com palavras de referência
Os modelos de IA têm um viés treinado forte em direção a proporções corporais exageradas em contextos generativos. Sem correção, você vai obter resultados simultaneamente sobre-idealizados em algumas áreas e anatomicamente incorretos em outras.
A solução não é descrever medidas. É usar uma linguagem qualitativa que ancore as expectativas.
Linguagem de proporção que funciona
"natural body proportions": ajuste genérico, mas eficaz, ao padrão de idealização
"realistic waist-to-hip ratio": mira especificamente a relação que mais costuma ser distorcida
"visible but not exaggerated muscle tone": trata o padrão de "físico sobre-humano"
"slight natural belly roundness" ou "soft abdominal definition": força uma região do abdômen não idealizada
"normal thigh width, no thigh gap exaggeration": aborda diretamente uma distorção comum
"authentic human silhouette": substituição ampla que recalibra o corpo inteiro
A postura como proporção
Os sinais de postura também influenciam a proporção percebida. Uma pose de pé rígida e perfeitamente ereta parece artificial, porque pessoas reais quase nunca ficam assim sem se esforçar. Use linguagem de postura para introduzir assimetria natural:
"weight shifted onto the right leg, left knee slightly bent"
"relaxed sloped shoulder posture"
"slight forward hip tilt from standing"
"natural spinal S-curve visible from the side"
Essas frases obrigam o modelo a interpretar a anatomia como um sistema em repouso sob a gravidade, e não como um manequim posado.
Dica 4: use linguagem de câmera e lente
As especificações de câmera e lente fazem mais do que controlar o enquadramento. Elas mudam fundamentalmente a forma como o modelo renderiza o corpo, porque distâncias focais diferentes têm relações geométricas diferentes com a forma humana.
Distância focal e renderização do corpo
Distância focal
Efeito no corpo
24-35mm
Leve distorção de perspectiva, alonga os membros nas bordas
50mm
Perspectiva neutra, mais próxima da visão humana natural
85mm
Leve compressão de teleobjetiva, proporções lisonjeiras
100-135mm
Forte compressão, remove distrações do fundo
Macro (50-100mm)
Força detalhe extremo da pele, ideal para close-ups
Para fotos de corpo inteiro, 85mm f/2.8 ou 50mm f/2.0 são as especificações mais confiáveis para proporções naturais e sem distorção. Para fotos de detalhe da pele, 100mm macro em f/2.8 a f/4 força o modelo a renderizar a pele em uma resolução na qual não consegue esconder imperfeições.
Abertura e profundidade de campo
Especificar a abertura muda a forma como o modelo renderiza a separação do fundo e a profundidade do plano focal:
f/1.4 a f/2.0: profundidade de campo muito rasa, fundo completamente dissolvido, sujeito totalmente nítido
f/2.8 a f/4: separação moderada, alguma textura do fundo visível
f/8 a f/11: foco profundo, ambiente completo em contexto com o sujeito
A profundidade de campo rasa é especialmente eficaz em fotos de corpo porque obriga o modelo a concentrar todo o seu detalhe de renderização na superfície do sujeito, resultando em maior qualidade de textura na pele, no cabelo e no tecido.
💡 Dica de especialista: combine a especificação da lente com um filme fotográfico: "85mm f/1.8, Kodak Portra 400 film grain" é uma das combinações mais confiáveis para resultados naturais de retrato e de corpo em quase todos os modelos de texto para imagem.
Dica 5: adicione física da roupa e comportamento do tecido
A roupa é onde a geração de corpos por IA mais visivelmente falha. A IA tende a criar roupas que se comportam como uma casca pintada, e não como um tecido drapeado sobre um corpo tridimensional. A roupa real tem peso, elasticidade e interação com a forma do corpo por baixo.
Palavras-chave de física do tecido
Estes termos mandam o modelo simular o comportamento real do tecido:
"natural gravity folds in fabric": o tecido cai e se acumula de forma realista
"tension lines where garment contacts the hip": o tecido estica e puxa nos pontos de pressão
"fabric bunching authentically at the waistband": compressão realista no elástico
"slight crease where elbow bends": deformação do tecido por articulação
"translucent fabric showing body silhouette in backlight": interação da luz com tecidos finos
"worn cotton texture with visible weave": detalhe de superfície específico do material
A roupa como ferramenta para revelar o corpo
A roupa que acompanha o corpo com precisão é um dos sinais mais fortes de anatomia realista. Quando você descreve o comportamento do tecido, obriga o modelo a se comprometer com uma forma corporal específica por baixo, o que evita o problema de membros flutuantes e indefinidos, comum na geração de corpos por IA.
Use frases como:
"the fabric reveals the natural curve of her hips without clinging"
"slight abdominal shape visible through the thin jersey material"
"denim conforming to natural thigh shape while walking"
Dica 6: estruture seu prompt em camadas
A maioria dos prompts de corpo que falham na IA é uma única frase longa que mistura descrição do sujeito, ambiente, iluminação e estilo de uma só vez. Isso cria interferência de tokens, em que o modelo pesa todos os elementos igualmente e dilui as instruções específicas sobre o corpo.
A solução é uma arquitetura de prompt em camadas: Sujeito primeiro, depois Ambiente, depois Iluminação, depois Câmera, depois Textura e, por fim, Estilo.
O framework SELCTS
Camada
O que controla
Exemplo
Sujeito
Quem é, o que veste, pose e anatomia
"A woman in her late 20s, natural body proportions, relaxed standing posture"
Environment (Ambiente)
Onde estão, elementos do fundo
"in a public park, soft bokeh greenery background"
Lighting (Iluminação)
Direção, qualidade, fonte
"overcast afternoon light, diffused, no harsh shadows"
"photorealistic, 8K RAW, no airbrushing --ar 16:9 --style raw"
Montar seu prompt nessa ordem garante que as instruções de corpo específicas do sujeito não sejam diluídas por tokens ambientais ou de estilo. Cada camada reforça a anterior.
Um modelo de prompt reutilizável
[Subject: person description + pose + body language + clothing with fabric physics] +
[Environment: setting + background] +
[Lighting: source, direction, quality] +
[Camera: lens spec + aperture + framing] +
[Texture: skin detail + film stock + imperfections] +
[Style flags: photorealistic, 8K RAW, --ar 16:9 --style raw]
Este modelo, aplicado a qualquer uma das dicas acima, gera resultados consistentemente mais naturais do que um despejo não estruturado de adjetivos.
Usando modelos de linguagem de IA para escrever prompts melhores
Escrever prompts longos e detalhados do zero é cansativo. Uma das formas mais práticas de economizar tempo é usar um modelo de linguagem de IA para expandir e refinar o prompt antes de enviá-lo ao gerador de imagens.
A PicassoIA inclui vários modelos de linguagem de alto desempenho que você pode usar diretamente na plataforma:
Claude Sonnet 5 se destaca na descrição criativa e pode expandir um prompt de corpo resumido em uma versão completa estruturada em SELCTS, com linguagem precisa de pele e iluminação.
GPT-5 é eficaz para gerar variações de um prompt de trabalho, permitindo testar diferentes abordagens de iluminação ou proporção sem reescrever do zero.
Gemini 3.5 Flash é rápido e bem adequado para iterações ágeis, permitindo testar de 10 a 15 variantes de prompt no tempo que levaria para criar uma com cuidado.
DeepSeek R1 é particularmente forte em raciocinar sobre problemas de precisão anatômica, sendo útil quando você quer descobrir por que um elemento específico do corpo continua saindo errado.
Um fluxo de trabalho simples: descreva o que você quer em linguagem comum para o LLM, peça que ele converta isso em um prompt de geração de imagem de 60 a 75 palavras usando a estrutura SELCTS e, em seguida, cole o resultado diretamente no seu gerador de imagens.
Faça upscaling e refine o resultado
Até uma imagem bem promptada se beneficia de upscaling após a geração. Uma resolução maior obriga a renderização a se comprometer com detalhes específicos de pele e tecido que se perdem em saídas de menor resolução.
Os modelos de super-resolução da PicassoIA adicionam passes de detalhe significativos a imagens já geradas:
Clarity Pro Upscaler é a opção mais forte para imagens de corpo fotorrealistas, aplicando passes de refinamento de textura detalhados que melhoram o realismo da pele e do tecido sem introduzir artefatos artificiais.
Crystal Upscaler é otimizado especificamente para retratos e é particularmente eficaz na textura da pele do rosto e do pescoço em fotos de corpo em que o rosto está no enquadramento.
Real ESRGAN é uma opção sólida do plano gratuito para upscaling padrão de 4x, adicionando resolução sem alterar a composição original.
P Image Upscale é a opção mais rápida disponível na PicassoIA, concluindo o upscaling em cerca de um segundo por imagem.
Um fluxo de acabamento padrão: gere a imagem na resolução base com um prompt SELCTS detalhado e, em seguida, passe-a pelo Clarity Pro Upscaler em 2x ou 4x. A camada de detalhe adicionada no upscaling frequentemente acrescenta a textura dos poros e a trama do tecido que a geração base não captou.
A comparação que mostra a diferença
A diferença entre uma imagem de corpo por IA convincente e uma perturbadora geralmente se resume a três ou quatro frases específicas. Abaixo, uma comparação lado a lado de estruturas de prompt para o mesmo sujeito:
"volumetric morning light from the upper left at 45 degrees, soft shadow in collarbone indentation"
Proporções
"fit woman"
"natural body proportions, realistic waist-to-hip ratio, slight muscle definition without exaggeration"
Câmera
"photorealistic"
"85mm f/2.0 lens, shallow depth of field, Kodak Portra 400 film grain"
Roupa
"wearing a dress"
"light linen dress with natural gravity folds, fabric tension at the hip, slight fabric movement"
Cada melhoria mira um modo de falha específico. Juntas, elas fecham a maior parte da distância entre o manequim de IA e uma figura humana genuinamente convincente.
Teste estes prompts na PicassoIA
As 6 dicas acima não são teóricas. Elas funcionam nos principais modelos de geração de imagens porque atacam os mecanismos subjacentes de como as redes neurais interpretam prompts de corpo humano.
A PicassoIA oferece acesso a mais de 91 modelos de texto para imagem, incluindo os geradores mais capazes da geração atual, tudo em um só lugar. Isso significa que você pode testar estas estruturas de prompt em várias arquiteturas de modelo sem trocar de plataforma, pagar assinaturas separadas ou gerenciar configurações de API diferentes.
A abordagem mais eficaz é testar uma dica por vez, aplicá-la a um prompt que você já tem e comparar o resultado. Comece pela Dica 1 (Textura da pele), já que ela produz a melhoria mais visível com a menor complexidade de prompt. Depois, acrescente a Dica 2 (Direção da luz), que é a mudança de maior impacto para fotos de corpo inteiro.
Quando você tiver uma estrutura de prompt que funciona, salve-a e use os modelos de LLM da PicassoIA para gerar variações. O ciclo de iteração, prompt, imagem, upscaling e variação, é o que faz os resultados passarem de bons a notáveis.
Veja todos os modelos disponíveis de geração de imagens e de linguagem em picassoia.com/en/all-models e comece a testar estas dicas na sua próxima rodada de geração.