Cómo mantener el aspecto coherente de tu compañera de IA en cada foto
Generar dos veces el mismo personaje de IA es más difícil de lo que parece. Este artículo explica las semillas, el entrenamiento de LoRA, las imágenes de referencia y los mejores modelos para fijar el rostro, el estilo y los rasgos de tu compañera en cada foto, en cada escena y siempre.
Tu compañera de IA acaba de quedar perfecta en la última imagen. Mismo rostro, misma vibra, exactamente como la imaginabas. Luego vuelves a generar, cambias el fondo y aparece como si fuera otra persona. Otra forma de nariz, otra separación entre los ojos, un cabello que ahora tira más a rojizo. ¿Te suena?
Esta es la frustración más común en la generación de retratos con IA, y tiene causas concretas que se pueden corregir. Este artículo repasa cada método que de verdad funciona: desde bloquear el seed de forma rápida hasta entrenar un LoRA completo, para que tu personaje se vea igual tanto en un café de París como en una esquina de una calle de Tokio.
Por qué tu compañera de IA se ve distinta cada vez
El motor de aleatoriedad que hay debajo
Todo modelo de generación de imágenes funciona con un seed aleatorio: un número de partida que determina en qué dirección recorre el modelo sus datos aprendidos. Cambias la descripción de la escena, la iluminación o incluso añades una coma a tu prompt, y el punto de partida efectivo se desplaza. Con él se va también el rostro de tu personaje.
El modelo no recuerda a tu compañera. No tiene ningún archivo guardado llamado "ella". Cada generación es una muestra nueva de una distribución de probabilidad. La palabra "morena" reduce el espacio de posibilidades, pero no fija a una persona concreta. Ahí es donde se esconde la falta de coherencia.
Qué cambia de verdad entre una toma y otra
Cuando vuelves a generar con un prompt algo modificado, estos elementos son los que más cambian:
Forma de la nariz (extremadamente sensible a cambios de palabras)
Separación entre los ojos y forma de los párpados
Anchura de la mandíbula y definición de la barbilla
Intensidad del color del cabello (castaño claro frente a castaño oscuro puede cambiar con una sola palabra)
Calidez del tono de piel (oliva puede tirar más a amarillo o más a rosa)
Proporciones generales del rostro y estructura ósea
Cuantos más elementos cambies en un prompt, más se desplaza el rostro. Añadir un lugar nuevo, ropa nueva o una nueva condición de iluminación aumenta la variación. Entender esto te permite controlarla.
Los números seed: tu primera línea de defensa
Qué hace realmente un seed
Un seed es un número, entre 0 y más de cuatro mil millones, que fija el punto de partida del proceso de generación. Dos ejecuciones con el mismo prompt y el mismo seed producen resultados idénticos píxel a píxel. Si bloqueas el seed, bloqueas buena parte de la identidad visual.
En cuanto encuentres una generación que se vea exactamente bien, anota ese número de seed de inmediato. Ese número ya forma parte de la identidad de tu personaje, tan esencial como el color de sus ojos o la longitud de su cabello.
Usar seeds en PicassoIA
La mayoría de los modelos de generación de PicassoIA muestran un campo de seed directamente en el panel de parámetros. Configúralo a mano en lugar de dejarlo en aleatorio. Para los modelos que muestran un seed aleatorio en los metadatos tras generar:
Genera una imagen que coincida con tu personaje
Busca el seed en los detalles de la salida de generación
Cópialo en tu documento de notas del personaje
Pégalo a mano cada vez que generes
Flux Dev y Flux 2 Pro admiten la entrada directa de seed, por lo que son opciones sólidas para flujos de retratos con seed bloqueado. El beneficio en coherencia se nota desde el primer momento en cuanto encuentras el seed adecuado para el rostro de tu personaje.
Cuando los seeds fallan
Los seeds bloquean por completo el resultado solo cuando todas las demás variables se mantienen idénticas. Si cambias el prompt de cualquier forma, el seed da el mismo punto de partida, pero produce un resultado distinto, porque el modelo recorre otra trayectoria. Los seeds por sí solos no bastan. Hay que combinarlos con un anclaje preciso en el prompt para mantener el rostro en escenas distintas.
💡 Guarda tu seed junto con el prompt completo de tu personaje en el mismo documento. Trata esa combinación como una sola unidad. Un seed sin su prompt correspondiente pierde casi todo su valor.
Anclaje del prompt: escribe como un director de casting
Crea la biblia de tu personaje
Una biblia de personaje es un bloque de descripción fijo y estandarizado que pegas al inicio de cada prompt. No cambia. Cambia la escena, cambia la iluminación, cambia la ropa. El bloque del personaje se mantiene idéntico, palabra por palabra.
Esta es una estructura sólida para una biblia de personaje:
Sección
Ejemplo de entrada
Edad y complexión
"principios de los treinta, complexión delgada y atlética"
Piel
"piel oliva cálida con pecas naturales"
Ojos
"ojos almendrados castaño miel, pestañas largas y oscuras de forma natural"
Cabello
"cabello castaño suave con ondas naturales sueltas hasta los hombros"
Marcas distintivas
"peca tenue cerca del labio superior izquierdo"
Seed
"seed: 39482817"
Cada generación empieza con este bloque exacto antes de que siga cualquier descripción de escena. Cuanto más distintiva y específica sea cada entrada, menos margen tiene el modelo para desviarse.
La anatomía de un prompt coherente
La fórmula que da los mejores resultados con el rostro bloqueado sigue esta estructura:
El bloque del personaje siempre va primero. Los modelos procesan los tokens en orden y dan más peso a los anteriores. Si colocas la descripción del personaje después de los detalles de la escena, la escena domina y el rostro se desvía. Poner el bloque del personaje al principio mantiene el rostro como ancla principal.
Sé específico con los detalles étnicos y faciales, no genérico. "Ojos marrones" produce mucha más variación que "ojos almendrados castaño miel con pestañas largas y oscuras de forma natural". Cuanto más único y preciso sea cada descriptor, más se reduce el espacio de generación y más constante será el resultado.
Entrenamiento de LoRA: enseñarle al modelo a tu personaje
Qué hace el entrenamiento de LoRA
LoRA (Low-Rank Adaptation) es un proceso de ajuste fino que enseña a un modelo base a reconocer y reproducir una identidad visual concreta. Proporcionas entre 10 y 25 imágenes de referencia del mismo rostro, y el entrenador genera un pequeño archivo adaptador que modifica las salidas del modelo hacia esa identidad.
Después del entrenamiento, invocas el LoRA en tus prompts con una palabra desencadenante, y el modelo genera de forma constante ese rostro sin importar los cambios de escena o de iluminación. Conserva la estructura ósea, la textura de la piel, la forma de los ojos y las marcas distintivas en todas las imágenes.
Los resultados son mucho más estables que los que se obtienen solo con anclaje de prompt o con seeds. Un LoRA bien entrenado puede poner ese mismo rostro en una playa, en una sala de juntas o en un atardecer atmosférico, con la misma geometría cada vez.
Entrena un LoRA en PicassoIA
P Image Trainer gestiona el entrenamiento de LoRA directamente en el navegador, sin necesidad de GPU local ni configuración técnica. El proceso:
Reúne entre 15 y 20 imágenes de referencia de tu personaje (con distinta iluminación, ángulos y expresiones)
Sube las imágenes a P Image Trainer
Define una palabra desencadenante única, como "aurelia_companion"
Inicia el entrenamiento (normalmente entre 15 y 30 minutos)
Usa el LoRA entrenado en P Image LoRA incluyendo tu palabra desencadenante en cada prompt
Para entrenar modelos basados en Qwen, Qwen Image LoRA Trainer Legacy ofrece resultados sólidos en la coherencia de retratos fotorrealistas.
Qué hace buenos los datos de entrenamiento:
Múltiples ángulos del rostro: de frente, tres cuartos y perfil
Iluminación variada pero coherente entre las imágenes
Expresiones distintas: neutra, sonriendo, mirando hacia otro lado
Ningún otro rostro dominante en las imágenes de entrenamiento
Imágenes nítidas y bien enfocadas en todo momento
💡 15 imágenes nítidas y con ángulos variados superarán siempre a 40 imágenes borrosas y con ángulos parecidos. La calidad frente a la cantidad se aplica directamente a los datos de entrenamiento.
Los mejores modelos para la coherencia del rostro
No todos los modelos gestionan la coherencia de personajes de la misma forma. Algunos están diseñados de manera más adecuada para mantener la identidad facial en prompts variados.
Image 01 de Minimax
Image 01 se diseñó específicamente para generar personajes coherentes. Su descripción lo dice claro: "Generar imágenes coherentes de personajes". Gestiona solicitudes con varias imágenes en las que el personaje debe verse idéntico en distintas poses y escenarios, con mucha menos deriva que los modelos de uso general.
Si tu objetivo principal es mantener a una sola compañera en una serie de fotos, Image 01 es el primer modelo que vale la pena probar en tu flujo de trabajo.
Flux Redux Dev para variaciones de imagen
Flux Redux Dev crea variaciones de imagen a partir de una imagen de origen. Dale tu mejor retrato de personaje, el más fiel, y genera nuevas escenas y poses mientras la identidad facial se mantiene anclada al original. Funciona como una herramienta de coherencia de imagen a imagen: la imagen de referencia conserva el rostro y el prompt controla lo que cambia.
Esto es muy potente para la fotografía de compañeras, porque partes de una imagen real del rostro y no de una descripción en texto.
RealVisXL v3 Multi ControlNet LoRA
RealVisXL v3 Multi ControlNet LoRA combina el render fotorrealista con la guía de estructura de ControlNet y la personalización con LoRA, todo a la vez. Puedes darle una referencia de pose y un LoRA de rostro al mismo tiempo, logrando coherencia de personaje y control preciso de la pose en una sola generación.
Para series de retratos en las que tu compañera tenga que aparecer en posiciones corporales concretas a lo largo de varias imágenes, esta combinación es extremadamente eficaz.
Qwen Image 2512 para rostros realistas
Qwen Image 2512 está diseñado específicamente para "Texto más nítido, rostros realistas". Los detalles faciales finos se renderizan con gran fidelidad: la textura de los poros, formas de ojos concretas y la variación natural de la piel se ven con claridad. Es una opción sólida cuando tu biblia de personaje incluye rasgos distintivos complejos que no puedes permitirte difuminar.
Seedream 5 Pro para la máxima calidad de salida
Seedream 5 Pro ofrece salidas de retrato nítidas en 2K. Combinado con una biblia de personaje precisa y bloqueada y un seed fijo, maneja la generación de retratos con una calidad visual excepcional. Úsalo cuando la calidad final de la imagen importe tanto como el bloqueo de identidad.
Usar imágenes de referencia como anclas
El método de imagen a imagen
Una vez que tienes un retrato perfecto, cada imagen posterior debería partir de ese retrato y no solo del texto. La generación de imagen a imagen toma tu referencia como entrada y aplica descripciones nuevas en el prompt, mientras conserva la identidad visual de la imagen de origen.
El parámetro de fuerza controla cuánto se aleja el modelo de la imagen de origen:
0,2 a 0,4: muy cercano al original, solo cambios mínimos
0,5 a 0,6: cambios moderados, la ropa y el escenario pueden cambiar de forma convincente
0,7 a 0,85: más libertad creativa, la identidad del rostro empieza a aflojarse
Para lograr coherencia con tu compañera, moverte en el rango de 0,4 a 0,6 te da variación suficiente para nuevas escenas sin perder el rostro.
PicassoIA Image Editor Pro gestiona los flujos de imagen a imagen con créditos de generación ilimitados, lo que lo hace ideal para iterar en varias escenas sin presión por el uso.
Inpainting para cambios de escena
En lugar de regenerar la imagen completa, el inpainting te permite cambiar regiones concretas mientras todo lo demás queda bloqueado. Cambia el fondo. Cambia la ropa. Cambia la hora del día. El rostro se mantiene completamente intacto porque nunca lo enmascaraste.
El flujo de trabajo es sencillo:
Empieza con tu mejor retrato de personaje
Enmascara solo la región que quieres cambiar (fondo, ropa, entorno)
Describe en el prompt cómo debe verse la nueva región
Genera, con las regiones no enmascaradas conservadas exactamente igual
P Image Edit gestiona el inpainting con ediciones de menos de un segundo y una iteración rápida. Para una edición más compleja de regiones combinada con personalización LoRA, Qwen Image Edit Plus LoRA mantiene la identidad coherente durante los cambios quirúrgicos de escena.
💡 La regla de oro del inpainting: nunca incluyas el rostro en la máscara a menos que estés corrigiendo específicamente el rostro. Cada vez que repintas la región del rostro, arriesgas una desviación.
Modelos 3D como ancla de coherencia
Crear una versión 3D de tu compañera añade una dimensión de coherencia que la generación de texto a imagen simplemente no puede igualar: proporciones faciales geométricamente fijas que existen en un espacio tridimensional real. Renderiza desde cualquier ángulo, con cualquier iluminación, y la estructura ósea sigue siendo físicamente correcta.
Create Character v1 en PicassoIA crea automáticamente el rigging de un personaje 3D a partir de una imagen de referencia, lo que te da un doble digital posable. Los fotogramas renderizados con este modelo son imágenes de entrada ideales para la generación de imagen a imagen, porque la geometría del rostro es siempre idéntica sin importar el ángulo de visión.
Hunyuan 3D 3.1 convierte fotografías en modelos 3D con alta fidelidad, y Rodin se especializa en generar recursos 3D utilizables a partir de fuentes fotográficas. Ambos te dan algo que ningún seed ni prompt puede ofrecer: una geometría tridimensional coherente del rostro de tu personaje para usarla como ancla de referencia permanente.
Este enfoque funciona especialmente bien con compañeras que aparecen en posiciones corporales muy variadas, porque la geometría 3D maneja la rotación sin las distorsiones que a veces introduce la imagen a imagen basada en prompts.
Combinar métodos: el conjunto de varias capas
Ningún método, por sí solo, da una coherencia perfecta. Los resultados más sólidos llegan al combinar varios métodos en el mismo flujo de trabajo:
Método
Nivel de coherencia
Mejor caso de uso
Solo bloqueo de semilla
Bajo a medio
Mismo prompt, variaciones menores
Solo biblia de personaje
Medio
Escenas variadas con una descripción estable
Semilla + biblia de personaje
Medio a alto
Control total del prompt con estabilidad
Imagen a imagen
Alto
Cambios de escena a partir de un retrato de referencia
Entrenamiento de LoRA
Muy alto
Series de fotos largas
LoRA + inpainting
El más alto
Cambios quirúrgicos, conservación perfecta del rostro
Para una compañera usada en una serie de contenido o en un proyecto narrativo, el conjunto recomendado es: entrenamiento de LoRA + biblia de personaje + inpainting para los cambios de escena individuales. Cada capa gestiona un tipo distinto de variación, y juntas cubren casi todos los fallos posibles.
Usar modelos de lenguaje para crear mejores prompts
Escribir desde cero una biblia del personaje detallada y coherente requiere mucha reflexión. Los modelos de lenguaje (LLM) pueden ayudar a crearla más rápido y con más detalle que hacerlo a mano.
Ampliar una descripción breve del personaje hasta convertirla en un prompt de imagen completo y detallado
Generar descripciones de escena variadas manteniendo el bloque del personaje sin cambios
Revisar la coherencia de los prompts en un lote de generaciones planificadas
Sugerir nuevos escenarios que encajen con la estética establecida de tu personaje
Escribir descripciones físicas precisas que reduzcan la variación del modelo
El flujo de trabajo más eficiente: escribe tu biblia de personaje una vez, idealmente con ayuda de un modelo de lenguaje para alcanzar el nivel de especificidad que reduce la variación de la generación, y luego bloquéala de forma permanente. Ese bloque ya no vuelve a cambiar.
Superresolución para el detalle final
Incluso un personaje bien bloqueado se beneficia de una pasada de nitidez al final, sobre todo en retratos en primer plano, donde importa la textura facial fina.
Clarity Pro Upscaler realiza un escalado con IA fotorrealista que añade detalle de textura fina sin cambiar la identidad facial. El detalle de los poros, los mechones de cabello individuales y la profundidad de la textura de la piel mejoran sin que el rostro se desplace. Es el último paso que hace que los retratos con IA parezcan de verdad fotografías.
Increase Resolution de Bria gestiona el escalado de 2x a 4x con preservación del rostro integrada en su lógica de procesamiento. Es la opción más segura cuando quieres dimensiones de salida mayores sin ningún riesgo de que el modelo alucine detalles faciales nuevos.
Ambas herramientas encajan de forma natural al final del flujo de coherencia: genera la imagen con el rostro bloqueado usando tu conjunto de métodos y luego aplica escalado para finalizarla.
Crea tu compañera en PicassoIA
Lo más difícil es el primer retrato. Una vez que tienes una imagen en la que el rostro está exactamente bien, el resto del flujo de trabajo se deriva de ella de forma natural. Empieza con Image 01 para tus primeras tomas del personaje, porque su arquitectura orientada a la coherencia hace que la primera sesión sea más productiva. Escribe la biblia de tu personaje durante esa primera sesión, mientras los prompts están frescos y los resultados son visibles.
Después, entrena tu LoRA con esas primeras imágenes como conjunto de datos. A partir de ese momento, tu compañera tiene una identidad visual permanente que la acompaña a cualquier escena, cualquier escenario, cualquier historia que quieras contar.
Explora la colección completa de modelos en picassoia.com/en/all-models, elige tu modelo de partida y crea la compañera que has imaginado, con cada generación igual a la anterior.