El video vertical ya lo domina todo. TikTok, Instagram Reels, YouTube Shorts: el formato 9:16 es donde está la atención, y las fotos fijas ya no bastan. Con Wan 2.7 I2V en PicassoIA, puedes convertir cualquier fotografía en un clip de video vertical fluido y realista en minutos, sin tocar una sola línea de tiempo de edición.
Este no es un proceso lento de animación fotograma a fotograma. Wan 2.7 Pro lee la iluminación, la profundidad y la posición del sujeto de tu foto, y genera un movimiento fluido que hace que la escena original parezca haber estado siempre en movimiento. El pelo se mueve con suavidad. La luz cambia. El entorno respira. El resultado es un video que parece grabado, no fabricado.
Qué hace realmente Wan 2.7 Pro
La brecha entre las fotos y el video
La mayoría de los creadores tienen miles de fotos sin usar. Buenas tomas de una sesión que nunca llegaron a publicarse porque las plataformas favorecen el video. Wan 2.7 Pro cierra esa brecha tratando tu foto como el primer fotograma de un video y generando todo lo que ocurre después.
El modelo no se limita a hacer zoom o un paneo sobre la imagen. Ese enfoque tipo efecto Ken Burns produce un movimiento evidentemente falso que los espectadores reconocen de inmediato. En cambio, Wan 2.7 I2V usa un proceso de difusión entrenado con enormes conjuntos de datos de video para predecir movimiento temporal realista: cómo se mueve el agua en ondas, cómo cae y se mueve la tela, cómo podría cambiar la expresión de una persona en los siguientes cinco segundos. El resultado es una conversión de imagen a video de estilo cinematográfico que se sostiene incluso en una salida vertical de 1080p.

Por qué el formato vertical lo cambia todo
El video horizontal es lo que la gente espera en YouTube o en pantallas de escritorio. El video en modo retrato (9:16) es lo que detiene el pulgar en TikTok y Reels. El problema siempre ha sido que la mayoría de los fotógrafos profesionales disparan en orientación horizontal, y recortar una foto horizontal a 9:16 destruye la composición.
Wan 2.7 I2V elude esto por completo. Puedes subir una foto en orientación vertical y obtener una salida nativa 9:16. Puedes subir una foto cuadrada u horizontal y usar los ajustes de recorte del modelo para centrarte en el sujeto. Incluso puedes dejar que el modelo amplíe el contexto de forma natural para que el encuadre vertical parezca intencionado, no recortado. Por eso la combinación de una buena foto de retrato con Wan 2.7 I2V produce mejor contenido para redes sociales que la mayoría de los videos verticales grabados con el teléfono.
El modelo Wan 2.7 I2V, explicado
Qué lo diferencia de las versiones anteriores de Wan
La familia Wan ha avanzado rápido. Wan 2.5 I2V introdujo un condicionamiento por imagen fiable. Wan 2.6 I2V mejoró la coherencia del movimiento y manejó mejor los fondos complejos. Wan 2.7 Pro da otro salto en dos frentes concretos.
Fidelidad del movimiento: El movimiento del sujeto es más realista desde el punto de vista físico. La dinámica de la tela, el movimiento del pelo y las microexpresiones faciales ya no producen los sutiles artefactos de distorsión que mostraban a veces las versiones anteriores. Cuando introduces un retrato en el modelo, el movimiento resultante parece basado en cómo se movería esa persona concreta con esa luz concreta.
Adherencia al prompt: El modelo sigue los prompts de movimiento con más precisión. Si escribes "la cámara se acerca lentamente mientras el sujeto sonríe", Wan 2.7 Pro ejecuta tanto el movimiento de cámara como el cambio de expresión. Las versiones anteriores a menudo ignoraban uno de los dos elementos y recurrían a un movimiento ambiental genérico.
Estabilidad en modo retrato: La composición vertical es notablemente más limpia. Los modelos Wan anteriores se entrenaron sobre todo con videos horizontales, y eso a veces se notaba en la salida vertical, con artefactos cerca de los bordes del encuadre. Wan 2.7 Pro maneja el encuadre 9:16 de forma nativa, sin distorsión de la composición.
Especificaciones de resolución y salida
| Especificación | Valor |
|---|
| Formato de salida | MP4 |
| Resolución máxima | 1080p |
| Relación de aspecto vertical | 9:16 |
| Duración predeterminada del clip | 5 segundos |
| Fotogramas por segundo | 24 fps |
| Audio | Audio ambiental sincronizado nativo |
💡 Cinco segundos son más que suficientes para los ganchos de TikTok y las introducciones de Instagram Reels. Repite el clip en la app de edición que ya usas si necesitas más duración.

Cómo usar Wan 2.7 I2V en PicassoIA
PicassoIA te da acceso directo a Wan 2.7 I2V sin claves de API, sin configuraciones de GPU locales ni ajustes técnicos. Así se hace el proceso completo, desde la foto hasta el video publicado.
Paso 1: Sube tu foto de origen
Ve a la página del modelo Wan 2.7 I2V en PicassoIA y haz clic en el campo de subida de imagen.
Lo que mejor funciona:
- Fotos en orientación vertical (tomadas en 9:16 o 4:5)
- Mínimo 1024 px en el lado corto
- Formato JPEG o PNG
- Fotos con un sujeto claro y un fondo identificable
Lo que conviene evitar:
- Artefactos fuertes de compresión, que el modelo detecta y amplifica en el movimiento
- Fotos muy oscuras o muy sobreexpuestas, ya que la generación de movimiento depende de leer la profundidad de la escena
- Fotos con mucho texto en el encuadre, porque el texto se distorsiona de forma impredecible al generar video
Paso 2: Escribe tu prompt de movimiento
Aquí es donde más usuarios se quedan cortos. Un prompt débil produce un movimiento flotante y genérico. Un prompt sólido produce exactamente el video que tenías en mente.
El modelo responde mejor a prompts que describen qué se mueve, cómo se mueve y qué hace la cámara, en ese orden.
Prompt débil: "mujer hermosa caminando"
Prompt sólido: "el pelo de la mujer se mueve suavemente con una brisa leve desde la izquierda, ella gira ligeramente la cabeza hacia la cámara con una sonrisa tranquila, toma de travelling lento hacia adelante, luz cálida de la mañana"
Mantén los prompts por debajo de 80 palabras. El modelo maneja bien la especificidad, pero pierde precisión cuando los prompts superan un párrafo.
Paso 3: Configura el formato en vertical
En el desplegable de relación de aspecto, selecciona 9:16. Si tu foto de origen ya está en orientación vertical, el modelo usa todo el encuadre. Si es horizontal, el modelo recortará al centro sobre el sujeto por defecto. Para una salida de mayor calidad, selecciona 1080p en el campo de resolución. La generación tarda algo más, pero la diferencia de nitidez es notable cuando el video se reproduce a pantalla completa en un teléfono.
Paso 4: Genera y descarga
Haz clic en Generar. Wan 2.7 I2V suele completarse en 60 a 120 segundos en la infraestructura de GPU de PicassoIA. Previsualiza el video en el reproductor integrado antes de descargarlo para detectar artefactos a tiempo. Si el movimiento parece demasiado exagerado o demasiado sutil, ajusta el control deslizante de intensidad de movimiento y vuelve a generar.

Escribir prompts que dan resultados
Palabras de movimiento que funcionan
El modelo Wan 2.7 I2V tiene una fuerte asociación con un vocabulario de movimiento concreto. Estas palabras producen siempre mejores resultados:
| Tipo de movimiento | Palabras eficaces para el prompt |
|---|
| Pelo y tela | "brisa suave", "viento suave desde la izquierda", "la tela ondula" |
| Cámara | "travelling lento hacia adelante", "empuje sutil", "paneo suave a la derecha", "toma fija" |
| Iluminación | "cambio de luz de hora dorada", "pasa la sombra de una nube", "parpadeo de luz cálida" |
| Sujeto | "giro leve de la cabeza", "exhalación suave", "los ojos se desplazan a la izquierda", "los labios se separan levemente" |
| Entorno | "las hojas crujen", "el agua brilla", "el humo sube" |
💡 Combina un movimiento del sujeto, un movimiento de cámara y una condición de iluminación para obtener la máxima calidad. Tres elementos son el punto ideal. Con más de cinco, el resultado se diluye.
Describir el movimiento de cámara con precisión
El movimiento de cámara es la capacidad más fiable del modelo. Estas frases funcionan siempre:
- "travelling lento hacia adelante": la cámara se acerca poco a poco al sujeto durante la duración del clip
- "grúa suave hacia arriba": la cámara se eleva ligeramente y revela más fondo en la parte superior del encuadre
- "cambio de foco sutil": el fondo se desenfoca progresivamente durante el clip, como si se reenfocara a mitad de toma
- "toma fija": ningún movimiento de cámara, ideal para retratos en los que el sujeto es el único elemento en movimiento
Errores habituales que arruinan la calidad
Sobrecargar el prompt: Pedir demasiadas acciones simultáneas produce un caos visual. Si quieres que se mueva el pelo, gire la cabeza, la cámara avance y cambie la luz a la vez, el modelo cederá en todas ellas. Elige dos o tres elementos clave.
Describir el resultado final en lugar de la acción: "Video cinematográfico precioso" no le dice nada útil al modelo. "Las hojas revolotean suavemente de fondo mientras la mirada del sujeto pasa lentamente de fuera de cámara a mirar de frente, travelling lento hacia adelante" le da indicaciones concretas.
Poner lenguaje negativo en el prompt principal: Escribir "sin temblor, sin desenfoque" en el campo de prompt principal no suprime de forma fiable esos comportamientos. Usa el campo de prompt negativo si la interfaz lo ofrece, o formula tu prompt con lenguaje positivo y específico sobre lo que quieres.
Ignorar la calidad de la imagen de origen: El modelo no puede inventar detalles que no estén en la foto. Una fuente borrosa produce un video borroso. Un JPEG muy comprimido produce artefactos en bloques en el video. Las salidas de mayor calidad siempre salen de fotos nítidas y bien expuestas.

Las mejores fotos para usar como entrada
Orientación vertical frente a horizontal
Las tomas en vertical se convierten de la forma más natural en video vertical. Cuando la composición se diseñó para verse en vertical (sujeto centrado, fondo que encuadra arriba y abajo), la salida 9:16 parece intencionada. Las fotos horizontales también pueden funcionar, pero requieren escribir prompts con cuidado para gestionar el recorte. Si tu sujeto está en el tercio izquierdo del encuadre, especifica "centrarse en el sujeto de la izquierda, la cámara se mueve ligeramente a la derecha" para evitar que el modelo recurra a un recorte central que deje fuera a tu sujeto.
Condiciones de iluminación que funcionan
La hora dorada natural produce el movimiento más cálido y orgánico. El degradado de luz de cálida a fría a esa hora del día le da al modelo información de profundidad sólida con la que trabajar, lo que se traduce en un paralaje y una separación entre sujeto y fondo más convincentes en el video.
La luz suave de día nublado crea una iluminación uniforme que el modelo maneja de forma predecible. El movimiento tiende a ser más limpio, con menos artefactos alrededor de los bordes del sujeto.
La luz solar directa y dura es la condición más difícil. Las sombras profundas y de alto contraste crean zonas con detalle perdido que el modelo tiene que inventar, lo que a veces produce un movimiento de relleno poco realista durante la generación del video.
La iluminación de estudio en interior funciona bien cuando la configuración es de tres puntos o con softbox. La iluminación interior plana y de bajo contraste procedente de una única fuente cenital tiende a producir un video plano, con poca profundidad percibida.
💡 Si tienes una foto tomada con sol de mediodía muy intenso, prueba primero las herramientas de superresolución de PicassoIA para recuperar el detalle de los bordes antes de pasarla a Wan 2.7 I2V.
Resolución y formato de archivo
El modelo extrae más información de la escena de las imágenes de origen más grandes. Recomendaciones mínimas:
- Retratos: 1024 x 1820 px o más para una salida 9:16 nativa
- Tomas de entorno: 1080 x 1920 px o más
- Fotos de producto: 1024 x 1024 px o más (sube un origen 1:1 y luego especifica una salida 9:16 en el modelo)
El formato PNG conserva el máximo detalle sin pérdida para que el modelo lo procese. El JPEG con una calidad del 90 % o superior también es fiable. Evita las fotos exportadas con una calidad JPEG inferior al 80 %, porque los artefactos de compresión se notarán en la salida de video.

Wan 2.7 Pro frente a otros modelos de video
Frente a Wan 2.6 I2V
Wan 2.6 I2V es un predecesor sólido que muchos creadores siguen usando para generación en lote. Las diferencias entre la 2.6 y la 2.7 son notables, pero no espectaculares:
| Característica | Wan 2.6 I2V | Wan 2.7 I2V |
|---|
| Estabilidad en modo retrato | Buena | Notablemente mejor |
| Realismo del movimiento | Sólido | Más preciso físicamente |
| Adherencia al prompt | Moderada | Más fuerte |
| Velocidad de generación | Algo más rápida | Algo más lenta |
| Resolución máxima | 1080p | 1080p |
Si generas lotes grandes y la velocidad importa más que el pico de calidad, Wan 2.6 I2V sigue siendo una opción sólida. Para una salida de calidad final destinada a publicarse, Wan 2.7 Pro merece el tiempo de generación extra.
Frente a Kling v2.6 y Kling v3 Video
Kling v2.6 y Kling v3 Video ofrecen una calidad cinematográfica excepcional, sobre todo en secuencias de movimiento dramáticas. Son opciones muy buenas para video en formato horizontal, pero muestran resultados menos constantes en salidas verticales (9:16) en comparación con Wan 2.7 Pro. Para contenido social vertical en concreto, Wan 2.7 Pro tiene una ventaja clara. Para narrativa cinematográfica en pantalla panorámica, Kling v3 Video puede dar resultados más dramáticos.
Frente a Hailuo 02 y Pixverse v5
Hailuo 02 destaca por su generación rápida y es ideal para prototipar y generar ideas rápidamente. La calidad de la salida es inferior a la de Wan 2.7 Pro en trabajos detallados con retratos, pero la ventaja de velocidad es real cuando haces muchas iteraciones. Pixverse v5 produce video visualmente vivo, pero tiende a una estética ligeramente procesada y de saturación muy alta. Para una conversión de foto a video fotorrealista y sin procesar que se mantenga fiel a la imagen de origen, Wan 2.7 Pro ofrece resultados más limpios.

Casos de uso reales que vale la pena probar
Contenido de TikTok a partir de fotos de producto
Las marcas de comercio electrónico y los pequeños empresarios fotografían sus productos constantemente. Las fotos estáticas de producto pasan de largo en TikTok en un instante. Convertir la misma foto en un clip de cinco segundos (quizá el producto girando ligeramente, o el envoltorio captando un cambio de luz) mejora el contenido de inmediato sin el presupuesto de una grabación de video.
Ejemplo de prompt para fotos de producto: "el producto gira 15 grados en sentido horario sobre su sitio, la luz ambiental del estudio pasa de cálida a fría sobre la etiqueta, un leve cambio de enfoque de profundidad hacia el texto frontal, cámara fija"
Instagram Reels a partir de fotografía de retrato
Los fotógrafos de retrato que quieren reutilizar su trabajo en Reels pueden convertir cada imagen en un clip corto: un leve giro de cabeza, una sonrisa suave que se forma, el pelo moviéndose con la brisa, un travelling lento hacia los ojos. Estos clips en Reels superan siempre a las publicaciones estáticas en alcance y en descubrimiento del perfil.
Ejemplo de prompt para retratos: "la mirada del sujeto pasa lentamente de estar ligeramente fuera de cámara a un contacto visual directo, se forma una sonrisa sutil en las comisuras de la boca, el pelo se mueve suavemente con una brisa leve desde la izquierda, cambio de foco lento del fondo al rostro"
YouTube Shorts a partir de fotografía de viajes y estilo de vida
Los creadores de contenido que construyen canales de YouTube Shorts en torno a la fotografía, los viajes o el estilo de vida pueden convertir por lotes sus imágenes más potentes en clips de video cortos con Wan 2.7 I2V. Añade a cada clip una narración con los modelos de texto a voz de PicassoIA y una pista de fondo de las herramientas de generación de música con IA, y tendrás un Short terminado sin grabar nada nuevo.
💡 Genera 10 clips verticales a partir de tus mejores fotos, añade audio ambiental con las herramientas de audio de PicassoIA y programa un Short al día durante dos semanas. Todo el lote se produce en una tarde.

Cuándo usar Wan 2.7 R2V en su lugar
Wan 2.7 R2V (de referencia a video) es un modelo relacionado de la misma familia que conviene conocer. Mientras que I2V usa tu imagen como primer fotograma del video y anima desde ahí hacia adelante, R2V la usa como referencia visual para el estilo, el aspecto de los personajes y la composición de la escena, sin fijar el video a ese fotograma inicial exacto.
Usa Wan 2.7 I2V cuando: Quieres que el video empiece exactamente desde tu foto y se anime hacia adelante. El sujeto, el fondo y la composición coinciden con la imagen de origen en el primer fotograma.
Usa Wan 2.7 R2V cuando: Quieres generar contenido de video nuevo que coincida con el aspecto, el personaje o el entorno de tu foto de referencia, pero con poses, ángulos de cámara o secuencias de acción distintos que no aparecen en el original.
También existe Wan 2.7 T2V para generar contenido de video totalmente nuevo a partir de una descripción de texto, sin imagen de origen. Las tres variantes de Wan 2.7 cubren todos los puntos de partida: solo texto, imagen de referencia o animación directa de una foto. Para contenido social vertical construido a partir de fotografía existente, I2V casi siempre es el punto de partida correcto.

Más modelos de video en PicassoIA
Si quieres crear videos verticales sin una foto de origen, PicassoIA ofrece más de 100 modelos de texto a video junto a la familia Wan 2.7. Opciones destacadas para crear contenido vertical:
- Seedance 2.0: el modelo insignia de ByteDance, con generación de audio sincronizado integrada, excelente para contenido impulsado por la música
- Kling v3 Omni Video: produce salida cinematográfica de 1080p a partir de texto, muy útil para narrativa dramática y storytelling
- Hailuo 02: generación rápida con calidad sólida, ideal para iterar rápido cuando necesitas volumen más que el pico de calidad
- LTX 2 Pro: modelo de video 4K de alta calidad de Lightricks para creadores que necesitan la máxima resolución de salida
- PicassoIA Video: el generador de video gratuito e ilimitado de la plataforma, perfecto para experimentar sin preocuparte por los créditos
Estas herramientas y Wan 2.7 I2V coexisten en la misma interfaz, lo que significa que nunca tienes que elegir entre animar una foto existente o generar algo totalmente nuevo. Ambos flujos están a un clic. Explora el catálogo completo en picassoia.com/en/all-models.

Empieza a crear con tus fotos
Todo fotógrafo tiene un disco duro lleno de imágenes que nunca encontraron público. Wan 2.7 I2V da a esas fotos una segunda vida en el formato que las plataformas sociales premian ahora mismo.
La barrera es baja: sube una foto, escribe una descripción de movimiento de unas 30 palabras, selecciona 9:16 a 1080p y haz clic en generar. En menos de dos minutos tendrás un clip de video vertical que parece grabado específicamente para redes sociales. Sin equipo de rodaje. Sin estudio de edición. Sin grabaciones adicionales.
Ve a PicassoIA y abre Wan 2.7 I2V. Elige tu mejor toma de retrato, escribe un prompt de movimiento usando el vocabulario y la estructura que hemos visto y lanza la primera generación. Ese primer clip te dirá exactamente lo que este modelo puede hacer con tu estilo fotográfico, tus sujetos y tu iluminación concretos.
Tus fotos ya tienen la calidad. Wan 2.7 Pro aporta el movimiento.