La pantalla de un teléfono tiene una física extraña. Tu pulgar se mueve más rápido que tus ojos, y un clip tiene cerca de medio segundo para convencer a ese pulgar de que se detenga. Wan 2.7 es uno de los pocos modelos de video con IA que de verdad respeta esa limitación, y cuando lo tratas como una herramienta pensada primero para la vertical, y no como una adaptación estirada de 16:9, la diferencia se nota en tus curvas de retención. Este artículo repasa los patrones de prompt, las tácticas de relación de aspecto, los movimientos de cámara y las elecciones de versión que producen de forma constante clips listos para el teléfono, de los que se vuelven a ver en lugar de los que se descartan deslizando.
Por qué la vertical gana en el teléfono
El video de formato corto ya no es una tendencia. Es lo habitual. TikTok, Instagram Reels, YouTube Shorts, Snap Spotlight, Pinterest Idea Pins e incluso LinkedIn premian ahora los clips en vertical con una distribución medible mayor que la de sus equivalentes en 16:9. Si publicas en horizontal y dependes de un recorte del feed, le das al algoritmo una razón menos para difundir tu contenido.
El hábito del 9:16 es permanente
La gente sostiene el teléfono de una sola manera. Solo lo gira a horizontal para películas largas, deportes y alguna sesión de videojuegos ocasional. Todo lo demás, incluida la mayor parte del tiempo en redes sociales y mensajería, ocurre en vertical. Ese hábito dio forma a toda la economía de creadores, y cualquier flujo de trabajo con IA que lo ignore está luchando contra la memoria muscular.
Dónde vive el video vertical
| Superficie | Relación nativa | Duración típica |
|---|
| TikTok | 9:16 | 7 a 60 segundos |
| Instagram Reels | 9:16 | 7 a 90 segundos |
| YouTube Shorts | 9:16 | hasta 60 segundos |
| Snap Spotlight | 9:16 | hasta 60 segundos |
| LinkedIn vertical | 9:16 | 15 a 60 segundos |
Fíjate en el patrón. Todos los feeds modernos quieren la misma forma y más o menos la misma duración. Wan 2.7 encaja bien en ese punto dulce de 5 a 10 segundos por clip, que es justo la duración de un buen momento de historia.

Lo que Wan 2.7 aporta de verdad
Wan 2.7 es el último salto de la familia Wan de código abierto, del laboratorio Tongyi de Alibaba, y en PicassoIA se ofrece en tres versiones. Cada una resuelve un problema ligeramente distinto, y elegir bien importa más en vertical que en horizontal, porque el teléfono no perdona nada en el tercio inferior del encuadre.
Salida en 1080p sin concesiones
Wan 2.7 renderiza en 1080p completo, lo que en un lienzo vertical equivale a unos 1080 por 1920 píxeles de resolución útil antes de que las plataformas sociales vuelvan a comprimir el archivo. Ese margen es justo lo que necesitas cuando tu miniatura va a ser republicada, grabada desde pantalla y remezclada por otros creadores. Las alternativas de menor resolución se emborronan en cuanto pasan una segunda vez por el codificador de TikTok.
Tres versiones, tres funciones
Hay tres endpoints de Wan 2.7 en PicassoIA, y se corresponden claramente con tres problemas creativos:
- Wan 2.7 T2V para momentos de texto a video, cuando tienes una idea pero aún no tienes una imagen de origen.
- Wan 2.7 I2V para animar una foto fija que ya te encanta y convertirla en un clip de 5 a 10 segundos.
- Wan 2.7 R2V para generación basada en referencias, cuando quieres que un sujeto concreto aparezca a lo largo del movimiento.
La mayoría de los errores de principiante vienen de elegir la versión equivocada. Lo veremos a continuación.

Reglas de composición pensadas para el teléfono
La diferencia más grande entre un director de fotografía horizontal y un creador vertical está en dónde vive la composición. La vertical es un corredor alto, no un escenario ancho. Wan 2.7 lee las pistas de relación de aspecto de tu prompt y de la imagen de origen cuando usas I2V, así que escribir pensando en la forma da resultados de inmediato.
Zonas seguras para los subtítulos
En TikTok y Reels, el 18 por ciento inferior de la pantalla queda parcialmente tapado por nombres de usuario, subtítulos y etiquetas de música. El 8 a 10 por ciento superior lo ocupan la barra de estado y los relojes superpuestos. Todo lo importante debe estar en el 70 por ciento central.
💡 Consejo: Cuando escribas el prompt de Wan 2.7, menciona de forma explícita "sujeto centrado en la parte media superior del encuadre" o "acción principal en el tercio vertical central". El modelo respeta estas palabras espaciales mucho mejor que frases vagas como "bien compuesto".
Rostros en el tercio superior
Los rostros venden el video vertical. Los ojos cerca del tercio superior del encuadre producen las puntuaciones más altas de tiempo de visualización en casi todos los benchmarks de formato corto que siguen los editores. Al escribir prompts para Wan 2.7 T2V o I2V, trata la línea de los ojos como un elemento que sostiene todo. Dilo expresamente. Prueba con una frase como "ojos del sujeto cerca del tercio superior, mirando ligeramente fuera de cuadro".

Escribir prompts que funcionan
Wan 2.7 responde mejor a prompts que se leen como una lista corta de planos y no como un párrafo de adjetivos de moodboard. El modelo tiene fuertes prioridades de movimiento nativas, así que describir exactamente qué se mueve, en qué orden y cómo reacciona la cámara te lleva el 80 por ciento del camino hacia una toma usable a la primera.
El patrón de prompt en tres bloques
Una estructura fiable para cualquier prompt de Wan 2.7 es esta:
- Bloque de sujeto. Quién o qué aparece en el encuadre, con detalle físico concreto.
- Bloque de movimiento. Qué ocurre a lo largo de la ventana de cinco segundos, en orden cronológico.
- Bloque de cámara y aspecto. Cómo se mueve la cámara y qué transmite la iluminación.
Un ejemplo real:
Una joven surfista con traje de neopreno negro encera su tabla en la orilla al amanecer. Se pone de pie, se coloca la tabla bajo el brazo y camina directamente hacia las olas que rompen. Travelling lento hacia delante desde un ángulo bajo a ras del agua, luz de contraluz cálida de la hora dorada desde la derecha, grano de película suave, fotorrealista.
Ese prompt, introducido en Wan 2.7 T2V, producirá un clip vertical de composición muy cuidada sin ninguna dificultad. Fíjate en que no hay contradicciones ni palabras abstractas de estilo haciendo el trabajo pesado.
Palabras que a Wan 2.7 le encantan
Estos términos sesgan de forma constante la salida hacia imágenes útiles y listas para el teléfono:
- "composición de retrato vertical"
- "profundidad de campo reducida"
- "luz solar natural"
- "en mano, movimiento sutil"
- "plano de seguimiento"
- "rodado en película"
- "realismo documental"
Palabras que conviene eliminar
Estas perjudican más de lo que ayudan, sobre todo en vertical:
- "épico"
- "cinematic 4K hyperrealistic ultra detailed"
- "8K obra maestra"
- "trending on artstation"
El relleno de adjetivos apilados funcionaba en los modelos de difusión antiguos. El codificador de texto de Wan 2.7 trata esos términos como ruido y diluye el resto de tu prompt.

Elegir la versión adecuada de Wan 2.7
Aquí es donde más tropiezan los creadores de formato corto. Las tres versiones no son intercambiables, y usar la equivocada para tu idea cuesta renders y tiempo.
Solo prompts de texto
Si solo tienes un concepto escrito y ninguna imagen de referencia, recurre a Wan 2.7 T2V. El texto a video funciona mejor cuando:
- Quieres total libertad creativa en el diseño del sujeto.
- La toma trata más de la atmósfera que de una persona concreta.
- Tu prompt describe un entorno genérico y no un personaje conocido.
Animar una sola foto
Cuando ya tienes una imagen que te encanta, la herramienta adecuada es Wan 2.7 I2V. La imagen a video conserva la composición exacta, la paleta de color y los rostros de tu fotograma de origen, y después añade movimiento encima. Es la forma más fiable de obtener clips verticales con la identidad de marca de un creador que ya tiene un aspecto visual definido.
💡 Consejo avanzado: Usa en I2V una imagen de origen que ya esté en 9:16. El modelo respeta match_input_image relación de aspecto y mantiene tu composición intacta. Enviarle una imagen 16:9 y pedir salida vertical es el camino más rápido hacia recortes torpes.
Flujos de trabajo con sujetos de referencia
Si la misma persona o el mismo producto deben aparecer en muchos clips, Wan 2.7 R2V es la opción correcta. La referencia a video acepta una imagen del sujeto y aplica el movimiento guiado por el prompt mientras mantiene la identidad. Los creadores de marca con un rostro o una mascota recurrentes trabajan con esta versión.
| Versión | Entrada | Mejor para |
|---|
| Wan 2.7 T2V | Solo texto | Clips conceptuales, atmósferas, escenas |
| Wan 2.7 I2V | Foto más texto | Animar un fotograma concreto que ya grabaste |
| Wan 2.7 R2V | Sujeto de referencia más texto | Persona o producto recurrente y coherente |

Movimientos de cámara que parecen cinematográficos
Vertical no significa estático. Wan 2.7 maneja muy bien un puñado de patrones de movimiento, y combinar cada uno con el sujeto adecuado es lo que da a tu clip un aire editorial en lugar de una sensación de presentación de diapositivas.
Travelling vertical hacia delante
Un empuje lento hacia el sujeto es la mejor apertura en el teléfono. Imita la forma en que nuestros ojos se fijan en un rostro en un feed abarrotado, y Wan 2.7 produce travellings muy suaves cuando los describes de forma explícita. Prueba esta frase: "travelling lento hacia delante desde la altura del pecho, terminando muy cerca de los ojos".
Inclinación lenta hacia arriba
Inclinar desde los pies hasta el rostro funciona de maravilla en vertical porque la trayectoria de la cámara coincide con la forma natural del encuadre. Úsala para presentaciones de moda, lanzamientos de zapatillas y baile de cuerpo entero.
Planos fijos
A veces el mejor movimiento es ningún movimiento de cámara. Bloquea el encuadre y deja que el sujeto haga el trabajo. Esto es especialmente potente en las introducciones de cabeza parlante, donde cualquier deriva aleja la atención de las palabras. Prueba: "trípode bloqueado, sin movimiento de cámara, el sujeto dice la línea directamente a la lente".

Elecciones de luz que sobreviven a la compresión
Los teléfonos comprimen mucho. Los cielos con degradados sutiles, los tonos de piel de bajo contraste y las caídas de sombra delicadas son justo lo primero que se come el codificador de TikTok. Pedirle a Wan 2.7 la luz adecuada desde el principio te ahorra una nueva grabación más adelante.
La hora dorada primero
La luz solar cálida y direccional es la opción más indulgente. Aguanta la compresión con la historia de color intacta, da a los rostros un contraluz favorecedor y hace que parezca una producción cara a los espectadores sin necesidad de corrección de color posterior.
Luz de ventana para escenas interiores
Para interiores, escribe "luz difusa de ventana grande desde la izquierda, caída suave" en lugar de mencionar marcas o equipos de estudio concretos. Los datos de entrenamiento de Wan 2.7 abundan en esta formulación y producen resultados naturales constantes.
Evita temperaturas de color mezcladas
Las temperaturas de color mezcladas confunden al modelo y al códec. Mantén una sola luz dominante por toma. Si quieres una sensación de atardecer con lámparas de vapor de sodio, escribe "única fuente de luz cálida de atardecer desde abajo a la derecha, sin luz de relleno". El resultado se limpia de forma notable.

Sincronizar el sonido sin audio nativo
Wan 2.7 genera video silencioso, lo que en realidad es una ventaja para el formato corto. Tú decides la música de cada clip, de modo que los puntos de corte encajan con el pulso que elijas en lugar de pelearse con una base de audio generada. Dos enfoques probados en la práctica:
Corta en el fotograma 24
Wan 2.7 renderiza a 24 fotogramas por segundo. Si tu música tiene un tiempo fuerte claro, coloca el primer corte duro exactamente en ese tiempo y haz que el pico de movimiento renderizado caiga en el mismo fotograma. El espectador lo siente aunque no sepa nombrarlo.
Ajusta el movimiento al tempo
Los travellings lentos van con 80 a 100 BPM. Los planos fijos van con cortes rápidos de 130 a 150 BPM. El seguimiento en mano rápido va con cualquier cosa por encima de 160. Elegir el movimiento adecuado para cada canción duplica el valor de producción percibido.

Cómo usar Wan 2.7 en PicassoIA
Tres guías rápidas explican cómo usar cada una de las tres versiones. Cada una supone que ya tienes una cuenta en PicassoIA y créditos en tu cartera.
Paso a paso para Wan 2.7 T2V
- Abre Wan 2.7 T2V en PicassoIA.
- Pega un prompt de tres bloques en el campo de texto.
- Fija la relación de aspecto en 9:16.
- Elige salida en 1080p y una duración de 5 segundos.
- Pulsa generar y espera unos 90 segundos.
- Descarga el MP4 directamente a tu teléfono o al equipo.
Paso a paso para Wan 2.7 I2V
- Abre Wan 2.7 I2V.
- Sube una imagen de origen vertical en 9:16 que ya te encante.
- Escribe un prompt corto que describa solo el movimiento, porque la composición ya está fijada.
- Elige 1080p y 5 segundos.
- Genera, revisa y vuelve a generar si el movimiento se desvía.
Paso a paso para Wan 2.7 R2V
- Abre Wan 2.7 R2V.
- Sube una foto de referencia clara del sujeto que quieres que se repita.
- Escribe un prompt de tres bloques que describa la nueva escena, el movimiento y el movimiento de cámara.
- Elige 1080p vertical.
- Lanza el render. Usa la misma referencia en toda una serie para mantener la continuidad visual.
Consejos para ahorrar créditos
- Previsualiza primero en menor resolución si la plataforma lo permite y luego vuelve a renderizar en 1080p cuando te guste el movimiento.
- Guarda tus prompts más fiables en un archivo de referencia que reutilices.
- Renderiza en lotes de tres con pequeñas variaciones del prompt en lugar de diez copias del mismo.
Errores comunes que conviene evitar
Tres fallos concretos afectan una y otra vez a los creadores. Detectarlos pronto ahorra créditos y protege tu cola de renders.
Prompts sobrecargados
Un prompt de 400 palabras no produce un mejor clip de Wan 2.7. Produce uno confuso. Mantén los prompts por debajo de 80 palabras, estructurados con el patrón de tres bloques de arriba.
Relación de aspecto equivocada
Si envías a Wan 2.7 I2V una fuente horizontal y pides salida vertical, el modelo recorta a mitad del render y pierdes tu composición. Empieza siempre con una fuente 9:16 para salida vertical.
Olvidar el verbo de movimiento
Los prompts sin un verbo de movimiento claro producen clips ambientales a la deriva, sin ningún momento de historia. Incluye siempre al menos uno de estos verbos: caminar, girar, levantar, verter, abrir, mirar de reojo, correr, bailar, sentarse, alcanzar.
| Error | Síntoma | Solución rápida |
|---|
| Prompt sobrecargado | Movimiento confuso, sujeto débil | Recórtalo a 60 palabras, tres bloques |
| Relación de aspecto equivocada | Recorte torpe, composición perdida | Usa una fuente 9:16 para I2V |
| Sin verbo de movimiento | Clip ambiental a la deriva | Añade un verbo de acción concreto |

Haz tu primer clip vertical hoy
La forma más rápida de interiorizar todo esto es renderizar un clip esta noche. Elige una sola foto que ya hayas tomado en 9:16, introdúcela en Wan 2.7 I2V en PicassoIA con un prompt de tres bloques y observa lo que sale. Si empiezas desde cero, Wan 2.7 T2V maneja de maravilla los clips conceptuales, y Wan 2.7 R2V está esperando cuando quieras un rostro o producto recurrente a lo largo de toda una serie. Crea el hábito de un render al día, estudia qué funcionó en tus curvas de retención, y tu instinto vertical se afinará más rápido de lo que cualquier tutorial puede enseñarte. PicassoIA te da el espacio para experimentar, las versiones para cada toma y la resolución para publicar directamente en TikTok, Reels y Shorts sin penalización de calidad. Abre tu teléfono, apunta la cámara a algo interesante y deja que Wan 2.7 haga el resto.