Runway Gen-4.5: novedades y cómo usarlo

Runway Gen-4.5 es la última versión del modelo insignia de texto a video de Runway, con mejoras notables en el control del movimiento, la coherencia temporal y la fidelidad a los prompts. Este artículo desglosa cada nueva función, muestra cómo usarlas en la práctica y compara Gen-4.5 con los generadores de video con IA más potentes disponibles en 2027.

Runway Gen-4.5: novedades y cómo usarlo
Cristian Da Conceicao
Fundador de Picasso IA

Runway lleva tiempo perfeccionando la arquitectura de Gen-4 y, con Gen-4.5, el salto se nota. Si has estado usando la versión anterior y te preguntas si la actualización realmente importa para tu flujo de trabajo, la respuesta corta es sí. Los cambios no son cosméticos. La calidad del movimiento, la coherencia entre fotogramas y lo fiel que es el modelo a tus prompts han mejorado de forma real. Este artículo repasa cada cambio importante de Gen-4.5, te muestra cómo usar el modelo paso a paso y lo compara con los competidores más sólidos disponibles hoy en 2027.

Manos sujetando una cámara de calidad cinematográfica en un plató

Qué cambió de verdad en Gen-4.5

El salto de Gen-4 a Gen-4.5 no es solo marketing. Tres áreas recibieron mucha atención: la precisión en el control del movimiento, la estabilidad de un fotograma a otro y la fidelidad al prompt. Cada una de ellas afecta a lo útil que resulta el modelo para trabajo creativo profesional, ya sea para rodar cortometrajes, contenido para redes sociales o recursos de video comerciales.

El pincel de multimovimiento

El pincel de multimovimiento es la función estrella de esta versión. En Gen-4 podías sugerir un movimiento general mediante texto, pero el modelo tomaba sus propias decisiones sobre cómo se movían los objetos entre sí. Gen-4.5 te da un control detallado: dibujas regiones directamente sobre tu imagen de entrada y asignas un vector de movimiento independiente a cada una.

Esto importa muchísimo en escenas con varios sujetos. Una persona que camina hacia la izquierda mientras una multitud de fondo se mueve hacia la derecha, o un coche que se aleja mientras la cámara panea en sentido contrario. Antes de esta actualización, lograr ese tipo de coreografía requería unir varias generaciones separadas en la postproducción. Ahora se consigue en una sola pasada de generación.

La herramienta también admite movimiento por capas. Puedes asignar una deriva lenta al cielo del fondo, un movimiento moderado a los árboles de la zona media y una trayectoria específica más rápida a tu sujeto en primer plano. El resultado es un efecto de profundidad por paralaje que antes requería un software de motion graphics dedicado.

💡 Tip: Mantén los vectores de movimiento de las regiones adyacentes claramente diferenciados. Las asignaciones de dirección que se solapan confunden al modelo y producen un movimiento mezclado y no deseado en la zona de solapamiento. Un pequeño espacio entre las regiones pintadas evita por completo este problema.

Mejoras en la coherencia temporal

Una de las frustraciones constantes de los primeros modelos de video con IA era el parpadeo. Los rostros cambiaban sutilmente entre fotogramas. Las texturas de la ropa se movían o pulsaban. Los objetos pequeños del fondo aparecían y desaparecían de formas que rompían la inmersión de inmediato.

Gen-4.5 aborda este problema con una atención temporal mejorada en la arquitectura del modelo. En la práctica, esto significa:

  • Las texturas de piel y superficies se mantienen estables durante toda la duración del clip
  • Los elementos del fondo ya no tiemblan ni desaparecen entre fotogramas
  • El cabello y la tela se mueven con una inercia físicamente plausible, en lugar de teletransportarse entre posiciones
  • La iluminación constante se mantiene incluso cuando los sujetos pasan por distintas partes del encuadre
  • La identidad de los objetos se conserva: una taza de café que empieza sobre una mesa sigue siendo una taza de café, con la misma forma y el mismo color en todo el clip

Para quien genere videos de presentadores, contenido tipo entrevista o tomas de producto en primer plano, esta mejora por sí sola justifica usar Gen-4.5 en lugar de su predecesor. La diferencia se percibe incluso en la primera visualización.

Mayor adherencia al prompt

Gen-4.5 es mucho mejor siguiendo instrucciones textuales concretas. La versión anterior solía respetar el estado de ánimo general de un prompt mientras ignoraba detalles específicos, sobre todo en lo referente al movimiento de cámara y al comportamiento de los objetos pequeños del encuadre.

El modelo actualizado ahora interpreta correctamente instrucciones como "travelling lento de acercamiento hacia el sujeto" o "las hojas caen desde la parte superior izquierda mientras el sujeto permanece quieto". La especificidad del prompt produce ahora resultados igualmente específicos, en lugar de una aproximación basada en suposiciones. Esto resulta especialmente valioso para creadores que han desarrollado bibliotecas de prompts detalladas y dependen de una interpretación constante para mantener el estilo visual a lo largo de un proyecto.

Cineasta revisando metraje en un equipo portátil en una sala de edición

Gen-4 frente a Gen-4.5: las diferencias reales

Esta es una comparación directa de lo que cambió entre las dos versiones en las funciones más importantes para el trabajo de producción:

CaracterísticaGen-4Gen-4.5
Control de movimientoSugerencias solo de textoRegiones del pincel Multi-Motion
Coherencia temporalModerada, parpadeo visibleParpadeo considerablemente reducido
Adherencia al promptSe respetaba la intención generalSe siguen las instrucciones específicas
Resolución máxima1280x7681280x768
Duración máxima10 segundos10 segundos
Control de cámaraBásico (controlado por texto)Mayor direccionalidad
Coherencia del sujetoVariable entre clipsMás estable dentro del clip
Movimiento multicapaNo disponibleDisponible con la herramienta de pincel
PreciosBasados en créditosBasados en créditos (sin cambios)

El límite de resolución no ha cambiado, y conviene tenerlo en cuenta. Si necesitas una salida en 4K de forma obligatoria para tu proyecto, tendrás que aplicar después de la generación un paso de superresolución por separado. Es una limitación real frente a varios competidores que ya ofrecen 1080p nativo o superior en su flujo base.

Cómo funciona Gen-4.5 en la práctica

Dos creativos colaborando en un escritorio compartido revisando metraje

Modo texto a video

El proceso de texto a video en Gen-4.5 toma un prompt escrito y produce un clip de hasta 10 segundos. El modelo está ajustado para contenido cinematográfico y maneja especialmente bien los entornos naturales, los interiores arquitectónicos y los sujetos humanos. Los prompts abstractos o surrealistas pueden dar resultados atractivos, pero la coherencia es más difícil de predecir y controlar en varias generaciones.

La estructura de prompt más fiable para Gen-4.5 sigue este patrón:

[Descripción del sujeto] + [Acción y movimiento] + [Entorno] + [Instrucción de cámara] + [Ambiente e iluminación]

Por ejemplo: "Una mujer con una bata blanca camina despacio por un campo de trigo bañado por el sol, la cámara la sigue desde atrás a baja altura, luz dorada de hora mágica y un ligero movimiento del viento en la hierba". Esta estructura da al modelo instrucciones claras en cada nivel: quién es, qué hace, dónde está, cómo se comporta la cámara y qué debe transmitir la escena.

Evita los descriptores emocionales vagos como "precioso" o "dramático" como modificadores sueltos. En su lugar, describe las condiciones visuales concretas que crean esa emoción. "Contraluz de última hora de la tarde con destellos de lente" es más útil que "iluminación preciosa".

Modo imagen a video

La imagen a video es donde Gen-4.5 se convierte en una herramienta de producción práctica. Aportas una imagen fija y un prompt de movimiento, y el modelo la anima conservando el estilo visual, la iluminación y la composición del material original.

Esto es especialmente útil cuando tienes:

  • Fotografía de producto que quieres animar con un movimiento sutil
  • Arte conceptual o ilustraciones que necesitan animación
  • Retratos en los que quieres una respiración, un parpadeo y un movimiento de ojos naturales
  • Fotos fijas de arquitectura en las que quieres animación ambiental, como viento, agua o cambios de luz
  • Recursos de marca o logotipos que necesitan un movimiento controlado y con identidad de marca

El pincel de multimovimiento se integra directamente en este modo. Pintas regiones sobre tu imagen de origen, asignas vectores de movimiento a cada región y luego dejas que el modelo calcule la física de cómo interactúan esos movimientos entre sí y con la geometría de la escena.

5 consejos para mejores resultados

Escritorio de un cineasta con un storyboard anotado y material de planificación

Obtener resultados buenos de forma constante con Gen-4.5 exige entender cómo interpreta el modelo lo que recibe. Estas cinco prácticas marcan una diferencia medible en la calidad del resultado:

  1. Usa imágenes de referencia cuando sea posible. Los resultados de imagen a video son más coherentes que los de texto a video puro, porque el modelo parte de un punto de partida visual concreto. La identidad del sujeto, las condiciones de luz y la composición quedan fijadas a partir de la referencia.
  2. Describe el movimiento a nivel de frase. En lugar de "cámara en movimiento", escribe "toma lateral lenta de izquierda a derecha, el sujeto permanece centrado en el encuadre en todo momento". Cuanto más explícita sea la instrucción de cámara, con más precisión se ejecuta.
  3. Mantén las escenas simples en su composición. Un sujeto principal con un fondo bien definido supera a las escenas complejas con varios elementos en cuanto a coherencia y estabilidad temporal.
  4. Separa las regiones de Multi-Motion Brush con espacios espaciales claros. Las definiciones de movimiento se filtran entre regiones con asignaciones solapadas, lo que produce un movimiento intermedio confuso que no cumple ninguna de las dos instrucciones.
  5. Genera varias versiones del mismo prompt. Gen-4.5 tiene una variación considerable entre ejecuciones. Generar tres a cinco versiones del mismo prompt te da un conjunto de opciones entre las que elegir y mejora mucho la probabilidad de obtener un buen resultado.

💡 Tip: En el caso concreto del contenido de cabeza parlante, parte de una fotografía de retrato en alta resolución en lugar de generar un personaje a partir de texto. Las mejoras de coherencia temporal de Gen-4.5 conservan la identidad facial mucho mejor cuando se trabaja a partir de una fuente fotográfica real.

Dónde se queda corto Gen-4.5

Ningún modelo está libre de debilidades. Estas son las áreas en las que Gen-4.5 todavía flaquea frente a lo que necesitan los creadores profesionales y a lo que ofrecen ya los modelos competidores:

Límite de resolución. Llegar como máximo a 1280x768 significa que cualquier cosa destinada a emisión, cine o entrega en 4K para redes sociales requiere un paso de escalado aparte. Competidores como LTX 2.3 Pro ofrecen 4K nativo, y Kling v3 genera 1080p de forma nativa sin un paso de posprocesado.

Duración máxima del clip. Con 10 segundos por generación, no puedes producir secuencias largas en una sola pasada. Unir varios clips introduce retos de coherencia: igualar la iluminación, la apariencia del sujeto y el comportamiento de la cámara entre generaciones separadas es un trabajo que requiere mucho tiempo y a menudo necesita corrección manual.

Sin audio nativo. Gen-4.5 produce video sin sonido. Modelos como Veo 3 y Seedance 2.0 ya generan en una sola pasada sonido ambiental, diálogos y música sincronizados con el video. Para quien quiere clips totalmente producidos sin trabajo adicional de postproducción, es una carencia importante.

Costo de los créditos en flujos de trabajo con muchas iteraciones. Runway funciona con un sistema de créditos, y Gen-4.5 consume créditos a un ritmo que se acumula rápido cuando iteras por muchas generaciones hasta encontrar la toma adecuada. Los creadores con presupuesto ajustado que trabajan en volumen notarán esta limitación con más intensidad que quienes hacen piezas ocasionales y pulidas.

Oficina creativa moderna con grandes ventanales y un equipo frente a monitores

La competencia en 2027

Gen-4.5 es un modelo sólido, pero el panorama de la generación de video con IA en 2027 es muy competitivo. Varias alternativas superan a Gen-4.5 en categorías concretas que importan según el tipo de producción.

Kling v3

Kling v3 de Kuaishou es actualmente uno de los modelos de texto a video más capaces disponibles. Genera 1080p nativo, maneja escenas complejas con varios sujetos con una gran coherencia temporal y cuenta con su propio sistema de control de movimiento a través de Kling v3 Motion Control. Para los creadores que priorizan la resolución de salida y la complejidad de los sujetos, Kling v3 es ahora la opción más sólida. La variante Kling v2.6 también sigue siendo una opción fiable para quien busca un equilibrio entre velocidad y calidad.

Sora 2 Pro

Sora 2 Pro, de OpenAI, ofrece una calidad de simulación física que Gen-4.5 no puede igualar en dinámica de fluidos, simulación de tela e interacciones complejas de partículas. Si tu contenido incluye agua, fuego, humo o movimientos de tela intrincados bajo el viento, Sora 2 Pro produce resultados físicamente más precisos que aguantan bien un examen detallado.

Veo 3

Veo 3, de Google, es el benchmark actual en generación de video sincronizada con audio. Produce sonido ambiental, diálogos y música atmosférica junto con las imágenes en una sola pasada de generación. Para creadores de contenido en redes sociales y especialistas en marketing que necesitan clips listos para publicar con sonido, esta ventaja de flujo de trabajo es considerable. Veo 3.1 va más allá con una fidelidad de audio mejorada y un render más rápido.

Seedance 2.0

Seedance 2.0, de ByteDance, destaca especialmente por su generación rápida con alta calidad. Seedance 2.0 Fast es el modelo al que recurrir cuando necesitas iterar con rapidez sin sacrificar demasiada calidad visual. Para agencias y creadores que trabajan con flujos de trabajo de alto volumen, la relación entre velocidad y calidad es difícil de superar.

Directora de cine segura de sí misma de pie en un estudio con iluminación profesional

Así se comparan estos modelos en las dimensiones que más pesan en las decisiones de producción:

ModeloResolución máximaAudio nativoControl del movimientoIdeal para
Runway Gen-4.51280x768NoPincel de multimovimientoCortos cinematográficos, movimiento preciso
Kling v31080pNoControl de movimiento avanzadoContenido profesional de alta resolución
Sora 2 Pro1080pSíEstándarEscenas con mucha física
Veo 31080pSíEstándarContenido para redes con audio sincronizado
Seedance 2.01080pSíEstándarIteración rápida, gran volumen
LTX 2.3 Pro4KNoEstándarSalida de ultra alta resolución

Cómo usar Gen 4.5 en PicassoIA

Gen 4.5 está disponible directamente en PicassoIA, lo que significa que puedes generar video de calidad Runway sin gestionar una cuenta aparte de Runway ni navegar por su sistema de créditos independiente. El flujo de trabajo es sencillo y apto para principiantes.

Primer plano de la línea de tiempo de edición de video en un monitor 4K

Paso 1: Abre la página del modelo Gen 4.5

Ve a la página del modelo Gen 4.5 en PicassoIA. Verás el campo de entrada del prompt y la opción de subir una imagen de referencia para el modo imagen a video.

Paso 2: Elige tu modo de generación

Si partes solo de texto, escribe tu prompt directamente en el campo de entrada. Si tienes una imagen de referencia, súbela con el campo de imagen. El modo imagen a video se activa automáticamente cuando se detecta una imagen, y la herramienta de pincel de multimovimiento aparece en la barra de herramientas.

Paso 3: Escribe un prompt estructurado

Sigue la estructura Sujeto, Acción, Entorno, Cámara, Ambiente que se describió antes. Para el pincel de multimovimiento: haz clic en el icono de la herramienta de pincel, dibuja tus regiones sobre la imagen subida y asigna direcciones de movimiento a cada región con los controles direccionales. Mantén las regiones separadas en el espacio para evitar que el movimiento se filtre.

Paso 4: Define tus parámetros

  • Duración: Empieza con 5 segundos para iterar más rápido y de forma más económica. Pasa a 10 segundos cuando tengas una estructura de prompt que produzca resultados constantes.
  • Relación de aspecto: 16:9 para contenido horizontal, 9:16 para formatos verticales de redes sociales.
  • Cantidad de movimiento: Los ajustes moderados dan los resultados más estables. Los ajustes de movimiento alto pueden introducir artefactos temporales incluso con las mejoras de Gen-4.5, sobre todo alrededor de sujetos que se mueven rápido.

Paso 5: Genera y evalúa

Envía tu trabajo. La generación suele tardar entre 60 y 120 segundos según la carga actual del servidor. Evalúa el resultado frente a lo que describiste en el brief de movimiento. Si la coherencia facial falla, cambia a una imagen de referencia fotográfica. Si el movimiento de cámara no coincide con lo que buscas, haz la instrucción de cámara más explícita en tu prompt.

Paso 6: Itera y refina

La interfaz de PicassoIA te permite volver a ejecutar el mismo prompt con modificaciones. Úsala para explorar variaciones de movimiento y después combina tus mejores tomas en tu editor de video. Si necesitas que el resultado se escale a 4K para la entrega, pásalo por LTX 2.3 Pro u otro modelo de superresolución como último paso.

💡 Tip: Si quieres una generación más rápida para iterar en volumen, Gen4 Turbo también está disponible en PicassoIA. Sacrifica algo de calidad a cambio de tiempos de salida significativamente más cortos, lo que lo hace práctico para la exploración creativa rápida antes de decidirte por un render final de Gen-4.5.

Tu turno de crear

Mujer trabajando al aire libre en una cafetería con un equipo portátil que muestra una interfaz de video

Gen-4.5 representa la versión más capaz de la arquitectura de Runway hasta la fecha, y el Multi-Motion Brush por sí solo abre flujos de trabajo de producción que simplemente no eran posibles en versiones anteriores. Las mejoras de coherencia temporal lo hacen realmente utilizable para primeros planos y contenido centrado en el rostro, sin la limpieza manual que exigían las versiones anteriores.

La verdadera ventaja de trabajar en PicassoIA es que no estás atado a un solo modelo. Si tu escena necesita audio nativo, Veo 3 está a un clic. Si necesitas salida nativa en 4K, LTX 2.3 Pro o Kling v3 están ahí mismo. Si necesitas volumen y velocidad, Seedance 2.0 Fast cumple. Y cuando quieras el control de movimiento preciso y la calidad cinematográfica para la que está diseñado Gen-4.5, está listo para usar sin configuración adicional.

La mejor forma de ver lo que estos modelos pueden hacer de verdad con tu contenido es ejecutarlos con tu propio material. Abre Gen 4.5 en PicassoIA, empieza con una imagen que ya tengas, escribe un prompt de movimiento claro y mira qué sale. La primera generación siempre sorprende.

Compartir este artículo

Elige tu idioma