API de video de OpenRouter: qué modelos de video existen y cuánto cuestan
OpenRouter ya dirige la generación de video a Veo 3.1, Seedance 2.5, Wan 3.0, Kling y más a través de un único endpoint asíncrono. Este artículo recoge los precios por segundo, muestra lo que cuestan de verdad diez clips y explica cómo elegir un modelo antes de gastar créditos.
Pagar por video con IA solía significar cinco paneles, cinco páginas de facturación y cinco SDK. OpenRouter ya dirige la generación de video a través de un único endpoint asíncrono, así que un solo token de autenticación llega a Google, ByteDance, Alibaba, Kling, MiniMax, Runway, xAI y más. El inconveniente es que cada modelo cobra sus segundos de forma distinta, y un clip que cuesta tres centavos por segundo en un modelo cuesta sesenta centavos en otro. Este artículo recoge los modelos de video que OpenRouter ofrece a principios de octubre de 2026, cuánto cobra cada uno, cómo funciona la facturación y cómo evitar que un proyecto real te vacíe los créditos. Los precios cambian a menudo, así que trata cada cifra como una instantánea y consulta el listado de modelos actualizado antes de comprometer un presupuesto.
Cómo funciona la API
OpenRouter gestiona el video de forma distinta a las llamadas de texto o de imagen. Un render puede tardar varios minutos, así que la API nunca mantiene una conexión abierta. Envías un trabajo, recibes un ID, consultas su estado y descargas el archivo cuando está listo. Ese patrón es idéntico para todos los modelos, y ahí está su gran atractivo: cambias una cadena model y el resto de tu código sigue funcionando.
Enviar, consultar y descargar
Cuatro endpoints hacen todo el trabajo:
POST /api/v1/videos envía un trabajo con un model y un prompt.
GET /api/v1/videos/{jobId} devuelve el estado actual.
GET /api/v1/videos/{jobId}/content descarga el archivo terminado.
GET /api/v1/videos/models enumera todos los modelos de video con sus resoluciones, duraciones y precios.
La respuesta al envío incluye un id, un polling_url y un status de pending. Después, el estado pasa a in_progress y termina como estado de éxito o como failed. Cuando un trabajo tiene éxito, la respuesta añade unsigned_urls para la descarga y un objeto usage con el cost final en USD y un indicador is_byok. Si consultar el estado te parece un desperdicio, pasa un callback_url y OpenRouter envía un webhook firmado con HMAC-SHA256.
curl -X POST "https://openrouter.ai/api/v1/videos" \
-H "Authorization: Bearer $OPENROUTER_TOKEN" \
-d '{"model": "google/veo-3.1", "prompt": "A golden retriever playing fetch on a sunny beach"}'
💡 Conviene saberlo: OpenRouter indica que la generación de video no es elegible para Zero Data Retention, porque el diseño asíncrono almacena cada salida hasta que la descargas. Si tu política prohíbe la retención, planifícalo antes de integrarlo.
Parámetros que cambian el precio
Además de model y prompt, puedes definir duration, resolution, aspect_ratio y size. Añade frame_images para animar una imagen fija, o input_references para la generación basada en referencias. También puedes activar o desactivar el audio, fijar una seed y pasar opciones específicas de cada proveedor. Las resoluciones van desde 480p hasta 4K y las relaciones de aspecto desde 21:9 hasta 9:21, pero cada modelo acepta solo un subconjunto. Cada una de estas opciones afecta al precio, por eso la facturación merece su propia sección.
Cómo funciona la facturación
Tarifas por segundo
La mayoría de los modelos cobran por segundo de salida. El endpoint de modelos muestra esto a través de pricing_skus, con entradas como una tarifa base de per-video-second y una tarifa aparte para 1080p. Una resolución más alta sube la tarifa, una pista de audio la sube de nuevo, y la duración multiplica todo. Veo 3.1 muestra la diferencia dentro de un mismo modelo: unos $0.20 por segundo para 1080p sin audio, hasta $0.60 por segundo para 4K con audio. Es una diferencia de tres veces antes incluso de elegir otro modelo.
Precios por tokens y trabajos fallidos
Los modelos Seedance de ByteDance aparecen en el endpoint de modelos con precios basados en tokens en lugar de segundos. La página de colección de OpenRouter los convierte en una tarifa inicial por segundo, y esa tarifa convertida es la cifra que se usa en todo este artículo.
Los fallos están menos claros. OpenRouter indica que un fallo 502 en el proveedor no se cobra, pero la documentación no detalla la regla para otros trabajos fallidos, así que reserva un margen para reintentos en tu presupuesto. Hay otros tres errores que conviene gestionar en el código:
402 significa que no tienes créditos suficientes.
403 significa que has alcanzado un límite de gasto.
429 significa que te están limitando la frecuencia de peticiones.
Cada modelo de video y su precio
Estos son quince de los listados más usados, ordenados del más barato al más caro en el extremo bajo del rango:
💡 El extremo bajo de un rango suele ser la resolución más barata sin audio. El extremo alto suele ser la resolución máxima con audio. Las filas de Seedance muestran la tarifa inicial convertida, no un precio fijo.
Si ya sabes qué necesitas, estas elecciones rápidas te ahorran tiempo:
Tarifa plana predecible:Gen-4.5 a $0.12 por segundo.
Hay algunos listados más que merece la pena revisar. Wan 3 Prime cuesta de $0.068 a $0.28 por segundo hasta 1080p. Kling v3 Video en su nivel Pro cuesta de $0.112 a $0.168. Hailuo 2.3 cobra $0.0817 por clips de 1080p de 6 o 10 segundos. Wan 2.7 está en $0.10 y Wan 2.6 en $0.04 a $0.15. Runway Aleph 2.0, pensado para editar metraje existente, empieza en $0.28.
Considera las cifras anteriores como un mapa, no como un contrato. Algunos listados difieren en uno o dos centavos entre la página de colección y el endpoint de modelos, así que consulta /api/v1/videos/models directamente antes de fijar un presupuesto.
Modelos económicos por menos de diez centavos
Empieza por Veo 3.1 Lite
Veo 3.1 Lite es el hermano económico del modelo insignia de Google. Genera clips de 720p y 1080p de 4, 6 u 8 segundos, acepta un prompt de texto o una imagen inicial, añade audio nativo y admite una semilla. Entre $0.03 y $0.08 por segundo, un clip completo de 8 segundos cuesta $0.24 y $0.64. Veo 3.1 Fast está un escalón por encima, entre $0.08 y $0.30, y añade una opción de 4K, lo que lo convierte en el paso intermedio sensato cuando Lite se ve blando pero el modelo completo es excesivo.
Presupuestos con Seedance y Wan
La opción de ByteDance más barata es Seedance 2.0 Mini, a unos $0.034 por segundo para clips de 480p y 720p de 4 a 15 segundos. Un clip de 15 segundos cuesta unos $0.50. Seedance 2.0 Fast prioriza la velocidad y el costo más bajo frente a la máxima calidad, a unos $0.040 por segundo.
Si buscas duración, mira Wan 3.0. Acepta de 2 a 30 segundos, de 480p a 1080p, con audio. A unos $0.05 por segundo, un clip de 30 segundos cuesta $1.50, lo que lo convierte en el clip único más largo de esta franja de precio. HeyGen Video empieza en $0.01 por segundo y es el listado más barato de todos, aunque conviene comprobar a qué resolución se aplica esa tarifa antes de planificar con ella.
Modelos premium que merecen el gasto
Veo 3.1 a precio completo
Veo 3.1 admite 720p, 1080p y 4K, clips de 4, 6 u 8 segundos, audio, condicionamiento por primer y último fotograma, y una semilla. A 1080p con audio la tarifa ronda los $0.40 por segundo, así que un clip de 8 segundos cuesta $3.20. En 4K con audio sube a $0.60. Reserva este gasto para las tomas principales, no para los borradores.
Seedance 2.5 para escenas largas
OpenRouter presenta Seedance 2.5 para narrativa de larga duración, generación basada en referencias, edición de video y extensión de video. Acepta de 4 a 30 segundos en 480p y 720p. A unos $0.103 por segundo, una escena completa de 30 segundos cuesta $3.08. Si necesitas control del primer y último fotograma y personajes coherentes en resoluciones más altas, Seedance 2.0 llega hasta 4K desde unos $0.067 por segundo.
Kling, Runway y HappyHorse
El nivel intermedio-premium está abarrotado. Kling v3.0 Standard genera clips de 720p de 3 a 15 segundos con audio, a $0.084 a $0.126 por segundo. Gen-4.5 de Runway cobra una tarifa plana de $0.12 por clips de 720p de 2 a 10 segundos, sin audio. HappyHorse 1.1 ofrece 720p y 1080p a $0.099 a $0.128. Grok Imagine Video 1.5 acepta clips de solo 1 segundo, el mínimo más bajo de la tabla, lo que resulta útil para pruebas de movimiento baratas.
Cuánto cuesta un proyecto real
Diez clips con tres presupuestos
Imagina diez clips de 8 segundos cada uno, es decir, 80 segundos de metraje terminado. Usando las tarifas más bajas y más altas publicadas, la factura queda así:
Fíjate en la diferencia: los mismos 80 segundos cuestan unos $2.40 o unos $48, una diferencia de veinte veces que depende solo del modelo y de los ajustes que elijas. Incluso Seedance 2.0 Mini a su tarifa inicial se queda en torno a $2.69 por el mismo metraje.
Costos ocultos y reintentos
El precio de catálogo supone que cada clip es aprovechable, y en la práctica ninguno lo es nunca. Si conservas una toma de cada tres, multiplica tu presupuesto por tres: el proyecto de $2.40 con Veo 3.1 Lite pasa a $7.20. La forma más barata de subir tu tasa de aciertos es un mejor prompt antes de enviar, no un modelo más caro después.
Un modelo de lenguaje sirve bien para esta tarea. Pide a Claude Sonnet 5, Gemini 3.5 Flash o GPT 5.6 Luna que reescriban tu idea como una descripción de plano en orden cronológico, con un sujeto, un movimiento, un movimiento de cámara y una indicación sonora. Los modelos de video responden mucho mejor a esa estructura que a una petición vaga de una sola línea. Además, descarga cada salida en cuanto termine y guarda tu propia copia, en lugar de dar por hecho que la URL del trabajo seguirá disponible.
Borradores baratos, acabado premium
La mejor jugada de presupuesto es un pipeline de dos etapas. Genera seis borradores de 8 segundos con Seedance 2.0 Mini: 48 segundos a unos $0.034 suman alrededor de $1.61. Elige el encuadre que mejor funcione y renderiza solo esa toma con Veo 3.1 a 1080p con audio por $3.20. La toma completa cuesta unos $4.81, frente a $19.20 por seis intentos premium.
💡 Regla práctica: nunca pagues tarifas premium para averiguar si un prompt funciona.
Usa Veo 3.1 Lite en PicassoIA
Si quieres probar el estilo de Veo 3.1 Lite antes de conectar ninguna API, Veo 3.1 Lite en PicassoIA funciona en el navegador y sin código. La página muestra clips de 4, 6 y 8 segundos, de 720p y 1080p, y audio nativo.
Escribe el prompt
Abre la página del modelo y describe la escena en el orden en que ocurre: quién o qué aparece en pantalla, cómo se mueve, hacia dónde va la cámara y cómo suena. Como el modelo genera audio, nombra el sonido: lluvia sobre el cristal, el silbato lejano de un tren, jazz suave. El prompt es el único campo obligatorio.
Elige duración y resolución
Ajuste
Opciones
Predeterminado
Duración
4, 6 u 8 segundos
8
Resolución
720p o 1080p
720p
Relación de aspecto
16:9 o 9:16
16:9
💡 La página del modelo indica que la duración debe ser de 8 segundos si eliges 1080p, y que 4K no es compatible con la versión Lite.
Anima una imagen inicial
Sube una imagen y el modelo la usa como primer fotograma. Añade una segunda imagen como último fotograma y Veo 3.1 Lite construye una transición suave entre ambas. Fija una semilla cuando te guste un resultado y quieras variaciones muy parecidas.
¿Prefieres código? PicassoIA también ofrece una API de predicciones al estilo de Replicate en https://api.picassoia.com/v1. Los trabajos son asíncronos, así que creas una predicción, la consultas y obtienes el resultado, muy parecido al flujo de OpenRouter de arriba. Los modelos de video expuestos allí son picassoia/picassoia-video y picassoia/seedance-2.5-lite, y una cuenta puede ejecutar hasta 5 predicciones a la vez. Revisa la página de precios para ver qué plan incluye acceso a la API antes de construir sobre ella.
Tu próximo clip empieza aquí
Leer tablas de precios solo te lleva hasta cierto punto. La forma más rápida de saber qué modelo encaja con tu proyecto es renderizar el mismo prompt en dos de ellos y comparar los fotogramas. Abre Seedance 2.5 Lite, que PicassoIA lista como ilimitado para los miembros de Wonder a 480p y 720p, y genera un borrador de 5 o 10 segundos. Luego prueba Veo 3.1 Lite o PicassoIA Video con la misma idea y comprueba qué movimiento prefieres.
Cuando tengas un clip que te guste, la plataforma también ofrece efectos de video, escalado, sincronización labial y texto a voz, así que puedes pulir el resultado sin salir de ella. Explora todos los modelos de video, imagen y lenguaje en picassoia.com/en/all-models, elige uno y crea tu primer clip hoy mismo.