API de generación de video: opciones gratuitas, precios y costos
Una API de generación de video cobra por segundo, y la diferencia entre 0,05 $ y 0,60 $ por segundo se acumula rápido. Este artículo explica qué opciones son gratuitas, cuánto cuestan de verdad las tarifas por segundo, cómo los reintentos inflan la factura y una fórmula sencilla para presupuestar tu primer mes de clips.
Una API de generación de video no te cobra por mes. Te cobra por segundo de metraje, y ese detalle decide si tu proyecto cuesta lo de una comida o lo de un equipo portátil. Google indica que Veo 3.1 Lite cuesta 0,05 $ por segundo en 720p y Veo 3.1 0,40 $ por segundo, una diferencia de ocho veces para la misma duración de clip. Este artículo muestra qué opciones son realmente gratuitas, cuánto cuestan las de pago y cómo calcular tu propia cifra antes de escribir una sola línea de código.
💡 Los precios cambian. Las cifras de abajo proceden de la tabla de precios de la API de Gemini de Google y de la documentación de la API de PicassoIA, ambas revisadas en octubre de 2026. Los proveedores cambian sus tarifas con frecuencia, así que confirma la página en vivo antes de fijar un presupuesto.
Qué hace de verdad una API de video
Una API de video es un endpoint web que recibe un prompt de texto, y a veces una imagen inicial, y devuelve un clip terminado. La clave está en el tiempo. Renderizar unos segundos de metraje tarda mucho más que una llamada a una API normal, por lo que la mayoría de los proveedores usan un patrón asíncrono en lugar de obligarte a mantener la conexión abierta.
El bucle de solicitud, consulta y descarga
El bucle tiene tres pasos:
Crear: envías un POST con tu prompt y tu configuración. El proveedor responde al momento con un ID de predicción y un estado de starting.
Consultar: compruebas ese ID con un temporizador hasta que el estado pase a succeeded, failed o canceled.
Descargar: bajas el MP4 desde la URL devuelta y lo guardas en un lugar que controles.
La API de PicassoIA sigue este patrón al estilo de Replicate. El ejemplo se renderiza en la página del modelo PicassoIA Video en unos 30 a 80 segundos, así que planifica tu intervalo de consulta en torno a ese rango en lugar de saturar el endpoint.
Lo que realmente pagas
Cuatro factores mueven la factura final:
Segundos de salida: la unidad base de casi todos los proveedores, así que un clip de 10 segundos cuesta el doble que uno de 5.
Resolución: 720p, 1080p y 4K suelen tener tarifas distintas.
Nivel del modelo: las versiones lite, fast y de gama alta de una misma familia pueden diferir en un factor de ocho.
Reintentos: cada toma que descartas es una toma que sigues pagando.
Opciones gratuitas que existen de verdad
Gratis es una palabra cargada en este mercado. Algunas opciones son gratuitas de usar, otras de descargar y algunas solo durante la primera tarde. Aquí está la versión corta antes del detalle:
Trabajo de producción que necesita un modelo específico
Niveles gratuitos de los proveedores
La tabla de precios de la API de Gemini de Google marca Veo 3.1 como no disponible en el nivel gratuito, así que cada segundo se cobra desde la primera solicitud. Otros proveedores de API a veces dan un pequeño crédito al registrarte. Trata ese crédito como una prueba: basta para probar prompts y medir la latencia, pero no para ejecutar un producto. Las aplicaciones de consumo que reparten créditos diarios normalmente no los extienden a las llamadas a la API.
Pesos abiertos que alojas tú
Modelos abiertos como LTX Video y Wan 2.1 1.3b no tienen tarifa por segundo, pero tampoco son gratuitos. Pagas en horas de GPU, tiempo de configuración y mantenimiento. Una comparación sencilla es el precio por hora de la GPU dividido entre los clips renderizados por hora. Con una GPU ilustrativa de 1,00 $ por hora que renderiza 12 clips por hora, cada clip cuesta unos 0,08 $ antes del tiempo ocioso. Eso gana frente a una API alojada solo mientras la GPU esté ocupada.
API de PicassoIA: predicciones gratuitas
PicassoIA documenta su API para desarrolladores en https://api.picassoia.com/v1 y afirma: "API predictions are currently free. They use no credits." Hay cuatro modelos expuestos: PicassoIA Video, Seedance 2.5 Lite con audio sincronizado y dos modelos de imagen para generación y edición. La autenticación es un token Bearer que empieza por pia_sk_, y una cuenta puede tener hasta dos.
Los límites importan tanto como el precio:
5 predicciones en cola o en ejecución a la vez por cuenta, compartidas entre todos los tokens y conexiones MCP
10 MB por cuerpo de solicitud
5 MB por imagen enviada como data URL
4.000 caracteres por prompt
💡 Lee la línea del plan. La documentación dice que las cuentas del plan Infinite pueden usar la API, y que las demás reciben un error 403 plan_required. Sin embargo, la página de precios incluye el acceso a la API en Pro+, Elite e Infinite. Hoy esas dos afirmaciones no coinciden, así que revisa qué plan necesita tu cuenta antes de construir sobre ella. Gratis por predicción no es lo mismo que gratis con cualquier plan.
Precios reales por segundo, comparados
La tabla de Google es el ejemplo público más claro de cómo escalan los niveles, porque una misma familia de modelos aparece en tres precios. Estas son las tarifas por segundo de la página de precios de la API de Gemini, con el costo de cada clip calculado para comparar. Escálalas a la duración que renderices de verdad.
Dentro de una misma familia la diferencia es grande. Lite frente a Standard es 8 veces más caro en 720p y 5 veces en 1080p. Otras familias publican sus propias tarifas, entre ellas Seedance 2.5, Kling v3 Video, Wan 2.7 T2V y LTX 2.3 Fast. Las tarifas varían según el proveedor y cambian con frecuencia, así que compáralas con la fórmula que verás más adelante en este artículo en lugar de fiarte de una captura de pantalla.
Un nivel más barato no es automáticamente una mala elección. Los borradores, los storyboards y los clips para redes sociales rara vez necesitan el modelo de gama alta, que puedes reservar para el render final.
El riesgo del proveedor también es un costo
OpenAI anunció que la API de Sora 2 se cerraría el 24 de septiembre de 2026, y quienes habían construido un producto sobre ella tuvieron que migrar. Una tarifa baja significa poco si el endpoint desaparece. Mantén los prompts y la configuración independientes del proveedor, y elige una plataforma que ponga varios modelos detrás de una misma interfaz.
Un clip frente a un día de rodaje
Un clip de 10 segundos en el nivel lite cuesta 0,50 $. Incluso diez tomas cuestan 5,00 $, una cantidad insignificante frente al alquiler de una cámara o a un día de rodaje con todo el equipo. La comparación deja de ser justa cuando necesitas a una persona real concreta, un producto o una ubicación exacta, porque la generación aproxima y la cámara captura. Usa la API para trabajo conceptual, b-roll, fondos y clips cortos para redes, y graba lo que tiene que ser exacto.
Los costos que se esconden tras la tarifa
El precio de etiqueta es el número más barato que verás jamás. Hay otros tres costos detrás de él.
Los reintentos se comen el presupuesto
Los modelos de video no te entregan un clip perfecto a la primera, así que el precio de etiqueta subestima el real. Divide el precio por clip entre la proporción de tomas que realmente puedes usar. Con 0,50 $ por clip y una tasa de acierto de una de cada cuatro, cada clip utilizable cuesta 2,00 $. Cuando una toma funcione, fija su semilla para poder reproducirla, ya que modelos como PicassoIA Video aceptan una semilla para obtener resultados repetibles.
💡 Borrador barato, acabado una sola vez. Prueba los prompts con el nivel y la resolución más bajos, y gasta la tarifa más alta solo en los prompts que ya funcionan.
La resolución se multiplica rápido
La propia tabla de Google muestra el efecto: Veo 3.1 Fast cuesta 0,10 $ por segundo en 720p y 0,30 $ por segundo en 4K, el triple para el mismo prompt. En PicassoIA Video puedes elegir 480p para el render más rápido o 720p para una salida más nítida. Haz el borrador con el ajuste bajo y reserva el ajuste alto para la pasada final.
Almacenamiento y tiempo de ingeniería
Cada MP4 terminado necesita almacenamiento y ancho de banda, y cada integración necesita a alguien que escriba el bucle de consulta, gestione los fallos y vigile los límites de frecuencia. En un proyecto pequeño son unas cuantas tardes. Para un equipo, es una partida más del presupuesto. Descarga los resultados cuanto antes y cópialos a tu propio almacenamiento en lugar de confiar en que la URL del proveedor siga activa.
Crea un presupuesto en cinco minutos
No necesitas una hoja de cálculo para poner precio a un proyecto. Necesitas una fórmula y una estimación honesta de los reintentos.
La fórmula
Costo mensual = clips utilizables × segundos por clip × precio por segundo × tomas por clip utilizable
Toma 200 clips utilizables de 8 segundos cada uno. Son 1.600 segundos de metraje terminado. A 0,10 $ por segundo, con cada toma utilizable, la factura es de 160 $. Si necesitas tres tomas por clip utilizable, son 480 $.
Tres presupuestos mensuales de ejemplo
Misma carga de trabajo, tres niveles, usando las tarifas de Veo indicadas antes:
La diferencia entre la fila más barata y la más cara es de 8 veces antes de los reintentos y de 8 veces después de ellos, por eso el nivel que elijas importa más que cualquier otra palanca. Elijas el nivel que elijas, haz un piloto de 20 clips, mide tus tomas reales por clip utilizable y sustituye mi 3 por tu propio número antes de comprometerte.
Cómo usar PicassoIA Video
PicassoIA tiene su propio modelo de texto e imagen a video, PicassoIA Video, así que es un lugar práctico para probar todo el bucle. La página del modelo indica un clip fijo de 5 segundos a 24 fotogramas por segundo, renderizado con audio sincronizado.
Escribe el prompt por orden. Describe el sujeto y la pose inicial, después el movimiento, luego el movimiento de cámara y por último la luz. El esquema del modelo indica que las descripciones cinematográficas y cronológicas funcionan mejor.
Añade una imagen de entrada si quieres un primer fotograma concreto. El clip la usa como plano de apertura y hereda su relación de aspecto.
Elige una resolución. 480p se renderiza más rápido, 720p es más nítido.
Elige una relación de aspecto. 16:9 va bien para paisaje, 9:16 para vertical y 1:1 para publicaciones cuadradas.
Fija una semilla cuando quieras reproducir una toma más tarde.
Deja save_audio activado para sonido sincronizado, o desactívalo para un clip sin audio.
Forma del fotograma, se ignora cuando se suministra una imagen
seed
entero
aleatorio
Resultados repetibles
save_audio
booleano
true
Mantiene o descarta el sonido generado
💡 Revisa el esquema en vivo. La página del modelo y la referencia de la API no muestran los mismos rangos de resolución y duración. Lee el esquema actual del modelo antes de fijar cualquier valor en tu código.
Llámala desde código
La API envuelve cada ajuste en un objeto input. Crea la predicción y luego consulta su ID:
curl -s -X POST https://api.picassoia.com/v1/models/picassoia/picassoia-video/predictions \
-H "Authorization: Bearer $PICASSOIA_TOKEN" \
-H "Content-Type: application/json" \
-d '{"input": {"prompt": "A fishing boat rocks on calm water at sunrise, mist lifts off the surface, slow dolly-in, warm low light", "resolution": "480p", "aspect_ratio": "16:9"}}'
curl -s https://api.picassoia.com/v1/predictions/PREDICTION_ID \
-H "Authorization: Bearer $PICASSOIA_TOKEN"
La primera respuesta devuelve 201 Created con un id, un estado starting y eta.next_poll_in_seconds. Cuando el estado sea succeeded, el campo output contiene la URL del video.
Límites que frenan tu rendimiento
El dinero no es el único techo. PicassoIA permite 5 predicciones en cola o en ejecución al mismo tiempo por cuenta, y ese grupo se comparte entre todos los tokens y conexiones MCP que tengas. Si un render tarda cerca de un minuto, cinco espacios te dan como máximo 300 clips por hora, sin importar lo grande que sea tu presupuesto.
Planifica en torno al límite:
Gestiona tú la cola: ejecuta un grupo de trabajadores de cinco o menos y aliméntalo desde una lista de trabajos.
Respeta la pista de consulta: espera el eta.next_poll_in_seconds que te indique la primera respuesta entre cada comprobación.
Reenvía los fallos: un estado failed termina esa predicción, así que envía una nueva en lugar de seguir consultando.
Mantén los payloads pequeños: quédate por debajo de 10 MB por solicitud y 5 MB por data URL de imagen.
Pruébalo tú mismo en PicassoIA
La forma más barata de encontrar tu propia cifra es hacer unos cuantos clips. Abre PicassoIA Video y renderiza un borrador de 480p de una toma que de verdad necesites. Luego lanza la misma idea con Seedance 2.5 Lite para audio sincronizado y compara los dos lado a lado.
Cuando un borrador funcione, cuenta tus tomas, mete los números en la fórmula y decide si la vía de la API gratuita, un nivel de pago por segundo alojado o tu propia GPU encaja con tu volumen. PicassoIA reúne bajo un mismo techo texto a imagen, texto a video, edición de imágenes y sincronización labial, así que puedes probarlo todo antes de comprometerte con un solo proveedor.
Crea tus propias imágenes y videos con PicassoIA hoy mismo. Empieza con un borrador, mide cuánto cuesta y escala solo cuando los números se sostengan.