API de texto a video gratis: precios y mejores opciones
Una API de texto a video gratis suele significar créditos de prueba, un nivel con marca de agua, pesos abiertos en tu propia GPU o una promoción de lanzamiento. Consulta las tarifas reales por segundo, lo que cuesta un clip de cinco segundos, los límites que más pesan y una solicitud funcional a la API de PicassoIA Video.
Busca "API de texto a video gratis" y aparecen dos tipos de resultados: listados que prometen clips ilimitados sin costo y páginas de precios con tarifas por segundo que escuecen. La respuesta honesta está entre ambos. Una API de texto a video realmente gratis existe solo en unas pocas formas, y cada una tiene una letra pequeña que conviene conocer antes de escribir una línea de código de integración. Este artículo separa las opciones reales del marketing, muestra cuánto cuesta un clip de cinco segundos en los principales proveedores y recorre una solicitud funcional en PicassoIA Video, cuyas predicciones por API son gratuitas ahora mismo para las cuentas del plan Infinite.
Qué significa realmente "gratis" aquí
Toda API de video "gratuita" es una muestra gratis, no una comida gratis. El proveedor quiere que pruebes el resultado, llegues a un límite y luego elijas un plan de pago. Eso no es una estafa, así funciona el mercado, pero la muestra tiene cuatro formas distintas y cada una sirve para un trabajo diferente.
Créditos de prueba que se agotan
La mayoría de los proveedores alojados dan a las cuentas nuevas un saldo pequeño. Alcanza para un puñado de clips de prueba y después empieza a contar el consumo. Trata esos créditos como una forma de comparar la calidad de salida entre modelos, no como presupuesto de producción. Unas pocas generaciones a 720p de un modelo premium pueden vaciar un saldo inicial en una tarde, así que decide qué prompts quieres probar antes de gastar nada. Un plan sencillo funciona bien: elige tres prompts, ejecuta cada uno en todos los modelos candidatos y anota en una hoja de cálculo el costo y el número de clips que valen la pena.
Niveles gratuitos con marca de agua
Las herramientas de video para consumidores suelen ofrecer una cuota diaria de renders gratuitos. La letra pequeña es una marca de agua y un techo de resolución, y la cuota cambia según la cuenta y la región. PixVerse V6 es un ejemplo típico: según un artículo de un proveedor, los renders gratuitos llevan marca de agua y llegan como máximo a unos 540p. Sirve para comprobar si un prompt funciona. No sirve para entregar algo a un cliente.
Pesos abiertos que alojas tú mismo
Algunos laboratorios publican los archivos del modelo, así que el software en sí no cuesta nada. LTX Video, Hunyuan Video y Mochi 1 publican pesos abiertos. Lo que pagas es la máquina: comprar una GPU con mucha memoria o alquilarla por hora. Para un desarrollador que ya tiene el hardware, esta es la opción más parecida a una API de texto a video realmente gratuita. Para el resto es una factura distinta, no más pequeña. Prevé una tarde entera con drivers, ajustes de memoria y colas de trabajos antes de que se renderice el primer clip. Ese tiempo de configuración es el precio oculto.
Gratis durante una ventana de lanzamiento
A veces los proveedores desactivan el cobro en un endpoint nuevo para atraer desarrolladores. PicassoIA lo hace hoy: su página de API indica que las predicciones son gratuitas actualmente y no consumen créditos, mientras que crearlas requiere el plan Infinite. Las promociones terminan, así que mantén tu integración detrás de un wrapper fino que te permita cambiar de proveedor sin reescribir tu app.
💡 Regla práctica: si un proveedor promete video ilimitado sin tarjeta, sin marca de agua y sin límite de frecuencia, al menos una de esas tres afirmaciones es falsa.
Precios de las APIs de texto a video comparados
Las APIs de texto a video de pago cobran por segundo de salida. La tarifa depende del modelo, de la resolución y, a veces, de si el clip incluye audio. La tabla siguiente usa tarifas públicas recogidas por rastreadores de precios y fichas de proveedores en el momento de escribir. Cambian con frecuencia, así que confírmalas en la página de precios del proveedor antes de presupuestar.
Cómo funciona el cobro por segundo
La fórmula es sencilla: segundos × tarifa × intentos. El último término es el que la gente olvida. Los modelos de video no son predecibles, así que un prompt que sale bien a la primera es la excepción. La cifra que importa es el costo por clip utilizable, no el costo por clip generado. Si una de cada tres generaciones sirve para publicar, multiplica el precio de etiqueta por tres.
La resolución también mueve la tarifa. Muchos proveedores cobran bastante más a 1080p que a 720p, y algunos añaden un recargo cuando la solicitud incluye un video de entrada. Según los rastreadores de precios, Veo no forma parte del nivel gratuito de la API de Gemini, así que cada generación se cobra.
El audio añade una complicación. Algunos modelos incluyen la pista de audio en la tarifa por segundo, mientras que otros la cobran aparte. Comprueba cuál aplica antes de comparar dos tarifas, o la más barata puede resultar la más cara.
Esto es lo que significa en la práctica. Un storyboard de veinte clips a $0.50 por clip, con tres intentos por cada clip que conservas, suma $30. El mismo storyboard a una tarifa de $0.05 suma $3. Los modelos más baratos no siempre son peores, así que ejecuta tus propios prompts en dos o tres de ellos antes de decidirte por uno.
💡 Consejo: las tarifas cambian cuando sale un modelo nuevo. Revisa las cifras al inicio de cada proyecto en lugar de copiar el presupuesto del trimestre pasado.
Las mejores opciones gratuitas y económicas
Ninguna opción gana en todos los aspectos. Estas son las que merecen una prueba, divididas según cuánto control quieres sobre el hardware.
Modelos abiertos que vale la pena ejecutar
LTX Video: pensado para la velocidad, algo que importa cuando iteras prompts decenas de veces al día.
Hunyuan Video: necesita más memoria que la mayoría de las opciones abiertas y lo recompensa con un movimiento más rico.
Mochi 1: una tercera opción abierta que sirve como punto de comparación útil para tus propios prompts.
Si prefieres no tener una GPU, los mismos modelos están en la colección de texto a video de PicassoIA, donde puedes probar un prompt en el navegador antes de comprometerte a alojar nada.
Modelos alojados con tarifas bajas
Para trabajar con APIs, las tarifas alojadas más bajas suelen venir de modelos más ligeros o más antiguos. Estos son los que conviene evaluar primero:
Veo 3.1 Lite: el nivel más barato de la familia Veo a 720p, con una tabla de tarifas publicada.
LTX 2.5 Fast: un modelo orientado a la velocidad, adecuado para borradores e iteración rápida.
Wan 3: una versión reciente de Wan en el catálogo de PicassoIA, que vale la pena comparar con las versiones anteriores de Wan.
Seedance 2.5 Lite: video con audio sincronizado, disponible a través de la API de PicassoIA.
Mi ranking, por lo que vale: la API de PicassoIA gana en precio hoy, los pesos abiertos ganan en control y Veo 3.1 Lite gana en una tabla de tarifas predecible de un proveedor grande.
Límites que pillan por sorpresa a los desarrolladores
Topes de concurrencia
La API de PicassoIA permite hasta 5 predicciones en cola o en ejecución a la vez, compartidas entre tus credenciales de API y tus conexiones MCP. Es un techo sensato para un prototipo y uno estricto para un pipeline por lotes. Otros proveedores fijan sus propios topes, a menudo más bajos en cuentas de prueba. Construye tu ejecutor de trabajos alrededor de una cola desde el primer día: envía hasta el tope, consulta el estado y rellena los huecos a medida que se liberan.
Techos de resolución y duración
Los límites se contraponen entre sí. En PicassoIA Video, 480p admite hasta 20 segundos, 720p hasta 10 segundos y 1080p hasta 5 segundos. Más resolución da detalle y cuesta duración. Seedance 2.5 Lite, que añade audio sincronizado, ofrece 5, 10 o 15 segundos a 480p o 720p.
Los clips cortos en alta resolución implican unirlos en un editor. Prevé eso en tu línea de tiempo, porque una escena de diez segundos a 1080p se convierte en dos generaciones, y eso duplica el término de intentos en tu fórmula de costos.
Licencias y uso comercial
Lo que es gratis de generar no siempre es gratis de publicar. Revisa tres cosas antes de que un clip entre en el anuncio de un cliente:
¿El nivel gratuito permite uso comercial o solo pruebas personales?
¿La licencia de los pesos abiertos restringe el uso comercial, por ejemplo por encima de un umbral de ingresos o de usuarios?
¿El proveedor conserva algún derecho sobre tus prompts y resultados?
Anota las respuestas en las notas del proyecto. Ellas deciden si un clip barato puede publicarse.
Cómo usar la API de PicassoIA Video
PicassoIA Video es hoy la vía más rápida para hacer una llamada a la API de texto a video sin cargo por segundo. La misma API también sirve Seedance 2.5 Lite para clips con audio. El flujo es asíncrono: creas una predicción, la consultas y lees la salida cuando el estado indica succeeded.
Consigue acceso primero
Elige el plan Infinite. Figuraba en €24 al mes con facturación anual, o €124 al mes con facturación mensual, en el momento de escribir. La página de la API indica que crear predicciones requiere este plan.
Crea una credencial de acceso. Abre la página de la API de PicassoIA en tu cuenta y genera una. Empieza por pia_sk_, y cada cuenta puede tener dos. Guárdala en una variable de entorno, nunca en tu repositorio.
La URL base es https://api.picassoia.com/v1, y la autenticación es un token Bearer. Esta solicitud pide un clip de cinco segundos:
curl -s -X POST https://api.picassoia.com/v1/models/picassoia/picassoia-video/predictions \
-H "Authorization: Bearer $PICASSOIA_TOKEN" \
-H "Content-Type: application/json" \
-d '{"input": {"prompt": "a paper boat sailing down a rainy street", "duration": 5}}'
La respuesta devuelve un ID de predicción. Solo es obligatorio prompt, y acepta de 1 a 4000 caracteres. Si la llamada se rechaza, revisa primero la credencial y el plan: una cuenta sin plan Infinite no puede crear predicciones, aunque sí puede leer, listar y cancelar las que ya tiene.
Consulta el resultado
Envía el ID al endpoint de predicciones hasta que el estado se estabilice:
El estado pasa por starting y processing hasta succeeded, failed o canceled. Un fallo es definitivo, así que envía una predicción nueva en lugar de esperar. Consulta cada pocos segundos y mantén el total en curso igual o por debajo del tope de 5.
Ajusta los parámetros
Campo
Qué hace
Notas
prompt
Describe el clip
Obligatorio, de 1 a 4000 caracteres
image
Fija el primer fotograma
URL HTTPS o URL de datos, convierte la llamada en imagen a video
resolution
Tamaño de salida
480p por defecto, 720p, 1080p
duration
Duración en segundos
Hasta 20 a 480p, 10 a 720p, 5 a 1080p
aspect_ratio
Forma del fotograma
16:9, 9:16, 1:1, 4:3, 3:4, 3:2, 2:3
save_audio
Conserva la pista de audio
Por defecto true
seed
Repite un resultado
Actívalo cuando quieras un borrador reproducible
Escribe los prompts como una escena corta y cronológica: el sujeto y su pose inicial, el movimiento a lo largo del clip, el movimiento de cámara y, después, la luz. "Una mujer con un suéter crema levanta una taza de café, travelling lento hacia delante, luz cálida de la mañana entrando por una ventana a la izquierda" supera a "video bonito de café" en todos los casos.
💡 Consejo: haz borradores a 480p con una semilla fija y regenera solo los ganadores a 720p. Conservas la composición y gastas el tiempo extra solo donde compensa.
Qué opción encaja con tu proyecto
Prototipo o proyecto paralelo. Usa pesos abiertos si ya tienes una GPU capaz. Si no la tienes, usa la API de PicassoIA mientras las predicciones sean gratuitas y mantén el wrapper fino para que un cambio de precios no te afecte.
Trabajo para clientes y apps en producción. Elige un proveedor con una tabla de tarifas publicada y condiciones estables, como Veo 3.1 Fast, y presupuesta con la fórmula de intentos. Obtén las respuestas sobre licencias por escrito.
Pipelines de alto volumen. Pon todo en cola, respeta el tope de concurrencia, haz borradores en baja resolución y acabados en alta y registra el costo por clip utilizable. Esa única métrica te dice cuándo cambiar de modelo.
Situación
Mejor opción
Por qué
Probar prompts e ideas
Pesos abiertos o la API de PicassoIA
Sin cargo por clip del que preocuparse
Entregable para cliente
Un proveedor con tabla de tarifas publicada
Condiciones estables y costo predecible
Cientos de clips a la semana
Una mezcla de borradores baratos y un acabado premium
Mantiene pequeño el término de intentos
Errores que desperdician el presupuesto
Renderizar a 1080p antes de que el prompt funcione. Haz primero un borrador a 480p. Un prompt malo cuesta lo mismo fallar a cualquier resolución, pero solo una de ellas es barata.
Contar clips generados en lugar de utilizables. Lleva un registro de la tasa de aprovechamiento por modelo. Un modelo con tarifa baja y mala tasa de aprovechamiento puede costar más que uno más caro.
Ignorar el tope de concurrencia. Un bucle que lanza cincuenta solicitudes a la vez alcanzará el límite y fallará en bloque. Usa una cola.
Diseñar en torno a una promoción. El acceso gratuito a la API puede terminar. Pon el proveedor detrás de una interfaz desde el primer commit.
Saltarte la lectura de la licencia. El clip más barato es el más caro de todos si no se puede publicar.
Haz tu primer clip hoy
No necesitas resolver la cuestión del precio antes de empezar. Escribe un prompt, ejecútalo en dos modelos y compara los resultados lado a lado. Abre PicassoIA Video y Seedance 2.5 Lite en Picasso IA, pega la misma descripción de escena en cada uno y mira cuál te da un clip que valga la pena conservar.
Cuando el resultado te parezca correcto, copia la solicitud cURL de este artículo, cambia tu propio prompt e intégrala en tu app. Crea tu primer video en Picasso IA hoy y deja que tus propios resultados decidan qué opción gana un lugar en tu conjunto de herramientas.