Clave API de Veo 3.1: acceso gratuito, límites y rate limit
Google indica que Veo 3.1, Veo 3.1 Fast y Veo 3.1 Lite son solo de pago en la API de Gemini. Este artículo desglosa el precio de cada clip, cómo funcionan los límites por proyecto y los niveles de uso, cómo evitar los errores 429 y dónde puedes probar Veo 3.1 sin escribir código.
Si buscabas una credencial gratuita de Veo 3.1, aquí va la respuesta corta: Google no ofrece ninguna. En la página de precios de la API de Gemini, todas las variantes de Veo 3.1 muestran «No disponible» en la columna del nivel gratuito, y el nivel de pago cobra cada segundo de video que generas. Esa sola línea explica buena parte de la confusión en internet, incluidos los hilos de foros en los que estudiantes con un plan gratuito de Google AI Pro pueden chatear con Gemini todo el día, pero se encuentran con un bloqueo en cuanto llaman a Veo desde código.
Este artículo explica cuánto cuesta Veo 3.1 por clip, cómo funcionan de verdad los límites de Google, cómo detener los errores de cuota 429 y las formas más baratas de probar el modelo antes de gastar dinero. Los precios y los límites provienen de la documentación oficial de Google, revisada el 6 de octubre de 2026. Cambian con frecuencia, así que confírmalos en las páginas oficiales antes de comprometer un presupuesto.
Lo que Google ofrece en realidad
Tres nombres de modelo que conviene conocer
A través de la API de Gemini, Veo 3.1 llega en tres códigos de modelo en vista previa:
veo-3.1-generate-preview es el modelo estándar.
veo-3.1-fast-generate-preview es la versión más rápida y barata.
veo-3.1-lite-generate-preview es la opción de precio más bajo, limitada a 720p y 1080p.
Cada llamada es asíncrona. Envías una solicitud, recibes un objeto de operación y lo consultas hasta que el clip esté listo. Google indica una latencia de 11 segundos en el mejor de los casos y de hasta 6 minutos en horas punta, así que diseña tu código para esperar en lugar de bloquearse.
Puedes probar los mismos tres modelos sin tocar Google Cloud: Veo 3.1, Veo 3.1 Fast y Veo 3.1 Lite están disponibles en Picasso IA.
Reglas de salida que cambian tu factura
La ficha técnica importa porque varias opciones obligan a una duración o resolución concretas, y esas elecciones fijan tu precio.
Función
Veo 3.1
Veo 3.1 Fast
Veo 3.1 Lite
Resolución
720p, 1080p, 4K
720p, 1080p, 4K
720p, 1080p
Duración
4, 6 u 8 segundos
4, 6 u 8 segundos
4, 6 u 8 segundos
Relación de aspecto
16:9 o 9:16
16:9 o 9:16
16:9 o 9:16
Imágenes de referencia
Hasta 3
Hasta 3
No compatible
Extensión de video
Sí
Sí
No compatible
Hay algunas reglas escondidas en la letra pequeña:
Los 8 segundos son obligatorios para 1080p, 4K, imágenes de referencia y extensiones. Un clip de 4 segundos en 1080p no existe.
Las extensiones añaden 7 segundos por paso, hasta 20 veces, y solo funcionan en 720p.
Cada solicitud devuelve un video, y el prompt de texto llega como máximo a 1.024 tokens.
Cada clip lleva una marca de agua SynthID.
Google conserva los archivos generados en sus servidores durante 2 días.
💡 Consejo: Descarga cada clip en cuanto termine la operación. Pasados dos días, el archivo desaparece y tienes que pagar de nuevo para regenerarlo.
¿Es real el acceso gratuito?
Qué hace el nivel gratuito
El nivel gratuito de Google es un entorno de pruebas sin costo para modelos de texto. Veo no está incluido. La página de precios muestra Veo 3.1, Veo 3.1 Fast y Veo 3.1 Lite como «No disponible» en el nivel gratuito, así que un proyecto sin cuenta de facturación no puede ejecutarlos.
Eso significa que cualquier sitio que prometa una API de Veo 3.1 gratuita suele revender acceso a través de su propia cuenta de pago, limitarte mucho o recopilar tu correo electrónico. Desconfía de los tokens de acceso gratuito de vendedores desconocidos. No existe ningún nivel gratuito legítimo que se pueda repartir.
Los planes para particulares no son la API
Los suscriptores de Google AI Pro y Google AI Ultra pueden generar clips de Veo 3.1 dentro de las propias aplicaciones de Google. Es un producto aparte con sus propios límites, y no te da acceso a la API. En los foros hay estudiantes con un plan gratuito de Google AI Pro que reciben errores 429 RESOURCE_EXHAUSTED al llamar a Veo desde código, aunque la generación de texto les funciona bien.
Si tu objetivo es ver qué produce Veo 3.1 y probar prompts, basta con una aplicación o una herramienta en el navegador. Si tu objetivo es la automatización, necesitas un proyecto con facturación activada. La página de Veo 3.1 en Picasso IA lo describe como gratuito y en línea, sin necesidad de programar, lo que lo convierte en un buen entorno de pruebas antes de pagar por segundo.
Precio por segundo, clip a clip
La tabla de precios
Google cobra el nivel de pago por segundo de video generado. Estos son los precios publicados en dólares estadounidenses, junto con lo que cuesta un clip de 8 segundos:
Modelo
Resolución
Precio por segundo
Un clip de 8 segundos
Veo 3.1
720p y 1080p
$0,40
$3,20
Veo 3.1
4K
$0,60
$4,80
Veo 3.1 Fast
720p
$0,10
$0,80
Veo 3.1 Fast
1080p
$0,12
$0,96
Veo 3.1 Fast
4K
$0,30
$2,40
Veo 3.1 Lite
720p
$0,05
$0,40
Veo 3.1 Lite
1080p
$0,08
$0,64
Hay dos diferencias destacables. Fast en 1080p cuesta $0,12 por segundo frente a $0,40 del modelo estándar, un recorte del 70 %. Lite en 1080p cuesta una quinta parte del precio estándar para la misma resolución. Un clip de 4 segundos en el modelo estándar sale por $1,60, así que las tomas cortas suman poco a poco, pero suman igualmente.
Cálculo del presupuesto para 100 clips
Tomemos 100 clips de 8 segundos cada uno, es decir, 800 segundos de video:
Veo 3.1 en 1080p: 800 × $0,40 = $320
Veo 3.1 Fast en 1080p: 800 × $0,12 = $96
Veo 3.1 Lite en 720p: 800 × $0,05 = $40
Ahora, un plan más inteligente: haz borradores de las 100 ideas en Lite a 720p por $40, elige las 10 mejores y renderiza solo esas en el modelo estándar a 1080p: 80 segundos × $0,40 = $32. El total es de $72 en lugar de $320, alrededor de un 78 % menos para los mismos diez clips terminados.
💡 Consejo: Los precios se aplican a los segundos de video generado. Antes de un lote grande, revisa tu panel de facturación para ver cómo aparecen las solicitudes filtradas o fallidas.
Rate limits y errores de cuota
Cómo cuenta Google los límites
Los límites de la API de Gemini se miden de tres formas: solicitudes por minuto (RPM), tokens de entrada por minuto (TPM) y solicitudes por día (RPD). Si superas cualquiera de ellos, la llamada falla. Hay dos detalles que pillan desprevenido a más de uno:
Los límites se aplican por proyecto, no por credencial de API. Una segunda credencial dentro del mismo proyecto no te da más margen.
Las cuotas diarias se reinician a medianoche, hora del Pacífico.
Tu nivel de uso determina cuánto margen tienes:
Nivel
Cómo calificas
Gratuito
Un proyecto activo o una prueba gratuita
Nivel 1
Una cuenta de facturación activa
Nivel 2
$100 y 3 días desde el primer pago exitoso
Nivel 3
$1.000 y 30 días desde el primer pago exitoso
Google también aplica topes de gasto en una ventana móvil de 10 minutos en los niveles de pago, algo que importa cuando un script lanza decenas de renders en 4K a la vez.
Lo honesto es lo siguiente: la página de límites de Google no publica un RPM, una concurrencia ni un tope diario específicos para Veo. Algunos blogs de terceros citan cifras como 10 solicitudes por minuto para video, pero no he podido relacionarlas con ninguna página de Google, así que tómalas como rumores. Consulta tus cifras en tiempo real en la vista de uso de Google AI Studio.
Cómo corregir el error 429 RESOURCE_EXHAUSTED
El mensaje dice: You exceeded your current quota, please check your plan and billing details. El personal de Google lo describe como un rate limit alcanzado, es decir, demasiadas solicitudes por minuto. Su consejo es mantenerse dentro de los límites del modelo y pedir un aumento de cuota cuando lo necesites.
Sigue esta lista en orden:
Vincula la facturación. Un proyecto del nivel gratuito no puede llamar a Veo en absoluto, y el error se ve igual.
Envía un trabajo cada vez. Consulta la operación que ya tienes en lugar de volver a enviarla.
Aplica una espera exponencial. Espera 1, 2, 4 y 8 segundos antes de cada reintento, más una pequeña variación aleatoria (jitter).
Solicita más cuota cuando ya estés en un nivel de pago y sigas tocando el techo.
Este es un pequeño wrapper de reintentos para el SDK oficial de Python:
import random
import time
from google.genai import errors
def submit_with_backoff(make_call, tries=5):
for attempt in range(tries):
try:
return make_call()
except errors.APIError as exc:
if exc.code != 429 or attempt == tries - 1:
raise
time.sleep(2 ** attempt + random.random())
Tres formas de obtener acceso
API de Gemini a través de AI Studio
Es la vía directa. Crea un proyecto de Google Cloud, vincula la facturación, genera una credencial en Google AI Studio y luego instala el SDK con pip install google-genai. Este ejemplo envía un trabajo con el modelo Fast y consulta el estado hasta que termina:
import time
from google import genai
from google.genai import types
client = genai.Client() # reads the credential from your environment
operation = client.models.generate_videos(
model="veo-3.1-fast-generate-preview",
prompt="Slow dolly shot through a rainy night market, steam rising from food stalls",
config=types.GenerateVideosConfig(aspect_ratio="16:9", resolution="720p"),
)
while not operation.done:
time.sleep(10)
operation = client.operations.get(operation)
video = operation.response.generated_videos[0]
client.files.download(file=video.video)
video.video.save("market.mp4")
Los equipos que ya trabajan en Google Cloud también pueden usar Veo 3.1 a través de Vertex AI, donde la cuota se gestiona a nivel de proyecto y los aumentos se piden mediante una solicitud de cuota.
Picasso IA sin código
Picasso IA ejecuta toda la familia Veo 3.1 desde páginas del navegador, así que no hay ningún proyecto de Google Cloud, cuenta de facturación ni panel de cuotas que gestionar. Abre Veo 3.1, Veo 3.1 Fast o Veo 3.1 Lite, escribe un prompt y descarga el resultado.
Los desarrolladores que quieran una API allí encontrarán un conjunto distinto de modelos. La API de Picasso IA está en https://api.picassoia.com/v1, usa un token bearer que empieza por pia_sk_ y sigue el patrón de Replicate: crear una predicción, consultarla y recuperar la salida. Expone cuatro modelos, dos de ellos para video: Picasso IA Video y Seedance 2.5 Lite. La familia Veo no aparece en esa lista. Los límites son 5 predicciones simultáneas por cuenta, prompts de 4.000 caracteres y un tiempo de espera de 3 horas. El sitio describe las predicciones de la API como gratuitas por ahora, pero su documentación también menciona el plan Infinite, así que revisa la página de precios antes de construir nada sobre eso.
Añade una imagen inicial, una imagen final o referencias si las necesitas.
Genera, revisa el clip y descárgalo.
Escribe el prompt
Veo 3.1 genera sonido junto con la imagen, así que escribe para ambos. Una estructura fiable es sujeto, acción, movimiento de cámara, iluminación y, después, audio. Por ejemplo: Un músico callejero toca el violín bajo un arco de piedra al anochecer, un lento acercamiento hacia sus manos, luz cálida de farola, murmullo suave de la gente y cuerdas que resuenan.
Usa el campo de prompt negativo para excluir lo que no quieras, como textos superpuestos o personas de más.
¿No sabes cómo formular una escena? Pídele a un modelo de lenguaje (LLM) que redacte cinco variantes primero. Gemini 3.5 Flash es rápido para generar ideas, y Claude Sonnet 5 o GPT 5.6 Terra funcionan igual de bien. Pega tu idea, pide sujeto, acción, cámara, luz y sonido en un solo párrafo y elige el borrador que mejor funcione.
Elige duración y resolución
El formulario de Picasso IA muestra estos ajustes:
Ajuste
Opciones
Predeterminado
Duración
4, 6 u 8 segundos
8
Resolución
720p o 1080p
1080p
Relación de aspecto
16:9 o 9:16
16:9
Generar audio
Activado o desactivado
Activado
Semilla
Cualquier número entero
Aleatoria
Usa 9:16 para clips verticales de redes sociales y 16:9 para todo lo demás. En las pruebas, baja a 4 segundos a 720p y, cuando el prompt funcione, pasa a 8 segundos a 1080p. Reutiliza la misma semilla al volver a ejecutar un prompt para comparar los cambios de forma justa.
Añade referencias o fotogramas
Tres entradas opcionales te dan más control:
Imagen inicial: sube una foto para animarla. Los tamaños ideales son 1280×720 o 720×1280, según tu relación de aspecto.
Último fotograma: añade una imagen final junto con la inicial y Veo crea la transición entre ambas.
Imágenes de referencia: sube de 1 a 3 imágenes para mantener la coherencia de un sujeto. Solo funciona con 16:9 y 8 segundos, y el último fotograma se ignora cuando hay referencias.
Hábitos que mantienen los costos bajos
Borradores baratos, un solo render
Cada render extra cuesta dinero real en una API de pago, así que trata los modelos baratos como tu cuaderno de bocetos. Haz los primeros borradores con Veo 3.1 Lite o Veo 3.1 Fast, y guarda Veo 3.1 para la pasada final.
Otros modelos también merecen una prueba para borradores. Veo 3 Fast crea videos con audio a partir de texto, LTX 2.5 Fast aparece como opción para salidas rápidas en 4K y Seedance 2.5 Lite figura como generador gratuito e ilimitado con clips de hasta 10 segundos.
Descarga y guarda cuanto antes
Google elimina los archivos generados a los 2 días, y un clip olvidado significa volver a pagar. Haz que guardar sea parte de tu script, no un paso manual. Lleva un registro sencillo con el prompt, el código del modelo, la semilla, la resolución y el nombre del archivo de cada render. Cuando un cliente pida «la versión del martes pasado», la encontrarás en segundos y evitarás un cobro duplicado.
Prueba Veo 3.1 en Picasso IA
Leer sobre precios por segundo es una cosa. Ver cómo tu propio prompt se convierte en un clip es otra. Abre Veo 3.1 en Picasso IA, escribe una escena, elige 720p y 4 segundos, y comprueba cómo maneja el modelo tu idea antes de gastar un céntimo en llamadas a la API. Prueba con una imagen inicial, añade fotos de referencia, cambia a Veo 3.1 Fast si quieres velocidad y compara los resultados lado a lado. Cuantos más prompts pruebes ahora, menos renders tendrás que pagar después.