Chave de API do Veo 3.1: acesso gratuito, limites e rate limit

O Google lista o Veo 3.1, o Veo 3.1 Fast e o Veo 3.1 Lite como pagos apenas na API Gemini. Este artigo detalha o preço de cada clipe, como funcionam os rate limits por projeto e os níveis de uso, como evitar erros 429 e onde você pode testar o Veo 3.1 sem escrever código.

Chave de API do Veo 3.1: acesso gratuito, limites e rate limit
Cristian Da Conceicao
Fundador do Picasso IA

Se você procurou uma credencial gratuita do Veo 3.1, aqui vai a resposta rápida: o Google não oferece uma. Na página de preços da API Gemini, todas as versões do Veo 3.1 aparecem como "Not available" na coluna da camada gratuita, e a camada paga cobra por cada segundo de vídeo gerado. Essa única informação explica a maior parte da confusão que circula online, incluindo os fóruns em que estudantes com um plano gratuito do Google AI Pro conversam com o Gemini o dia inteiro, mas batem em um muro assim que chamam o Veo a partir de um código.

Este artigo mostra quanto custa o Veo 3.1 por clipe, como os rate limits do Google realmente funcionam, como evitar erros de cota 429 e as formas mais baratas de testar o modelo antes de gastar dinheiro. Preços e limites vêm da própria documentação do Google, verificados em 6 de outubro de 2026. Eles mudam com frequência, então confirme nas páginas oficiais antes de comprometer um orçamento.

O que o Google realmente oferece

Três nomes de modelo para conhecer

Pela API Gemini, o Veo 3.1 chega como três códigos de modelo em prévia:

  • veo-3.1-generate-preview é o modelo padrão.
  • veo-3.1-fast-generate-preview é a opção mais rápida e mais barata.
  • veo-3.1-lite-generate-preview é a opção de menor preço, limitada a 720p e 1080p.

Cada chamada é assíncrona. Você envia uma solicitação, recebe um objeto de operação e consulta essa operação até o clipe ficar pronto. O Google indica uma latência de 11 segundos, no melhor caso, a 6 minutos nos horários de pico, então construa seu código contando com a espera, em vez de bloquear a execução.

Você pode testar os mesmos três modelos sem entrar no Google Cloud: Veo 3.1, Veo 3.1 Fast e Veo 3.1 Lite estão todos disponíveis no Picasso IA.

Desenvolvedor digitando em um notebook em um espaço de coworking iluminado enquanto confere as especificações do modelo Veo 3.1

Regras de saída que mudam sua conta

A ficha técnica importa porque várias opções exigem uma duração ou resolução específica, e essas escolhas definem seu preço.

RecursoVeo 3.1Veo 3.1 FastVeo 3.1 Lite
Resolução720p, 1080p, 4K720p, 1080p, 4K720p, 1080p
Duração4, 6 ou 8 segundos4, 6 ou 8 segundos4, 6 ou 8 segundos
Proporção16:9 ou 9:1616:9 ou 9:1616:9 ou 9:16
Imagens de referênciaAté 3Até 3Não suportado
Extensão de vídeoSimSimNão suportado

Algumas regras estão escondidas nas letras miúdas:

  • 8 segundos é obrigatório para 1080p, 4K, imagens de referência e extensões. Um clipe de 1080p com 4 segundos não existe.
  • As extensões adicionam 7 segundos por etapa, até 20 vezes, e rodam apenas em 720p.
  • Cada solicitação retorna um vídeo, e o prompt de texto tem o limite de 1.024 tokens.
  • Todo clipe leva uma marca d’água SynthID.
  • O Google mantém os arquivos gerados em seus servidores por 2 dias.

💡 Dica: Baixe cada clipe assim que a operação terminar. Depois de dois dias o arquivo some, e você paga de novo para gerá-lo outra vez.

O acesso gratuito é real?

O que a camada gratuita faz

A camada gratuita do Google é uma área de testes sem custo para modelos de texto. O Veo não faz parte dela. A página de preços lista o Veo 3.1, o Veo 3.1 Fast e o Veo 3.1 Lite como "Not available" na camada gratuita, então um projeto sem conta de faturamento não consegue executá-los.

Isso significa que qualquer site que prometa uma API do Veo 3.1 gratuita normalmente está revendendo acesso por meio de uma conta paga própria, impondo limites rígidos ao seu uso ou coletando seu e-mail. Desconfie de tokens de acesso gratuitos de vendedores desconhecidos. Não existe camada gratuita legítima para distribuir.

Planos individuais não são a API

Assinantes do Google AI Pro e do Google AI Ultra podem gerar clipes do Veo 3.1 dentro dos próprios aplicativos do Google. Trata-se de um produto separado, com limites próprios, e não dá acesso à API. Posts em fóruns mostram estudantes com um plano gratuito do Google AI Pro recebendo erros 429 RESOURCE_EXHAUSTED quando chamam o Veo a partir de um código, mesmo com a geração de texto funcionando bem para eles.

Se seu objetivo é ver o que o Veo 3.1 produz e testar prompts, um aplicativo ou uma ferramenta no navegador basta. Se seu objetivo é automação, você precisa de um projeto com faturamento ativado. A página do Veo 3.1 no Picasso IA descreve o modelo como gratuito e online, sem necessidade de programar, o que a torna uma boa área de testes antes de você pagar por segundo.

Estudante em uma mesa de biblioteca olhando confuso para um notebook depois de um erro da camada gratuita do Veo 3.1

Preço por segundo, clipe a clipe

A tabela de preços

O Google cobra a camada paga por segundo de vídeo gerado. Estes são os preços listados em dólares americanos, ao lado do custo de um clipe de 8 segundos:

ModeloResoluçãoPreço por segundoUm clipe de 8 segundos
Veo 3.1720p e 1080pUS$ 0,40US$ 3,20
Veo 3.14KUS$ 0,60US$ 4,80
Veo 3.1 Fast720pUS$ 0,10US$ 0,80
Veo 3.1 Fast1080pUS$ 0,12US$ 0,96
Veo 3.1 Fast4KUS$ 0,30US$ 2,40
Veo 3.1 Lite720pUS$ 0,05US$ 0,40
Veo 3.1 Lite1080pUS$ 0,08US$ 0,64

Duas diferenças se destacam. O Fast em 1080p custa US$ 0,12 por segundo contra US$ 0,40 no modelo padrão, um corte de 70 por cento. O Lite em 1080p custa um quinto do preço padrão para a mesma resolução. Um clipe de 4 segundos no modelo padrão fica em US$ 1,60, então execuções mais curtas somam devagar, mas ainda somam.

Vista de cima de uma calculadora, uma planilha e um café usados para orçar os custos de vídeo do Veo 3.1

Conta de orçamento para 100 clipes

Considere 100 clipes de 8 segundos cada, o que dá 800 segundos de vídeo:

  • Veo 3.1 em 1080p: 800 × US$ 0,40 = US$ 320
  • Veo 3.1 Fast em 1080p: 800 × US$ 0,12 = US$ 96
  • Veo 3.1 Lite em 720p: 800 × US$ 0,05 = US$ 40

Agora um plano mais inteligente. Crie os 100 rascunhos no Lite em 720p por US$ 40, escolha os 10 melhores e renderize apenas esses no modelo padrão em 1080p: 80 segundos × US$ 0,40 = US$ 32. O total fica em US$ 72 em vez de US$ 320, cerca de 78 por cento a menos pelos mesmos dez clipes finalizados.

💡 Dica: Os preços se aplicam aos segundos de vídeo gerado. Antes de um lote grande, confira seu painel de faturamento para ver como as solicitações filtradas ou com falha aparecem.

Rate limits e erros de cota

Como o Google conta os limites

Os limites da API Gemini são medidos de três formas: solicitações por minuto (RPM), tokens de entrada por minuto (TPM) e solicitações por dia (RPD). Ultrapassou qualquer um deles e a chamada falha. Dois detalhes pegam as pessoas de surpresa:

  • Os limites se aplicam por projeto, não por credencial de API. Uma segunda credencial dentro do mesmo projeto não dá espaço extra.
  • As cotas diárias são zeradas à meia-noite, no horário do Pacífico.

O seu nível de uso define quanto espaço você recebe:

NívelComo você se qualifica
GratuitoUm projeto ativo ou um teste gratuito
Nível 1Uma conta de faturamento ativa
Nível 2US$ 100 e 3 dias desde o primeiro pagamento bem-sucedido
Nível 3US$ 1.000 e 30 dias desde o primeiro pagamento bem-sucedido

O Google também aplica limites de gastos em uma janela deslizante de 10 minutos nos níveis pagos, o que importa quando um script dispara dezenas de renderizações em 4K de uma vez.

Aqui está a parte honesta: a página de rate limits do Google não publica um RPM, uma simultaneidade ou um teto diário específico do Veo. Blogs de terceiros citam números como 10 solicitações por minuto para vídeo, mas não consegui associá-los a nenhuma página do Google, então trate-os como boatos. Leia seus números atuais na visualização de uso do Google AI Studio.

Técnico caminhando por um corredor de servidores, uma imagem dos rate limits da API Gemini por projeto

Como corrigir o erro 429 RESOURCE_EXHAUSTED

A mensagem diz: Você excedeu sua cota atual, verifique seu plano e os detalhes de faturamento. A equipe do Google descreve o erro como um rate limit atingido, ou seja, solicitações demais por minuto. A orientação deles é ficar dentro dos limites do modelo e pedir um aumento de cota quando precisar de mais.

Siga esta lista, nesta ordem:

  1. Ative o faturamento. Um projeto na camada gratuita não consegue chamar o Veo de jeito nenhum, e o erro aparece igual.
  2. Envie um trabalho por vez. Consulte a operação que você já tem em vez de reenviar.
  3. Recue de forma exponencial. Espere 1, 2, 4 e 8 segundos antes de cada nova tentativa, mais um pequeno jitter aleatório.
  4. Peça mais cota quando já estiver em um nível pago e ainda bater no teto.

Editor de vídeo frustrado, recostado para trás longe do monitor depois de um erro de cota do Veo 3.1

Aqui está um pequeno wrapper de nova tentativa para o SDK oficial de Python:

import random
import time
from google.genai import errors

def submit_with_backoff(make_call, tries=5):
    for attempt in range(tries):
        try:
            return make_call()
        except errors.APIError as exc:
            if exc.code != 429 or attempt == tries - 1:
                raise
            time.sleep(2 ** attempt + random.random())

Três formas de obter acesso

API Gemini pelo AI Studio

Este é o caminho direto. Crie um projeto no Google Cloud, ative o faturamento, gere uma credencial no Google AI Studio e depois instale o SDK com pip install google-genai. Este exemplo envia uma tarefa com o modelo Fast e consulta até ela terminar:

import time
from google import genai
from google.genai import types

client = genai.Client()  # reads the credential from your environment

operation = client.models.generate_videos(
    model="veo-3.1-fast-generate-preview",
    prompt="Slow dolly shot through a rainy night market, steam rising from food stalls",
    config=types.GenerateVideosConfig(aspect_ratio="16:9", resolution="720p"),
)

while not operation.done:
    time.sleep(10)
    operation = client.operations.get(operation)

video = operation.response.generated_videos[0]
client.files.download(file=video.video)
video.video.save("market.mp4")

Equipes que já rodam no Google Cloud também podem acessar o Veo 3.1 pela Vertex AI, onde a cota é gerenciada no nível do projeto e os aumentos passam por uma solicitação de cota.

Picasso IA sem código

O Picasso IA executa toda a família Veo 3.1 a partir de páginas no navegador, então não há projeto no Google Cloud, conta de faturamento nem painel de cotas para gerenciar. Abra o Veo 3.1, o Veo 3.1 Fast ou o Veo 3.1 Lite, escreva um prompt e baixe o resultado.

Desenvolvedores que querem uma API ali encontram um conjunto diferente de modelos. A API do Picasso IA fica em https://api.picassoia.com/v1, usa um token bearer que começa com pia_sk_ e segue o padrão do Replicate: criar uma predição, consultá-la e buscar a saída. Ela expõe quatro modelos, dois deles para vídeo: Picasso IA Video e Seedance 2.5 Lite. A família Veo não está nessa lista. Os limites são 5 predições simultâneas por conta, prompts de 4.000 caracteres e um tempo limite de 3 horas. O site descreve as predições pela API como atualmente gratuitas, mas a documentação também menciona um plano Infinite, então confira a página de preços antes de construir algo sobre isso.

Como usar o Veo 3.1 no PicassoIA

O fluxo de trabalho leva cinco minutos:

  1. Abra a página do Veo 3.1.
  2. Escreva um prompt.
  3. Escolha duração, resolução e proporção.
  4. Adicione uma imagem inicial, uma imagem final ou referências, se precisar.
  5. Gere, revise o clipe e baixe.

Escreva o prompt

O Veo 3.1 gera som junto com a imagem, então escreva pensando nos dois. Uma estrutura confiável é sujeito, ação, movimento de câmera, iluminação e, por último, áudio. Por exemplo: Um músico de rua toca violino sob um arco de pedra ao entardecer, uma aproximação lenta nas mãos dele, luz quente de lampião, murmúrio suave da multidão e cordas ecoando.

Use o campo de prompt negativo para excluir o que você não quer, como textos sobrepostos ou pessoas extras.

Não sabe como formular uma cena? Peça a um LLM que crie cinco variações antes. O Gemini 3.5 Flash é rápido para fazer brainstorming, e o Claude Sonnet 5 ou o GPT 5.6 Terra funcionam igualmente bem. Cole sua ideia, peça sujeito, ação, câmera, luz e som em um único parágrafo e escolha o melhor rascunho.

Mãos digitando um prompt do Veo 3.1 em um notebook sobre uma bancada de cozinha iluminada

Escolha duração e resolução

O formulário do Picasso IA expõe estas configurações:

ConfiguraçãoOpçõesPadrão
Duração4, 6 ou 8 segundos8
Resolução720p ou 1080p1080p
Proporção16:9 ou 9:1616:9
Gerar áudioLigado ou desligadoLigado
SeedQualquer número inteiroAleatória

Use 9:16 para clipes verticais de redes sociais e 16:9 para todo o resto. Em testes, reduza para 4 segundos em 720p e mude para 8 segundos em 1080p quando o prompt funcionar. Reutilize a mesma seed ao repetir um prompt para comparar as mudanças de forma justa.

Videógrafo ajustando um tripé e uma câmera de cinema, uma imagem da escolha de configurações do Veo 3.1

Adicione referências ou quadros

Três entradas opcionais dão mais controle:

  • Imagem inicial: envie uma foto para animar. Os tamanhos ideais são 1280×720 ou 720×1280, de acordo com sua proporção.
  • Último quadro: adicione uma imagem final junto com a imagem inicial e o Veo cria a transição entre as duas.
  • Imagens de referência: envie de 1 a 3 imagens para manter um sujeito consistente. Isso funciona apenas com 16:9 e 8 segundos, e o último quadro é ignorado quando há referências.

Hábitos que mantêm os custos baixos

Rascunhe barato, renderize uma vez

Cada renderização extra custa dinheiro de verdade em uma API paga, então trate os modelos baratos como seu caderno de esboços. Faça os primeiros rascunhos no Veo 3.1 Lite ou no Veo 3.1 Fast e reserve o Veo 3.1 para a versão final.

Outros modelos também valem um teste para rascunhos. O Veo 3 Fast cria vídeos com áudio a partir de texto, o LTX 2.5 Fast é indicado para saídas rápidas em 4K, e o Seedance 2.5 Lite é listado como um gerador gratuito e sem limites, com clipes de até 10 segundos.

Dois colegas comparando quadros de storyboard impressos e clipes pausados antes da renderização final do Veo 3.1

Baixe e armazene cedo

O Google apaga os arquivos gerados após 2 dias, e um clipe esquecido significa pagar de novo. Torne o salvamento parte do seu script, não um passo manual. Mantenha um registro simples com o prompt, o código do modelo, a seed, a resolução e o nome do arquivo de cada renderização. Quando um cliente pedir "a versão da última terça", você a encontrará em segundos e evitará uma cobrança repetida.

HD externo e leitor de cartão de memória ao lado de um calendário de parede para armazenar clipes do Veo 3.1

Experimente o Veo 3.1 no Picasso IA

Ler sobre preço por segundo é uma coisa. Ver o seu próprio prompt virar um clipe é outra. Abra o Veo 3.1 no Picasso IA, digite uma cena, escolha 720p e 4 segundos e veja como o modelo lida com a sua ideia antes de gastar um centavo com chamadas de API. Teste uma imagem inicial, adicione fotos de referência, troque para o Veo 3.1 Fast se quiser velocidade e compare os resultados lado a lado. Quanto mais prompts você testar agora, menos renderizações pagará depois.

Compartilhe este artigo

Escolha seu idioma