API de geração de vídeo: opções gratuitas, preços e custos

Uma API de geração de vídeo cobra por segundo, e a diferença entre US$ 0,05 e US$ 0,60 por segundo se acumula rápido. Este artigo mostra quais opções são gratuitas, quanto custam de fato as faixas por segundo, como as novas tentativas inflam a conta e uma fórmula simples para orçar seu primeiro mês de clipes.

API de geração de vídeo: opções gratuitas, preços e custos
Cristian Da Conceicao
Fundador do Picasso IA

Uma API de geração de vídeo não cobra por mês. Ela cobra por segundo de material, e esse detalhe decide se seu projeto custa um almoço ou um notebook. O Google lista o Veo 3.1 Lite a US$ 0,05 por segundo em 720p e o Veo 3.1 a US$ 0,40 por segundo, uma diferença de oito vezes para o mesmo tamanho de clipe. Este artigo mostra quais opções são realmente gratuitas, quanto custam as pagas e como calcular o seu próprio número antes de escrever uma única linha de código.

Orçamento desenhado à mão em papel quadriculado, ao lado de uma calculadora e uma pilha de moedas

💡 Os preços mudam. Os valores abaixo vêm da tabela de preços da API Gemini do Google e da documentação de API da PicassoIA, ambas conferidas em outubro de 2026. Os provedores alteram as tarifas com frequência, então confirme a página atualizada antes de fechar um orçamento.

O que uma API de vídeo realmente faz

Uma API de vídeo é um endpoint web que recebe um prompt de texto, e às vezes uma imagem inicial, e devolve um clipe pronto. O detalhe é o tempo. Renderizar alguns segundos de material leva muito mais do que uma chamada de API comum, então a maioria dos provedores usa um padrão assíncrono em vez de manter a conexão aberta.

O ciclo de requisição, consulta e download

O ciclo tem três etapas:

  1. Criar: você envia um POST com seu prompt e configurações. O provedor responde na hora com um ID de predição e um status de starting.
  2. Consultar: você verifica esse ID em um intervalo de tempo até o status virar succeeded, failed ou canceled.
  3. Baixar: você baixa o MP4 da URL devolvida e o armazena em um lugar que você controla.

A API da PicassoIA segue esse padrão no estilo Replicate. O exemplo é renderizado na página do modelo PicassoIA Video em cerca de 30 a 80 segundos, então planeje seu intervalo de consulta com base nessa faixa, em vez de sobrecarregar o endpoint.

Engenheiro de backend inclinado em direção a um monitor, com um fluxograma desenhado à mão de três caixas conectadas em um bloco de notas

O que você está pagando de fato

Quatro fatores alteram a conta final:

  • Segundos de saída: a unidade base de quase todo provedor, então um clipe de 10 segundos custa o dobro de um clipe de 5 segundos.
  • Resolução: 720p, 1080p e 4K geralmente têm tarifas diferentes.
  • Faixa do modelo: as versões lite, fast e de ponta de uma mesma família podem diferir em até oito vezes.
  • Novas tentativas: cada take descartado é um take que você pagou mesmo assim.

Opções gratuitas que realmente existem

"Gratuito" é um termo carregado neste mercado. Algumas opções são gratuitas para usar, algumas são gratuitas para baixar e algumas são gratuitas só na primeira tarde. Aqui está a versão curta antes dos detalhes:

OpçãoTaxa por segundoO que você paga no lugarIdeal para
Camada gratuita do provedorNenhuma, quando oferecidaCrédito pequeno, limites apertadosTestar prompts e latência
Modelo de código aberto hospedado por vocêNenhumaHoras de GPU e manutençãoVolume alto e constante
API da PicassoIANenhuma por predição, segundo a documentaçãoUm plano e um limite de 5 slotsProtótipos e trabalhos em lote
API paga por segundoUS$ 0,05 a US$ 0,60 (faixas do Veo 3.1)DinheiroProdução que precisa de um modelo específico

Camadas gratuitas dos provedores

A tabela de preços da API Gemini do Google marca o Veo 3.1 como não disponível na camada gratuita, então cada segundo é cobrado desde a primeira requisição. Outros provedores de API às vezes concedem um pequeno crédito no cadastro. Trate esse crédito como um teste: é suficiente para testar prompts e medir a latência, mas não para rodar um produto. Aplicativos de consumo que distribuem créditos diários geralmente não estendem isso às chamadas de API.

Pesos abertos que você hospeda

Modelos abertos como o LTX Video e o Wan 2.1 1.3b não têm taxa por segundo, mas também não são gratuitos. Você paga em horas de GPU, tempo de configuração e manutenção. Uma comparação simples é o preço horário da GPU dividido pelo número de clipes renderizados por hora. Com uma GPU ilustrativa de US$ 1,00 por hora que renderiza 12 clipes por hora, cada clipe custa cerca de US$ 0,08 antes do tempo ocioso. Isso só vence uma API hospedada enquanto a GPU ficar ocupada.

Vista aérea de dois colegas em uma mesa de madeira compartilhada, com notebook, tablet, cadernos e um gráfico em papel

API da PicassoIA: predições gratuitas

A PicassoIA documenta sua API para desenvolvedores em https://api.picassoia.com/v1 e afirma: "API predictions are currently free. They use no credits." Quatro modelos estão expostos: PicassoIA Video, Seedance 2.5 Lite com áudio sincronizado, e dois modelos de imagem para geração e edição. A autenticação é um token Bearer que começa com pia_sk_, e uma conta pode ter até dois.

Os limites importam tanto quanto o preço:

  • 5 predições em fila ou em execução ao mesmo tempo por conta, compartilhadas entre todos os tokens e conexões MCP
  • 10 MB de corpo de requisição
  • 5 MB por imagem enviada como data URL
  • 4.000 caracteres por prompt

💡 Leia a linha sobre o plano. A documentação diz que contas do plano Infinite podem usar a API, e que as demais recebem um erro 403 plan_required. A página de preços, porém, lista o acesso à API nos planos Pro+, Elite e Infinite. As duas informações divergem hoje, então verifique qual plano sua conta precisa antes de construir sobre ele. Gratuito por predição não é o mesmo que gratuito sem nenhum plano.

Preços reais por segundo, comparados

A tabela do Google é o exemplo público mais claro de como as faixas escalam, porque uma mesma família de modelos aparece em três pontos de preço. Estas são as taxas por segundo da página de preços da API Gemini, com o custo dos clipes calculado para comparação. Ajuste-as para o tamanho que você realmente renderiza.

FaixaResoluçãoPor segundoClipe de 5 segundosClipe de 10 segundos
Veo 3.1 Lite720pUS$ 0,05US$ 0,25US$ 0,50
Veo 3.1 Lite1080pUS$ 0,08US$ 0,40US$ 0,80
Veo 3.1 Fast720pUS$ 0,10US$ 0,50US$ 1,00
Veo 3.1 Fast1080pUS$ 0,12US$ 0,60US$ 1,20
Veo 3.1 Fast4KUS$ 0,30US$ 1,50US$ 3,00
Veo 3.1 Standard720p e 1080pUS$ 0,40US$ 2,00US$ 4,00
Veo 3.1 Standard4KUS$ 0,60US$ 3,00US$ 6,00

Faixas baratas contra faixas de ponta

Dentro de uma mesma família, a diferença é grande. O Lite contra o Standard é 8x em 720p e 5x em 1080p. Outras famílias publicam suas próprias tarifas, entre elas o Seedance 2.5, o Kling v3 Video, o Wan 2.7 T2V e o LTX 2.3 Fast. As tarifas variam por provedor e mudam com frequência, então compare-as com a fórmula mais adiante neste artigo, em vez de confiar em uma captura de tela.

Uma faixa mais barata não é automaticamente a escolha pior. Rascunhos, storyboards e clipes para redes sociais raramente precisam do modelo de ponta, que você pode guardar para a renderização final.

O risco do fornecedor também é custo

A OpenAI anunciou que a API do Sora 2 seria desativada em 24 de setembro de 2026, e quem tinha construído um produto sobre ela precisou migrar. Uma taxa baixa significa pouco se o endpoint desaparece. Mantenha os prompts e as configurações independentes de provedor e prefira uma plataforma que coloque vários modelos atrás de uma mesma interface.

Pequeno estúdio de produção com uma câmera de cinema em tripé, uma softbox e um produtor revisando imagens em um monitor

Um clipe contra um dia de filmagem

Um clipe de 10 segundos na faixa lite custa US$ 0,50. Mesmo dez takes custam US$ 5,00, um trocado perto do aluguel de uma câmera ou de um dia de equipe. A comparação deixa de ser justa quando você precisa de uma pessoa real específica, um produto ou um local específico, porque a geração aproxima e a câmera captura. Use a API para trabalho de conceito, b-roll, fundos e clipes curtos para redes sociais, e filme o que precisa ser exato.

Custos escondidos atrás da taxa

O preço de etiqueta é o número mais barato que você verá. Outros três custos ficam por trás dele.

As novas tentativas consomem o orçamento

Modelos de vídeo não entregam um clipe perfeito na primeira tentativa, então o preço de etiqueta subestima o custo real. Divida o preço por clipe pela fração de takes que você de fato consegue usar. Com US$ 0,50 por clipe e uma taxa de acerto de um em cada quatro, cada clipe utilizável custa US$ 2,00. Quando um take funcionar, trave o seu seed para reproduzi-lo, já que modelos como o PicassoIA Video aceitam um seed para resultados repetíveis.

Dedos sobre o trackpad de um notebook enquanto uma barra de progresso espera na borda de uma tela desfocada

💡 Rascunhe barato, finalize uma vez. Teste os prompts na menor faixa e resolução e gaste a taxa mais alta apenas nos prompts que já funcionam.

A resolução multiplica rápido

A própria tabela do Google mostra o efeito: o Veo 3.1 Fast custa US$ 0,10 por segundo em 720p e US$ 0,30 por segundo em 4K, o triplo do preço para o mesmo prompt. No PicassoIA Video, você pode escolher 480p para a renderização mais rápida ou 720p para uma saída mais nítida. Rascunhe na configuração baixa e guarde a alta para a passagem final.

Armazenamento e tempo de engenharia

Cada MP4 finalizado precisa de armazenamento e largura de banda, e cada integração precisa de alguém para escrever o ciclo de consulta, tratar falhas e observar os limites de taxa. Para um projeto pequeno, são algumas noites. Para uma equipe, é um item de orçamento. Baixe os resultados logo e copie-os para o seu próprio armazenamento, em vez de depender de uma URL do provedor continuar ativa.

Monte um orçamento em cinco minutos

Você não precisa de uma planilha para precificar um projeto. Precisa de uma fórmula e de uma estimativa honesta de novas tentativas.

A fórmula

Custo mensal = clipes utilizáveis × segundos por clipe × preço por segundo × takes por clipe utilizável

Considere 200 clipes utilizáveis de 8 segundos cada. São 1.600 segundos de material finalizado. A US$ 0,10 por segundo, com todo take utilizável, a conta fica em US$ 160. Se você precisar de três takes por clipe utilizável, sobe para US$ 480.

Três orçamentos mensais de exemplo

Mesma carga de trabalho, três faixas, usando as tarifas do Veo listadas antes:

FaixaTaxa por segundoTodo take utilizávelTrês takes por clipe utilizável
Veo 3.1 Lite, 720pUS$ 0,05US$ 80US$ 240
Veo 3.1 Fast, 720pUS$ 0,10US$ 160US$ 480
Veo 3.1 Standard, 1080pUS$ 0,40US$ 640US$ 1.920

A diferença entre a linha mais barata e a mais cara é de 8x antes das novas tentativas e de 8x depois delas, e por isso a faixa que você escolhe importa mais do que qualquer outra alavanca. Qualquer que seja a faixa, faça um piloto de 20 clipes, meça seus takes reais por clipe utilizável e substitua o meu 3 pelo seu próprio número antes de se comprometer.

Quatro colegas em volta de uma mesa de madeira revisando uma planilha impressa com linhas destacadas

Como usar o PicassoIA Video

A PicassoIA tem seu próprio modelo de texto e imagem para vídeo, o PicassoIA Video, então é um lugar prático para testar todo o ciclo. A página do modelo lista um clipe fixo de 5 segundos a 24 quadros por segundo, renderizado com áudio sincronizado.

Escolha suas configurações

  1. Abra a página do PicassoIA Video.
  2. Escreva o prompt em ordem. Descreva o assunto e a pose inicial, depois o movimento, depois o movimento de câmera e por fim a luz. O esquema do modelo diz que descrições cinematográficas e cronológicas funcionam melhor.
  3. Adicione uma imagem de entrada se quiser um primeiro quadro específico. O clipe a usa como plano de abertura e herda a proporção dela.
  4. Escolha uma resolução. 480p renderiza mais rápido, 720p é mais nítido.
  5. Escolha uma proporção. 16:9 combina com paisagem, 9:16 com vertical, 1:1 com publicações quadradas.
  6. Defina um seed quando quiser reproduzir um take depois.
  7. Deixe save_audio ligado para som sincronizado, ou desligue para um clipe sem áudio.
ParâmetroTipoPadrãoO que faz
promptstring, obrigatórionenhumDescreve o plano
imagestringvazioQuadro inicial para imagem para vídeo
resolution480p ou 720p720pNitidez da saída e velocidade de renderização
aspect_ratiomatch_input_image, 16:9, 9:16, 1:1, 4:3, 3:4, 3:2, 2:3match_input_imageFormato do quadro, ignorado quando uma imagem é enviada
seedinteiroaleatórioResultados repetíveis
save_audiobooleanotrueMantém ou remove o som gerado

💡 Confira o esquema atualizado. A página do modelo e a referência da API não listam intervalos idênticos de resolução e duração. Leia o esquema atual do modelo antes de fixar qualquer valor no código.

Criadora de conteúdo em um estúdio caseiro segurando um smartphone enquanto um notebook mostra um clipe vertical de uma rua da cidade ao entardecer

Chame pelo código

A API envolve cada configuração em um objeto input. Crie a predição e depois consulte o ID dela:

curl -s -X POST https://api.picassoia.com/v1/models/picassoia/picassoia-video/predictions \
  -H "Authorization: Bearer $PICASSOIA_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"input": {"prompt": "A fishing boat rocks on calm water at sunrise, mist lifts off the surface, slow dolly-in, warm low light", "resolution": "480p", "aspect_ratio": "16:9"}}'

curl -s https://api.picassoia.com/v1/predictions/PREDICTION_ID \
  -H "Authorization: Bearer $PICASSOIA_TOKEN"

A primeira resposta devolve 201 Created com um id, um status starting e eta.next_poll_in_seconds. Quando o status indicar succeeded, o campo output traz a URL do vídeo.

Limites que restringem seu volume

Dinheiro não é o único teto. A PicassoIA permite 5 predições em fila ou em execução ao mesmo tempo por conta, e esse grupo é compartilhado entre todos os tokens e conexões MCP que você tiver. Se uma renderização leva cerca de um minuto, cinco slots dão no máximo 300 clipes por hora, não importa o tamanho do seu orçamento.

Fileira de racks de servidores de rede com cabos de conexão organizados e um técnico agachado no rack mais baixo com uma lanterna

Planeje em torno do limite:

  • Enfileire do seu lado: rode um pool de workers de cinco ou menos e alimente-o a partir de uma lista de jobs.
  • Respeite a dica de consulta: aguarde o eta.next_poll_in_seconds que a primeira resposta indica entre as verificações.
  • Reenvie as falhas: um status failed encerra aquela predição, então envie uma nova em vez de consultar de novo.
  • Mantenha os payloads pequenos: fique abaixo de 10 MB por requisição e 5 MB por data URL de imagem.

Experimente você mesmo na PicassoIA

A forma mais barata de descobrir o seu próprio número é fazer alguns clipes. Abra o PicassoIA Video e renderize um rascunho em 480p de um plano que você realmente precisa. Depois, rode a mesma ideia pelo Seedance 2.5 Lite para áudio sincronizado e compare os dois lado a lado.

Quando um rascunho funcionar, conte seus takes, coloque os números na fórmula e decida se a rota da API gratuita, uma faixa paga por segundo ou sua própria GPU cabe no seu volume. A PicassoIA reúne texto para imagem, texto para vídeo, edição de imagem e sincronização labial em um só lugar, então você pode testar tudo isso antes de se comprometer com um único provedor.

Cineasta independente em um café iluminado pelo sol, com notebook mostrando uma linha do tempo de vídeo, fones no pescoço e um flat white sobre uma mesa de mármore

Crie suas próprias imagens e vídeos com a PicassoIA hoje. Comece com um rascunho, meça quanto ele custa e só escale quando os números se sustentarem.

Compartilhe este artigo

Escolha seu idioma