API de geração de vídeo mais barata: custo por segundo comparado

Tarifas por segundo das principais APIs de geração de vídeo, verificadas em outubro de 2026, de US$ 0,005 a US$ 0,70. Veja quanto custam de fato 500 segundos de vídeo, por que as novas tentativas mudam o ranking e como calcular o custo por segundo utilizável antes de escolher um provedor.

API de geração de vídeo mais barata: custo por segundo comparado
Cristian Da Conceicao
Fundador do Picasso IA

Toda página de preços de API de vídeo começa com o mesmo número: dólares por segundo. Parece o caminho mais rápido para encontrar a opção mais barata, e também é o número com mais chance de enganar você. Uma tarifa de US$ 0,02 por segundo parece uma pechincha, até você descartar três clipes em cada quatro, ou até o mesmo modelo cobrar US$ 0,04 no instante em que você pede 1080p.

Esta comparação reúne as tarifas por segundo publicadas, em outubro de 2026, dos modelos que as pessoas realmente usam por meio de uma API: Veo 3.1, Kling v3, Wan 2.7, Seedance 2.0, Grok Imagine Video, P Video, LTX 2.3 Fast e alguns outros. Depois, dá um passo além e transforma essas tarifas no número com o qual você pode de fato planejar o orçamento: custo por segundo utilizável.

💡 Resposta rápida: as tarifas mais baixas listadas ficam entre US$ 0,005 e US$ 0,05 por segundo, e pertencem ao P Video (modo rascunho e qualidade total), ao Grok Imagine 1.5 Lite, ao Grok Imagine Video e ao Veo 3.1 Lite. As faixas premium começam em US$ 0,40 por segundo, então o Veo 3.1 pelo preço cheio custa 20 vezes o que o P Video cobra em 720p.

Os preços mudam com frequência. Trate cada valor abaixo como um retrato do momento e confirme-o na página do próprio provedor antes de comprometer um orçamento.

Cronômetro, calculadora e pilhas de moedas sobre uma mesa de nogueira, vista de cima para ilustrar a precificação de geração de vídeo por segundo

Por que o custo por segundo engana

Por segundo não é por clipe

Nem todo provedor cobra do mesmo jeito. Alguns cobram por segundo de vídeo gerado, outros por milhão de tokens, outros em créditos, e muitos revendedores convertem tudo em um valor por segundo com a própria margem por cima. Um monitor de preços observa que a ByteDance cobra o Seedance por milhão de tokens e não por segundo, e é por isso que as linhas do Seedance na maioria das comparações vêm de revendedores.

Os créditos acrescentam outra camada. A lista de preços do próprio Kling indica o Kling 3.0 em créditos por segundo: 6 para 720p sem áudio, 9 com áudio, 8 para 1080p sem áudio e 12 com áudio. Os valores em dólar deste artigo são conversões desses créditos, então a tarifa que você paga depende do que um crédito custa no seu plano.

O mesmo modelo também pode ter tarifas diferentes em hospedagens distintas. O Wan 2.7 aparece por US$ 0,086 por segundo em 720p em um revendedor e por US$ 0,10 em outros dois, e em 1080p a variação vai de US$ 0,144 a US$ 0,15. São diferenças pequenas, mas se acumulam em milhares de clipes.

Áudio e resolução mudam a tarifa

Duas configurações alteram a tarifa mais do que o nome do modelo. O Kling v3 aparece por cerca de US$ 0,084 por segundo em 720p sem áudio nativo e por US$ 0,112 com ele. Em 1080p com áudio, a listagem chega a US$ 0,14, que é 67% mais do que a configuração mais barata do Kling. O Veo 3.1 Fast vai de US$ 0,10 por segundo em 720p para US$ 0,30 em 4K, um salto de três vezes para o mesmo prompt.

Os preços do Veo do Google incluem áudio por padrão, então uma tarifa do Veo e uma tarifa de clipe silencioso de outro provedor não são o mesmo produto.

💡 Regra prática: compare tarifas na mesma resolução e com a mesma configuração de áudio, ou a tabela estará comparando coisas diferentes.

Microfone condensador de estúdio em frente a um monitor que mostra um quadro pausado de um penhasco à beira-mar

A tabela de preços de outubro de 2026

As tarifas abaixo vêm de páginas oficiais, quando foi possível verificá-las (a página de preços da API Gemini do Google, a documentação da xAI, a documentação da Pruna), da página de preços para desenvolvedores do Kling convertida para dólares e de listagens de revendedores, quando o fabricante não publica um preço por segundo. As linhas de revendedores estão marcadas com um asterisco.

ModeloTarifa por segundoObservações
P Video, modo rascunhoUS$ 0,005 em 720p, US$ 0,01 em 1080pPassagem rápida de prévia, documentação da Pruna
P Video, qualidade totalUS$ 0,02 em 720p, US$ 0,04 em 1080pÁudio incluído, documentação da Pruna
Grok Imagine 1.5 LiteUS$ 0,02Tarifa fixa, documentação da xAI
Grok Imagine VideoUS$ 0,05Tarifa fixa, documentação da xAI
Veo 3.1 LiteUS$ 0,05 em 720p, US$ 0,08 em 1080pÁudio incluído, Google
Grok Imagine Video 1.5US$ 0,08Tarifa fixa, documentação da xAI
Kling v3US$ 0,084 a US$ 0,14Silencioso em 720p até 1080p com áudio
Seedance 2.0 Fast*US$ 0,09Listagem de revendedor
Hailuo 2.3*US$ 0,10Listagem de revendedor
Veo 3.1 FastUS$ 0,10 em 720p, US$ 0,12 em 1080p, US$ 0,30 em 4KÁudio incluído, Google
Wan 2.7*US$ 0,086 a US$ 0,10 em 720p, US$ 0,144 a US$ 0,15 em 1080pVaria conforme o revendedor
LTX 2.3 Fast e LTX 2.3 ProUS$ 0,06 a US$ 0,32Conforme a faixa e a resolução, de 1080p a 4K
Seedance 2.0*US$ 0,247Listagem de revendedor, faixa Pro
Veo 3.1US$ 0,40 em 720p e 1080p, US$ 0,60 em 4KÁudio incluído, Google
Sora 2US$ 0,10 a US$ 0,70Faixa por resolução, veja a nota abaixo

Visão por cima do ombro de um desenvolvedor comparando preços de API de vídeo em uma planilha

Abaixo de US$ 0,10 por segundo

O P Video é o piso de preço. A US$ 0,02 por segundo em 720p, um clipe de cinco segundos custa US$ 0,10, e o modo rascunho reduz isso para US$ 0,025. A Pruna posiciona o rascunho como uma passagem rápida de prévia: um clipe de 5 segundos em 720p é renderizado em cerca de 2,5 segundos, contra cerca de 10 segundos na qualidade total.

Seguem o Grok Imagine 1.5 Lite, a US$ 0,02 fixos, o Grok Imagine Video, a US$ 0,05, e o Veo 3.1 Lite, também a US$ 0,05. O número do Veo Lite merece uma olhada mais atenta, porque inclui áudio, que várias opções mais baratas cobram à parte ou simplesmente não têm. O Kling v3 começa em US$ 0,084 para 720p silencioso.

Vista de baixo para cima de moedas de cobre empilhadas em colunas ascendentes ao lado de uma claquete de madeira

Entre US$ 0,10 e US$ 0,15

Esta é a faixa do meio, lotada. O Veo 3.1 Fast fica entre US$ 0,10 e US$ 0,12, o Wan 2.7 fica por volta de US$ 0,09 a US$ 0,15 conforme a hospedagem e a resolução, o Hailuo 2.3 aparece por US$ 0,10, e o Kling v3 cai aqui assim que o áudio e o 1080p são ativados. O Seedance 2.0 Fast fica logo abaixo, a US$ 0,09 em um revendedor.

Para muitas equipes, essa faixa é onde a qualidade começa a justificar o preço: movimento mais estável, seguimento de prompt mais fiel, menos clipes no lixo. A conta de custo por segundo utilizável, mais adiante, põe números nisso.

Tarifas premium acima disso

O Veo 3.1 a US$ 0,40 por segundo (US$ 0,60 em 4K) é o benchmark premium na própria página do Google. Dentro da linha do próprio Google, a escada é íngreme: o Veo 3.1 Lite a US$ 0,05, o Veo 3.1 Fast a US$ 0,10 e o Veo 3.1 a US$ 0,40 em 720p, uma subida de 8 vezes da base ao topo.

O Seedance 2.0 a US$ 0,247 por segundo na faixa Pro de um revendedor e o LTX 2.3 Pro, a até US$ 0,32 em 4K, completam o topo. O Sora 2 aparece a US$ 0,10 a US$ 0,70 por segundo, embora um monitor aponte um encerramento previsto em 24 de setembro de 2026 para a API da OpenAI, então confirme a disponibilidade antes de construir algo sobre ela.

Tarifas premium fazem sentido para o plano final principal, não para as trinta renderizações de teste que antecedem esse plano.

Plano aberto de baixo para cima de uma câmera de cinema em um tripé dentro de um estúdio de cinema escuro

Quanto custam 500 segundos de vídeo

Tarifas por segundo são mais fáceis de perceber em volume. Aqui está a conta de 100 clipes de 5 segundos cada, 500 segundos no total, em 720p, supondo que cada clipe seja aproveitável:

OpçãoTarifa por segundo100 clipes de 5 segundos
P Video, modo rascunhoUS$ 0,005US$ 2,50
P Video, qualidade totalUS$ 0,02US$ 10,00
Grok Imagine 1.5 LiteUS$ 0,02US$ 10,00
Veo 3.1 LiteUS$ 0,05US$ 25,00
Kling v3, silenciosoUS$ 0,084US$ 42,00
Seedance 2.0 Fast*US$ 0,09US$ 45,00
Veo 3.1 FastUS$ 0,10US$ 50,00
Veo 3.1US$ 0,40US$ 200,00

A diferença de US$ 2,50 para US$ 200 é uma lacuna de 80 vezes no papel. Ela também pressupõe que cada clipe seja utilizável, o que nunca acontece na prática.

Agora aplique uma taxa de aproveitamento realista. Se você publica apenas um clipe em cada quatro, precisa gerar 400 clipes, ou 2.000 segundos, para ficar com 100 utilizáveis. Isso multiplica cada linha por quatro: US$ 40 para o P Video em qualidade total, US$ 100 para o Veo 3.1 Lite e US$ 800 para o Veo 3.1. O ranking se mantém, mas os números absolutos viram outra conversa.

Custos ocultos que estouram o orçamento

Gerações com falha e inutilizáveis

A maioria dos provedores cobra apenas por uma renderização bem-sucedida, e somente por ela. A página de preços do Google, por exemplo, diz que você só é cobrado se o vídeo for gerado com sucesso. Mas uma renderização que tecnicamente funciona e mesmo assim mostra uma mão deformada ou um logotipo que se desloca é cobrada como qualquer outra. É aí que está o desperdício real, e o primeiro prompt raramente acerta.

Mãos amassando uma folha de contato impressa acima de uma lixeira cheia de papéis descartados

Re-renderizações e aumentos de resolução

Fazer um rascunho em baixa resolução e re-renderizar o vencedor em resolução maior significa pagar duas vezes pelo plano final. É uma boa aposta quando o rascunho prevê o resultado final, e uma opção cara quando a composição muda entre as passagens. Fixe um seed sempre que o modelo permitir, para que a re-renderização fique próxima do rascunho.

Filas, limites e concorrência

Custo não é só dinheiro. A API para desenvolvedores do PicassoIA permite 5 predições simultâneas por conta, compartilhadas entre todas as credenciais e conexões MCP, com prompts limitados a 4.000 caracteres. Os trabalhos são assíncronos: você cria uma predição, consulta o status e depois busca o resultado. Um modelo barato atrás de um limite de concorrência apertado ou de uma fila lenta ainda consome horas de desenvolvedor, então verifique esses limites em qualquer provedor antes de se comprometer.

Vale fazer uma conta rápida de vazão. Com 5 predições simultâneas e cerca de 110 segundos por renderização, o tempo listado para um exemplo de Seedance 2.5 Lite em 720p, o teto fica em torno de 160 clipes por hora (5 x 3.600 / 110). Os tempos reais variam com a carga, mas o teto mostra que um lote de 500 clipes leva cerca de três horas, na melhor das hipóteses.

Custo por segundo utilizável

A fórmula

Custo por segundo utilizável = tarifa por segundo ÷ taxa de aproveitamento, em que a taxa de aproveitamento é a parcela dos segundos gerados que você realmente publica. Se você corta clipes na edição, conte apenas os segundos que sobram depois do corte.

Dois exemplos trabalhados

Estes números são hipotéticos. Eles mostram como a conta se comporta, não resultados medidos.

  • Modelo barato, taxa de aproveitamento baixa: US$ 0,02 por segundo com 1 clipe em cada 4 aproveitado dá US$ 0,08 por segundo utilizável.
  • Modelo mais caro, taxa de aproveitamento alta: US$ 0,05 por segundo com 3 clipes em cada 4 aproveitados dá cerca de US$ 0,067 por segundo utilizável.

O modelo com preço de etiqueta mais baixo acaba custando 20% a mais. Um fluxo de trabalho com rascunhos pode inverter o resultado de novo. Renderize oito rascunhos de 5 segundos a US$ 0,005 por segundo (US$ 0,20 no total) e depois um final de 5 segundos a US$ 0,02 por segundo (US$ 0,10). São US$ 0,30 por um clipe utilizável de 5 segundos, ou US$ 0,06 por segundo utilizável, desde que o final corresponda ao rascunho. Quatro tentativas seguidas em qualidade total a US$ 0,10 cada custariam US$ 0,40, ou US$ 0,08 por segundo utilizável.

Tarifa por segundo25% aproveitado50% aproveitado75% aproveitado
US$ 0,02US$ 0,080US$ 0,040US$ 0,027
US$ 0,05US$ 0,200US$ 0,100US$ 0,067
US$ 0,10US$ 0,400US$ 0,200US$ 0,133
US$ 0,40US$ 1,600US$ 0,800US$ 0,533

Leia uma linha na horizontal para ver quanto o desperdício custa a você, e uma coluna na vertical para ver como o preço do modelo o amplia. Dois modelos ficam no equilíbrio quando as razões entre tarifa e taxa de aproveitamento coincidem, então um modelo com preço 2,5 vezes maior precisa aproveitar 2,5 vezes mais clipes só para empatar.

Editor de vídeo freelancer em uma mesa de café com um laptop mostrando a linha do tempo e um caderno

Como usar o Seedance 2.5 Lite

Quando o objetivo é volume de iterações, a menor tarifa por segundo é zero. O Seedance 2.5 Lite é descrito na página do modelo no PicassoIA como gratuito e sem limites para membros Wonder, com clipes de até 10 segundos e áudio sincronizado. Isso reescreve a conta de custo por segundo utilizável, porque as novas tentativas deixam de custar qualquer coisa por clipe.

Escolha suas configurações

  • Resolução: 480p para rascunhos rápidos, 720p para o final, mais nítido. O modelo se limita a essas duas.
  • Duração: 5 ou 10 segundos.
  • Proporção: 16:9, 9:16, 1:1, 4:3, 3:4, 3:2 ou 2:3. Mantenha o padrão match_input_image quando você começar a partir de uma foto.
  • Áudio: ativado por padrão por meio de save_audio. Desative-o para um clipe silencioso.
  • Seed: fixe-o para reproduzir um clipe.

Escreva e renderize o prompt

  1. Abra a página do Seedance 2.5 Lite e escreva um prompt cronológico: sujeito, movimento, movimento de câmera, iluminação.
  2. Opcionalmente, adicione uma imagem de entrada como primeiro quadro. O clipe herda a proporção dela. Uma imagem de último quadro também é aceita, mas somente junto com um primeiro quadro.
  3. Renderize em 480p e 5 segundos até a composição funcionar. Os exemplos de renderização listados na página do modelo levaram cerca de 100 a 110 segundos para clipes de 5 e 10 segundos.
  4. Fixe o seed, mude para 720p para o final e confira o resultado, já que uma resolução diferente pode alterar detalhes finos.

Prefere um formato fixo? O Picasso IA Video renderiza clipes de 5 segundos a 24 fps, em 480p ou 720p, com áudio sincronizado.

Mãos de um criador digitando ao lado de um monitor com um quadro pausado de um caminho na floresta

Chamando pela API

A API para desenvolvedores segue o estilo Replicate. A URL base é https://api.picassoia.com/v1, as requisições levam um token Bearer com o prefixo pia_sk_, você cria uma predição com POST /v1/models/{owner}/{name}/predictions e consulta GET /v1/predictions/{id} até que ela termine. Os modelos expostos ali incluem picassoia/seedance-2.5-lite e picassoia/picassoia-video.

A documentação descreve as predições de API como gratuitas por enquanto, mas os requisitos do plano são redigidos de forma diferente na página da API e na página de preços. Confira as duas antes de montar um orçamento em torno de "gratuito".

Qual API se encaixa no seu projeto

Clipes para redes sociais e marketing

Volume e velocidade importam mais aqui. Faça rascunhos na faixa barata, com o P Video a US$ 0,02 ou o Grok Imagine 1.5 Lite, ou itere sem medidor no Seedance 2.5 Lite e no Picasso IA Video. Quando um clipe precisa de áudio e acabamento mais limpo, o Veo 3.1 Lite a US$ 0,05 por segundo é a opção econômica que já inclui isso.

Produção de produto e anúncios

Menos clipes, mais em jogo. Rascunhe barato e depois invista no Veo 3.1 Fast, no Kling v3 ou no Wan 2.7 para os finais, e reserve o Veo 3.1 a US$ 0,40 para o único plano principal que o justifica. Planeje o orçamento pelo custo por segundo utilizável, nunca pela tarifa de etiqueta.

Faça seu próprio teste de custo

Tarifas publicadas são um ponto de partida, não um veredito. Seus prompts, seus sujeitos e seu padrão de qualidade definem a taxa de aproveitamento, e a taxa de aproveitamento define o preço real.

Escolha um prompt e rode-o em três modelos: uma opção barata, como o Seedance 2.5 Lite ou o P Video, uma opção intermediária, como o Veo 3.1 Fast, e uma opção premium, como o Veo 3.1. Gere dez clipes em cada um, conte os aproveitáveis e divida o gasto pelos segundos utilizáveis.

Para manter o teste honesto:

  1. Escreva os critérios de aprovação antes de gerar: mãos limpas, movimento legível, sem cintilação, áudio compatível com a ação.
  2. Use o mesmo prompt, a mesma proporção e a mesma resolução em todos os modelos.
  3. Registre a tarifa, os segundos gerados e os segundos que você de fato publicaria.
  4. Divida o gasto total pelos segundos utilizáveis e some qualquer custo de nova tentativa ou re-renderização.
  5. Repita com um segundo prompt, porque um único prompt pode favorecer ou prejudicar um modelo.

Dono de uma padaria sorrindo diante de um clipe promocional curto em um tablet atrás de um balcão de madeira

Abra o Picasso IA, teste o mesmo prompt nos modelos de texto para vídeo e veja qual oferece o menor custo por segundo utilizável para o seu próprio conteúdo. Uma tarde de testes vai dizer mais do que qualquer tabela de preços.

Compartilhe este artigo

Escolha seu idioma