API de imagem para vídeo: gratuita, barata e com preços comparados

As APIs de imagem para vídeo cobram desde nada até US$ 2,00 por um único clipe de 5 segundos. Este artigo reúne as rotas gratuitas, as opções baratas por segundo e os custos ocultos, com preços conferidos em outubro de 2026 e um exemplo prático da API do PicassoIA.

API de imagem para vídeo: gratuita, barata e com preços comparados
Cristian Da Conceicao
Fundador do Picasso IA

Um clipe de cinco segundos feito a partir de uma única imagem pode custar nada, vinte e cinco centavos de dólar ou dois dólares, dependendo da API de imagem para vídeo que você chamar e do plano que escolher. Essa diferença é a verdadeira história dos preços deste mês, e é por isso que uma olhada rápida na página de um único provedor raramente prevê quanto um projeto vai custar. A seguir você encontra as rotas gratuitas, as rotas baratas, as caras, a conta para um clipe de 5 segundos e os pontos em que o preço da página não é o preço da fatura.

💡 Os preços mudam todo mês. Todos os números aqui foram conferidos em outubro de 2026 em uma página do provedor ou em um acompanhamento de terceiros identificado. Use-os como um instantâneo do momento e confirme na página oficial do provedor antes de fechar um volume grande.

O que uma API de imagem para vídeo faz

Mãos de um fotógrafo segurando uma foto impressa de montanha, levemente erguida sobre uma mesa de madeira

Imagem entra, clipe sai

Você envia uma imagem como primeiro quadro, junto com um prompt curto de movimento. A API devolve um MP4, normalmente com 5 a 10 segundos, em resoluções que vão de 480p a 4K. Muitos modelos agora geram áudio sincronizado na mesma passagem, e isso muda o preço (mais sobre isso adiante). A imagem fixa o assunto, as cores e o enquadramento, então o resultado é bem mais previsível do que o de texto para vídeo, em que o modelo inventa tudo do zero.

As entradas são parecidas entre os provedores: uma URL ou upload de imagem, um prompt escrito como descrição cronológica ("a câmera se aproxima devagar enquanto o vapor sobe da xícara"), uma resolução, uma duração e, às vezes, uma seed para resultados repetíveis.

Por que os trabalhos rodam de forma assíncrona

Vista de cima de uma mesa de nogueira com um notebook, um diagrama em um caderno e fotografias impressas

A renderização leva tempo real, então quase toda API de vídeo funciona em duas etapas: criar um trabalho e depois consultá-lo até que o status indique succeeded ou failed. Exemplos de execução listados nas próprias páginas de modelos do PicassoIA mostram a faixa: cerca de 30 a 80 segundos para clipes de 5 segundos no Picasso IA Video, e algo como 100 a 190 segundos para clipes de 10 a 15 segundos no Seedance 2.5 Lite. Seu código precisa esperar, tentar de novo e tratar falhas, e um trabalho que falha continua custando seu tempo e, às vezes, seu dinheiro.

APIs gratuitas de imagem para vídeo

Uma estudante universitária digitando em um notebook em uma cabine silenciosa de biblioteca

"Gratuito" vem em três versões, e só uma delas é gratuita do jeito que as pessoas imaginam.

Camadas gratuitas que existem

  • A API do PicassoIA. A documentação diz "API predictions are currently free. They use no credits," com um plano Infinite necessário. Os detalhes estão na seção sobre o PicassoIA abaixo.
  • Modelos abertos hospedados com camada gratuita. A ModelsLab lista uma camada gratuita para imagem para vídeo com o LTX 2.3 Fast, com cobrança por uso depois disso.
  • Créditos de aplicativos de consumo. Um acompanhamento listou o Kling 3.0 com 66 créditos diários e o Runway com 125 créditos mensais em fevereiro. Essas são cotas de aplicativo, não chamadas de API, então não construa um produto sobre elas.

💡 A pegadinha: camadas gratuitas vêm com limites, filas e a palavra "currently" nos termos. Elas são perfeitas para testar prompts e arriscadas como o único plano de um produto pago.

Modelos abertos na sua própria GPU

Um pequeno corredor de data center com fileiras de racks de servidores pretos

Modelos abertos como o Wan 2.2 I2V, o LTX Video e o Stable Video Diffusion não têm taxa por clipe. Você paga em hardware. As necessidades relatadas são de cerca de 10 a 16 GB de VRAM para o Stable Video Diffusion em 576x1024 e 24 GB ou mais para o Wan 2.2 I2V A14B em 720p. O Hugging Face também hospeda Spaces de demonstração, mas espere filas.

Alugar uma GPU por hora traz a conta de volta para um número por clipe, então meça os segundos de GPU que cada clipe usa antes de chamá-lo de gratuito.

Preços baratos por segundo

Uma calculadora de mesa vintage ao lado de moedas, um recibo e um cronômetro

A cobrança por segundo é a mais fácil de comparar: multiplique a taxa pelo tamanho do clipe e você tem o custo.

Quanto custam cinco segundos

ModeloFontePreço por segundoClipe de 5 segundos
Veo 3.1 Lite, 720pPágina da API Google GeminiUS$ 0,05US$ 0,25
Veo 3.1 Fast, 720pPágina da API Google GeminiUS$ 0,10US$ 0,50
Veo 3.1, 720pPágina da API Google GeminiUS$ 0,40US$ 2,00
Kling 2.5 Turbo ProPágina de preços da falUS$ 0,07US$ 0,35
Kling 3.0, faixa ProPágina de preços da falUS$ 0,14US$ 0,70
Kling 3.0Acompanhamento de terceiros, fevereirocerca de US$ 0,029cerca de US$ 0,15
Imagem para vídeo da MiniMax (dois modelos listados)Página de preços da falUS$ 0,025 a US$ 0,05US$ 0,13 a US$ 0,25

As linhas do Google incluem áudio. O Seedance 2 é cobrado por token (US$ 0,014 por 1.000 tokens na página da fal), então você não consegue convertê-lo em taxa por segundo sem saber quantos tokens um clipe usa. Faça um clipe de teste e leia a fatura.

A resolução também pesa na conta. Na página do Google, o Veo 3.1 Fast custa US$ 0,10 por segundo em 720p, US$ 0,12 em 1080p e US$ 0,30 em 4K. Mesmo modelo, preço triplicado. Faça o rascunho em 720p e atualize só os clipes que você vai manter.

Mesmo modelo, quatro preços

O Kling 3.0 aparece a cerca de US$ 0,029 por segundo em um acompanhamento e a US$ 0,14 na faixa Pro na fal. A diferença vem da faixa (padrão ou pro), do áudio estar ligado ou não, da margem do revendedor e da data do levantamento. Compare coisas equivalentes: mesma resolução, mesma duração, mesma configuração de áudio, mesma faixa.

O que o barato realmente oferece

Preços baixos geralmente vêm de variantes menores, não de um desconto no modelo principal. Uma versão Lite ou Fast troca o máximo de detalhe e as maiores resoluções por velocidade e volume. O Seedance 2.5 Lite, por exemplo, é limitado a 480p e 720p de propósito. Para clipes de redes sociais, loops de produto e storyboards animados, isso basta. Para uma imagem principal em 4K na página inicial de um cliente, não basta.

Seja qual for a faixa escolhida, teste com as suas próprias imagens antes de comprar volume. As mesmas poucas coisas quebram clipes em quase todos os modelos: mãos em movimento, texto legível dentro do quadro, movimentos rápidos de câmera e multidões de figuras pequenas. Um assunto calmo com um movimento claro, como vapor, nuvens à deriva, uma aproximação lenta ou a cabeça virando, é onde os modelos baratos rendem melhor. Passe cinco das suas fotos reais por uma faixa barata e por uma intermediária, depois compare os resultados lado a lado. Se você não conseguir distinguir os dois no tamanho em que vai publicar, vence o mais barato.

Preços comparados lado a lado

Um homem comparando três planilhas impressas lado a lado em uma mesa de conferência

Modelos de cobrança explicados

Estilo de cobrançaExemploPonto forteAtenção a
Por segundoFamília Veo 3.1 do GoogleConta fácilÁudio e resolução mudam a taxa
Por tokenSeedance 2 na falClipes curtos baratosDifícil de prever
CréditosApiframeUm saldo para muitos modelosCréditos por segundo variam cerca de 7x
AssinaturaPlanos no estilo RunwayFatura previsívelCota não usada expira
Auto-hospedadoWan 2.2 I2V, LTX VideoSem taxa por clipeGPU, configuração, manutenção

A diferença nos créditos é real. A tabela de agosto da Apiframe lista o Seedance 1.5 Pro em 720p por 4 segundos com 15 créditos, e o Luma Ray 2 em 720p por 5 segundos com 131 créditos. Isso dá cerca de 3,75 créditos por segundo contra 26,2, ou seja, cerca de sete vezes mais.

Assinaturas seguem uma regra simples de ponto de equilíbrio: mensalidade dividida pelo custo por clipe. Um acompanhamento colocou os planos do Runway entre US$ 12 e US$ 76 por mês. Um plano de US$ 12 equivale a cerca de 34 clipes a US$ 0,35 cada. Se você faz menos clipes do que isso, pague por segundo.

Um orçamento para 100 clipes

Aqui está uma tomada para cada um de 100 clipes de 5 segundos em 720p:

ModeloCusto por clipe100 clipes
Veo 3.1 LiteUS$ 0,25US$ 25
Kling 2.5 Turbo ProUS$ 0,35US$ 35
Veo 3.1 FastUS$ 0,50US$ 50
Kling 3.0 ProUS$ 0,70US$ 70
Veo 3.1US$ 2,00US$ 200

💡 Planeje refações. Poucos prompts acertam na primeira tentativa. Se você fizer em média 3 tomadas por clipe aproveitável, multiplique cada número dessa tabela por 3.

Qual opção serve para você

  • Testar prompts e ideias: use uma rota gratuita, seja a API do PicassoIA ou uma camada gratuita hospedada, e aceite os limites.
  • Clipes para redes sociais em volume: uma faixa Lite ou Fast em 720p, como o Veo 3.1 Lite ou o Kling 2.5 Turbo Pro, mantém 100 clipes entre US$ 25 e US$ 35 com uma tomada cada.
  • Trabalho para clientes em 1080p ou mais: Veo 3.1 Fast ou Kling 3.0 Pro, com um orçamento de refações à parte.
  • Trabalho com privacidade ou offline: pesos abertos como o Wan 2.2 I2V na sua própria GPU, se você já tiver o hardware.
  • Uso ocasional: dispense assinaturas, que só compensam acima da contagem de ponto de equilíbrio citada acima.

A API do PicassoIA

Um desenvolvedor de software em uma mesa em pé com dois monitores exibindo código desfocado

Modelos e limites

A API fica em https://api.picassoia.com/v1 e usa um token Bearer que começa com pia_sk_. Os endpoints seguem o padrão já conhecido do Replicate: criar uma predição, consultá-la e buscar a saída. Quatro modelos são expostos:

Os limites importam para qualquer trabalho em lote: 5 predições em andamento ao mesmo tempo por conta (a sexta retorna 429 concurrency_limit), um corpo de requisição de 10 MB, 5 MB por imagem em data URL, prompts de até 4.000 caracteres e 2 tokens por conta.

Quanto custa hoje

A documentação afirma que as predições da API são atualmente gratuitas e não usam créditos, e que o preço é "Free with the Infinite plan". Sem esse plano, criar uma predição retorna 403 plan_required. Um detalhe: a página de preços lista API Access e MCP Connections como recursos novos nos planos, enquanto a documentação exige o Infinite. Trate a documentação como a regra e confira a página de planos antes de construir sobre isso. E lembre-se da palavra currently.

Uma requisição funcionando

Esta requisição anima uma foto com o Seedance 2.5 Lite. Os parâmetros vão dentro de um objeto input:

curl -s -X POST https://api.picassoia.com/v1/models/picassoia/seedance-2.5-lite/predictions \
  -H "Authorization: Bearer $PICASSOIA_TOKEN" \
  -H "Content-Type: application/json" \
  -d '{"input": {"image": "https://example.com/first-frame.jpg", "prompt": "The camera pushes in slowly as steam rises from the cup and morning light shifts across the table", "resolution": "720p", "duration": 5}}'

Você recebe uma resposta 201 com um id, um status de starting, uma URL de consulta e uma eta. Consulte GET /v1/predictions/{id} até que o status seja succeeded, failed ou canceled. O loop de Python documentado é curto:

import os, time, requests

API = "https://api.picassoia.com/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['PICASSOIA_TOKEN']}"}

def run(model, input):
    r = requests.post(f"{API}/models/{model}/predictions", json={"input": input}, headers=HEADERS)
    p = r.json()
    if not r.ok:
        raise RuntimeError(f"{p['code']}: {p['detail']}")
    while p["status"] not in ("succeeded", "failed", "canceled"):
        time.sleep((p.get("eta") or {}).get("next_poll_in_seconds", 2))
        p = requests.get(p["urls"]["get"], headers=HEADERS).json()
    if p["status"] != "succeeded":
        raise RuntimeError(p["error"] or p["status"])
    return p["output"]

Como usar o Seedance 2.5 Lite

Não precisa de código se você quer apenas alguns clipes. O Seedance 2.5 Lite roda pela página do modelo, e a descrição dele diz que membros Wonder podem gerar sem limites.

  1. Escolha o primeiro quadro. Envie a imagem que você quer animar. O clipe a usa como quadro inicial e herda sua proporção, então a configuração de proporção é ignorada.
  2. Escreva o movimento como uma linha do tempo. Descreva o que se move primeiro, o que a câmera faz e como a luz muda. Prompts cinematográficos e cronológicos funcionam melhor.
  3. Comece em 480p. É a renderização mais rápida. Mude para 720p quando o movimento estiver certo.
  4. Escolha 5 ou 10 segundos. Cinco segundos bastam para um teaser de produto ou um loop para redes sociais.
  5. Decida sobre o áudio. O áudio sincronizado vem ligado por padrão. Desligue save_audio para um clipe sem som.
  6. Fixe uma seed quando gostar de um resultado e quiser reproduzi-lo. Adicione uma imagem de último quadro se precisar que o clipe termine em um plano específico.

Três prompts iniciais para movimentos calmos e de baixo risco:

  • Foto de produto: "Aproximação lenta sobre a garrafa enquanto a luz suave da janela se move pelo vidro, nada mais se move."
  • Retrato: "Ela vira a cabeça em direção à câmera e sorri levemente, o cabelo se movendo em uma brisa leve, profundidade de campo rasa."
  • Paisagem: "Nuvens passam sobre a crista, névoa se move pelo vale, a câmera sobe devagar na luz dourada da hora mágica."

Precisa do próprio primeiro quadro? Gere-o com o Picasso IA Image, ajuste os detalhes com o Picasso IA Image Editor Pro e depois anime. O Picasso IA Video é a alternativa mais simples: cada clipe tem 5 segundos fixos a 24 quadros por segundo, em 480p ou 720p.

Custos ocultos a observar

Um editor de vídeo com fones ao redor do pescoço revisando um quadro em uma sala de edição escura

Clipes com falha e refeitos

O preço por segundo é o preço de uma tentativa. Mãos que derretem, rostos que se desfazem e um movimento de câmera que ignora seu prompt significam outra tomada. Com 3 tomadas por clipe aproveitável, um clipe de US$ 0,25 custa de fato US$ 0,75. Pergunte a cada provedor se predições com falha ou canceladas são cobradas, e acompanhe as tomadas por clipe aproveitável no seu próprio conteúdo, porque essa proporção muda com cada modelo.

Áudio, duração e concorrência

  • O áudio pode dobrar o preço. A mesma tabela da Apiframe lista o Seedance 1.5 Pro em 720p por 4 segundos com 15 créditos, e 30 créditos com áudio.
  • A duração multiplica a conta. Um clipe de 10 segundos custa o dobro de um de 5 segundos em qualquer plano por segundo.
  • Concorrência custa tempo. Com 5 trabalhos ao mesmo tempo e cerca de um minuto por clipe, 100 clipes levam cerca de 20 minutos de espera. Modelos mais lentos esticam isso para horas.

Crie seu próprio clipe hoje

Uma dona de loja de cerâmica arrumando tigelas feitas à mão em uma prateleira de madeira em uma boutique iluminada

A forma mais barata de descobrir quanto seus clipes vão custar é fazer um. Escolha uma foto que você já tenha, como uma foto de produto, uma paisagem ou um retrato. Abra o Seedance 2.5 Lite ou o Picasso IA Video no Picasso IA, adicione um prompt de movimento de uma frase e renderize um rascunho em 480p. Depois teste três variações de prompt e anote quantas foram necessárias para obter um clipe que você publicaria.

Se precisar de um primeiro quadro novo, crie-o com o Picasso IA Image e anime-o na mesma sessão. Quando o rascunho funcionar, passe para 720p e, se o seu volume justificar, chame a API com a requisição acima. Veja todos os modelos de vídeo e imagem em picassoia.com/en/all-models e faça sua própria comparação antes de se comprometer com um provedor pago.

Compartilhe este artigo

Escolha seu idioma