API de imagem para vídeo: gratuita, barata e com preços comparados
As APIs de imagem para vídeo cobram desde nada até US$ 2,00 por um único clipe de 5 segundos. Este artigo reúne as rotas gratuitas, as opções baratas por segundo e os custos ocultos, com preços conferidos em outubro de 2026 e um exemplo prático da API do PicassoIA.
Um clipe de cinco segundos feito a partir de uma única imagem pode custar nada, vinte e cinco centavos de dólar ou dois dólares, dependendo da API de imagem para vídeo que você chamar e do plano que escolher. Essa diferença é a verdadeira história dos preços deste mês, e é por isso que uma olhada rápida na página de um único provedor raramente prevê quanto um projeto vai custar. A seguir você encontra as rotas gratuitas, as rotas baratas, as caras, a conta para um clipe de 5 segundos e os pontos em que o preço da página não é o preço da fatura.
💡 Os preços mudam todo mês. Todos os números aqui foram conferidos em outubro de 2026 em uma página do provedor ou em um acompanhamento de terceiros identificado. Use-os como um instantâneo do momento e confirme na página oficial do provedor antes de fechar um volume grande.
O que uma API de imagem para vídeo faz
Imagem entra, clipe sai
Você envia uma imagem como primeiro quadro, junto com um prompt curto de movimento. A API devolve um MP4, normalmente com 5 a 10 segundos, em resoluções que vão de 480p a 4K. Muitos modelos agora geram áudio sincronizado na mesma passagem, e isso muda o preço (mais sobre isso adiante). A imagem fixa o assunto, as cores e o enquadramento, então o resultado é bem mais previsível do que o de texto para vídeo, em que o modelo inventa tudo do zero.
As entradas são parecidas entre os provedores: uma URL ou upload de imagem, um prompt escrito como descrição cronológica ("a câmera se aproxima devagar enquanto o vapor sobe da xícara"), uma resolução, uma duração e, às vezes, uma seed para resultados repetíveis.
Por que os trabalhos rodam de forma assíncrona
A renderização leva tempo real, então quase toda API de vídeo funciona em duas etapas: criar um trabalho e depois consultá-lo até que o status indique succeeded ou failed. Exemplos de execução listados nas próprias páginas de modelos do PicassoIA mostram a faixa: cerca de 30 a 80 segundos para clipes de 5 segundos no Picasso IA Video, e algo como 100 a 190 segundos para clipes de 10 a 15 segundos no Seedance 2.5 Lite. Seu código precisa esperar, tentar de novo e tratar falhas, e um trabalho que falha continua custando seu tempo e, às vezes, seu dinheiro.
APIs gratuitas de imagem para vídeo
"Gratuito" vem em três versões, e só uma delas é gratuita do jeito que as pessoas imaginam.
Camadas gratuitas que existem
A API do PicassoIA. A documentação diz "API predictions are currently free. They use no credits," com um plano Infinite necessário. Os detalhes estão na seção sobre o PicassoIA abaixo.
Modelos abertos hospedados com camada gratuita. A ModelsLab lista uma camada gratuita para imagem para vídeo com o LTX 2.3 Fast, com cobrança por uso depois disso.
Créditos de aplicativos de consumo. Um acompanhamento listou o Kling 3.0 com 66 créditos diários e o Runway com 125 créditos mensais em fevereiro. Essas são cotas de aplicativo, não chamadas de API, então não construa um produto sobre elas.
💡 A pegadinha: camadas gratuitas vêm com limites, filas e a palavra "currently" nos termos. Elas são perfeitas para testar prompts e arriscadas como o único plano de um produto pago.
Modelos abertos na sua própria GPU
Modelos abertos como o Wan 2.2 I2V, o LTX Video e o Stable Video Diffusion não têm taxa por clipe. Você paga em hardware. As necessidades relatadas são de cerca de 10 a 16 GB de VRAM para o Stable Video Diffusion em 576x1024 e 24 GB ou mais para o Wan 2.2 I2V A14B em 720p. O Hugging Face também hospeda Spaces de demonstração, mas espere filas.
Alugar uma GPU por hora traz a conta de volta para um número por clipe, então meça os segundos de GPU que cada clipe usa antes de chamá-lo de gratuito.
Preços baratos por segundo
A cobrança por segundo é a mais fácil de comparar: multiplique a taxa pelo tamanho do clipe e você tem o custo.
Imagem para vídeo da MiniMax (dois modelos listados)
Página de preços da fal
US$ 0,025 a US$ 0,05
US$ 0,13 a US$ 0,25
As linhas do Google incluem áudio. O Seedance 2 é cobrado por token (US$ 0,014 por 1.000 tokens na página da fal), então você não consegue convertê-lo em taxa por segundo sem saber quantos tokens um clipe usa. Faça um clipe de teste e leia a fatura.
A resolução também pesa na conta. Na página do Google, o Veo 3.1 Fast custa US$ 0,10 por segundo em 720p, US$ 0,12 em 1080p e US$ 0,30 em 4K. Mesmo modelo, preço triplicado. Faça o rascunho em 720p e atualize só os clipes que você vai manter.
Mesmo modelo, quatro preços
O Kling 3.0 aparece a cerca de US$ 0,029 por segundo em um acompanhamento e a US$ 0,14 na faixa Pro na fal. A diferença vem da faixa (padrão ou pro), do áudio estar ligado ou não, da margem do revendedor e da data do levantamento. Compare coisas equivalentes: mesma resolução, mesma duração, mesma configuração de áudio, mesma faixa.
O que o barato realmente oferece
Preços baixos geralmente vêm de variantes menores, não de um desconto no modelo principal. Uma versão Lite ou Fast troca o máximo de detalhe e as maiores resoluções por velocidade e volume. O Seedance 2.5 Lite, por exemplo, é limitado a 480p e 720p de propósito. Para clipes de redes sociais, loops de produto e storyboards animados, isso basta. Para uma imagem principal em 4K na página inicial de um cliente, não basta.
Seja qual for a faixa escolhida, teste com as suas próprias imagens antes de comprar volume. As mesmas poucas coisas quebram clipes em quase todos os modelos: mãos em movimento, texto legível dentro do quadro, movimentos rápidos de câmera e multidões de figuras pequenas. Um assunto calmo com um movimento claro, como vapor, nuvens à deriva, uma aproximação lenta ou a cabeça virando, é onde os modelos baratos rendem melhor. Passe cinco das suas fotos reais por uma faixa barata e por uma intermediária, depois compare os resultados lado a lado. Se você não conseguir distinguir os dois no tamanho em que vai publicar, vence o mais barato.
A diferença nos créditos é real. A tabela de agosto da Apiframe lista o Seedance 1.5 Pro em 720p por 4 segundos com 15 créditos, e o Luma Ray 2 em 720p por 5 segundos com 131 créditos. Isso dá cerca de 3,75 créditos por segundo contra 26,2, ou seja, cerca de sete vezes mais.
Assinaturas seguem uma regra simples de ponto de equilíbrio: mensalidade dividida pelo custo por clipe. Um acompanhamento colocou os planos do Runway entre US$ 12 e US$ 76 por mês. Um plano de US$ 12 equivale a cerca de 34 clipes a US$ 0,35 cada. Se você faz menos clipes do que isso, pague por segundo.
Um orçamento para 100 clipes
Aqui está uma tomada para cada um de 100 clipes de 5 segundos em 720p:
💡 Planeje refações. Poucos prompts acertam na primeira tentativa. Se você fizer em média 3 tomadas por clipe aproveitável, multiplique cada número dessa tabela por 3.
Qual opção serve para você
Testar prompts e ideias: use uma rota gratuita, seja a API do PicassoIA ou uma camada gratuita hospedada, e aceite os limites.
Clipes para redes sociais em volume: uma faixa Lite ou Fast em 720p, como o Veo 3.1 Lite ou o Kling 2.5 Turbo Pro, mantém 100 clipes entre US$ 25 e US$ 35 com uma tomada cada.
Trabalho para clientes em 1080p ou mais:Veo 3.1 Fast ou Kling 3.0 Pro, com um orçamento de refações à parte.
Trabalho com privacidade ou offline: pesos abertos como o Wan 2.2 I2V na sua própria GPU, se você já tiver o hardware.
Uso ocasional: dispense assinaturas, que só compensam acima da contagem de ponto de equilíbrio citada acima.
A API do PicassoIA
Modelos e limites
A API fica em https://api.picassoia.com/v1 e usa um token Bearer que começa com pia_sk_. Os endpoints seguem o padrão já conhecido do Replicate: criar uma predição, consultá-la e buscar a saída. Quatro modelos são expostos:
Os limites importam para qualquer trabalho em lote: 5 predições em andamento ao mesmo tempo por conta (a sexta retorna 429 concurrency_limit), um corpo de requisição de 10 MB, 5 MB por imagem em data URL, prompts de até 4.000 caracteres e 2 tokens por conta.
Quanto custa hoje
A documentação afirma que as predições da API são atualmente gratuitas e não usam créditos, e que o preço é "Free with the Infinite plan". Sem esse plano, criar uma predição retorna 403 plan_required. Um detalhe: a página de preços lista API Access e MCP Connections como recursos novos nos planos, enquanto a documentação exige o Infinite. Trate a documentação como a regra e confira a página de planos antes de construir sobre isso. E lembre-se da palavra currently.
Uma requisição funcionando
Esta requisição anima uma foto com o Seedance 2.5 Lite. Os parâmetros vão dentro de um objeto input:
curl -s -X POST https://api.picassoia.com/v1/models/picassoia/seedance-2.5-lite/predictions \
-H "Authorization: Bearer $PICASSOIA_TOKEN" \
-H "Content-Type: application/json" \
-d '{"input": {"image": "https://example.com/first-frame.jpg", "prompt": "The camera pushes in slowly as steam rises from the cup and morning light shifts across the table", "resolution": "720p", "duration": 5}}'
Você recebe uma resposta 201 com um id, um status de starting, uma URL de consulta e uma eta. Consulte GET /v1/predictions/{id} até que o status seja succeeded, failed ou canceled. O loop de Python documentado é curto:
import os, time, requests
API = "https://api.picassoia.com/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['PICASSOIA_TOKEN']}"}
def run(model, input):
r = requests.post(f"{API}/models/{model}/predictions", json={"input": input}, headers=HEADERS)
p = r.json()
if not r.ok:
raise RuntimeError(f"{p['code']}: {p['detail']}")
while p["status"] not in ("succeeded", "failed", "canceled"):
time.sleep((p.get("eta") or {}).get("next_poll_in_seconds", 2))
p = requests.get(p["urls"]["get"], headers=HEADERS).json()
if p["status"] != "succeeded":
raise RuntimeError(p["error"] or p["status"])
return p["output"]
Como usar o Seedance 2.5 Lite
Não precisa de código se você quer apenas alguns clipes. O Seedance 2.5 Lite roda pela página do modelo, e a descrição dele diz que membros Wonder podem gerar sem limites.
Escolha o primeiro quadro. Envie a imagem que você quer animar. O clipe a usa como quadro inicial e herda sua proporção, então a configuração de proporção é ignorada.
Escreva o movimento como uma linha do tempo. Descreva o que se move primeiro, o que a câmera faz e como a luz muda. Prompts cinematográficos e cronológicos funcionam melhor.
Comece em 480p. É a renderização mais rápida. Mude para 720p quando o movimento estiver certo.
Escolha 5 ou 10 segundos. Cinco segundos bastam para um teaser de produto ou um loop para redes sociais.
Decida sobre o áudio. O áudio sincronizado vem ligado por padrão. Desligue save_audio para um clipe sem som.
Fixe uma seed quando gostar de um resultado e quiser reproduzi-lo. Adicione uma imagem de último quadro se precisar que o clipe termine em um plano específico.
Três prompts iniciais para movimentos calmos e de baixo risco:
Foto de produto: "Aproximação lenta sobre a garrafa enquanto a luz suave da janela se move pelo vidro, nada mais se move."
Retrato: "Ela vira a cabeça em direção à câmera e sorri levemente, o cabelo se movendo em uma brisa leve, profundidade de campo rasa."
Paisagem: "Nuvens passam sobre a crista, névoa se move pelo vale, a câmera sobe devagar na luz dourada da hora mágica."
Precisa do próprio primeiro quadro? Gere-o com o Picasso IA Image, ajuste os detalhes com o Picasso IA Image Editor Pro e depois anime. O Picasso IA Video é a alternativa mais simples: cada clipe tem 5 segundos fixos a 24 quadros por segundo, em 480p ou 720p.
Custos ocultos a observar
Clipes com falha e refeitos
O preço por segundo é o preço de uma tentativa. Mãos que derretem, rostos que se desfazem e um movimento de câmera que ignora seu prompt significam outra tomada. Com 3 tomadas por clipe aproveitável, um clipe de US$ 0,25 custa de fato US$ 0,75. Pergunte a cada provedor se predições com falha ou canceladas são cobradas, e acompanhe as tomadas por clipe aproveitável no seu próprio conteúdo, porque essa proporção muda com cada modelo.
Áudio, duração e concorrência
O áudio pode dobrar o preço. A mesma tabela da Apiframe lista o Seedance 1.5 Pro em 720p por 4 segundos com 15 créditos, e 30 créditos com áudio.
A duração multiplica a conta. Um clipe de 10 segundos custa o dobro de um de 5 segundos em qualquer plano por segundo.
Concorrência custa tempo. Com 5 trabalhos ao mesmo tempo e cerca de um minuto por clipe, 100 clipes levam cerca de 20 minutos de espera. Modelos mais lentos esticam isso para horas.
Crie seu próprio clipe hoje
A forma mais barata de descobrir quanto seus clipes vão custar é fazer um. Escolha uma foto que você já tenha, como uma foto de produto, uma paisagem ou um retrato. Abra o Seedance 2.5 Lite ou o Picasso IA Video no Picasso IA, adicione um prompt de movimento de uma frase e renderize um rascunho em 480p. Depois teste três variações de prompt e anote quantas foram necessárias para obter um clipe que você publicaria.
Se precisar de um primeiro quadro novo, crie-o com o Picasso IA Image e anime-o na mesma sessão. Quando o rascunho funcionar, passe para 720p e, se o seu volume justificar, chame a API com a requisição acima. Veja todos os modelos de vídeo e imagem em picassoia.com/en/all-models e faça sua própria comparação antes de se comprometer com um provedor pago.