API image vers vidéo : gratuite, bon marché et comparatif des tarifs
Les API image vers vidéo facturent de 0 à 2,00 $ pour un seul clip de 5 secondes. Cet article compare les options gratuites, les offres bon marché au tarif par seconde et les coûts cachés, avec des prix vérifiés en octobre 2026 et un exemple fonctionnel de l’API PicassoIA.
Un clip de cinq secondes créé à partir d’une seule image peut ne rien coûter, un quart de dollar ou deux dollars, selon l’API d’image vers vidéo que vous appelez et le palier choisi. Cet écart est le vrai sujet des prix ce mois-ci, et c’est pourquoi un rapide coup d’œil à la page d’un seul fournisseur permet rarement de prévoir ce que coûtera un projet. Vous trouverez ci-dessous les voies gratuites, les moins chères, les plus coûteuses, le calcul pour un clip de 5 secondes, et les endroits où le prix affiché n’est pas celui de la facture.
💡 Les prix changent chaque mois. Tous les chiffres ici ont été vérifiés en octobre 2026 sur la page d’un fournisseur ou sur un suivi tarifaire nommé. Utilisez-les comme un instantané, puis confirmez sur la page du fournisseur avant de vous engager sur un gros volume.
Ce que fait une API image vers vidéo
Une image en entrée, un clip en sortie
Vous envoyez une image unique comme première image, accompagnée d’un court prompt de mouvement. L’API renvoie un fichier MP4, généralement long de 5 à 10 secondes, en résolution allant de 480p à 4K. Beaucoup de modèles génèrent désormais un son synchronisé dans le même passage, ce qui modifie le prix (on y revient plus bas). L’image fixe le sujet, les couleurs et le cadrage, si bien que le résultat est nettement plus prévisible qu’avec le texte vers vidéo, où le modèle invente tout à partir de zéro.
Les entrées se ressemblent d’un fournisseur à l’autre : une URL d’image ou un import, un prompt décrivant une action dans l’ordre chronologique (« la caméra se rapproche lentement pendant que la vapeur monte de la tasse »), une résolution, une durée et parfois un seed pour obtenir des résultats reproductibles.
Pourquoi les tâches tournent de façon asynchrone
Le rendu prend vraiment du temps, donc presque toutes les API vidéo fonctionnent en deux étapes : créer une tâche, puis l’interroger jusqu’à ce que le statut indique succeeded ou failed. Les exemples d’exécution listés sur les pages de modèles de PicassoIA montrent l’ordre de grandeur : environ 30 à 80 secondes pour des clips de 5 secondes sur Picasso IA Video, et à peu près 100 à 190 secondes pour des clips de 10 à 15 secondes sur Seedance 2.5 Lite. Votre code doit attendre, relancer et gérer les échecs, et une tâche qui échoue vous coûte du temps, parfois aussi de l’argent.
API image vers vidéo gratuites
La gratuité existe sous trois formes, et une seule est gratuite au sens où on l’espère.
Les offres gratuites qui existent
L’API PicassoIA. La documentation indique « API predictions are currently free. They use no credits » (les prédictions API sont actuellement gratuites et n’utilisent aucun crédit), avec un forfait Infinite requis. Les détails figurent dans la section PicassoIA ci-dessous.
Modèles ouverts hébergés avec offre gratuite. ModelsLab propose une offre gratuite pour l’image vers vidéo avec LTX 2.3 Fast, puis un paiement à l’usage.
Crédits des applications grand public. Un suivi tarifaire a relevé Kling 3.0 avec 66 crédits quotidiens et Runway avec 125 crédits mensuels, en février. Il s’agit de quotas d’application, pas d’appels API, donc ne bâtissez pas un produit dessus.
💡 Le piège : les offres gratuites s’accompagnent de plafonds, de files d’attente et du mot « currently » dans leurs conditions. Elles sont parfaites pour tester des prompts et risquées comme seule base d’un produit payant.
Des poids ouverts sur votre propre GPU
Les modèles ouverts comme Wan 2.2 I2V, LTX Video et Stable Video Diffusion n’ont pas de frais par clip. Vous payez en matériel. Les besoins signalés sont d’environ 10 à 16 Go de VRAM pour Stable Video Diffusion en 576x1024, et 24 Go ou plus pour Wan 2.2 I2V A14B en 720p. Hugging Face héberge aussi des Spaces de démonstration, mais attendez-vous à des files d’attente.
Louer un GPU à l’heure ramène la facturation à un montant par clip, donc mesurez les secondes de GPU que chaque clip consomme avant de le dire gratuit.
Tarifs bon marché au tarif par seconde
La facturation à la seconde est la plus facile à comparer : multipliez le tarif par la durée du clip et vous obtenez le coût.
Les lignes Google incluent le son. Seedance 2 est facturé au token à la place (0,014 $ pour 1 000 tokens sur la page de fal), donc vous ne pouvez pas le convertir en tarif par seconde sans savoir combien de tokens un clip utilise. Générez un clip test et lisez la facture.
La résolution pèse aussi sur la facture. Sur la page de Google, Veo 3.1 Fast coûte 0,10 $ par seconde en 720p, 0,12 $ en 1080p et 0,30 $ en 4K. Même modèle, prix triplé. Faites vos brouillons en 720p et ne montez en qualité que les clips que vous gardez.
Même modèle, quatre prix
Kling 3.0 affiche environ 0,029 $ par seconde chez un suivi et 0,14 $ pour l’offre Pro sur fal. L’écart vient de l’offre (standard ou pro), de l’activation du son, de la marge du revendeur et de la date de l’instantané. Comparez des choses comparables : même résolution, même durée, même réglage audio, même offre.
Ce que « bon marché » achète vraiment
Les prix bas viennent généralement de variantes plus petites, et non d’une remise sur le modèle phare. Une version Lite ou Fast échange le détail maximal et les plus hautes résolutions contre la vitesse et le volume. Seedance 2.5 Lite, par exemple, est volontairement limité au 480p et au 720p. Pour des clips pour les réseaux sociaux, des boucles produit et des storyboards animés, c’est largement suffisant. Pour un plan héros en 4K sur la page d’accueil d’un client, ça ne l’est pas.
Quelle que soit l’offre choisie, testez-la sur vos propres images avant d’acheter du volume. Les mêmes quelques éléments font échouer des clips sur presque tous les modèles : les mains en mouvement, le texte lisible dans le cadre, les mouvements de caméra rapides et les foules de petits personnages. Un sujet calme avec un seul mouvement clair, comme de la vapeur, des nuages qui dérivent, un lent rapprochement ou un mouvement de tête, est le terrain où les modèles bon marché sont à leur meilleur. Passez cinq de vos vraies photos dans une offre bon marché et une offre intermédiaire, puis comparez les résultats côte à côte. Si vous ne parvenez pas à les distinguer à la taille à laquelle vous publiez, c’est le moins cher qui gagne.
L’écart de crédits est réel. Le tableau d’août d’Apiframe indique Seedance 1.5 Pro en 720p pour 4 secondes à 15 crédits, et Luma Ray 2 en 720p pour 5 secondes à 131 crédits. Cela fait environ 3,75 crédits par seconde contre 26,2, soit environ sept fois plus.
Les abonnements suivent une règle simple de seuil de rentabilité : frais mensuels divisés par le coût par clip. Un suivi a situé les forfaits Runway entre 12 $ et 76 $ par mois. Un forfait à 12 $ équivaut à environ 34 clips à 0,35 $ chacun. Si vous faites moins de clips que cela, payez à la seconde.
Un budget pour 100 clips
Voici une prise pour chacun des 100 clips de 5 secondes en 720p :
💡 Prévoyez des reprises. Peu de prompts réussissent du premier coup. Si vous obtenez en moyenne 3 prises par clip utilisable, multipliez tous les chiffres de ce tableau par 3.
Quelle option vous convient
Tester des prompts et des idées : utilisez une option gratuite, soit l’API PicassoIA, soit une offre gratuite hébergée, et acceptez les plafonds.
Clips pour les réseaux sociaux en volume : une offre Lite ou Fast en 720p, comme Veo 3.1 Lite ou Kling 2.5 Turbo Pro, revient entre 25 et 35 $ pour 100 clips avec une seule prise chacun.
Travail client en 1080p ou plus :Veo 3.1 Fast ou l’offre Pro de Kling 3.0, avec un budget de reprises en plus.
Travail confidentiel ou hors ligne : des poids ouverts comme Wan 2.2 I2V sur votre propre GPU, si vous possédez déjà le matériel.
Usage occasionnel : évitez les abonnements, qui ne deviennent rentables qu’au-delà du seuil calculé plus haut.
L’API PicassoIA
Modèles et limites
L’API se trouve à https://api.picassoia.com/v1 et utilise un token Bearer qui commence par pia_sk_. Les points de terminaison suivent le schéma familier de Replicate : créer une prédiction, l’interroger, récupérer le résultat. Quatre modèles sont exposés :
Les limites comptent pour tout traitement par lot : 5 prédictions en cours à la fois par compte (une sixième renvoie 429 concurrency_limit), un corps de requête de 10 Mo, 5 Mo par image en data URL, des prompts allant jusqu’à 4 000 caractères et 2 tokens par compte.
Ce que cela coûte aujourd’hui
La documentation indique que les prédictions API sont actuellement gratuites et n’utilisent aucun crédit, et que le prix est « Free with the Infinite plan » (gratuit avec le forfait Infinite). Sans ce forfait, la création d’une prédiction renvoie 403 plan_required. Une subtilité : la page tarifaire présente API Access et MCP Connections comme de nouveautés de ses forfaits, alors que la documentation exige Infinite. Considérez la documentation comme la règle et vérifiez la page des forfaits avant de bâtir dessus. Et retenez le mot currently.
Une requête fonctionnelle
Cette requête anime une photo avec Seedance 2.5 Lite. Les paramètres vont dans un objet input :
curl -s -X POST https://api.picassoia.com/v1/models/picassoia/seedance-2.5-lite/predictions \
-H "Authorization: Bearer $PICASSOIA_TOKEN" \
-H "Content-Type: application/json" \
-d '{"input": {"image": "https://example.com/first-frame.jpg", "prompt": "The camera pushes in slowly as steam rises from the cup and morning light shifts across the table", "resolution": "720p", "duration": 5}}'
Vous recevez une réponse 201 avec un id, un status de starting, une URL d’interrogation et un eta. Interrogez GET /v1/predictions/{id} jusqu’à ce que le statut soit succeeded, failed ou canceled. La boucle Python documentée est courte :
import os, time, requests
API = "https://api.picassoia.com/v1"
HEADERS = {"Authorization": f"Bearer {os.environ['PICASSOIA_TOKEN']}"}
def run(model, input):
r = requests.post(f"{API}/models/{model}/predictions", json={"input": input}, headers=HEADERS)
p = r.json()
if not r.ok:
raise RuntimeError(f"{p['code']}: {p['detail']}")
while p["status"] not in ("succeeded", "failed", "canceled"):
time.sleep((p.get("eta") or {}).get("next_poll_in_seconds", 2))
p = requests.get(p["urls"]["get"], headers=HEADERS).json()
if p["status"] != "succeeded":
raise RuntimeError(p["error"] or p["status"])
return p["output"]
Comment utiliser Seedance 2.5 Lite
Pas besoin de code si vous ne voulez que quelques clips. Seedance 2.5 Lite se lance depuis la page du modèle, et sa description indique que les membres Wonder peuvent générer sans limite.
Choisissez la première image. Importez l’image que vous voulez animer. Le clip l’utilise comme image d’ouverture et reprend son format, donc le réglage du format est ignoré.
Décrivez le mouvement sous forme de chronologie. Indiquez ce qui bouge en premier, ce que fait la caméra et comment la lumière évolue. Les prompts cinématographiques et chronologiques donnent les meilleurs résultats.
Commencez en 480p. C’est le rendu le plus rapide. Passez en 720p une fois que le mouvement vous convient.
Choisissez 5 ou 10 secondes. Cinq secondes suffisent pour un teaser produit ou une boucle pour les réseaux sociaux.
Décidez pour le son. Le son synchronisé est activé par défaut. Désactivez save_audio pour obtenir un clip silencieux.
Fixez un seed lorsqu’un résultat vous plaît et que vous voulez le reproduire. Ajoutez une image de dernière frame si vous voulez que le clip se termine sur un plan précis.
Trois prompts de départ pour des mouvements calmes et peu risqués :
Photo produit : « Lent rapprochement sur la bouteille pendant que la lumière douce d’une fenêtre glisse sur le verre, rien d’autre ne bouge. »
Portrait : « Elle tourne la tête vers la caméra et sourit légèrement, les cheveux bougeant dans une brise légère, faible profondeur de champ. »
Paysage : « Des nuages dérivent au-dessus de la crête, la brume traverse la vallée, la caméra s’élève lentement dans la lumière dorée de l’heure dorée. »
Vous avez besoin de la première image elle-même ? Générez-la avec Picasso IA Image, corrigez les détails avec Picasso IA Image Editor Pro, puis animez-la. Picasso IA Video est l’alternative la plus simple : chaque clip dure 5 secondes fixes à 24 images par seconde, en 480p ou 720p.
Les coûts cachés à surveiller
Clips échoués et refaits
Le prix par seconde est le prix d’une seule tentative. Des mains qui fondent, des visages qui dérivent et un mouvement de caméra qui ignore votre prompt signifient une prise de plus. À 3 prises par clip utilisable, un clip à 0,25 $ coûte en réalité 0,75 $. Demandez à chaque fournisseur si les prédictions échouées ou annulées sont facturées, et suivez le nombre de prises par clip utilisable pour vos propres contenus, car ce ratio change avec chaque modèle.
Son, durée et simultanéité
Le son peut doubler le prix. Le même tableau Apiframe indique Seedance 1.5 Pro en 720p pour 4 secondes à 15 crédits, et 30 crédits avec le son.
La durée fait grimper la facture. Un clip de 10 secondes coûte deux fois un clip de 5 secondes sur tout forfait à la seconde.
La simultanéité coûte du temps. Avec 5 tâches en parallèle et environ une minute par clip, 100 clips représentent environ 20 minutes d’attente. Les modèles plus lents étirent cela en heures.
Créez votre propre clip dès aujourd’hui
La façon la moins chère de savoir combien coûteront vos clips est d’en créer un. Choisissez une photo que vous possédez déjà, comme une photo produit, un paysage ou un portrait. Ouvrez Seedance 2.5 Lite ou Picasso IA Video sur Picasso IA, ajoutez un prompt de mouvement d’une seule phrase et générez un brouillon en 480p. Essayez ensuite trois variantes de prompt et notez combien il en a fallu pour obtenir un clip que vous publieriez.
Si vous avez besoin d’une première image neuve, créez-la avec Picasso IA Image et animez-la dans la même session. Une fois le brouillon concluant, passez en 720p et, si votre volume le justifie, appelez l’API avec la requête ci-dessus. Parcourez tous les modèles vidéo et image sur picassoia.com/en/all-models et faites votre propre comparaison avant de vous engager auprès d’un fournisseur payant.