Nom d’API Veo 3.1 : identifiants de modèles pour Veo 3.1, Fast et Lite

Les trois identifiants de modèles Veo 3.1 dans l’API Gemini, côte à côte : standard, Fast et Lite. Découvrez les résolutions et durées de clip autorisées pour chacun, le coût d’un clip par seconde, comment les appeler en Python et comment les utiliser depuis votre navigateur.

Nom d’API Veo 3.1 : identifiants de modèles pour Veo 3.1, Fast et Lite
Cristian Da Conceicao
Fondateur de Picasso IA

Vous collez un nom de modèle dans votre script, vous l’exécutez et vous obtenez une erreur au lieu d’une vidéo. Avec Veo 3.1, cela arrive plus souvent qu’il ne le devrait, car le nom dans une annonce de lancement, le nom dans l’API Gemini et le nom sur une plateforme tierce sont trois chaînes de caractères différentes. Cette page répertorie les identifiants exacts de Veo 3.1, Veo 3.1 Fast et Veo 3.1 Lite, ce que chacun permet de faire, ce que chacun coûte par seconde, et comment les appeler sans deviner.

En bref : dans l’API Gemini, les trois noms sont veo-3.1-generate-preview, veo-3.1-fast-generate-preview et veo-3.1-lite-generate-preview. Tout ce qui suit explique pourquoi ils ont cette forme, lequel correspond à votre besoin, et comment utiliser les mêmes modèles sur PicassoIA si vous préférez cliquer plutôt que coder. Si une requête échoue immédiatement, comparez votre chaîne au tableau ci-dessous avant de toucher à quoi que ce soit d’autre, car un caractère erroné est facile à commettre et difficile à repérer dans un long script.

Mains de développeur tapant sur un clavier à un bureau, avec un éditeur de code légèrement flou en arrière-plan

Les trois identifiants de modèles

La documentation de l’API Gemini de Google répertorie ces codes pour la famille Veo 3.1. Copiez-les exactement, y compris la terminaison -preview.

ModèleIdentifiant de modèle dans l’API GeminiStatutPage PicassoIA
Veo 3.1veo-3.1-generate-previewPreviewVeo 3.1
Veo 3.1 Fastveo-3.1-fast-generate-previewPreviewVeo 3.1 Fast
Veo 3.1 Liteveo-3.1-lite-generate-previewPreviewVeo 3.1 Lite

💡 Astuce : les identifiants sont des chaînes littérales. veo-3.1, veo3.1 et veo-3-1-fast ne correspondent à aucun des trois codes ci-dessus, donc une requête qui les utilise demande un modèle absent de la liste de Google.

Veo 3.1 standard

veo-3.1-generate-preview occupe le sommet de la famille. Selon le tableau des propriétés de Google, il accepte en entrée un texte ou une image, renvoie une vidéo avec un son généré nativement, et propose des sorties en 720p, 1080p et 4k. Les clips durent 4, 6 ou 8 secondes, et le 1080p et le 4k sont limités à 8 secondes. Choisissez-le lorsque le clip est le livrable final et que le budget le permet.

Veo 3.1 Fast

veo-3.1-fast-generate-preview partage les mêmes lignes d’entrée, de sortie, de résolution et de durée que le modèle standard dans le tableau de Google. Ce qui change, c’est le compromis : un prix par seconde plus bas et des temps d’attente plus courts. Dans les exemples de générations publiés sur sa page PicassoIA, les clips Fast se sont terminés en 45 à 59 secondes environ, contre 72 à 114 secondes pour les exemples de la page standard Veo 3.1.

Veo 3.1 Lite

veo-3.1-lite-generate-preview est le palier le moins cher. Il prend en charge le 720p et le 1080p (8 secondes uniquement), ne propose pas de sortie en 4k, et la documentation de Google indique que l’extension vidéo n’est pas disponible pour lui. Les exemples de la page Veo 3.1 Lite se sont terminés en 37 à 42 secondes environ. Considérez-le comme le palier de volume : beaucoup de brouillons, de clips pour les réseaux sociaux et de boucles d’arrière-plan.

Vue aérienne d’un bureau en noyer avec un carnet de croquis, un crayon, un ordinateur portable et un café

D’où viennent les noms

Lire la structure

Chaque identifiant suit une même forme : la version, le palier facultatif, le mot generate, puis un stade de sortie. Ainsi, veo-3.1-fast-generate-preview se lit comme Veo 3.1, palier Fast, generate, stade preview.

Les anciens modèles Veo 3 utilisent un suffixe de stade différent. veo-3.0-generate-001 et veo-3.0-fast-generate-001 sont répertoriés comme stables, avec des clips de 8 secondes en 720p ou 1080p. Si vous voulez ceux-ci sur PicassoIA, ce sont Veo 3 et Veo 3 Fast.

Preview signifie que Google peut encore modifier le comportement, les limites ou le prix. Placez la chaîne dans une constante de configuration unique, afin qu’une seule modification mette à jour l’ensemble de votre projet le jour où un nom change.

Stable ou preview ? Si votre produit ne peut pas tolérer qu’un modèle soit renommé ou que son prix change, la paire stable Veo 3 est la base la plus sûre, à condition que des clips de 8 secondes en 720p ou 1080p suffisent. Si vous avez besoin de durées de 4, 6 ou 8 secondes, du palier Lite moins cher ou de la sortie en 4k, vous êtes dans le domaine preview et devez prévoir des changements. Enregistrez la chaîne du modèle à côté de chaque fichier généré, afin de pouvoir reproduire ou auditer un résultat des mois plus tard.

Les noms sur d’autres plateformes

Ne collez jamais une chaîne de l’API Gemini dans une autre plateforme. PicassoIA catalogue ces modèles sous le propriétaire google, avec des noms qui retirent les mots generate et preview, et des slugs de pages qui retirent les points.

OùVeo 3.1FastLite
API Geminiveo-3.1-generate-previewveo-3.1-fast-generate-previewveo-3.1-lite-generate-preview
Nom du modèle sur PicassoIAgoogle/veo-3.1google/veo-3.1-fastgoogle/veo-3.1-lite
Slug de la page PicassoIAgoogle-veo-31google-veo-31-fastgoogle-veo-31-lite

La règle pratique : un outil qui communique avec l’API Gemini attend veo-3.1-generate-preview, tandis qu’un outil ou un catalogue qui fonctionne avec des couples propriétaire et nom attend google/veo-3.1. Mélanger les deux est un moyen facile de demander un modèle qui n’existe pas.

Vertex AI de Google Cloud tient sa propre liste de modèles. Lisez l’identifiant dans cette console au lieu de supposer qu’il correspond à la chaîne de l’API Gemini.

Vue en contre-plongée d’une longue allée de serveurs, avec un technicien qui s’éloigne

Les caractéristiques côte à côte

Tous les chiffres ci-dessous proviennent de la documentation de l’API Gemini de Google pour Veo.

PropriétéVeo 3.1Veo 3.1 FastVeo 3.1 LiteVeo 3 et Fast
EntréeTexte, imageTexte, imageTexte, imageTexte, image
SortieVidéo avec sonVidéo avec sonVidéo avec sonVidéo avec son
Résolution720p, 1080p, 4k720p, 1080p, 4k720p, 1080p720p, 1080p
Durée4, 6 ou 8 s4, 6 ou 8 s4, 6 ou 8 s8 s
StatutPreviewPreviewPreviewStable

La règle du 1080p

Google lie le 1080p (et le 4k sur les modèles qui le proposent) aux clips de 8 secondes, et le formulaire Lite de PicassoIA reprend la même règle : la durée doit être de 8 lorsque vous choisissez le 1080p. Traitez la résolution et la durée comme un couple. Un clip de 4 ou 6 secondes correspond au 720p.

Ce que Lite ne propose pas

Au-delà du 4k et de l’extension de vidéo, le formulaire Lite sur PicassoIA ne comporte ni champ de prompt négatif, ni bouton de son, ni images de référence. Le formulaire du modèle standard les comporte tous les trois, et Fast conserve le prompt négatif et le bouton de son. Si votre pipeline repose sur des images de référence pour garder un personnage stable, Lite n’est pas le bon palier.

Appareil photo hybride compact posé à côté d’un rig de caméra cinéma plus imposant sur une table en bois

Le coût de chaque appel

Google facture Veo à la seconde de vidéo générée. Voici les prix avec son sur sa page tarifaire au moment de la rédaction, ainsi que le coût d’un clip de 8 secondes.

Modèle720p par seconde1080p par seconde4k par secondeClip de 8 s en 1080p
Veo 3.10,40 $0,40 $0,60 $3,20 $
Veo 3.1 Fast0,10 $0,12 $0,30 $0,96 $
Veo 3.1 Lite0,05 $0,08 $Non pris en charge0,64 $

💡 À vérifier avant de budgétiser : ce sont des modèles preview, et les prix preview peuvent évoluer. Google précise également que vous n’êtes facturé que lorsqu’une vidéo est générée avec succès.

Brouillons peu coûteux, version finale plus chère

Faites les calculs sur un lot réel. Dix brouillons de 8 secondes sur Lite en 720p coûtent 10 x 0,40 $ = 4,00 $. Trois retouches sur Fast en 1080p coûtent 3 x 0,96 $ = 2,88 $. Une version finale sur le standard en 1080p coûte 3,20 $. Total : 10,08 $. Générer les quatorze clips sur le standard en 1080p coûterait 14 x 3,20 $ = 44,80 $ pour le même nombre de générations.

Des brouillons plus courts font encore plus d’économies. Un clip de 4 secondes est autorisé en 720p, donc un brouillon Lite coûte 4 x 0,05 $ = 0,20 $, un brouillon Fast coûte 0,40 $ et un brouillon standard coûte 1,60 $. Réglez le mouvement de caméra et le son sur des brouillons de 4 secondes, puis utilisez les 8 secondes une fois que le prompt fonctionne.

Sur PicassoIA, vous générez depuis le navigateur, donc il n’y a aucun compteur par seconde dans votre propre code à suivre. Les limites dépendent de votre forfait, vérifiez-les donc avant une grande série.

Calculatrice de bureau posée sur une liste budgétaire manuscrite, avec un stylo et quelques pièces

Un appel Python fonctionnel

La documentation de Google montre le schéma ci-dessous pour le modèle standard. Il utilise le SDK google-genai, lance une opération de longue durée et interroge cette opération jusqu’à ce que la vidéo soit prête. Le client lit vos identifiants Gemini depuis l’environnement, donc configurez-les comme le décrit Google AI Studio avant de l’exécuter.

import time
from google import genai
from google.genai import types

client = genai.Client()

prompt = "A slow dolly shot along a rainy street at dusk, a street musician plays saxophone, rain and distant traffic in the audio"

operation = client.models.generate_videos(
    model="veo-3.1-generate-preview",
    prompt=prompt,
)

while not operation.done:
    print("Waiting for video generation to finish...")
    time.sleep(10)
    operation = client.operations.get(operation)

generated_video = operation.response.generated_videos[0]
client.files.download(file=generated_video.video, destination="output.mp4")

Passer d’un palier à l’autre ne change qu’un argument. Conservez les trois noms dans un dictionnaire et passez celui dont vous avez besoin :

VEO_MODELS = {
    "standard": "veo-3.1-generate-preview",
    "fast": "veo-3.1-fast-generate-preview",
    "lite": "veo-3.1-lite-generate-preview",
}

operation = client.models.generate_videos(
    model=VEO_MODELS["fast"],
    prompt=prompt,
)

Interroger l’opération

L’appel renvoie une opération, et non une vidéo. Votre boucle vérifie operation.done toutes les 10 secondes, puis télécharge le fichier. Prévoyez une attente d’une à deux minutes sur le modèle standard et moins sur Fast et Lite, d’après les durées d’exemple indiquées plus haut. Ne renvoyez pas la requête tant qu’une opération est encore en cours, sinon vous générez (et payez) un second clip.

Les erreurs qui font perdre de l’argent

  • Suffixe manquant. veo-3.1-generate sans -preview n’est pas un code répertorié.
  • 4k sur Lite. Ce palier ne le propose pas.
  • 1080p avec un clip de 6 secondes. Réglez 8 secondes, ou passez au 720p.
  • Prolonger un clip Lite. Google indique que l’extension n’est pas disponible pour Lite.
  • Éparpiller les chaînes. Si vous codez l’identifiant en dur dans dix fichiers, un renommage vous coûtera un après-midi.

Avant de lancer un lot, parcourez cette courte liste de contrôle :

  • La chaîne du modèle correspond à l’un des trois codes du premier tableau, caractère pour caractère.
  • La résolution et la durée forment un couple valide : 1080p signifie 8 secondes.
  • Le palier choisi prend en charge ce dont vous avez besoin : le 4k, l’extension et les images de référence ne sont pas disponibles sur Lite.
  • Vous avez enregistré la chaîne du modèle et le prompt à côté de chaque fichier généré.
  • Vous avez multiplié le prix par seconde par le nombre de clips avant d’appuyer sur lancer.

Gros plan d’un chronomètre en laiton posé à côté d’un ordinateur portable

Quel modèle convient à votre besoin

BesoinPalier recommandéPourquoi
Tests de prompts et storyboardsFastPrix bas, délai court
Clip final phare ou livraison en 4kVeo 3.1 standardPlafond de résolution le plus élevé
Clips verticaux quotidiens pour les réseaux sociauxLiteLe moins cher à la seconde
Garder un même sujet stable d’un plan à l’autreVeo 3.1 standardImages de référence sur PicassoIA

Fast pour itérer

La plupart des prompts demandent trois ou quatre réécritures avant que le mouvement de caméra et le son vous conviennent. Faites ces réécritures sur Veo 3.1 Fast, puis passez le prompt gagnant sur le modèle standard.

Comme chaque palier renvoie un son natif, intégrez le son dans le prompt. Les prompts d’exemple de PicassoIA font exactement cela : le sifflet d’un train et le bruit ambiant d’une gare, du jazz doux avec la pluie qui tambourine sur une vitre, une réplique parlée entre guillemets. Un prompt qui nomme le son donne au modèle de quoi construire la piste audio, et vous entendrez vite la différence entre les brouillons.

Deux développeurs examinant ensemble un écran à un bureau debout

Le standard pour les versions finales

Quand un clip figurera sur une page d’accueil, dans une présentation client ou sur un grand écran, le surcoût de Veo 3.1 se justifie facilement. C’est aussi le seul palier de cette famille à proposer les images de référence sur PicassoIA, et il partage la ligne 4k avec Fast dans le tableau de Google.

Petite équipe de tournage filmant sur une route de montagne brumeuse à l’aube

Lite pour le volume

Veo 3.1 Lite convient à tout flux de travail où vous avez besoin de dizaines de courts clips : boucles de produits, publications verticales, images d’arrière-plan pour un podcast. Passez le format à 9:16 et réglez le 720p pour obtenir le résultat le moins cher.

Vue par-dessus l’épaule d’un responsable marketing regardant une vidéo verticale sur son téléphone dans un café

Utiliser Veo 3.1 sur PicassoIA

Sans code, sans identifiants, mais avec la même famille de modèles. Voici le déroulé sur la page Veo 3.1 :

  1. Ouvrez la page du modèle. Rendez-vous sur Veo 3.1 sur PicassoIA.
  2. Rédigez le prompt. C’est le seul champ obligatoire. Décrivez le sujet, le mouvement de caméra, la lumière et le son que vous voulez entendre.
  3. Réglez la durée. Choisissez 4, 6 ou 8 secondes. La valeur par défaut est 8.
  4. Réglez la résolution et le format. Choisissez 720p ou 1080p (la valeur par défaut est 1080p), puis 16:9 ou 9:16.
  5. Gardez le son activé. L’option audio est activée par défaut. Ajoutez un prompt négatif pour tout ce que vous voulez exclure.
  6. Générez et téléchargez. Attendez le clip, puis enregistrez le fichier.

Images clés et images de référence

Ajoutez une image d’entrée pour partir de votre propre première image. Ajoutez aussi une dernière image et le modèle construit une transition entre les deux. Les images idéales sont en 16:9 ou 9:16, en 1280x720 ou 720x1280, selon le format choisi.

Pour garder un sujet cohérent, importez plutôt une à trois images de référence. Cela ne fonctionne que sur le modèle standard, et uniquement en 16:9 et sur 8 secondes. Si vous fournissez des images de référence, la dernière image est ignorée, donc choisissez une seule approche par clip.

Fast et Lite sur PicassoIA

Veo 3.1 Fast utilise le 1080p par défaut et conserve le prompt négatif et le bouton de son. Veo 3.1 Lite utilise le 720p par défaut et exige 8 secondes dès que vous choisissez le 1080p.

💡 Vous codez avec PicassoIA ? Au moment de la rédaction, l’API développeur de PicassoIA répertoriait quatre de ses propres modèles, dont PicassoIA Video et Seedance 2.5 Lite, et non les modèles Veo de Google. Les identifiants Veo de cet article appartiennent à l’API Gemini, et les pages Veo ci-dessus servent pour le navigateur.

Créez votre premier clip dès aujourd’hui

Choisissez un prompt et lancez-le trois fois : une fois sur Veo 3.1, une fois sur Fast et une fois sur Lite. Gardez le seed identique là où le formulaire en propose un, puis placez les trois clips côte à côte. Vous verrez la différence de prix et de vitesse en cinq minutes environ, et vous saurez quel palier mérite une place dans votre flux de travail.

Un bon prompt de test : un barista fait glisser un latte sur un comptoir en marbre, la vapeur monte, du jazz doux et le sifflement d’une machine à espresso, lent travelling avant sur la tasse. Il a un sujet clair, un seul mouvement de caméra et un environnement sonore défini, donc les écarts entre paliers apparaissent dans la qualité du mouvement et de l’audio plutôt que dans les suppositions.

PicassoIA réunit les trois sur un seul site, vous pouvez donc tester avant d’écrire une ligne de code d’intégration. Ouvrez Veo 3.1, Veo 3.1 Fast ou Veo 3.1 Lite, tapez la scène que vous imaginez, et regardez-la devenir un clip avec son.

Créateur riant doucement devant un clip terminé sur un ordinateur portable, dans un appartement ensoleillé

Partager cet article

Choisissez votre langue