Limites de l’offre gratuite de l’API Gemini : modèles, limites de débit et génération d’images

L’offre gratuite de l’API Gemini fonctionne toujours pour les modèles de texte, mais la génération d’images et la vidéo Veo exigent désormais une facturation. Cet article détaille les limites de débit par projet, les modèles qui restent gratuits, ce que demande chaque offre payante et où créer des images IA sans compte Google Cloud.

Limites de l’offre gratuite de l’API Gemini : modèles, limites de débit et génération d’images
Cristian Da Conceicao
Fondateur de Picasso IA

L’offre gratuite de l’API Gemini existe toujours, mais elle ne ressemble plus à celle dont on parlait il y a un an. Les modèles de texte peuvent être appelés sans carte bancaire, alors que chaque modèle qui dessine des images ou génère une vidéo se trouve désormais derrière la facturation, et les quotas journaliers des modèles restants ont changé plus d’une fois. Si vous budgétez un projet annexe, un prototype ou une démonstration en classe autour de ces limites, les détails décident si votre application fonctionne le jour du lancement ou si elle affiche des erreurs dès midi.

Cet article présente ce que comprend l’offre gratuite, les modèles que vous pouvez appeler sans facturation, le comportement des limites de débit dans un projet réel, et la raison pour laquelle la génération d’images pose problème. Vous verrez aussi ce qu’exigent les offres payantes et où créer des images IA sans compte Google Cloud.

💡 Réponse rapide : Les modèles de texte comme Gemini 2.5 Flash sont accessibles gratuitement, avec des quotas serrés par projet. Les modèles d’images comme Nano Banana et Imagen 4, ainsi que la vidéo Veo 3.1, nécessitent un projet facturé.

Ce que comprend l’offre gratuite

Chaque nouveau projet de l’API Gemini démarre sur l’offre gratuite. La seule condition est d’avoir un projet actif, donc aucun compte de facturation à lier ni carte à saisir. C’est la façon la plus rapide de tester un prompt, de connecter un prototype ou de vérifier comment un modèle traite vos propres données.

Vue en contre-plongée d’une allée de centre de données bordée de baies de serveurs noires et de voyants verts stables

Les limites s’appliquent par projet

Google mesure l’utilisation par projet, et non par identifiant d’API. Créer cinq identifiants dans un même projet ne vous donne pas cinq quotas, car ils puisent tous dans le même pot. Répartir une application sur plusieurs projets pour cumuler les allocations est fragile, et mieux vaut l’éviter. Concevez plutôt votre application autour de l’allocation d’un seul projet et faites-la tenir dans cette limite.

RPM, TPM et RPD expliqués

Quatre compteurs déterminent si une requête passe :

  • RPM compte les requêtes par minute.
  • TPM compte les tokens d’entrée par minute.
  • RPD compte les requêtes par jour et se réinitialise à minuit, heure du Pacifique.
  • IPM compte les images par minute et s’applique aux modèles d’images.

Dépasser un seul de ces compteurs déclenche une erreur de limite de débit, même si les trois autres semblent en bonne santé. Un chatbot qui envoie de courts messages atteint généralement la limite RPM en premier. Un outil de résumé de documents qui envoie de longs fichiers atteint la limite TPM. Une application amateur qui tourne toute l’après-midi atteint la limite RPD.

Deux mains tapant sur un ordinateur portable à côté d’un carnet rempli de marques de comptage au crayon et d’une grille dessinée à la main

LimiteCe qu’elle compteQui l’atteint en premier
RPMRequêtes sur une fenêtre de 60 secondesApplications de chat, scripts en rafales
TPMTokens d’entrée sur une fenêtre de 60 secondesLongs documents, contextes volumineux
RPDRequêtes depuis la dernière réinitialisationTraitements par lots, outils utilisés toute la journée
IPMImages par minuteBoucles de génération d’images

Pourquoi les chiffres ne cessent de changer

La documentation de Google n’affiche plus de tableau des offres gratuites par modèle. Les RPM, TPM et RPD exacts de votre projet apparaissent dans la vue des limites de débit de Google AI Studio, et ils peuvent varier d’un projet à l’autre. En décembre 2025, des développeurs ont signalé de fortes baisses, Gemini 2.5 Flash tombant à environ 20 requêtes par jour selon certains témoignages. Des tableaux tiers de début 2026 indiquaient des plages de 5 à 15 RPM, environ 250 000 TPM et 100 à 1 000 RPD. Considérez ces valeurs comme des chiffres rapportés, et non comme des engagements.

💡 Conseil : Lisez les limites dans votre propre tableau de bord AI Studio et dans les messages d’erreur reçus par votre application. Coder en dur un chiffre tiré d’un article de blog, y compris celui-ci, est ce qui fait casser les applications après un changement discret de quota.

Quels modèles fonctionnent sans facturation

Tous les modèles n’ont pas le même statut gratuit. Au moment de la rédaction, la page tarifaire trace une ligne nette entre les modèles de texte et tout ce qui produit du média.

Les modèles de texte gratuits

La famille Flash est le terrain naturel de l’offre gratuite. Selon la page tarifaire, les modèles Gemini 3.x Flash et Gemini 2.5 Flash affichent l’entrée et la sortie comme « gratuites » dans l’offre Standard. Les variantes plus légères Flash-Lite vont plus loin et restent gratuites dans les offres Standard, Batch et Flex. Les modèles de synthèse vocale de la gamme Flash sont également gratuits dans les offres Standard et Priority.

Gemini 3.5 Flash est le modèle par lequel la plupart des nouveaux venus devraient commencer, car il gère le chat, le code et les images en entrée à une vitesse adaptée à des quotas aussi réduits. Les offres Batch et Flex ne sont pas gratuites sur les plus grands modèles Flash, donc un traitement massif sur ces offres implique une facturation.

Les modèles réservés à la facturation

Tout ce qui produit des images, de la musique ou de la vidéo nécessite un projet payant. Les modèles de texte de catégorie Pro forment une zone grise, alors vérifiez-les dans AI Studio avant de construire quoi que ce soit dessus.

Famille de modèlesOffre gratuiteRemarques
Texte Gemini Flash et Flash-LiteOuiQuotas serrés par projet
Gemini 3.1 Pro PreviewNon confirmé par les vérifications tiercesÀ vérifier dans AI Studio
Nano Banana 2 (Gemini 3.1 Flash Image)NonFacturation requise
Nano Banana Pro (Gemini 3 Pro Image)NonFacturation requise
Famille Imagen 4NonComptes facturés uniquement
Veo 3.1NonNon disponible sur l’offre gratuite
Musique LyriaNonFacturation requise

Trois collègues autour d’une table claire en chêne, l’un montrant un ordinateur portable tandis que les autres prennent des notes

Une équipe qui choisit un modèle doit d’abord se poser une question : la fonctionnalité nécessite-t-elle une sortie média ? Si oui, l’offre gratuite est déjà exclue, et la vraie décision porte sur le fait de payer Google directement ou de passer par une autre voie.

Les limites de débit dans les projets réels

Une limite sur le papier et une limite en production ne se ressemblent pas du tout. Sur le papier, 15 requêtes par minute semblent suffisantes. En production, une page qui lance quatre appels à chaque chargement atteindra ce plafond avec une poignée de visiteurs.

Un petit calcul de dimensionnement aide. Divisez votre limite quotidienne de requêtes par le nombre d’appels que déclenche une action de l’utilisateur. Supposons que votre projet autorise 100 requêtes par jour et que chaque action effectue trois appels : vous pouvez servir environ 33 actions avant la réinitialisation, soit quelques dizaines de visiteurs au maximum. Faites ce calcul avec les chiffres affichés dans votre propre tableau de bord AI Studio avant de promettre quoi que ce soit à vos utilisateurs.

Lire une erreur 429

Lorsqu’un quota est dépassé, l’API répond avec le code HTTP 429. Le message indique la limite qui a échoué, alors lisez-le avant de deviner.

Ce que vous voyezCause probableSolution
Erreurs par courtes rafales, puis retour à la normaleRPMMettre les requêtes en file d’attente et les espacer
Erreurs uniquement sur les prompts longsTPMRéduire le contexte ou découper les documents
Tout fonctionne le matin, échecs le soirRPDMettre les résultats en cache et réduire le volume d’appels
Le modèle d’images renvoie un quota nulPas d’offre gratuiteLier la facturation ou utiliser une autre plateforme

Une logique de nouvelle tentative qui fonctionne

Un backoff exponentiel avec un peu d’aléatoire gère bien les limites par minute. Ce schéma tient en une dizaine de lignes :

import random, time

def call_with_backoff(send, max_tries=5):
    for attempt in range(max_tries):
        try:
            return send()
        except RateLimitError:
            wait = (2 ** attempt) + random.random()
            time.sleep(wait)
    raise RuntimeError("Rate limited after all retries")

Le backoff résout les RPM. Il ne peut pas résoudre les RPD, car ce quota ne se reconstitue qu’à minuit, heure du Pacifique, quelle que soit la patience avec laquelle vous réessayez.

Une horloge murale ronde et ancienne aux aiguilles en laiton indiquant minuit dans une pièce sombre éclairée par une lampe de bureau chaleureuse

Quatre habitudes permettent d’étirer un petit quota gratuit :

  • Mettez en cache les réponses répétées pour que des questions identiques ne coûtent qu’une requête.
  • Raccourcissez les prompts, car moins de tokens d’entrée préservent votre TPM.
  • Regroupez les questions liées dans une seule requête lorsque la tâche le permet.
  • Orientez les tâches simples vers un modèle Flash-Lite et réservez le modèle plus puissant aux tâches difficiles.

La génération d’images nécessite une facturation

C’est là que la confusion commence, car les anciens conseils remplissent encore les résultats de recherche.

Un photographe dans un studio éclairé par la lumière du jour, examinant un écran calibré qui montre un paysage de montagne flou

Le statut de Nano Banana et d’Imagen

Début 2026, plusieurs publications ont affirmé que Gemini 2.5 Flash Image permettait jusqu’à 500 images gratuites par jour en 1024 sur 1024. Cette affirmation est dépassée. La page tarifaire actuelle n’indique aucune offre gratuite pour aucun modèle de génération d’images :

  • Nano Banana 2, appelé Gemini 3.1 Flash Image dans l’API, n’a pas d’offre gratuite.
  • Nano Banana Pro, appelé Gemini 3 Pro Image dans l’API, n’a pas d’offre gratuite.
  • La famille Imagen 4 ne fonctionne qu’avec un compte de facturation lié.

Il y a aussi le quota fantôme. Dans AI Studio, un projet gratuit peut afficher à côté d’Imagen un compteur du type « 0 / 25 », qui ressemble à une allocation quotidienne. Un fil du forum des développeurs Google de février 2026 signale que les requêtes échouent encore avec un message indiquant que l’API Imagen n’est accessible qu’aux utilisateurs facturés. Activer la facturation n’ajoute pas non plus d’allocation quotidienne gratuite. Le seul usage gratuit provient du crédit d’introduction de 300 $ offert aux nouveaux utilisateurs de Google Cloud, valable 90 jours. Une fois ce crédit expiré, les tarifs à l’usage s’appliquent immédiatement.

Une main tenant une carte en métal sombre et sobre au-dessus du clavier d’un ordinateur portable, sur un bureau bien rangé

💡 Attention : Un chiffre de quota affiché à l’écran n’est pas une garantie d’accès. Si un modèle figure dans la colonne « Non » de la page tarifaire, aucune attente ne le fera fonctionner sur l’offre gratuite.

Veo et les limites vidéo

La vidéo suit la même règle. Veo 3.1 est indiqué comme « non disponible » sur l’offre gratuite pour l’ensemble de ses variantes tarifaires standard, donc une démonstration qui génère des clips nécessite un projet payant dès le premier jour. Si vous voulez des clips vidéo sans aucune configuration d’API, PicassoIA propose Veo 3.1, Veo 3.1 Fast et Veo 3.1 Lite à utiliser directement.

Monter d’un palier

Les offres payantes relèvent le plafond et ouvrent l’accès aux modèles média. La montée en palier se fait automatiquement dès que vous remplissez les conditions ci-dessous.

Un tableau blanc avec un croquis au feutre noir de trois marches ascendantes reliées par des flèches

Ce que demande chaque palier

PalierCritères d’accèsPlafond de dépenses
FreeProjet actif ou essai gratuitNon applicable
Palier 1Compte de facturation associé250 $
Palier 2100 $+ dépensés et 3+ jours depuis le premier paiement2 000 $
Palier 31 000 $+ dépensés et 30+ jours depuis le premier paiement20 000 $ à 100 000 $+

Chaque palier dispose aussi d’une limite de dépenses mesurée sur une fenêtre glissante de 10 minutes : 10 $ pour le palier 1, 50 $ pour le palier 2 et 200 $ pour le palier 3. Le passage de l’offre gratuite au palier 1 prend effet immédiatement après la configuration de la facturation. Les montées de palier ultérieures interviennent dans les 10 minutes environ suivant la satisfaction des critères.

Restez sur l’offre gratuite si :

  • Vous prototypez uniquement avec du texte.
  • Votre trafic représente quelques centaines de requêtes par jour ou moins.
  • Un appel raté ne coûte rien à vos utilisateurs.

Passez au palier 1 si :

  • Vous avez besoin des sorties de Nano Banana, d’Imagen ou de Veo.
  • Les limites quotidiennes font tomber votre application avant la fin de la journée.
  • De vrais clients dépendent de la réponse.

Générer des images gratuitement sans facturation

Si votre objectif est une image plutôt qu’un texte, il existe un chemin plus court qu’un projet Google Cloud. PicassoIA héberge les modèles d’images et de vidéo de Google directement dans le navigateur : pas de compte de facturation Google Cloud, pas de configuration de projet et pas de tableau de bord de quotas à surveiller.

Les modèles Gemini sur PicassoIA

Un jeune homme dans un café ensoleillé utilisant une tablette posée sur un support, à côté d’un latte orné d’une mousse décorée

La gamme Google qui nécessite une facturation via l’API est disponible directement sur la plateforme :

BesoinModèle
Création et édition d’images rapides et souplesNano Banana 2
Détails en haute résolutionNano Banana Pro
Brouillons plus légers et plus rapidesNano Banana 2 Lite
Images fixes photoréalistesImagen 4 et Imagen 4 Ultra
La rapidité avant le soinImagen 4 Fast
Chat, code et rédactionGemini 3.5 Flash et Gemini 3 Flash

Comme il s’agit de modèles distincts, vous pouvez envoyer le même prompt à deux d’entre eux et comparer les résultats. Imagen 4 convient aux images fixes photoréalistes, tandis que Nano Banana 2 est le meilleur choix lorsque vous voulez éditer ou fusionner des images existantes. Choisir selon la tâche plutôt que selon le nom permet de garder des résultats cohérents.

Comment utiliser Nano Banana 2

Nano Banana 2 est le modèle à essayer en premier, car il crée des images à partir de texte et édite ou fusionne aussi des images existantes.

  1. Ouvrez la page Nano Banana 2 sur PicassoIA.
  2. Rédigez un prompt qui nomme le sujet, le décor, l’éclairage et l’objectif.
  3. Ajoutez une image de référence si vous voulez modifier une photo ou mélanger deux images.
  4. Choisissez le format qui correspond à votre mise en page, par exemple 16:9 pour un en-tête de blog.
  5. Générez, examinez le résultat et ajustez un seul détail du prompt à la fois.

Les prompts précis font la différence. Une demande vague comme « un bureau » donne un résultat générique, alors que « un bureau en chêne de développeur à l’heure dorée, de la vapeur qui s’élève d’une tasse, objectif 35 mm, faible profondeur de champ » donne quelque chose que vous pouvez publier.

Vue de dessus d’un espace de travail créatif avec un ordinateur portable, une tablette, des nuanciers de couleurs et une tasse de thé

💡 Conseil : Ne changez qu’une chose à chaque essai. Si l’éclairage ne convient pas, modifiez les mots qui décrivent l’éclairage et laissez le reste intact. Vous verrez exactement ce que fait chaque expression.

Réponses rapides

L’API Gemini est-elle gratuite ?

En partie. Les modèles de texte des familles Flash et Flash-Lite disposent d’une offre gratuite avec des limites par projet. Les modèles de texte de catégorie Pro, tous les modèles d’images et la vidéo Veo nécessitent un projet facturé.

L’offre gratuite permet-elle de créer des images ?

Non. La page tarifaire actuelle n’indique aucune offre gratuite pour Nano Banana, les modèles d’images Gemini ou Imagen. Les publications qui annoncent des centaines d’images quotidiennes gratuites décrivent une configuration antérieure. Pour créer des images sans projet Google Cloud, utilisez une plateforme comme PicassoIA avec Nano Banana 2 ou Imagen 4.

Les limites se réinitialisent-elles chaque jour ?

Les requêtes par jour se réinitialisent à minuit, heure du Pacifique. Les limites par minute se rétablissent au fil de la fenêtre glissante, ce qui explique pourquoi le backoff corrige les rafales mais pas un quota journalier épuisé.

Créez vos propres images dès aujourd’hui

L’offre gratuite est un bon endroit pour tester des prompts textuels, mais dès que vous avez besoin d’une image, un compte de facturation devient le prix d’entrée côté Google. Vous pouvez éviter cette étape. Ouvrez Nano Banana 2 sur PicassoIA, saisissez la scène que vous avez en tête et découvrez le résultat en quelques secondes. Essayez Imagen 4 lorsque vous voulez une image fixe photoréaliste, ou Veo 3.1 Fast lorsqu’une image fixe ne suffit pas. Lancez le même prompt sur deux modèles, comparez les résultats côte à côte et gardez celui qui convient à votre projet. Tous les modèles sont listés sur picassoia.com/en/all-models, pour comparer vos options avant de vous engager.

Partager cet article

Choisissez votre langue