Limites de l’offre gratuite de l’API Gemini : modèles, limites de débit et génération d’images
L’offre gratuite de l’API Gemini fonctionne toujours pour les modèles de texte, mais la génération d’images et la vidéo Veo exigent désormais une facturation. Cet article détaille les limites de débit par projet, les modèles qui restent gratuits, ce que demande chaque offre payante et où créer des images IA sans compte Google Cloud.
L’offre gratuite de l’API Gemini existe toujours, mais elle ne ressemble plus à celle dont on parlait il y a un an. Les modèles de texte peuvent être appelés sans carte bancaire, alors que chaque modèle qui dessine des images ou génère une vidéo se trouve désormais derrière la facturation, et les quotas journaliers des modèles restants ont changé plus d’une fois. Si vous budgétez un projet annexe, un prototype ou une démonstration en classe autour de ces limites, les détails décident si votre application fonctionne le jour du lancement ou si elle affiche des erreurs dès midi.
Cet article présente ce que comprend l’offre gratuite, les modèles que vous pouvez appeler sans facturation, le comportement des limites de débit dans un projet réel, et la raison pour laquelle la génération d’images pose problème. Vous verrez aussi ce qu’exigent les offres payantes et où créer des images IA sans compte Google Cloud.
💡 Réponse rapide : Les modèles de texte comme Gemini 2.5 Flash sont accessibles gratuitement, avec des quotas serrés par projet. Les modèles d’images comme Nano Banana et Imagen 4, ainsi que la vidéo Veo 3.1, nécessitent un projet facturé.
Ce que comprend l’offre gratuite
Chaque nouveau projet de l’API Gemini démarre sur l’offre gratuite. La seule condition est d’avoir un projet actif, donc aucun compte de facturation à lier ni carte à saisir. C’est la façon la plus rapide de tester un prompt, de connecter un prototype ou de vérifier comment un modèle traite vos propres données.
Les limites s’appliquent par projet
Google mesure l’utilisation par projet, et non par identifiant d’API. Créer cinq identifiants dans un même projet ne vous donne pas cinq quotas, car ils puisent tous dans le même pot. Répartir une application sur plusieurs projets pour cumuler les allocations est fragile, et mieux vaut l’éviter. Concevez plutôt votre application autour de l’allocation d’un seul projet et faites-la tenir dans cette limite.
RPM, TPM et RPD expliqués
Quatre compteurs déterminent si une requête passe :
RPM compte les requêtes par minute.
TPM compte les tokens d’entrée par minute.
RPD compte les requêtes par jour et se réinitialise à minuit, heure du Pacifique.
IPM compte les images par minute et s’applique aux modèles d’images.
Dépasser un seul de ces compteurs déclenche une erreur de limite de débit, même si les trois autres semblent en bonne santé. Un chatbot qui envoie de courts messages atteint généralement la limite RPM en premier. Un outil de résumé de documents qui envoie de longs fichiers atteint la limite TPM. Une application amateur qui tourne toute l’après-midi atteint la limite RPD.
Limite
Ce qu’elle compte
Qui l’atteint en premier
RPM
Requêtes sur une fenêtre de 60 secondes
Applications de chat, scripts en rafales
TPM
Tokens d’entrée sur une fenêtre de 60 secondes
Longs documents, contextes volumineux
RPD
Requêtes depuis la dernière réinitialisation
Traitements par lots, outils utilisés toute la journée
IPM
Images par minute
Boucles de génération d’images
Pourquoi les chiffres ne cessent de changer
La documentation de Google n’affiche plus de tableau des offres gratuites par modèle. Les RPM, TPM et RPD exacts de votre projet apparaissent dans la vue des limites de débit de Google AI Studio, et ils peuvent varier d’un projet à l’autre. En décembre 2025, des développeurs ont signalé de fortes baisses, Gemini 2.5 Flash tombant à environ 20 requêtes par jour selon certains témoignages. Des tableaux tiers de début 2026 indiquaient des plages de 5 à 15 RPM, environ 250 000 TPM et 100 à 1 000 RPD. Considérez ces valeurs comme des chiffres rapportés, et non comme des engagements.
💡 Conseil : Lisez les limites dans votre propre tableau de bord AI Studio et dans les messages d’erreur reçus par votre application. Coder en dur un chiffre tiré d’un article de blog, y compris celui-ci, est ce qui fait casser les applications après un changement discret de quota.
Quels modèles fonctionnent sans facturation
Tous les modèles n’ont pas le même statut gratuit. Au moment de la rédaction, la page tarifaire trace une ligne nette entre les modèles de texte et tout ce qui produit du média.
Les modèles de texte gratuits
La famille Flash est le terrain naturel de l’offre gratuite. Selon la page tarifaire, les modèles Gemini 3.x Flash et Gemini 2.5 Flash affichent l’entrée et la sortie comme « gratuites » dans l’offre Standard. Les variantes plus légères Flash-Lite vont plus loin et restent gratuites dans les offres Standard, Batch et Flex. Les modèles de synthèse vocale de la gamme Flash sont également gratuits dans les offres Standard et Priority.
Gemini 3.5 Flash est le modèle par lequel la plupart des nouveaux venus devraient commencer, car il gère le chat, le code et les images en entrée à une vitesse adaptée à des quotas aussi réduits. Les offres Batch et Flex ne sont pas gratuites sur les plus grands modèles Flash, donc un traitement massif sur ces offres implique une facturation.
Les modèles réservés à la facturation
Tout ce qui produit des images, de la musique ou de la vidéo nécessite un projet payant. Les modèles de texte de catégorie Pro forment une zone grise, alors vérifiez-les dans AI Studio avant de construire quoi que ce soit dessus.
Une équipe qui choisit un modèle doit d’abord se poser une question : la fonctionnalité nécessite-t-elle une sortie média ? Si oui, l’offre gratuite est déjà exclue, et la vraie décision porte sur le fait de payer Google directement ou de passer par une autre voie.
Les limites de débit dans les projets réels
Une limite sur le papier et une limite en production ne se ressemblent pas du tout. Sur le papier, 15 requêtes par minute semblent suffisantes. En production, une page qui lance quatre appels à chaque chargement atteindra ce plafond avec une poignée de visiteurs.
Un petit calcul de dimensionnement aide. Divisez votre limite quotidienne de requêtes par le nombre d’appels que déclenche une action de l’utilisateur. Supposons que votre projet autorise 100 requêtes par jour et que chaque action effectue trois appels : vous pouvez servir environ 33 actions avant la réinitialisation, soit quelques dizaines de visiteurs au maximum. Faites ce calcul avec les chiffres affichés dans votre propre tableau de bord AI Studio avant de promettre quoi que ce soit à vos utilisateurs.
Lire une erreur 429
Lorsqu’un quota est dépassé, l’API répond avec le code HTTP 429. Le message indique la limite qui a échoué, alors lisez-le avant de deviner.
Ce que vous voyez
Cause probable
Solution
Erreurs par courtes rafales, puis retour à la normale
RPM
Mettre les requêtes en file d’attente et les espacer
Erreurs uniquement sur les prompts longs
TPM
Réduire le contexte ou découper les documents
Tout fonctionne le matin, échecs le soir
RPD
Mettre les résultats en cache et réduire le volume d’appels
Le modèle d’images renvoie un quota nul
Pas d’offre gratuite
Lier la facturation ou utiliser une autre plateforme
Une logique de nouvelle tentative qui fonctionne
Un backoff exponentiel avec un peu d’aléatoire gère bien les limites par minute. Ce schéma tient en une dizaine de lignes :
import random, time
def call_with_backoff(send, max_tries=5):
for attempt in range(max_tries):
try:
return send()
except RateLimitError:
wait = (2 ** attempt) + random.random()
time.sleep(wait)
raise RuntimeError("Rate limited after all retries")
Le backoff résout les RPM. Il ne peut pas résoudre les RPD, car ce quota ne se reconstitue qu’à minuit, heure du Pacifique, quelle que soit la patience avec laquelle vous réessayez.
Quatre habitudes permettent d’étirer un petit quota gratuit :
Mettez en cache les réponses répétées pour que des questions identiques ne coûtent qu’une requête.
Raccourcissez les prompts, car moins de tokens d’entrée préservent votre TPM.
Regroupez les questions liées dans une seule requête lorsque la tâche le permet.
Orientez les tâches simples vers un modèle Flash-Lite et réservez le modèle plus puissant aux tâches difficiles.
La génération d’images nécessite une facturation
C’est là que la confusion commence, car les anciens conseils remplissent encore les résultats de recherche.
Le statut de Nano Banana et d’Imagen
Début 2026, plusieurs publications ont affirmé que Gemini 2.5 Flash Image permettait jusqu’à 500 images gratuites par jour en 1024 sur 1024. Cette affirmation est dépassée. La page tarifaire actuelle n’indique aucune offre gratuite pour aucun modèle de génération d’images :
Nano Banana 2, appelé Gemini 3.1 Flash Image dans l’API, n’a pas d’offre gratuite.
Nano Banana Pro, appelé Gemini 3 Pro Image dans l’API, n’a pas d’offre gratuite.
La famille Imagen 4 ne fonctionne qu’avec un compte de facturation lié.
Il y a aussi le quota fantôme. Dans AI Studio, un projet gratuit peut afficher à côté d’Imagen un compteur du type « 0 / 25 », qui ressemble à une allocation quotidienne. Un fil du forum des développeurs Google de février 2026 signale que les requêtes échouent encore avec un message indiquant que l’API Imagen n’est accessible qu’aux utilisateurs facturés. Activer la facturation n’ajoute pas non plus d’allocation quotidienne gratuite. Le seul usage gratuit provient du crédit d’introduction de 300 $ offert aux nouveaux utilisateurs de Google Cloud, valable 90 jours. Une fois ce crédit expiré, les tarifs à l’usage s’appliquent immédiatement.
💡 Attention : Un chiffre de quota affiché à l’écran n’est pas une garantie d’accès. Si un modèle figure dans la colonne « Non » de la page tarifaire, aucune attente ne le fera fonctionner sur l’offre gratuite.
Veo et les limites vidéo
La vidéo suit la même règle. Veo 3.1 est indiqué comme « non disponible » sur l’offre gratuite pour l’ensemble de ses variantes tarifaires standard, donc une démonstration qui génère des clips nécessite un projet payant dès le premier jour. Si vous voulez des clips vidéo sans aucune configuration d’API, PicassoIA propose Veo 3.1, Veo 3.1 Fast et Veo 3.1 Lite à utiliser directement.
Monter d’un palier
Les offres payantes relèvent le plafond et ouvrent l’accès aux modèles média. La montée en palier se fait automatiquement dès que vous remplissez les conditions ci-dessous.
Ce que demande chaque palier
Palier
Critères d’accès
Plafond de dépenses
Free
Projet actif ou essai gratuit
Non applicable
Palier 1
Compte de facturation associé
250 $
Palier 2
100 $+ dépensés et 3+ jours depuis le premier paiement
2 000 $
Palier 3
1 000 $+ dépensés et 30+ jours depuis le premier paiement
20 000 $ à 100 000 $+
Chaque palier dispose aussi d’une limite de dépenses mesurée sur une fenêtre glissante de 10 minutes : 10 $ pour le palier 1, 50 $ pour le palier 2 et 200 $ pour le palier 3. Le passage de l’offre gratuite au palier 1 prend effet immédiatement après la configuration de la facturation. Les montées de palier ultérieures interviennent dans les 10 minutes environ suivant la satisfaction des critères.
Restez sur l’offre gratuite si :
Vous prototypez uniquement avec du texte.
Votre trafic représente quelques centaines de requêtes par jour ou moins.
Un appel raté ne coûte rien à vos utilisateurs.
Passez au palier 1 si :
Vous avez besoin des sorties de Nano Banana, d’Imagen ou de Veo.
Les limites quotidiennes font tomber votre application avant la fin de la journée.
De vrais clients dépendent de la réponse.
Générer des images gratuitement sans facturation
Si votre objectif est une image plutôt qu’un texte, il existe un chemin plus court qu’un projet Google Cloud. PicassoIA héberge les modèles d’images et de vidéo de Google directement dans le navigateur : pas de compte de facturation Google Cloud, pas de configuration de projet et pas de tableau de bord de quotas à surveiller.
Les modèles Gemini sur PicassoIA
La gamme Google qui nécessite une facturation via l’API est disponible directement sur la plateforme :
Comme il s’agit de modèles distincts, vous pouvez envoyer le même prompt à deux d’entre eux et comparer les résultats. Imagen 4 convient aux images fixes photoréalistes, tandis que Nano Banana 2 est le meilleur choix lorsque vous voulez éditer ou fusionner des images existantes. Choisir selon la tâche plutôt que selon le nom permet de garder des résultats cohérents.
Comment utiliser Nano Banana 2
Nano Banana 2 est le modèle à essayer en premier, car il crée des images à partir de texte et édite ou fusionne aussi des images existantes.
Rédigez un prompt qui nomme le sujet, le décor, l’éclairage et l’objectif.
Ajoutez une image de référence si vous voulez modifier une photo ou mélanger deux images.
Choisissez le format qui correspond à votre mise en page, par exemple 16:9 pour un en-tête de blog.
Générez, examinez le résultat et ajustez un seul détail du prompt à la fois.
Les prompts précis font la différence. Une demande vague comme « un bureau » donne un résultat générique, alors que « un bureau en chêne de développeur à l’heure dorée, de la vapeur qui s’élève d’une tasse, objectif 35 mm, faible profondeur de champ » donne quelque chose que vous pouvez publier.
💡 Conseil : Ne changez qu’une chose à chaque essai. Si l’éclairage ne convient pas, modifiez les mots qui décrivent l’éclairage et laissez le reste intact. Vous verrez exactement ce que fait chaque expression.
Réponses rapides
L’API Gemini est-elle gratuite ?
En partie. Les modèles de texte des familles Flash et Flash-Lite disposent d’une offre gratuite avec des limites par projet. Les modèles de texte de catégorie Pro, tous les modèles d’images et la vidéo Veo nécessitent un projet facturé.
L’offre gratuite permet-elle de créer des images ?
Non. La page tarifaire actuelle n’indique aucune offre gratuite pour Nano Banana, les modèles d’images Gemini ou Imagen. Les publications qui annoncent des centaines d’images quotidiennes gratuites décrivent une configuration antérieure. Pour créer des images sans projet Google Cloud, utilisez une plateforme comme PicassoIA avec Nano Banana 2 ou Imagen 4.
Les limites se réinitialisent-elles chaque jour ?
Les requêtes par jour se réinitialisent à minuit, heure du Pacifique. Les limites par minute se rétablissent au fil de la fenêtre glissante, ce qui explique pourquoi le backoff corrige les rafales mais pas un quota journalier épuisé.
Créez vos propres images dès aujourd’hui
L’offre gratuite est un bon endroit pour tester des prompts textuels, mais dès que vous avez besoin d’une image, un compte de facturation devient le prix d’entrée côté Google. Vous pouvez éviter cette étape. Ouvrez Nano Banana 2 sur PicassoIA, saisissez la scène que vous avez en tête et découvrez le résultat en quelques secondes. Essayez Imagen 4 lorsque vous voulez une image fixe photoréaliste, ou Veo 3.1 Fast lorsqu’une image fixe ne suffit pas. Lancez le même prompt sur deux modèles, comparez les résultats côte à côte et gardez celui qui convient à votre projet. Tous les modèles sont listés sur picassoia.com/en/all-models, pour comparer vos options avant de vous engager.