Nano Banana Pro API ComfyUI : configuration, nœuds, flux de travail et coût

Nano Banana Pro fonctionne dans ComfyUI comme Partner Node, sans modification de Python ni projet Google Cloud. Cet article présente le nœud, un flux de travail fonctionnel, les réglages qui modifient le prix, et le coût des rendus en 1K, 2K et 4K.

Nano Banana Pro API ComfyUI : configuration, nœuds, flux de travail et coût
Cristian Da Conceicao
Fondateur de Picasso IA

Si vous utilisez déjà ComfyUI, ajouter Nano Banana Pro prend environ cinq minutes et une seule connexion. Le modèle est fourni sous forme de Partner Node, donc il n’y a aucun environnement Python à corriger, aucun projet Google Cloud à ouvrir et aucune charge sur votre propre GPU. Vous recherchez le nœud, reliez un prompt à celui-ci, et le modèle Gemini 3 Pro Image de Google génère jusqu’au 4K natif. Ce qui prend plus de temps, c’est de décider où placer le nœud dans un graphe, quels réglages font varier le prix, et si les crédits Comfy sont plus avantageux qu’un appel direct à Google. Cet article répond à ces trois questions avec les chiffres publiés par Google et Comfy en octobre 2026.

💡 Réponse rapide sur le coût : au tarif public de Google, une image en 1K et une image en 2K coûtent le même prix ($0,134), et une image en 4K coûte $0,24. Faites vos brouillons en 2K, finalisez en 4K, et ne choisissez jamais le 1K pour économiser, car cela ne fait aucune économie.

Ce que fait le nœud Nano Banana Pro

Nano Banana Pro est le nom commercial de Gemini 3 Pro Image, que Google expose via l’API Gemini sous le nom gemini-3-pro-image-preview. Ce n’est pas un checkpoint que l’on télécharge. C’est un modèle multimodal hébergé : un seul nœud gère donc la génération de texte vers image, l’édition d’image et le mélange de plusieurs images. Le gros du travail se fait sur le matériel de Google, pendant que ComfyUI se contente d’envoyer la requête et d’enregistrer le résultat.

Gemini 3 Pro Image en détail

Quatre caractéristiques comptent lorsque vous placez ce modèle dans un graphe :

  • Sortie native en 4K. Le modèle génère en 1K, 2K ou 4K sans étape d’upscaling séparée.
  • Jusqu’à 14 images de référence. Visages, produits, styles et mises en page peuvent être mélangés en un seul appel.
  • Rendu du texte en 10 langues. Affiches, étiquettes et panneaux sont bien plus lisibles qu’avec la plupart des checkpoints de diffusion, selon l’annonce de lancement de Comfy.
  • Inférence hébergée. Rien ne se charge dans la VRAM, donc un ordinateur portable sans GPU dédié exécute le même graphe qu’une station de travail.

Un point à savoir : Google n’indique aucune offre gratuite pour ce modèle sur son API, donc chaque appel est facturé.

Partner Node ou votre propre identifiant

Il existe trois façons d’accéder au même modèle depuis ComfyUI, et la bonne dépend de la personne à qui vous voulez adresser la facture.

AccèsCompte nécessaireFacturationIdéal pour
Partner Node de ComfyUICompte ComfyCrédits ComfyMise en place la plus rapide, aucune autre inscription
Nœud communautaire avec un identifiant Google AI StudioCompte Google sur une offre payanteGoogle facture à l’imageUtiliser la facture de Google et les tarifs Batch
Nœud relais tiersCompte du fournisseur de relaisTarifs du relaisRégions ou moyens de paiement que Google ne couvre pas

Des packages communautaires existent pour la troisième voie. ComfyUI-Nano-Banana-apiyi appelle Nano Banana Pro et Nano Banana 2 sans compte Google Cloud, et le nœud « Luck » Nano Banana Pro ajoute la gestion des délais d’attente et des nouvelles tentatives, la progression en direct, les modes de seed natifs et jusqu’à 14 entrées d’images combinées.

💡 Un nœud relais voit chaque prompt et chaque photo de référence que vous envoyez. Traitez-le comme n’importe quel service tiers et gardez les travaux clients ou les photos privées sur la voie officielle.

Un photographe plaçant la dernière de quatorze photographies de référence imprimées dans une grille sur une table en noyer

Configurer ComfyUI avant de commencer

Trois conditions doivent être remplies avant que le nœud fonctionne : une version récente de ComfyUI, un compte Comfy connecté et un solde de crédits positif. Le reste est facultatif.

Mettre à jour et se connecter

  1. Mettez à jour ComfyUI. Utilisez la mise à jour intégrée à l’application de bureau ou actualisez votre version portable. Les anciennes versions n’incluent pas le nœud Nano Banana Pro, et la documentation officielle recommande de mettre à jour en premier.
  2. Connectez-vous. Ouvrez Paramètres, puis Utilisateur, et connectez-vous à votre compte Comfy. Les Partner Nodes refusent de fonctionner sans cela.
  3. Achetez des crédits. Ouvrez Paramètres, puis Crédits. Les Partner Nodes appellent des modèles tiers payants, donc le solde doit être supérieur à zéro. Les crédits mensuels expirent à la fin de la période de facturation, tandis que les crédits rechargés restent valables un an après l’achat.

Un homme en chemise de flanelle grise mettant à jour un logiciel sur un ordinateur portable, sur un îlot de cuisine, à la lumière du matin

💡 La documentation de Comfy mentionne aussi un environnement réseau autorisé et des limites de concurrence. Si le nœud ne fonctionne que sur un VPN d’entreprise, testez depuis une connexion domestique simple avant de déboguer le graphe.

Ouvrir le modèle prêt à l’emploi

Ouvrez la bibliothèque de modèles et choisissez le modèle Nano Banana Pro. Les utilisateurs du cloud peuvent lancer le même flux depuis Comfy Cloud, sans rien installer. Le modèle charge un graphe court : un nœud LoadImage pour une photo de référence, le nœud Nano Banana Pro qui contient votre prompt, et un nœud SaveImage à la fin.

Importez une image de référence, saisissez un prompt, choisissez un niveau de réflexion et appuyez sur Exécuter. Puis vérifiez votre solde de crédits. La différence correspond à votre coût réel pour cette résolution, et elle est plus fiable que n’importe quel tableau de cet article, y compris celui plus bas.

Construire le flux de travail nœud par nœud

Le modèle prêt à l’emploi fonctionne, mais un graphe de production a généralement besoin de plus de trois nœuds. Voici le rôle de chaque élément et les erreurs fréquentes.

Les quatre nœuds essentiels

NœudRôlePoints de vigilance
LoadImageImporte une photo de référenceLes gros fichiers s’importent lentement
BatchImagesNodeFusionne plusieurs images en une seule entréeLe modèle voit un ensemble, donc nommez chaque image dans le prompt
Nano Banana Pro (GeminiImage2Node)Envoie le prompt et les images à Gemini 3 Pro ImageLa résolution définie ici fixe le prix
SaveImageÉcrit le PNG dans votre dossier de sortieChangez le préfixe du nom de fichier par projet, sinon les fichiers s’accumulent

Vue en contre-plongée de deux écrans affichant un graphe de nœuds tentaculaire à côté d’un aperçu de paysage de montagne

Les réglages qui modifient le résultat

Les noms des champs varient légèrement selon les versions de ComfyUI, mais les versions actuelles proposent ces commandes :

  • Prompt. Rédigez-le comme un brief photo : sujet, décor, lumière et objectif. De courtes phrases concrètes valent mieux que de longues listes de tags.
  • Format. Choisissez dès maintenant le cadre final. Le modifier plus tard vous obligerait à payer une image entièrement nouvelle.
  • Résolution. 1K, 2K ou 4K. C’est le principal levier de prix.
  • Seed. Utile pour reproduire un rendu, mais un modèle hébergé ne garantit pas une sortie identique au pixel près. Enregistrez les fichiers qui vous plaisent.
  • Niveau de réflexion. La documentation liste Minimal, High et Dynamic. Les niveaux plus élevés aident sur les mises en page denses et les longs textes.
  • Format de réponse. Choisissez image uniquement, sauf si vous voulez aussi le commentaire textuel du modèle, car la sortie texte a son propre petit coût.

Doigts tournant la bague d’ouverture d’un objectif vintage de 50 mm sur une table en bois

Enchaîner les entrées multi-références

La limite de 14 images est ce qui justifie la place de ce nœud dans un graphe. Voici un schéma reproductible :

  1. Envoyez d’abord la photo du sujet, puis les références de style et d’accessoires.
  2. Indiquez à quoi sert chaque image : « Image 1 : la personne, image 2 : la veste, image 3 : la référence d’éclairage. »
  3. Testez les combinaisons en 2K, puis refaites le meilleur résultat en 4K.
  4. Pour un travail en deux étapes, envoyez la première sortie dans un second nœud comme seule référence et demandez exactement une modification.

Chaque image d’entrée supplémentaire coûte environ $0,0011 au tarif public de Google, donc 14 références ajoutent environ $0,015 par appel. C’est assez bon marché pour être généreux, à condition que chaque image ait un rôle.

Une directrice artistique épinglant six photos d’ambiance imprimées sur un mur de liège dans un studio lumineux

Rédiger les prompts avec un LLM

ComfyUI propose aussi un nœud Google Gemini capable de légender des images et de rédiger des prompts à partir de notes brutes, si bien qu’une étape de rédaction peut vivre dans le même graphe. Si vous préférez rédiger en dehors de ComfyUI, PicassoIA héberge Gemini 3.5 Flash pour des reformulations rapides et Claude Sonnet 5 pour les briefs plus longs.

Demandez au LLM un prompt en quatre parties : sujet et action, environnement, éclairage, caméra et objectif. Collez le résultat dans le nœud et ne modifiez qu’une partie à la fois entre deux exécutions, afin de savoir quelle modification a changé l’image.

Une femme écrivant une longue liste dans un carnet à spirale à côté d’un ordinateur portable, devant la fenêtre d’un café

Le coût réel de chaque image

Prix officiels par résolution

La page de tarification de l’API Gemini de Google, consultée le 6 octobre 2026, indique ces prix pour Gemini 3 Pro Image :

ModeImage 1K ou 2KImage 4KImage d’entrée
Standard$0,134$0,24$0,0011 chacune
Batch$0,067$0,12$0,0006 chacune

L’annonce de lancement de Comfy cite les mêmes $0,134 et $0,24 pour le Partner Node. La page de tarification des Partner Nodes, en revanche, facture en crédits par token : 30,38 crédits pour 1 000 tokens d’image en sortie, 0,5064 crédit pour 1 000 tokens en entrée et 3,0384 crédits pour 1 000 tokens de texte en sortie.

Une image en 1K ou 2K représente environ 1 120 tokens de sortie et une image en 4K environ 2 000, ce qui donne environ 34 crédits et 61 crédits avant les frais d’entrée. Il s’agit de mon calcul à partir du tableau publié : vérifiez-le par rapport à votre propre solde après un test.

Un rendu en 4K coûte environ 79 % de plus qu’un rendu en 2K. C’est un prix juste pour un travail d’impression ou un recadrage poussé, et un gaspillage pour une vignette de blog.

Trois façons de réduire la facture

  1. Faites vos brouillons en 2K, pas en 1K. Le prix est identique, et vous obtenez davantage de détails pour juger la composition et le texte.
  2. Ne finalisez en 4K que les meilleurs résultats. Trois brouillons en 2K et un rendu final en 4K coûtent $0,642 ($0,402 plus $0,24), contre $0,96 pour quatre essais en 4K.
  3. Envoyez les tâches en volume via l’API Batch. Elle coûte deux fois moins cher, mais les résultats arrivent avec un délai, et d’après la documentation, le Partner Node de ComfyUI ne l’expose pas. Le travail en volume relève d’un script.
TâcheStandardBatch
100 images en 2K$13,40$6,70
100 images en 4K$24,00$12,00
500 images en 2K$67,00$33,50

Une main tenant une calculatrice au-dessus de tickets de caisse vierges, de pièces en argent et d’un carnet sur un bureau en bois

Appeler l’API en dehors de ComfyUI

Parfois le nœud n’est pas le bon outil : tâches nocturnes, milliers d’images, ou application sans interface graphique. Le même modèle est disponible via le SDK google-genai de Google. Il vous faut un projet sur une offre payante dans Google AI Studio, car ce modèle n’a pas d’offre gratuite.

Un appel Python minimal

from google import genai
from google.genai import types

client = genai.Client()  # reads your AI Studio credential from the environment

response = client.models.generate_content(
    model="gemini-3-pro-image-preview",
    contents=["Overhead photo of a walnut desk with a ceramic mug, soft window light"],
    config=types.GenerateContentConfig(
        response_modalities=["TEXT", "IMAGE"],
        image_config=types.ImageConfig(aspect_ratio="16:9", image_size="2K"),
    ),
)

for part in response.parts:
    if part.inline_data is not None:
        part.as_image().save("desk.png")

Deux détails piègent souvent les utilisateurs. image_size prend "1K", "2K" ou "4K" avec un K majuscule, et les images de référence sont ajoutées à contents comme éléments supplémentaires à côté du prompt. Encadrez l’appel d’une nouvelle tentative avec temporisation croissante et journalisez chaque réponse, car un prompt filtré renvoie du texte au lieu d’une image.

Utilisez ComfyUI pour l’itération interactive et le SDK pour le volume. Les deux accèdent au même modèle, donc un prompt qui fonctionne sur le canevas fonctionnera dans le script.

Les mains d’un développeur sur un ordinateur portable, dans un bureau à domicile faiblement éclairé au crépuscule, avec une lampe chaude à droite

Erreurs courantes et correctifs rapides

SymptômeCause probableSolution
Le nœud est absent de la rechercheLa version de ComfyUI est obsolèteMettez à jour ComfyUI et redémarrez l’application
L’exécution échoue immédiatementNon connecté, ou solde de crédits à zéroVérifiez Paramètres, Utilisateur, puis Paramètres, Crédits
Aucune image, seulement du texteLe prompt a été filtré ou est trop vagueRéécrivez-le sous forme de brief photo neutre
Le texte dans l’image est fauxChaînes longues ou langues mélangéesMettez les mots exacts entre guillemets et gardez-les courts
La facture est plus élevée que prévu4K activé, nombreuses nouvelles tentatives ou nombreuses référencesFaites vos brouillons en 2K et limitez les tentatives par tâche
Les exécutions se mettent en file d’attente ou échouent en volumeLimites de concurrenceLancez moins de tâches simultanées

Utiliser Nano Banana Pro sur PicassoIA

ComfyUI est le bon environnement lorsque le modèle n’est qu’une étape d’un graphe plus long. Pour une seule image, un onglet de navigateur est plus rapide. Nano Banana Pro sur PicassoIA ne nécessite ni nœuds, ni crédits Comfy, ni code, et la page du modèle indique qu’il est gratuit à utiliser en ligne.

Étape par étape

  1. Ouvrez la page du modèle Nano Banana Pro.
  2. Rédigez le prompt comme un brief photo : sujet, décor, lumière, objectif.
  3. Réglez la résolution sur 1K, 2K (par défaut) ou 4K.
  4. Choisissez un format parmi les 11 préréglages, dont 16:9, 9:16, 4:5 et 21:9.
  5. Ajoutez jusqu’à 14 images de référence si vous voulez un sujet ou un style précis.
  6. Choisissez JPG ou PNG. Laissez le filtre de sécurité sur sa valeur par défaut, block_only_high, sauf si votre plateforme exige un réglage plus strict.
  7. Générez, examinez le résultat et ne modifiez qu’un élément du prompt à la fois.

Une jeune designer tenant une grande photographie imprimée devant une fenêtre ensoleillée

Alternatives à tester

Aucun modèle n’est le meilleur sur tous les prompts. Ceux-ci figurent dans la même collection de texte vers image, donc un test côte à côte ne prend que quelques minutes.

ModèleÀ essayer quand
Nano Banana 2Vous voulez la famille Nano Banana dans une version plus légère pour des brouillons rapides
Seedream 4.5Vous voulez un second avis d’un autre laboratoire sur les scènes produit et lifestyle
Flux 2 ProVous voulez un rendu photographique de la gamme Black Forest Labs
GPT Image 2Votre prompt mêle mise en page, texte et instructions précises
Imagen 4Vous voulez un autre modèle Google pour des scènes propres et réalistes

PicassoIA propose aussi l’édition d’image, la suppression d’arrière-plan et la super-résolution pour un upscaling de 2x à 4x, si bien qu’un rendu peut être corrigé, détouré ou agrandi sans quitter la plateforme.

Créez votre première image dès aujourd’hui

Vous avez maintenant la vue d’ensemble : mettez à jour ComfyUI, connectez-vous, ajoutez des crédits, lancez le modèle et surveillez la résolution. Un premier test coûte quelques centimes, et vous apprendrez davantage d’un vrai rendu que de n’importe quelle quantité de lecture.

Si vous préférez vous passer de la configuration, ouvrez Nano Banana Pro sur PicassoIA, collez un prompt de cet article et lancez la génération. Essayez le même brief en 2K puis en 4K, et comparez ensuite les résultats à côté d’un second modèle du tableau ci-dessus. Picasso IA rend cette comparaison rapide, donc la prochaine étape est simple : rédigez un prompt, générez-le et voyez ce que Nano Banana Pro en fait.

Partager cet article

Choisissez votre langue