Nano Banana Pro API ComfyUI : configuration, nœuds, flux de travail et coût
Nano Banana Pro fonctionne dans ComfyUI comme Partner Node, sans modification de Python ni projet Google Cloud. Cet article présente le nœud, un flux de travail fonctionnel, les réglages qui modifient le prix, et le coût des rendus en 1K, 2K et 4K.
Si vous utilisez déjà ComfyUI, ajouter Nano Banana Pro prend environ cinq minutes et une seule connexion. Le modèle est fourni sous forme de Partner Node, donc il n’y a aucun environnement Python à corriger, aucun projet Google Cloud à ouvrir et aucune charge sur votre propre GPU. Vous recherchez le nœud, reliez un prompt à celui-ci, et le modèle Gemini 3 Pro Image de Google génère jusqu’au 4K natif. Ce qui prend plus de temps, c’est de décider où placer le nœud dans un graphe, quels réglages font varier le prix, et si les crédits Comfy sont plus avantageux qu’un appel direct à Google. Cet article répond à ces trois questions avec les chiffres publiés par Google et Comfy en octobre 2026.
💡 Réponse rapide sur le coût : au tarif public de Google, une image en 1K et une image en 2K coûtent le même prix ($0,134), et une image en 4K coûte $0,24. Faites vos brouillons en 2K, finalisez en 4K, et ne choisissez jamais le 1K pour économiser, car cela ne fait aucune économie.
Ce que fait le nœud Nano Banana Pro
Nano Banana Pro est le nom commercial de Gemini 3 Pro Image, que Google expose via l’API Gemini sous le nom gemini-3-pro-image-preview. Ce n’est pas un checkpoint que l’on télécharge. C’est un modèle multimodal hébergé : un seul nœud gère donc la génération de texte vers image, l’édition d’image et le mélange de plusieurs images. Le gros du travail se fait sur le matériel de Google, pendant que ComfyUI se contente d’envoyer la requête et d’enregistrer le résultat.
Gemini 3 Pro Image en détail
Quatre caractéristiques comptent lorsque vous placez ce modèle dans un graphe :
Sortie native en 4K. Le modèle génère en 1K, 2K ou 4K sans étape d’upscaling séparée.
Jusqu’à 14 images de référence. Visages, produits, styles et mises en page peuvent être mélangés en un seul appel.
Rendu du texte en 10 langues. Affiches, étiquettes et panneaux sont bien plus lisibles qu’avec la plupart des checkpoints de diffusion, selon l’annonce de lancement de Comfy.
Inférence hébergée. Rien ne se charge dans la VRAM, donc un ordinateur portable sans GPU dédié exécute le même graphe qu’une station de travail.
Un point à savoir : Google n’indique aucune offre gratuite pour ce modèle sur son API, donc chaque appel est facturé.
Partner Node ou votre propre identifiant
Il existe trois façons d’accéder au même modèle depuis ComfyUI, et la bonne dépend de la personne à qui vous voulez adresser la facture.
Accès
Compte nécessaire
Facturation
Idéal pour
Partner Node de ComfyUI
Compte Comfy
Crédits Comfy
Mise en place la plus rapide, aucune autre inscription
Nœud communautaire avec un identifiant Google AI Studio
Compte Google sur une offre payante
Google facture à l’image
Utiliser la facture de Google et les tarifs Batch
Nœud relais tiers
Compte du fournisseur de relais
Tarifs du relais
Régions ou moyens de paiement que Google ne couvre pas
Des packages communautaires existent pour la troisième voie. ComfyUI-Nano-Banana-apiyi appelle Nano Banana Pro et Nano Banana 2 sans compte Google Cloud, et le nœud « Luck » Nano Banana Pro ajoute la gestion des délais d’attente et des nouvelles tentatives, la progression en direct, les modes de seed natifs et jusqu’à 14 entrées d’images combinées.
💡 Un nœud relais voit chaque prompt et chaque photo de référence que vous envoyez. Traitez-le comme n’importe quel service tiers et gardez les travaux clients ou les photos privées sur la voie officielle.
Configurer ComfyUI avant de commencer
Trois conditions doivent être remplies avant que le nœud fonctionne : une version récente de ComfyUI, un compte Comfy connecté et un solde de crédits positif. Le reste est facultatif.
Mettre à jour et se connecter
Mettez à jour ComfyUI. Utilisez la mise à jour intégrée à l’application de bureau ou actualisez votre version portable. Les anciennes versions n’incluent pas le nœud Nano Banana Pro, et la documentation officielle recommande de mettre à jour en premier.
Connectez-vous. Ouvrez Paramètres, puis Utilisateur, et connectez-vous à votre compte Comfy. Les Partner Nodes refusent de fonctionner sans cela.
Achetez des crédits. Ouvrez Paramètres, puis Crédits. Les Partner Nodes appellent des modèles tiers payants, donc le solde doit être supérieur à zéro. Les crédits mensuels expirent à la fin de la période de facturation, tandis que les crédits rechargés restent valables un an après l’achat.
💡 La documentation de Comfy mentionne aussi un environnement réseau autorisé et des limites de concurrence. Si le nœud ne fonctionne que sur un VPN d’entreprise, testez depuis une connexion domestique simple avant de déboguer le graphe.
Ouvrir le modèle prêt à l’emploi
Ouvrez la bibliothèque de modèles et choisissez le modèle Nano Banana Pro. Les utilisateurs du cloud peuvent lancer le même flux depuis Comfy Cloud, sans rien installer. Le modèle charge un graphe court : un nœud LoadImage pour une photo de référence, le nœud Nano Banana Pro qui contient votre prompt, et un nœud SaveImage à la fin.
Importez une image de référence, saisissez un prompt, choisissez un niveau de réflexion et appuyez sur Exécuter. Puis vérifiez votre solde de crédits. La différence correspond à votre coût réel pour cette résolution, et elle est plus fiable que n’importe quel tableau de cet article, y compris celui plus bas.
Construire le flux de travail nœud par nœud
Le modèle prêt à l’emploi fonctionne, mais un graphe de production a généralement besoin de plus de trois nœuds. Voici le rôle de chaque élément et les erreurs fréquentes.
Les quatre nœuds essentiels
Nœud
Rôle
Points de vigilance
LoadImage
Importe une photo de référence
Les gros fichiers s’importent lentement
BatchImagesNode
Fusionne plusieurs images en une seule entrée
Le modèle voit un ensemble, donc nommez chaque image dans le prompt
Nano Banana Pro (GeminiImage2Node)
Envoie le prompt et les images à Gemini 3 Pro Image
La résolution définie ici fixe le prix
SaveImage
Écrit le PNG dans votre dossier de sortie
Changez le préfixe du nom de fichier par projet, sinon les fichiers s’accumulent
Les réglages qui modifient le résultat
Les noms des champs varient légèrement selon les versions de ComfyUI, mais les versions actuelles proposent ces commandes :
Prompt. Rédigez-le comme un brief photo : sujet, décor, lumière et objectif. De courtes phrases concrètes valent mieux que de longues listes de tags.
Format. Choisissez dès maintenant le cadre final. Le modifier plus tard vous obligerait à payer une image entièrement nouvelle.
Résolution. 1K, 2K ou 4K. C’est le principal levier de prix.
Seed. Utile pour reproduire un rendu, mais un modèle hébergé ne garantit pas une sortie identique au pixel près. Enregistrez les fichiers qui vous plaisent.
Niveau de réflexion. La documentation liste Minimal, High et Dynamic. Les niveaux plus élevés aident sur les mises en page denses et les longs textes.
Format de réponse. Choisissez image uniquement, sauf si vous voulez aussi le commentaire textuel du modèle, car la sortie texte a son propre petit coût.
Enchaîner les entrées multi-références
La limite de 14 images est ce qui justifie la place de ce nœud dans un graphe. Voici un schéma reproductible :
Envoyez d’abord la photo du sujet, puis les références de style et d’accessoires.
Indiquez à quoi sert chaque image : « Image 1 : la personne, image 2 : la veste, image 3 : la référence d’éclairage. »
Testez les combinaisons en 2K, puis refaites le meilleur résultat en 4K.
Pour un travail en deux étapes, envoyez la première sortie dans un second nœud comme seule référence et demandez exactement une modification.
Chaque image d’entrée supplémentaire coûte environ $0,0011 au tarif public de Google, donc 14 références ajoutent environ $0,015 par appel. C’est assez bon marché pour être généreux, à condition que chaque image ait un rôle.
Rédiger les prompts avec un LLM
ComfyUI propose aussi un nœud Google Gemini capable de légender des images et de rédiger des prompts à partir de notes brutes, si bien qu’une étape de rédaction peut vivre dans le même graphe. Si vous préférez rédiger en dehors de ComfyUI, PicassoIA héberge Gemini 3.5 Flash pour des reformulations rapides et Claude Sonnet 5 pour les briefs plus longs.
Demandez au LLM un prompt en quatre parties : sujet et action, environnement, éclairage, caméra et objectif. Collez le résultat dans le nœud et ne modifiez qu’une partie à la fois entre deux exécutions, afin de savoir quelle modification a changé l’image.
Le coût réel de chaque image
Prix officiels par résolution
La page de tarification de l’API Gemini de Google, consultée le 6 octobre 2026, indique ces prix pour Gemini 3 Pro Image :
Mode
Image 1K ou 2K
Image 4K
Image d’entrée
Standard
$0,134
$0,24
$0,0011 chacune
Batch
$0,067
$0,12
$0,0006 chacune
L’annonce de lancement de Comfy cite les mêmes $0,134 et $0,24 pour le Partner Node. La page de tarification des Partner Nodes, en revanche, facture en crédits par token : 30,38 crédits pour 1 000 tokens d’image en sortie, 0,5064 crédit pour 1 000 tokens en entrée et 3,0384 crédits pour 1 000 tokens de texte en sortie.
Une image en 1K ou 2K représente environ 1 120 tokens de sortie et une image en 4K environ 2 000, ce qui donne environ 34 crédits et 61 crédits avant les frais d’entrée. Il s’agit de mon calcul à partir du tableau publié : vérifiez-le par rapport à votre propre solde après un test.
Un rendu en 4K coûte environ 79 % de plus qu’un rendu en 2K. C’est un prix juste pour un travail d’impression ou un recadrage poussé, et un gaspillage pour une vignette de blog.
Trois façons de réduire la facture
Faites vos brouillons en 2K, pas en 1K. Le prix est identique, et vous obtenez davantage de détails pour juger la composition et le texte.
Ne finalisez en 4K que les meilleurs résultats. Trois brouillons en 2K et un rendu final en 4K coûtent $0,642 ($0,402 plus $0,24), contre $0,96 pour quatre essais en 4K.
Envoyez les tâches en volume via l’API Batch. Elle coûte deux fois moins cher, mais les résultats arrivent avec un délai, et d’après la documentation, le Partner Node de ComfyUI ne l’expose pas. Le travail en volume relève d’un script.
Tâche
Standard
Batch
100 images en 2K
$13,40
$6,70
100 images en 4K
$24,00
$12,00
500 images en 2K
$67,00
$33,50
Appeler l’API en dehors de ComfyUI
Parfois le nœud n’est pas le bon outil : tâches nocturnes, milliers d’images, ou application sans interface graphique. Le même modèle est disponible via le SDK google-genai de Google. Il vous faut un projet sur une offre payante dans Google AI Studio, car ce modèle n’a pas d’offre gratuite.
Un appel Python minimal
from google import genai
from google.genai import types
client = genai.Client() # reads your AI Studio credential from the environment
response = client.models.generate_content(
model="gemini-3-pro-image-preview",
contents=["Overhead photo of a walnut desk with a ceramic mug, soft window light"],
config=types.GenerateContentConfig(
response_modalities=["TEXT", "IMAGE"],
image_config=types.ImageConfig(aspect_ratio="16:9", image_size="2K"),
),
)
for part in response.parts:
if part.inline_data is not None:
part.as_image().save("desk.png")
Deux détails piègent souvent les utilisateurs. image_size prend "1K", "2K" ou "4K" avec un K majuscule, et les images de référence sont ajoutées à contents comme éléments supplémentaires à côté du prompt. Encadrez l’appel d’une nouvelle tentative avec temporisation croissante et journalisez chaque réponse, car un prompt filtré renvoie du texte au lieu d’une image.
Utilisez ComfyUI pour l’itération interactive et le SDK pour le volume. Les deux accèdent au même modèle, donc un prompt qui fonctionne sur le canevas fonctionnera dans le script.
Erreurs courantes et correctifs rapides
Symptôme
Cause probable
Solution
Le nœud est absent de la recherche
La version de ComfyUI est obsolète
Mettez à jour ComfyUI et redémarrez l’application
L’exécution échoue immédiatement
Non connecté, ou solde de crédits à zéro
Vérifiez Paramètres, Utilisateur, puis Paramètres, Crédits
Aucune image, seulement du texte
Le prompt a été filtré ou est trop vague
Réécrivez-le sous forme de brief photo neutre
Le texte dans l’image est faux
Chaînes longues ou langues mélangées
Mettez les mots exacts entre guillemets et gardez-les courts
La facture est plus élevée que prévu
4K activé, nombreuses nouvelles tentatives ou nombreuses références
Faites vos brouillons en 2K et limitez les tentatives par tâche
Les exécutions se mettent en file d’attente ou échouent en volume
Limites de concurrence
Lancez moins de tâches simultanées
Utiliser Nano Banana Pro sur PicassoIA
ComfyUI est le bon environnement lorsque le modèle n’est qu’une étape d’un graphe plus long. Pour une seule image, un onglet de navigateur est plus rapide. Nano Banana Pro sur PicassoIA ne nécessite ni nœuds, ni crédits Comfy, ni code, et la page du modèle indique qu’il est gratuit à utiliser en ligne.
Étape par étape
Ouvrez la page du modèle Nano Banana Pro.
Rédigez le prompt comme un brief photo : sujet, décor, lumière, objectif.
Réglez la résolution sur 1K, 2K (par défaut) ou 4K.
Choisissez un format parmi les 11 préréglages, dont 16:9, 9:16, 4:5 et 21:9.
Ajoutez jusqu’à 14 images de référence si vous voulez un sujet ou un style précis.
Choisissez JPG ou PNG. Laissez le filtre de sécurité sur sa valeur par défaut, block_only_high, sauf si votre plateforme exige un réglage plus strict.
Générez, examinez le résultat et ne modifiez qu’un élément du prompt à la fois.
Alternatives à tester
Aucun modèle n’est le meilleur sur tous les prompts. Ceux-ci figurent dans la même collection de texte vers image, donc un test côte à côte ne prend que quelques minutes.
Vous voulez un autre modèle Google pour des scènes propres et réalistes
PicassoIA propose aussi l’édition d’image, la suppression d’arrière-plan et la super-résolution pour un upscaling de 2x à 4x, si bien qu’un rendu peut être corrigé, détouré ou agrandi sans quitter la plateforme.
Créez votre première image dès aujourd’hui
Vous avez maintenant la vue d’ensemble : mettez à jour ComfyUI, connectez-vous, ajoutez des crédits, lancez le modèle et surveillez la résolution. Un premier test coûte quelques centimes, et vous apprendrez davantage d’un vrai rendu que de n’importe quelle quantité de lecture.
Si vous préférez vous passer de la configuration, ouvrez Nano Banana Pro sur PicassoIA, collez un prompt de cet article et lancez la génération. Essayez le même brief en 2K puis en 4K, et comparez ensuite les résultats à côté d’un second modèle du tableau ci-dessus. Picasso IA rend cette comparaison rapide, donc la prochaine étape est simple : rédigez un prompt, générez-le et voyez ce que Nano Banana Pro en fait.